{"schema_version":"0.3.0","doc_type":"dataset","dataset_id":"nm000253","name":"Wang et al. 2024 — Brain Treebank: Large-scale intracranial recordings from naturalistic language stimuli","description":"Brain Treebank is a large-scale intracranial EEG dataset comprising 43 hours of iEEG recordings from 10 epilepsy patients watching naturalistic Hollywood movies, with 1,688 electrodes sampled at 2048 Hz. The dataset includes time-aligned linguistic annotations with word-level transcripts and Universal Dependencies syntax trees, providing a unique resource for studying neural language processing during naturalistic stimulation.","source":"nemar","recording_modality":["IEEG"],"bids_version":null,"license":"CC BY 4.0","authors":[{"name":"Christopher Wang","name_type":"Personal"},{"name":"Adam Yaari","name_type":"Personal"},{"name":"Aaditya K Singh","name_type":"Personal"},{"name":"Vighnesh Subramaniam","name_type":"Personal"},{"name":"Dana Rosenfarb","name_type":"Personal"},{"name":"Jan DeWitt","name_type":"Personal"},{"name":"Pranav Misra","name_type":"Personal"},{"name":"Joseph R Madsen","name_type":"Personal"},{"name":"Scellig Stone","name_type":"Personal"},{"name":"Gabriel Kreiman","name_type":"Personal"},{"name":"Boris Katz","name_type":"Personal"},{"name":"Ignacio Cases","name_type":"Personal"},{"name":"Andrei Barbu","name_type":"Personal"}],"keywords":[{"term":"intracranial EEG"},{"term":"stereo-EEG"},{"term":"language processing"},{"term":"naturalistic stimuli"},{"term":"epilepsy"},{"term":"electrocorticography"},{"term":"syntax"},{"term":"linguistic annotations"},{"term":"Universal Dependencies"},{"term":"naturalistic language"}],"related_identifiers":[{"identifier":"10.48550/arXiv.2411.08343","identifier_type":"DOI","relation_type":"IsDerivedFrom"},{"identifier":"https://github.com/nemarDatasets/nm000253","identifier_type":"URL","relation_type":"IsDescribedBy"},{"identifier":"https://nemar.org/dataexplorer/detail?dataset_id=nm000253","identifier_type":"URL","relation_type":"IsDescribedBy"}],"contributors":[],"dates":[],"rights":[{"rights":"CC BY 4.0","rights_uri":null,"rights_identifier":"CC BY 4.0","rights_identifier_scheme":"SPDX"}],"language":null,"funding":[],"tasks":["movie"],"datatypes":["ieeg"],"sessions":[],"sessions_count":null,"demographics":{"subjects_count":10,"age_min":null,"age_max":null},"data_summary":{"total_files":162,"size_bytes":276286984484,"size_human":"257 GB"},"provenance":{"latest_snapshot":"v1.0.0","publish_date":"2026-06-08 03:32:35"},"external_links":{"dataset_doi":"10.82901/nemar.nm000253","github_url":"https://github.com/nemarDatasets/nm000253"},"extensions":{"nemar":{"versions":[{"version":"v1.0.0","doi":"10.82901/nemar.nm000253.v1.0.0","created_at":"2026-06-08 03:32:35","manifest_url":"/nm000253/v1.0.0/manifest.json"}],"bids_index":{"version":"v1.0.0","subjects":{"sub-01":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01","02","03"]}}}}},"sub-02":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01","02","03","04","05","06","07"]}}}}},"sub-03":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01","02","03"]}}}}},"sub-04":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01","02","03"]}}}}},"sub-05":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01"]}}}}},"sub-06":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01","02","05"]}}}}},"sub-07":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01","02"]}}}}},"sub-08":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01"]}}}}},"sub-09":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01"]}}}}},"sub-10":{"sessions":[],"modalities":{"ieeg":{"tasks":{"movie":{"runs":["01","02"]}}}}}}},"pipeline_stage":"validated","data_complete":null,"bytes_present":null}}}