BrainBench:用于全面脑电图理解的大型语言模型评测基准
本文介绍了BrainBench,这是一个统一的脑电图(EEG)全面理解评测基准,涵盖17个数据集和多个任务,测试大型语言模型在根据指令分析EEG信号并生成科学报告方面的能力。评测通过代码执行和结构化智能体分析两种方式进行,结果显示模型表现差异显著,体现了模型及其执行策略对EEG理解能力的影响。该基准将于近期开源提供,推动基于大型语言模型的EEG分析研究。
这条 研究论文 信号说明,来自 arXiv cs.AI 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。