研究背景
非侵入式内心言语解码面临一个根本性的数据问题:无法收集将大脑活动与个人自发内心独白配对的语料库,而且现有的替代范式(提示性重复和回顾性报告的生成式内心言语)获取速度慢、时间锁定性差,且无法验证受试者的依从性。
研究方法
研究人员将默读视为一个可扩展的替代任务,并探究对比解码器能从中提取多少词汇和语义信息。他们对一名高密度采样受试者在393次实验(约49小时)中使用19通道干电极脑电图记录的约240,000个单词呈现进行了开放词汇分析。连续叙事文本中的单词以快速序列视觉呈现的方式展示,每次试验的排版都进行随机化,以部分消除单词身份与低级视觉形式的关联。一个卷积脑电图编码器(可选地后跟一个因果变压器)通过CLIP风格的对比目标进行训练,以使短脑电图窗口与从大语言模型中获取的所呈现单词的隐藏状态嵌入对齐。
研究结果
解码效果通过与排列基线的单词分组前10检索进行评估,结果可靠地高于随机水平,涵盖中频和稀有单词,并且随着训练数据量的增加呈对数线性增长,没有饱和迹象。移除枕叶和后颞叶电极使单词级增益大约降低了三分之一,但上下文跟踪能力保持不变。对照分析将单词级解码与叙事上下文跟踪以及变压器位置嵌入引入的非神经位置先验区分开来。
研究结论
这些结果表明,在默读过程中可以从脑电图中恢复开放词汇的单词级信息,并且解码受数据限制而非达到饱和状态。