Communications Biology|EEG 预处理会显著改变解码性能,但高准确率可能来自伪迹 Communications BiologyEEG 预处理会显著改变解码性能但高准确率可能来自伪迹脑电解码研究通常把分类准确率作为流程性能的重要指标但准确率升高并不必然表示模型提取到了更有效的神经信号。Kessler、Enge 和 Skeide 发表在 Communications Biology 的研究系统比较了 2592 条 EEG 预处理路径并在 EEGNet 与逐时间点逻辑回归两类框架中评价其影响。结果显示预处理选择可以显著改变解码表现部分能够提高准确率的流程也会增加时间扩散或基线期虚假解码而眼动、肌肉和坏试次处理虽然普遍降低准确率却可能减少模型对非神经线索的利用。摘要本研究使用公开 ERP CORE 数据集纳入 40 名参与者的 7 类 ERP 实验系统改变眼动伪迹校正、肌肉伪迹校正、低通滤波、高通滤波、参考方式、去趋势、基线校正和 autoreject 八类预处理步骤共形成 2592 条独立路径。作者分别使用 EEGNet 对完整试次进行二分类并使用逐时间点逻辑回归分析不同实验条件何时能够被区分。研究发现伪迹校正总体上降低了两类模型的解码性能较高的高通截止频率则通常提高性能EEGNet 进一步受益于基线校正逐时间点解码则更多受益于 6 Hz 低通和线性去趋势。作者强调这些结果不能被解释为“伪迹不应清除”或“准确率最高的流程就是最佳流程”因为模型可能利用与类别标签共变的眼动和肌电也可能受到滤波造成的时间泄漏影响。选择预处理流程时应同时考虑解码表现、信号来源、时间解释和研究目标。背景EEG 解码利用多个电极和时间点的联合信息区分刺激、反应或认知状态已经广泛用于基础神经科学、临床转化研究和脑机接口。与传统 ERP 分析相比解码能够利用更高维的信号结构但也更容易吸收分布在全头皮和完整时间窗中的非神经信息。不同研究在滤波、参考、基线、ICA 和坏试次处理上的选择差异很大同一研究问题因此可能对应多条合理却并不相同的分析路径。既往多宇宙研究主要考察预处理如何改变 ERP 振幅或显著通道数量本研究则把结局指标换成解码性能目的是判断常见预处理步骤会在多大程度上改变分类结果。多宇宙方法并不是从研究者常用的流程中挑选少数几条进行比较而是预先定义每个步骤的候选选项再分析全部组合。本研究的低通候选为不使用、6 Hz、20 Hz 和 45 Hz高通候选为不使用、0.1 Hz 和 0.5 Hz参考方式包括全平均参考、Cz 和 P9/P10 平均参考此外还比较了是否使用眼动 ICA、肌肉 ICA、线性去趋势、200 ms 或 400 ms 基线以及 autoreject 的插值或试次拒绝模式。这种设计使作者能够估计各步骤的平均影响也能够分析高通、去趋势和基线校正等步骤之间的交互作用。方法ERP CORE 包含 40 名参与者完成的 6 个实验范式可得到 ERN、LRP、MMN、N170、N2pc、N400 和 P3 七类 ERP 分析其中 ERN 与 LRP 来自同一个 Eriksen flanker 范式。EEG 由 30 个头皮电极记录同时包含 3 个 EOG 通道原始采样率为 1024 Hz研究中降采样至 256 Hz。ERN 和 LRP 按反应时刻分段其余实验按刺激时刻分段。为适应全头皮解码LRP 试次按左手与右手反应分类N2pc 试次按目标位于左侧或右侧分类。所有预处理均使用 MNE-Python 1.6.1 自动完成不包含人工挑选成分或手动拒绝试次。图 1 八类预处理步骤及其候选选项。不同选项的笛卡尔积形成 2592 条分叉路径星号表示作者用于部分示例分析的参考路径。来源Kessler 等2025原文图 1CC BY 4.0。EEGNet 使用完整试次的时空信息进行分类每名参与者、每项实验和每条预处理路径分别进行分层五折交叉验证以五折平均平衡测试准确率作为结果指标。逐时间点框架在每个时间点单独使用全部头皮电极训练逻辑回归分类器采用分层十折交叉验证并在 40 名参与者的组水平上执行单尾簇质量置换检验。置换共进行 1024 次作者把全部显著时间簇的 T 值相加为 T-sum作为主文中逐时间点解码性能的指标。随后EEGNet 准确率采用线性混合模型分析逐时间点 T-sum 采用线性模型分析全部模型均纳入预处理主效应及两两交互。结果不同预处理路径显著改变两类模型的解码表现七项实验的解码难度存在明显差异。EEGNet 中ERN 最容易区分中位平衡准确率约为 0.85LRP 次之MMN 最低中位准确率约为 0.57。逐时间点解码得到的实验难度排序与 EEGNet 大体一致。作者还标记了一条几乎不进行预处理的路径该路径不做伪迹校正、滤波、基线校正或去趋势只保留模型自身的数据归一化。它在 EEGNet 中表现高于全部路径的平均水平但在逐时间点逻辑回归中表现很差说明不同模型对数据尺度、慢漂移和特征形态的适应能力不同不能用一套流程概括所有解码框架的需求。图 2 七项实验在 EEGNet 和逐时间点解码中的表现分布。A 为 EEGNet 的平衡测试准确率B 为逐时间点解码的 T-sum三角形表示几乎不进行预处理的路径。来源Kessler 等2025原文图 3CC BY 4.0。伪迹校正普遍降低性能但下降可能反映非神经线索被移除眼动 ICA、肌肉 ICA 和 autoreject 等伪迹处理总体上降低了解码性能这种下降在伪迹与类别标签天然共变的实验中尤其明显。N2pc 实验解码目标位于左侧还是右侧参与者可能不自觉地向目标方向扫视因此水平眼动本身携带目标位置信息去除眼动成分后模型失去了一类具有预测性的线索。LRP 实验解码左手还是右手按键不同反应伴随不同的肌肉活动因此肌肉伪迹同样可以帮助分类去除肌肉成分后LRP 的 EEGNet 准确率明显下降并形成了与是否进行肌肉校正相关的双峰分布。这一结果并不表示伪迹校正损害了数据质量。对于需要解释模型空间分布、时间进程或神经来源的基础研究去除与实验条件共变的眼动和肌电仍然十分重要否则模型可能主要依赖非神经信号完成分类。另一方面阈值式 ICA 也可能在移除伪迹时同时删除部分神经信号因此性能下降可能同时包含“非神经线索被去除”和“目标信号被误删”两种成分。作者据此提出不能仅凭准确率判断伪迹校正是否合理还需要检查被移除成分的来源以及模型最终使用的特征。滤波、去趋势和基线校正的作用依赖解码框架在本研究比较的候选参数内0.5 Hz 高通在两类解码框架中通常获得更高性能。高通滤波可以减弱慢漂移并使不同试次的信号处于更接近的尺度当未进行基线校正时这一作用尤其明显。对于逐时间点解码6 Hz 低通和线性去趋势通常提高 T-sum。作者认为较低低通可以排除 alpha 活动这一重要的试次间变异来源线性去趋势则可以减少分段边缘的随机漂移。EEGNet 对低通选择没有表现出相同趋势但基线校正通常带来更高准确率。参考方式的总体影响相对较弱而且表现最佳的参考会随实验和模型改变。图 3A 各预处理选项对 EEGNet 平衡准确率的影响。数值表示相对各实验边际均值的百分比偏差绿色表示相对提高红色表示相对降低。来源Kessler 等2025原文图 5ACC BY 4.0。图 3B 各预处理选项对逐时间点解码 T-sum 的影响。图 3A 与图 3B 使用不同色标不能直接比较颜色深浅或百分比幅度。来源Kessler 等2025原文图 5BCC BY 4.0。提高解码性能的流程也可能制造基线伪解码较窄的滤波频带虽然提高了部分模型的性能却会限制对解码时间进程的解释。6 Hz 低通可能延长 ERP 及解码效应的时间范围0.5 Hz 高通则可能在真实 ERP 前后产生极性相反的滤波伪迹。本研究采用零相位非因果 FIR 滤波刺激后的信号可以向前影响更早的时间点因此部分高性能路径在刺激前基线期已经出现显著解码。作者发现线性去趋势、6 Hz 低通、不做基线校正以及部分情况下的 0.5 Hz 高通会增加基线伪解码的概率伪迹处理则通常降低这一概率。预处理步骤之间还存在明显交互。高通、去趋势和基线校正都能够在一定程度上调整试次的整体尺度线性去趋势会降低高通截止频率选择的重要性如果三者同时缺失逐时间点解码通常表现最差。当 autoreject 采用 reject 模式时缺少上述处理还可能使更多高电压试次被丢弃从而减少模型训练数据。这些结果说明单独评价某个步骤的平均主效应并不充分同一选项在不同前后组合中的结果可能不同。被试差异大于预处理路径差异EEGNet 准确率在参与者之间存在较大差异其幅度明显大于同一参与者不同预处理路径之间的差异。年龄、性别和利手均未能稳定解释个体解码表现不同实验之间也只有 LRP 与 N170 的参与者特异表现呈显著相关r 0.52FDR 校正后 p 0.011。该结果提示在讨论预处理选择时还需要考虑参与者状态、任务执行和个体信号质量等更大的变异来源不能把全部性能差异都归因于参数设置。讨论本研究的核心结果不是给出一套统一的最佳预处理流程而是说明“最大化解码性能”与“提高神经解释有效性”并非同一个目标。未清理的眼动和肌电可以与类别标签稳定共变从而提高分类准确率较窄的滤波频带和较高高通可以降低无关变异却也可能造成时间扩散和基线伪解码。对于基础研究如果需要解释模型在何时、何处利用了哪些神经信息就必须同时报告基线期解码、伪迹残留和模型特征来源。对于部分只关心控制性能的 BCI 应用稳定的非神经信息或许具有工程价值但研究者应明确系统利用的信号来源而不能把它表述为神经解码能力。作者也讨论了交叉验证之前共同预处理可能产生的潜在数据泄漏。ICA、高通滤波和 autoreject 都在训练试次与测试试次划分前使用完整数据估计因此测试数据可能轻微参与预处理参数的形成。作者在部分路径中重新实现了训练与测试的严格隔离没有发现潜在泄漏明显抬高本研究的准确率但这一补充分析只覆盖部分步骤和路径。在更一般的 EEG 解码研究中如果研究目标是选择最优流程或报告最终模型性能更稳妥的做法仍是把数据驱动的预处理估计限制在训练数据内并使用独立测试数据评价最终流程。这些结果的适用范围也需要限制。本研究只使用 ERP CORE 一个数据集、40 名参与者、30 个头皮电极和七类经典 ERP 分析并只比较 EEGNet 与逐时间点逻辑回归。预处理实现主要来自 MNE步骤顺序基本固定模型也大多采用默认超参数。因此0.5 Hz 高通或 6 Hz 低通只能被理解为本研究候选范围内、特定任务和特定指标对应的结果不能直接外推到静息态、频域解码、跨被试模型或 RSVP 多类别任务。尤其对于静息态 alpha 功率研究6 Hz 低通会直接移除目标频段不能因为它在本研究逐时间点 ERP 解码中提高 T-sum 就照搬使用。结论系统比较 2592 条预处理路径后作者发现 EEG 预处理能够显著改变解码性能但性能变化并不能单独判断流程是否更合理。伪迹校正通常降低准确率却可能减少模型对眼动和肌电等非神经线索的依赖较高高通、较低低通、线性去趋势和基线校正可以在特定框架中提高表现也可能增加时间解释偏差或基线伪解码。选择预处理流程时应根据研究目标同时评价分类性能、伪迹残留、信号损失、基线期结果和特征可解释性而不是把准确率最高的路径直接定义为最佳流程。参考文献Kessler R, Enge A, Skeide MA. How EEG preprocessing shapes decoding performance. Communications Biology. 2025;8:1039. https://doi.org/10.1038/s42003-025-08464-3原始数据https://osf.io/thsqg/分析结果https://zenodo.org/records/14223514分析代码https://github.com/kesslerr/m4d在线面板https://multiverse.streamlit.app

相关新闻

最新新闻

怎样专业配置LOOT:5个高效插件加载优化技巧

怎样专业配置LOOT:5个高效插件加载优化技巧

怎样专业配置LOOT:5个高效插件加载优化技巧 【免费下载链接】loot A modding utility for Starfield and some Elder Scrolls and Fallout games. 项目地址: https://gitcode.com/gh_mirrors/lo/loot LOOT(Load Order Optimization Tool&#xff…

2026/7/21 15:56:13
OpenCV-Python实战(14)——人脸检测详解(仅需6行代码学会4种人脸检测方法)

OpenCV-Python实战(14)——人脸检测详解(仅需6行代码学会4种人脸检测方法)

OpenCV-Python实战(14)——人脸检测详解(仅需6行代码学会4种人脸检测方法)0. 前言1. 人脸处理简介2. 安装人脸处理相关库2.1 安装 dlib2.2 安装 face_recognition2.3 安装 cvlib3. 人脸检测3.1 使用 OpenCV 进行人脸检测3.1.1 基于…

2026/7/21 15:56:13
OpenCV-Python实战(16)——人脸追踪详解

OpenCV-Python实战(16)——人脸追踪详解

OpenCV-Python实战(16)——人脸追踪详解 0. 前言 1. 人脸追踪技术简介 2. 使用基于 dlib DCF 的跟踪器进行人脸跟踪 2.1 完整代码 3. 使用基于 dlib DCF 的跟踪器进行对象跟踪 3.2 完整代码 小结 系列链接 0. 前言 人脸处理是人工智能中的一个热门话题,人脸处理可以使用计算…

2026/7/21 15:56:13
从工具使用者到AI协作者,深度转型路径全拆解,含6套可落地的个人AI工作流模板

从工具使用者到AI协作者,深度转型路径全拆解,含6套可落地的个人AI工作流模板

更多请点击: https://codechina.net 第一章:从工具使用者到AI协作者:竞争力跃迁的本质逻辑 过去十年,开发者角色正经历一场静默却深刻的范式迁移——我们不再仅调用API、编写脚本或部署容器,而是在与具备推理能力的AI…

2026/7/21 15:56:13
AI提示词工程师副业指南,手把手教你接单、定价、交付,3类高单价客户精准锁定

AI提示词工程师副业指南,手把手教你接单、定价、交付,3类高单价客户精准锁定

更多请点击: https://codechina.net 第一章:AI提示词工程师副业的底层逻辑与变现全景图 AI提示词工程师并非单纯“写句子”的岗位,而是融合语言学理解、用户心理建模、业务场景拆解与模型行为调优的复合型角色。其副业价值根植于大模型应用落…

2026/7/21 15:56:13
TMS320F2837xS ADC寄存器深度解析与电机控制实战配置

TMS320F2837xS ADC寄存器深度解析与电机控制实战配置

1. 深入理解TMS320F2837xS ADC模块的架构与核心概念在嵌入式实时控制领域,尤其是电机控制、数字电源和精密测量等应用,模数转换器(ADC)的性能往往是系统性能的瓶颈。德州仪器(TI)的TMS320F2837xS系列微控制…

2026/7/21 15:51:13

月新闻