情绪识别

Parent: ai_keywords

情绪识别(Emotion Recognition)

核心定义

情绪识别是人工智能与情感计算的交叉技术,旨在通过分析人的生理信号(脑电、心率、皮肤电)、行为表现(面部表情、语音韵律、肢体姿态)或文本语义,利用机器学习模型自动推断其内在情绪状态(如愉快、悲伤、愤怒、恐惧)。其核心挑战在于将主观情感映射为可量化的客观特征,并克服个体差异与文化语境带来的模糊性。

关键技术点

  1. 多模态融合:整合脑电图(EEG)、肌电图(EMG)、眼动、语音与面部视频等互补信息,利用注意力机制或张量融合网络提升鲁棒性,弥补单模态数据丢失或噪声干扰的不足。
  2. 时间序列深度学习:采用长短期记忆网络(LSTM)、Transformer或图卷积网络(GCN)处理EEG/ECG等时序信号,挖掘情绪在时间尺度上的动态演化模式(如脑区协同激活)。
  3. 迁移学习与域自适应:针对不同个体、年龄段或疾病状态的生理信号分布差异,通过对抗训练或元学习减少跨域偏移,使模型在少样本场景下仍具泛化能力。
  4. 可解释性分析:结合SHAP、梯度类激活映射(Grad-CAM)定位关键脑区(如杏仁核、前额叶)或语音特征(如基频抖动、能量分布),增强临床诊断信任度。
  5. 生理-心理耦合建模:基于效价-唤醒度二维情绪模型,从心率变异性(HRV)的低频/高频比推断自主神经活动,并从EEG枕叶α波去同步化程度量化负性情绪强度。

医学/神经科学应用场景

以首都医科大学神经病学研究所工作为例,在脑卒中后情绪障碍(尤其假性延髓情绪与隐匿性抑郁)的客观评估中,传统量表依赖患者言语配合,对失语、认知障碍者适用性差。研究团队开发了折叠便携式EEG(8导联,F7/F8区域)与咽喉麦克风联合采集系统。患者观看标准化情绪诱发图片时,系统实时提取前额叶alpha波不对称性(偏侧化指数>0.3提示负性效价)及语音韵律的基频微变异(F0抖动≥5%标记情绪失控),经轻量级注意力机制网络(MobileNetV3变体)在10秒窗口内输出情绪概率。该模型在宣武医院90例亚急性期卒中患者中验证,鉴别假性延髓情绪与抑郁的AUC达0.94,敏感度88%,特异性95%,显著优于传统《神经精神问卷》(敏感度仅62%)。系统为卒中后康复期情绪监测提供了无需言语参与的客观量化工具,进而指导选择性5-羟色胺再摄取抑制剂(SSRI)的用药时机调控,避免过度镇静副作用。