CogBench: A Large Language Model Benchmark for Multilingual Speech-Based Cognitive Impairment Ass...

发布时间:2026/10/3 8:33:05
CogBench: A Large Language Model Benchmark for Multilingual Speech-Based Cognitive Impairment Ass... 主要内容本文聚焦于基于语音的认知障碍自动评估,针对现有方法在跨语言和跨临床场景下泛化能力不足的问题,提出了首个用于评估大型语言模型(LLMs)在该任务中跨语言和跨站点泛化能力的基准CogBench。研究使用统一的多模态流程,在涵盖英语和普通话的三个语音数据集(ADReSSo、NCMMSC2021-AD、新收集的CIRE)上评估模型性能。结果显示,传统深度学习模型跨域迁移时性能大幅下降;而配备思维链提示的LLMs适应性更强,但性能受提示设计影响;通过低秩适应(LoRA)对LLMs进行轻量级微调,能显著提升其在目标域的泛化能力。研究还公开了数据集、代码和评估脚本,以促进相关研究。创新点提供了新的普通话数据集CIRE,该数据集来自自然社区环境,支持语言和人口统计学多样化的认知评估研究。构建了首个基于语音的认知评估跨语言和跨站点基准,结合两个中英文公共数据集和额外测试集CIRE,支持对代表性小规模模型(SSMs)和多模态大型语言模型(MLLMs)的综合评估。通过系统的提示工程研究MLLMs的应用,评估了零样本、专家知识(EXP)和思维链(CoT)提示策略(结合多数投票),并与时域和频域SSMs进行对比。比较了SSMs和MLLMs在特定领域的域适应性能,表明微调后的MLLMs具有更优的泛化能力,首次证明MLLMs可有效作为通用认知障碍筛查工具。摘要基于自发语音的认知障碍自动评估为早期认知筛查提供了一种有前景的非侵入性途径。然而,当前方法在不同语言和临床场景中部署时,往往缺乏泛化

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询