Improving Crash Data Quality with Large Language Models: Evidence from Secondary Crash Narratives...

发布时间:2026/10/6 7:48:39
Improving Crash Data Quality with Large Language Models: Evidence from Secondary Crash Narratives... 文章主要内容总结本文聚焦于利用先进自然语言处理(NLP)技术提升交通事故数据质量,以肯塔基州二次事故识别为案例,系统评估了三类模型的性能:零样本开源大型语言模型(LLMs)、微调的Transformer模型以及传统逻辑回归(基线模型)。研究使用2015-2022年共16,656份人工审核的事故描述数据(其中3,803份确认为二次事故),以2015-2021年数据校准模型,2022年1,771份数据作为测试集。结果显示:微调的Transformer模型表现最优,其中RoBERTa的F1分数达0.90,准确率95%;零样本LLMs(如LLaMA3:70B)F1分数达0.86,但推理时间长(如LLaMA3:70B需139分钟);传统逻辑回归表现最差(F1=0.66)。研究还发现中型LLMs(如DeepSeek-R1:32B)可在降低运行时间的同时接近大型模型性能,并提出了隐私保护部署、集成方法、增量处理等实际应用建议,为交通部门提升事故数据质量提供了可复制方案。文章创新点系统对比三类模型性能:首次针对二次事故识别,全面评估零样本LLMs、微调Transformer与传统模型的准确性、效率及数据需求,揭示不同模型的权衡关系。突出微调Transformer的优势:证明微调后的RoBERTa等模型在平衡精确率和召回率上的优越性,且推理效率远高于零样本LLMs。探索中型LLMs的潜力

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询