跳至主要内容
临床试验/ChiCTR2500115771
ChiCTR2500115771尚未招募回顾性研究

基于多中心骨科电子病历的全流程大语言模型智能代理回顾性验证研究

自选课题(自筹)1 个研究点 分布在 1 个国家开始时间: 2026年1月1日最近更新:

试验速览

阶段
回顾性研究
状态
尚未招募
发起方
试验地点
1
主要终点
任务级诊断与决策准确性

研究概览

简要总结

回顾性评估基于 LLM 的骨科全流程智能代理,在单中心和多中心真实 EHR 数据上的任务级诊断与决策预测准确性及稳定性。通过人机对比实验比较 LLM 智能代理与不同年资骨科医生,以及非骨科医生在关键临床任务上的表现,并评估“医生+AI 协同”模式是否优于单纯医生或单纯 AI。

研究设计

研究类型
观察性研究
主要目的
连续入组
盲法

入排标准

年龄范围
18 至 120(—)
性别
All

入选标准

  • 1.年龄 ≥18 岁;
  • 2.在瑞金医院(及合作中心)骨科住院 ≥24 小时;
  • 3.有完整的入院记录、至少一次手术记录或围手术期管理记录、出院小结;
  • 4.电子病历文书为中文或中英文混合,便于文本处理;
  • 5.电子病历中记录了 11 个核心任务相关的关键信息(诊断、手术方案、医嘱、康复建议、会诊意见等)。

排除标准

  • 1.非骨科住院(如骨科会诊但住院在其他科室者);
  • 2.仅急诊留观、日间手术等非正式住院;
  • 3.重要文书严重缺失或不清(无法确定主要诊断或手术类型);
  • 4.病例涉及特殊隐私或法律纠纷,经伦理评估不宜纳入分析者;
  • 5.文本因技术原因无法解析。

研究组 & 干预措施

人机对比评估组

结局指标

主要结局

任务级诊断与决策准确性

时间窗: 模型推理完成时

任务正确率 / 符合率

时间窗: 医生完成指定任务后

次要结局

  • 模型泛化能力与稳定性(模型在外部测试集上评估时)

研究者

发起方
自选课题(自筹)

研究点 (1)

Loading locations...

相似试验