本文提出了一套面向AI辅助精神科接诊系统的临床医生导向质量评估平台,旨在帮助医疗机构按自身临床标准对这类工具进行常规化质量保障。该平台以记忆增强的患者模拟器InterviewPlayground为核心,支持开放式AI访谈,并基于专家撰写的病例脚本构建交互式患者与模拟接诊环境。在一项由6名临床医生参与、时长25分钟的试点评估中,研究将GPT类大模型访谈者与临床医生进行对比,发现LLM能够覆盖病例中更多临床相关条目(88.0%对38.9%),但产生了更多缺乏访谈依据的临床推断(56.8%对27.8%),且对已识别安全问题的特征描述比例更低(33.3%对66.7%)。该研究为AI精神科接诊工具的实际部署提供了可操作的评估框架,并揭示了当前模型在推断严谨性与安全风险表述方面的不足。
| InterviewPlayground | 一个记忆增强的患者模拟器平台,用于开放式AI访谈,支持创建交互式患者案例。 |
| Psychiatric Intake | 精神科接诊,指患者初次就诊时进行的全面评估和病史采集过程。 |
| Quality Assurance | 质量保证,指系统化地评估和确保医疗工具符合临床标准的过程。 |
| Memory-Augmented Patient Simulator | 记忆增强的患者模拟器,一种能够记住对话历史并模拟真实患者行为的AI系统。 |
| Clinical Inferences | 临床推断,指基于访谈信息之外的知识或假设得出的临床结论。 |
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅