返回首页
RadarAI··论文与技术

斯坦福牛津 MedRSI:医疗智能体自我改进需护栏

中文摘要

医疗AI自我改进需验证,否则效果下降;优先处理高风险错误。

English Summary

Medical AI self-improvement needs validation to avoid performance drops; prioritizes high-risk errors.

原文节选

斯坦福与牛津论文 MedRSI 显示,医疗智能体可从自身错误中自我改进,但新能力须先在后续新患者上验证才能固化。若每轮都立即注册新工具,第 30 轮准确率降至 76.9%(57 个工具);放慢注册、仅保留 18 个工具时准确率达 94.4%。该智能体还会优先处理可能造成更大临床危害的错误,而非仅关注最常见错误。