Claude、GPT、Gemini 智能体在 72% 的美国医疗工作流中失败
Claude, GPT, Gemini Agents Fail 72% of U.S. Healthcare Workflows
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Claude、GPT、Gemini 等智能体在美国医疗工作流测试中失败率达 72%。该结果来自 Hacker News 上的一项讨论,正文未披露具体评测基准、模型版本或测试样本规模。
来源:apnews.com(经 Hacker News) · apnews.com