哈佛最新研究:AI看病錯誤率達80%
2026年04月16日 12:26

據第一財經,美國哈佛醫學院的一個研究團隊評估了20幾種最先進的AI大型語言模型(LLM)的診斷能力,其中包括ChatGPT、DeepSeek、Gemini和Claude。
結果顯示,基於患者的初步癥狀和體征進行「鑒別診斷」(識別可能的疾病)的錯誤率高達80%。
這項研究進一步顯示,在患者提供更多檢測結果后,大模型可以將「最終診斷」的失敗率降至40%左右。
研究人員表示,這意味著AI聊天機器人需要通過充分的患者信息,才能對疾病作出更為精準的診斷,患者無法提供完整的健康檢測信息時,AI提供的結果並不可靠。研究人員還強調:「人工智慧尚未達到無需醫療專業人員干預即可為患者做出診斷決策的水平。」
*以上內容系網友指點山河自行轉載自南京新聞,該文僅代表原作者觀點和態度。yeeyi號系信息發布平台,僅提供信息存儲空間服務,不代表贊同其觀點和對其真實性負責。如果對文章或圖片/視頻版權有異議,請郵件至我們反饋,平台將會及時處理。


