在紐約,一家名為 Future Doctor 的中國人工智能醫療科技公司與 32 位臨牀專家合作,發佈了一項新的研究,發表於 Nature Portfolio 的 npj Digital Medicine,提出了一種獨特的評估方法,稱為 “臨牀安全 - 有效性雙軌基準”(CSEDB)。該框架旨在評估醫療人工智能系統在實際臨牀場景中的安全性和有效性。研究包括對 OpenAI 的 o3 和谷歌的 Gemini 2.5 P 等知名大型語言模型的比較分析。
在紐約,一家名為 Future Doctor 的中國人工智能醫療科技公司與 32 位臨牀專家合作,發佈了一項新的研究,發表於 Nature Portfolio 的 npj Digital Medicine,提出了一種獨特的評估方法,稱為 “臨牀安全 - 有效性雙軌基準”(CSEDB)。該框架旨在評估醫療人工智能系統在實際臨牀場景中的安全性和有效性。研究包括對 OpenAI 的 o3 和谷歌的 Gemini 2.5 P 等知名大型語言模型的比較分析。
