選項
首頁
新聞
隨著 OpenAI、Google 和 Anthropic 相繼推出新產品,AI 健康科技戰局持續升溫

隨著 OpenAI、Google 和 Anthropic 相繼推出新產品,AI 健康科技戰局持續升溫

2026-03-19
167

本月,OpenAI、Google 和 Anthropic 相隔僅數日便相繼揭露了各自專門的醫療 AI 功能。這波密集的公告顯示出競爭壓力,而非單純的巧合。然而,儘管行銷話術強調將徹底改變醫療保健,但這些產品均未獲准作為醫療器材、未獲准用於臨床,也無法直接用於患者診斷。

1月7日,OpenAI推出ChatGPT Health,透過與b.well、Apple Health、Function及MyFitnessPal的合作,讓美國用戶能串接醫療紀錄。Google則於1月13日發布MedGemma 1.5,將其開源醫療AI模型擴展至可解讀3D電腦斷層掃描(CT)與磁振造影(MRI)影像,以及全切片組織病理學影像。

Anthropic 隨後於 1 月 11 日推出「Claude for Healthcare」,提供符合 HIPAA 規範的連接器,可串接至 CMS 保險給付資料庫、ICD-10 編碼系統以及國家醫療服務提供者識別碼登記處。

這三家公司皆瞄準相同的行政痛點——事前授權審查、理賠處理及臨床文件記錄——雖採用相似的技術方法,但市場推廣策略各異。

開發者平台,而非診斷產品

其架構上的相似性令人驚嘆。每個系統皆採用針對醫學文獻與臨床資料集進行微調的多模態大型語言模型。各系統均強調隱私保護與法規免責聲明,並將自身定位為輔助而非取代臨床判斷。

差異在於部署與存取模式。OpenAI 的 ChatGPT Health 作為面向消費者的服務運作,針對歐洲經濟區(EEA)、瑞士及英國以外地區的 ChatGPT Free、Plus 和 Pro 訂閱用戶設有候補名單。Google 的 MedGemma 1.5 則透過其「健康 AI 開發者基礎計畫」以開放模型形式發布,使用者可透過 Hugging Face 下載,或透過 Google Cloud 的 Vertex AI 進行部署。

Anthropic 的 Claude for Healthcare 則透過 Claude for Enterprise 整合至現有企業工作流程,目標客群為機構買家而非個人消費者。這三者均持一致的監管立場。

OpenAI 明確聲明 Health「不適用於診斷或治療」。Google 將 MedGemma 定位為「開發者評估並適應其醫療應用場景的起點」。Anthropic 則強調其輸出結果「不應直接用於臨床診斷、病患管理決策、治療建議,或任何其他直接的臨床實踐應用」。

基準測試表現與臨床驗證

這三款產品在醫療 AI 基準測試中的表現均有顯著提升,但測試表現與實際臨床部署之間的差距依然龐大。Google 報告指出,MedGemma 1.5 在斯坦福大學的 MedAgentBench(醫療代理完成度基準測試)上達到了 92.3% 的準確度,而之前的 Sonnet 3.5 基準版本僅為 69.6%。

在內部測試中,該模型在 MRI 疾病分類上的表現提升了 14 個百分點,在 CT 檢查結果判讀上則提升了 3 個百分點。Anthropic 的 Claude Opus 4.5 在啟用 Python 程式碼執行功能的 MedCalc 醫療計算準確度測試中獲得 61.3% 的成績,而在 MedAgentBench 測試中則達到 92.3%。

該公司還聲稱在針對事實性幻覺的「誠實度評估」方面有所改善,但未公開具體指標。

OpenAI 並未針對 ChatGPT Health 發布具體的基準比較,而是根據對現有使用情況的去識別化分析指出,「全球每週有超過 2.3 億人透過 ChatGPT 提出健康與保健相關的問題」。

這些基準測試衡量的是在精選測試資料集上的表現,而非臨床結果。由於醫療錯誤可能導致危及生命的後果,將基準準確度轉化為實際臨床實用性,遠比其他 AI 領域複雜得多。

監管路徑仍不明朗

這些醫療 AI 工具的監管環境仍不明朗。在美國,FDA 的監管取決於產品的使用目的。任何「協助或向醫療專業人員提供關於預防、診斷或治療建議」的軟體,可能需作為醫療器材接受上市前審查。目前已公布的工具均未獲得 FDA 核准。

責任歸屬問題同樣懸而未決。當班納健康(Banner Health)的技術長麥克·雷金(Mike Reagin)表示該系統是「被 Anthropic 對 AI 安全的重視所吸引」時,這僅涉及技術選擇,而非法律責任框架。

若臨床醫師依賴 Claude 的預先授權分析,而患者因延誤治療而遭受傷害,現行判例法對責任歸屬幾乎沒有提供任何指引。

各區域的監管方針差異顯著。雖然美國食品藥物管理局(FDA)與歐洲《醫療器材法規》針對作為醫療器材的軟體提供了既定框架,但許多亞太地區監管機構尚未針對生成式人工智慧診斷工具發布具體指引。

這種不確定性影響了各市場的採用時程——在醫療基礎設施尚有缺口的市場中,這本可能加速技術導入,卻反而造成臨床需求與監管謹慎之間的張力。

行政工作流程,而非臨床決策

實際部署範圍仍相當有限。諾和諾德(Novo Nordisk)內容數位化總監 Louise Lind Skov 描述了將 Claude 用於「藥品開發中的文件與內容自動化」,重點在於法規申報而非患者診斷。

台灣健保署採用 MedGemma 從 30,000 份病理報告中提取數據進行政策分析,而非用於治療決策。

此模式顯示,機構採用AI的重點集中在行政工作流程上——例如帳務處理、文件記錄及試驗方案起草等,這些環節的錯誤通常不會立即造成危險;而非直接的臨床決策支援,儘管AI在後者領域對患者預後的影響可能最為顯著。

醫療 AI 的發展速度,已超越機構處理監管、法律責任及工作流程整合等複雜問題的能力。這項技術已然存在,只需支付月費,即可使用先進的醫療推理工具。

這是否能轉化為醫療服務的變革,取決於這些協調發布的聲明尚未解決的關鍵問題。

另請參閱:阿斯特捷利康押注內部 AI 以加速腫瘤學研究

想向業界領袖深入了解人工智慧與大數據?歡迎參加將於阿姆斯特丹、加州及倫敦舉辦的「人工智慧與大數據博覽會」。這場綜合性活動隸屬於 TechEx 系列,並與其他頂尖科技盛會同期舉行。點擊此處獲取更多資訊。

AI News 由 TechForge Media 提供技術支援。點此探索其他即將舉行的企業科技活動與線上研討會。

相關文章
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。 DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。 Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額 儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額 儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代 加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代 Guident 在南佛羅里達州營運一輛 AuveTech 接駁車,並運用其遠端監控技術,管理西棕櫚灘的一條四英里路線以及博卡拉頓的一條一英里路線。| 圖片來源:Guident加州正重新定義無人駕駛車輛的監管格局,從科技產業的「快速行動、打破常規」心態,轉向嚴格的問責制與嚴謹的行駛里程要求。Guident 執行董事長兼執行長哈羅德·布勞恩(Harold Braun)在《機器人報告》(The Robo
相關專題推薦
寫作 適用於長篇寫作的 AI 文章大綱工具
適用於長篇寫作的 AI 文章大綱工具

2026 年最新、最受好評的長文寫作 AI 大綱工具!這份精選清單收錄了強大且具顛覆性的工具,能透過實際測試生成精準、結構化的大綱,大幅提升寫作效率。XIX.AI 正是這份菁英名單中的一員。 獲取免費版與付費版的比較指南,助您挑選最合適的工具。立即探索,釋放您的 AI 優勢!

9 個工具
xix.ai
聊天機器人 用於語言練習、面試準備和日常流利度的最佳 AI 角色扮演聊天應用
用於語言練習、面試準備和日常流利度的最佳 AI 角色扮演聊天應用

2026 年最新最佳頂級評分 AI 角色扮演聊天應用,用於語言練習、面試準備和日常流利度!XIX.AI 精心策劃了一個強大的變革性合集,提供免費與付費對比、真實世界測試以及每週更新的排名。這些必試工具可幫助您提升寫作技能,克服流利度挑戰,並提高所有日常場景下的溝通效率。立即探索,發現您語言成長的完美工具!

10 個工具
xix.ai
音樂創作 用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具
用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具

2026年最新、最優秀且評分最高的AI音軌分離工具彙總,專為混音製作、取樣準備以及卡拉OK音訊處理而設計。這些功能強大的創新工具經過實際測試,能夠實現精準的音訊分離,顯著提升工作效率。XIX.AI每週都會更新免費的付費產品對比指南,幫助您找到最適合自身需求的工具。立即探索,發揮您的AI優勢。

8 個工具
xix.ai
數據分析 用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手
用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手

2026年最新最優秀的AI SQL輔助工具排名揭曉!XIX.AI精心挑選了一系列功能強大的工具,這些工具會定期更新,並透過真實的場景測試來驗證其效能。使用這些值得嘗試的工具,您可以快速生成精準的收入分析報表、分析銷售流程,並追蹤產品各項指標,從而大幅提升工作效率。立即探索,找到最適合您的資料驅動決策工具!238個字元

9 個工具
xix.ai
音樂創作 最佳用於歌曲草稿的 AI 旋律創作工具
最佳用於歌曲草稿的 AI 旋律創作工具

2026 年最新最佳頂級評分 AI 旋律創作工具,助力歌曲草稿創作!XIX.AI 精心策劃了一套極具影響力且經過嚴格真實世界測試的變革性合集,旨在提供最佳的創作體驗。您可以找到詳細的免費與付費版對比、精準的排名以及必試選項,這些工具旨在幫助您輕鬆創作出令人驚豔的歌曲草稿,並顯著提升您的創意生產力。立即探索,發現您的完美工具!

8 個工具
xix.ai
聊天機器人 最適合面試練習的 AI 對話訓練工具
最適合面試練習的 AI 對話訓練工具

2026 年最新、最受好評的 AI 面試對話訓練工具,盡在 XIX.AI!這份精心精選的清單收錄了多款功能強大、顛覆傳統的工具,這些工具均經過嚴格的實戰測試,能提供精準的回饋。 您將在此找到免費版與付費版的比較分析,以及詳細的排名榜單,助您挑選必試的選項,從而提升自信與技能。立即探索,發掘助您在面試中脫穎而出的完美工具!

12 個工具
xix.ai
評論 (1)
0/500
JuanThomas
JuanThomas 2026-05-05 14:00:35

Wow, this AI health race is getting intense! Just saw the news about OpenAI, Google, and Anthropic all dropping medical AI tools almost at the same time. It's clearly a strategic move, not a coincidence. Makes you wonder who's really leading the pack and what it means for our future healthcare. Exciting but also a bit scary, right? 🤔

OR