「AI 健康答案贏過醫師」怎麼讀:OpenAI 自評勝出,但每週 2.3 億人已在問才是重點
OpenAI 說新模型的健康答案贏過醫師,但分數全在它自家內部跑、未公開外審。真正的重點不是它贏了幾項,是每週 2.3 億人已在用 ChatGPT 問健康。AI 取代的不是醫師,而是 Google 搜尋。
追蹤 AI、資安、數位工具、軟體產品、新創、半導體、產業科技與科技政策。
OpenAI 說新模型的健康答案贏過醫師,但分數全在它自家內部跑、未公開外審。真正的重點不是它贏了幾項,是每週 2.3 億人已在用 ChatGPT 問健康。AI 取代的不是醫師,而是 Google 搜尋。
為什麼 Amazon 和 AMD 投的不是下一個 ChatGPT?答案可能是:聊天模型正在商品化,而世界模型要真實世界資料、感測器、機器人、模擬環境,護城河更深。
一個放了 16 個月、沒人記得的舊帳號,撬開了週下載破百萬的 @mastra 套件生態。AI 供應鏈最大的漏洞不是程式碼,是沒人收回的權限。
前沿模型攻防同源、能力是真的,技術上擋不掉;缺的是制度。真正的治理缺口不是能力是授權,企業該用風險分類加 ISO/IEC 42001 在能力升級時同步收緊。
Gartner 估 2026 年底 40% 企業 app 內建 agent,市場焦點從『agent 是不是真的』轉向『哪個部門先被 agent 化』;真正的落差不是技術,是治理跟不上部署速度。
大部分人看到 74 億美元。我看到的是投資人結構變了:騰訊、寧德時代進場,代表 AI 不再只是網路產業,而開始變成能源、製造、平台共同投資的基礎設施。
NVIDIA 把安全、網路、隱私護欄做成 runtime(OpenShell),配上為長任務調過的 Nemotron 3 Ultra。真正要看的是治理被往工具層下沉,不是模型跑分。
Meta Business Agent 平台的賣點是拿海量顧客對話養出幫企業客服與銷售的 agent。技術不難,難的是這些對話的來源同意、二次利用與跨境邊界。台灣企業導入前,先把資料來源盡職調查清單跑過一遍。
微軟 Work IQ 把 email、會議、聊天與協作模式做成語意索引,讓 AI agent 讀懂組織怎麼運作。好處是 agent 更懂你公司,代價是『誰能查到誰的工作軌跡』成為新的隱私與權限治理對象。
LastPass 證實客戶資料外洩,但破口不在自家系統,而是第三方情報平台 Klue 的 OAuth 長期權杖被竊,攻擊者拿來橫向讀走各家 Salesforce 的 CRM 資料。受害的反而多是資安廠。企業真正該補的是第三方整合授權這筆爛帳。
國科會 2026 科技預算 1800 億,三主軸是數位基磐、關鍵技術、智慧應用,半導體與 AI 領頭信賴產業。對企業來說算力與供應鏈方向已定,要對齊的是落地應用,不是等補助。
通行密鑰用裝置端的公私鑰取代密碼,登入時以生物辨識解鎖私鑰簽章,密碼不再傳輸或外洩。本文整理 Passkey 的運作原理、怎麼開始用,以及台灣已支援的服務與限制。
KPMG 6/9 把 Copilot 與 Agent 365 推給全球 27.6 萬名員工。導入不難,難在 27 萬人同時用 agent,權限、稽核與責任歸屬要一次到位。治理不是附加題,是這場部署的真正考題。
最強 AI 模型被比照核彈等級管制禁用,加上各版本服務持續出現錯誤率攀升,正在揭露一個更根本的問題:工作流對單一 AI 服務的過度依賴。本文從備援設計、容錯邏輯、管制趨勢應對、Prompt 跨模型可移植性四個面向,提出可執行的準備原則。
Supabase 募 5 億美元、估值 105 億,熱錢從模型移到 AI 應用的基建層。估值翻倍反映 vibe coding 下的真實需求,但維運與資料治理的成本也被一起放大。
OpenAI 拿約 130 萬則真實對話重放、餵給待上線的新模型測試,比合成測題更早抓到行為漂移。上線前驗收該從跑分搬回真實情境,企業導入 AI 也一樣。
Databricks 6/16 發表 Genie One,把 agent 講成能跑重複工作流的「同事」,還給業務開了 vibe coding 環境。當全員自助生成應用,真正的門檻不在介面,在 agent 動得到哪些資料、用誰的權限。
iRhythm 的臨床與醫材系統都沒事,被攻破的是第三方代管的商業應用、入口是社交工程。醫療資料外洩越來越少發生在資料所在的地方,而在資料流動的地方。