智能與秩序
916|WAIC觀察筆記:當AI離開聊天框,聰明已經不是唯一考核標準
摘要
2026年世界人工智慧大會展示AI進入物理世界的四大挑戰。復旦蘇昊提出物理智慧六層階梯(從物體、狀態、動力學到功能、目標、行為),彌補AI缺乏真實互動經驗的不足;中科院肖炳甲指出核融合等高風險場景要求AI可靠性達99.9%,因為剩餘5%可能導致設備損毀或人身傷害;圖靈獎得主戴維.帕特森揭示AI環境成本的統計口徑混亂問題;清華薛瀾發布國家AI能力雙維度框架,區分發展能力與治理能力。這四場論壇勾勒出AI離開聊天框後必須通過的能力、可靠性、成本、治理四張考卷,沒有任何提示詞能修正物理世界裡答錯的後果。評估AI不能只看最優表現,更要重視最差情況下的責任與代價。
重點
- 物理智慧六層階梯從客觀世界(物體、狀態、動力學)到主觀互動(功能、目標、行為),補足AI缺乏真實試錯童年經驗。
- 高風險場景如核融合要求AI可靠性99.9%,因為0.1%失敗可能導致設備損毀或人身安全威脅。
- AI環保成本統計口徑混亂常被誇大,企業購買綠色證書抵消排放的可信度存疑。
- 國家AI能力雙維度框架拆分發展能力(知識產出、真實擴散、市場轉化)與治理能力(立法、資料保護、標準制定)。
- 評判AI聰慧程度不再只看像人程度,更要問:懂物理世界嗎?能穩定完成任務嗎?代價算清楚嗎?社會敢信任嗎?
章節
- WAIC 2026 AI進入物理世界的挑戰
2026年世界人工智慧大會除展示機器人應用外,140多場論壇聚焦AI進入物理世界的核心問題。
- 物理智慧六層階梯:補足AI的童年經驗
復旦蘇昊提出從物體知識到行為知識的六層能力模型,幫LLM補上真實互動經驗缺失。
- 可靠性的代價:高風險場景的5%臨界
中科院肖炳甲以核融合為例,說明99.9%可靠性要求,因為剩餘0.1%可能危及人身與設備。
- 環保迷思:AI成本統計的混亂
圖靈獎得主帕特森指出AI耗水耗電統計口徑混亂,綠色證書制度的可信度有限。
- 國家AI能力雙維度框架
清華薛瀾提出發展能力與治理能力並行評估,超越用戶規模迷思。
- 四張考卷的整體評估框架
能力、可靠性、成本、治理四個維度綜合判斷AI落地物理世界的真實成熟度。
金句
聊天軟體偶爾答錯一次,我們重新問就行了。但AI進入物理世界後,判斷錯一次,可能損壞設備,也可能影響人的安全。
在考試裡,95分已經是學霸。但在核融合、醫療、駕駛這些高風險場景裡,剩下那5分,可能才是最要命的部分。
以後再判斷一個AI是不是真的厲害,可以少問一句它有多像人,多問幾句:它懂不懂這個世界?能不能穩定把事做完?代價算不算得清?我們敢不敢把它交給社會?
用戶規模大不等於價值高,國家AI能力需要區分發展能力與治理能力兩個維度。