(綜合ETtoday新聞雲、TVBS新聞報導)
Anthropic於28日宣布推出旗艦級AI模型Claude Opus 4.8,在Opus 4.7基礎上全面提升,維持相同價格。新模型主打「更誠實」,能主動標記不確定性,減少缺乏根據的宣稱。官方數據顯示,在程式碼評估中,Opus 4.8漏看自身缺陷的機率比前代降低約四倍。
在程式開發能力方面,Opus 4.8於SWE-bench Pro測試取得69.2%成績,高於Opus 4.7的64.3%[1]。高速模式運行速度提升至2.5倍,費用比以往模型便宜三倍[2]。
新功能方面,Opus 4.8在claude.ai網頁端新增「努力程度控制(Effort Control)」,用戶可調整模型處理任務時的思考深度;預設為「高努力」,消耗代幣量與4.7預設值相當但效能更好[2]。開發者工具Claude Code新增「動態工作流(Dynamic Workflows)」研究預覽,允許AI先規劃工作,再同時執行數百個平行子代理,最後自行驗證輸出結果[2]。Messages API也同步更新,開發者可在任務中途更新提示指令而不破壞提示快取[2]。
在正式發表前的對齊評估中,Opus 4.8在支持用戶自主性、維護用戶最大利益等親社會特質上創下新高,欺瞞或協助惡意使用的「不良行為率」顯著低於4.7版本,接近該公司安全對齊最佳的Claude Mythos Preview[2]。
Anthropic透露,更高階的Claude Mythos模型預計未來數周內進一步擴大開放[1]。
本事件已沉寂,相關脈絡見「相關事件」