標籤
#Claude

Blockchain
GLM-5.3自稱最強開源coding模型 自家跑分卻先拆了台
Z.ai推出743B參數的GLM-5.3,官方部落格的跑分卻顯示它輸給Claude Fable 5,甚至在部分測試上不敵中國同行Kimi K3,而所謂「open-weights」目前也還下載不到。

Blockchain
三個 Claude 互不知道對方存在,被丟進同一個程式碼庫後打了起來
Anthropic 最新論文記錄多代理系統的地盤戰:惡意程式碼互攻、停用帳號,也有代理自己講和、發明錦標賽退場機制,甚至學會了偷偷佔便宜。

Tech
Claude語音模式不搶話只輪流講,跟ChatGPT差在哪先搞懂
Anthropic把語音模式升級到Sonnet、Opus等級,還能接Gmail、Slack,但它跟ChatGPT的即時對話邏輯完全不同,用之前該先知道這件事。

Tech
準確率小贏卻胡謅率飆89%,ChatGPT與Claude的分歧不只是分數
AA-Omniscience基準顯示ChatGPT新旗艦準確率小贏Claude,胡言亂語比例卻是對方的1.6倍。功能、定價與一場美國國防部合約,讓兩家AI公司走向不同路線。