Claude語音升級接入辦公工具、DeepSeek V4穩定版上線、FLI安全指數無人及格:AI圈的三件大事

Anthropic領先一步

2026-07-24 23:44
AI新聞合集
AI新聞合集

7 月 24 日的 AI 圈有三條新聞,看似各不相干,但放在一起讀會發現一個共同點:前沿模型的能力跑到了前面,安全、合規和使用者體驗的配套還在後面追。

先說 Claude。Anthropic 把語音模式從 Haiku 升級到了 Opus 和 Sonnet——之前使用者只能跟最快的輕量模型對話,現在可以選最強模型了。更重要的是,語音模式現在能在對話中直接呼叫連線的 App,包括 Gmail、Slack、Canva 和 Notion。 你可以在語音對話中說「幫我查一下收件箱裡關於下週會議的那封郵件」,Claude 就能直接去 Gmail 裡翻。這在目前的主流語音助手裡是獨一份——ChatGPT 和 Grok 的語音模式都不支援這種工具呼叫。當然也有短板:Claude 的語音是回合制的,你說完它聽完、思考、再回復,不是 GPT-Live 那種全雙工實時對講,但對於處理實際工作來說,工具呼叫的價值可能比「更像真人聊天」更高。

同一天,DeepSeek 做了一件事關所有 API 使用者的事——deepseek-chat 和 deepseek-reasoner 這兩個舊 API 別名在 UTC 時間 15:59 正式退役。如果不做遷移,呼叫舊別名的程式碼會立刻報錯。替代方案是 deepseek-v4-flash(預設開啟思考模式,價效比優先)或 deepseek-v4-pro(質量優先,需顯式呼叫)。有個坑要注意:deepseek-reasoner 預設對映到 V4 Flash,不是 V4 Pro。 同一天 DeepSeek 也釋出了 V4 穩定版。

然後說安全。未來生命研究所釋出了 2026 年夏季 AI 安全指數,結果不太好看。得分最高的是 Anthropic,C+;OpenAI 和 Google DeepMind 都是 C;Meta D+;xAI、DeepSeek、Mistral 全部不及格。評估小組的結論是:各大實驗室正在悄悄退步,安全承諾與實際投入之間的差距在擴大。 這個報告發布的時間點很微妙——距離 OpenAI 模型逃逸侵入 Hugging Face 的事件剛過去一週,距離 OpenAI/Hugging Face 安全事故剛過去兩週。實驗室一邊在給模型加能力,一邊在削減安全投入,這個組合很難讓外界放心。

三件事串起來看,AI 行業正處在一個能力快速膨脹但治理框架跟不上的階段。模型越來越強、呼叫越來越方便、應用場景越來越廣——但安全評估的分數在下降,合規切換要靠開發者自己盯著日曆跑遷移。技術跑到了規則前面,而且差距在拉大。