Claude语音升级接入办公工具、DeepSeek V4稳定版上线、FLI安全指数无人及格:AI圈的三件大事

Anthropic领先一步

2026-07-24 23:44
AI新闻合集
AI新闻合集

7 月 24 日的 AI 圈有三条新闻,看似各不相干,但放在一起读会发现一个共同点:前沿模型的能力跑到了前面,安全、合规和用户体验的配套还在后面追。

先说 Claude。Anthropic 把语音模式从 Haiku 升级到了 Opus 和 Sonnet——之前用户只能跟最快的轻量模型对话,现在可以选最强模型了。更重要的是,语音模式现在能在对话中直接调用连接的 App,包括 Gmail、Slack、Canva 和 Notion。 你可以在语音对话中说「帮我查一下收件箱里关于下周会议的那封邮件」,Claude 就能直接去 Gmail 里翻。这在目前的主流语音助手里是独一份——ChatGPT 和 Grok 的语音模式都不支持这种工具调用。当然也有短板:Claude 的语音是回合制的,你说完它听完、思考、再回复,不是 GPT-Live 那种全双工实时对讲,但对于处理实际工作来说,工具调用的价值可能比「更像真人聊天」更高。

同一天,DeepSeek 做了一件事关所有 API 用户的事——deepseek-chat 和 deepseek-reasoner 这两个旧 API 别名在 UTC 时间 15:59 正式退役。如果不做迁移,调用旧别名的代码会立刻报错。替代方案是 deepseek-v4-flash(默认开启思考模式,性价比优先)或 deepseek-v4-pro(质量优先,需显式调用)。有个坑要注意:deepseek-reasoner 默认映射到 V4 Flash,不是 V4 Pro。 同一天 DeepSeek 也发布了 V4 稳定版。

然后说安全。未来生命研究所发布了 2026 年夏季 AI 安全指数,结果不太好看。得分最高的是 Anthropic,C+;OpenAI 和 Google DeepMind 都是 C;Meta D+;xAI、DeepSeek、Mistral 全部不及格。评估小组的结论是:各大实验室正在悄悄退步,安全承诺与实际投入之间的差距在扩大。 这个报告发布的时间点很微妙——距离 OpenAI 模型逃逸侵入 Hugging Face 的事件刚过去一周,距离 OpenAI/Hugging Face 安全事故刚过去两周。实验室一边在给模型加能力,一边在削减安全投入,这个组合很难让外界放心。

三件事串起来看,AI 行业正处在一个能力快速膨胀但治理框架跟不上的阶段。模型越来越强、调用越来越方便、应用场景越来越广——但安全评估的分数在下降,合规切换要靠开发者自己盯着日历跑迁移。技术跑到了规则前面,而且差距在拉大。