AI日报 | 2026年9月3日:大模型集体越过'安全临界点',中国开源模型成全球底座

2026年9月3日AI行业要闻速览:OpenAI Astra 成为首个触及最高'关键'网络安全阈值的模型、可自主串联零日漏洞;谷歌推 Gemini 3.8 Flash 与安全版 Flash Cyber、Meta 发布 Muse Spark 1.3,能力与安全同步绑定;中国开放权重模型(Kimi K3、DeepSeek-V3)被 Harvey、Cursor、Thinking Machines 用作全球研发底座;阿里 Qwen3.8-Max 前端编程登顶、博通 AI 芯片净利同比+216%。

头条:大模型能力越过”触碰真实系统”红线——Astra 自主串联零日漏洞,谷歌、Meta 同步亮出”安全模型”

9月2日,OpenAI 披露下一代模型 Astra 已成为首个触及自身 Preparedness Framework 最高”关键(Critical)“网络安全阈值的模型:在评测中它能自主发现未知漏洞、串联两个零日漏洞,完成浏览器沙箱逃逸并从普通用户提权到 root。为防控风险,OpenAI 8 月主动暂停了 Astra 部分开发以补安全,初期仅向 Daybreak Blue 计划的防御型研究员开放高级网安能力,通用 API 用户拿到的是过滤版。(来源:OpenAI、华尔街见闻、Pondero)

同一天,谷歌与 Meta 也把”能力 + 安全”绑在一起发布:谷歌推出 Gemini 3.8 Flash 与专用安全版 Flash Cyber——后者在漏洞挖掘基准 CyberGym 达顶尖水平,Chrome 安全团队实测其生成的正确补丁数量是体量更大商业模型的 2.6 倍,并通过 Fairwind 计划向 650+ 政府与关键基础设施机构开放优先通道;Meta 则发布 Muse Spark 1.3,首席 AI 官称其编程能力”优于 GPT-5.6 Sol、与 Claude Fable 5.1 旗鼓相当”,Token 消耗降 25%、代理能力显著增强。

为什么重要?行业主线已从”谁更会考试”切换到”谁敢让 AI 真正碰真实系统”。当模型能自己挖洞、自己修洞、自己提权,厂商的节奏变成”先把油门踩到底、脚同时死死踩住刹车”——能力越强,安全合规的门槛越高。(来源:Ars Technica、华尔街见闻、aizhijian)


中国开放权重模型出海——Kimi、DeepSeek 正成为海外 AI 研发的”底座”

9月3日《人民网》刊文指出,随着 Kimi、DeepSeek 等中国开放权重模型能力持续提升,越来越多海外 AI 企业直接在其基础上做后训练,中国模型正加速融入全球 AI 产业链。

几个标志性案例凑齐了”出海”的三种姿势:

  • 美国法律 AI 独角兽 Harvey 发布后训练开放权重模型 Tenet,以月之暗面 Kimi K3 为基座,依托约 1750 个专业化法律工作智能体环境迭代约 2 个月;完整完成的综合法律实务任务量接近原始 Kimi K3 的 2 倍,合同起草/审查/谈判专项任务提升约 20%,且基本保留原模型通用法律知识。
  • Cursor(代码编辑器) 所属公司的编程模型 Composer 2 / 2.5 均以 Kimi K2.5 为基座,经代码数据持续预训练 + 大规模强化学习进阶。
  • Mira Murati 的 Thinking Machines 在研发首款开放权重模型 Inkling 时,MoE 架构主要沿用 DeepSeek-V3 技术路线。

为什么重要?过去”中国大模型 = 便宜但落后”的叙事正在被改写:在垂直场景,海外公司宁可在中国开源底座上做后训练,也不全依赖闭源 API——这意味着中国开放权重模型已从”被使用”升级为”被当作基础设施”。(来源:人民网、网易)


模型发布进入”小步快跑”节奏——同日三家旗舰较劲前端与代理

9月2日前后,发布节奏明显从”憋大招”转向”高频小版本”:

  • 谷歌六周内第三款 Flash:3.8 Flash 主打长周期软件工程与自主智能体,Simon Willison 实测一个复杂 HTML 项目仅用 13 秒、花费 1.8 美分,主打快与省。
  • 阿里 Qwen3.8-Max 更新,据称前端编程能力跃居全球第一,在代码生成、多轮修改上表现优异。
  • 更早前,阿里 Qwen3.8-Next 架构论文披露:125B 总参数、每 token 仅激活 6B 的稀疏 MoE,在 14 项预训练基准中 8 项超过 397B 前代、其余差距不超 2.6 分,而激活参数与训练 token 均只有 1/3——“参数不再是叙事主角”的最新实证。(来源:aizhijian、IT之家、Qwen)

更多值得关注的动态

  • 特朗普政府支持 OpenAI 诉纽约时报:联邦官员主张用 copyrighted 文本训练 AI 属合理使用,裁决将决定训练数据是否需付费(来源:The Guardian、dailyai)
  • AI 训练基建公司 AfterQuery 成 YC 最快独角兽:5 个月估值从 3 亿飙到 32 亿美元,打破 YC 增长纪录(来源:AI 早报)
  • 博通第三财季净利 130.88 亿美元、同比 +216%:营收 295.91 亿美元、同比 +86%,增长主要来自 AI 芯片需求(来源:aizhijian)
  • Hugging Face 旗下 Pollen Robotics 消费级开源机器人 Microduck 大卖:搭载中国自研芯片,发布 4 天销量破 1 万台(来源:AI 早报)
  • Anthropic 据称与 Lambda 签 350 亿美元云计算协议:继续锁定训练算力(来源:AI 早报)
  • World Labs 发布世界模型 Atlas:原生支持文本/图像/视频/3D,可生成最长 1 分钟 1440p 视频、稀疏视角 3D 重建超专用模型(来源:AI 早报)
  • 讯飞星火开源 X2.5 端侧模型(4B/1.7B):基于全国产算力训练,原生支持最长 100 万 Token 上下文,Apache 2.0(来源:讯飞)
  • Meta 发布实时音频感知模型 Muse Voice Transcribe:流式 ASR + 20+ 说话人分离,公开基准排名第一(来源:Meta)
  • OpenAI 把 ChatGPT Live Voice 带上 iPhone 锁屏:首个无需解锁即可调用的第三方语音助手,覆盖锁屏与灵动岛(来源:Pondero)
  • Anthropic 承认此前多起模型入侵企业系统事件属运营安全失误:已全面升级内部测试管控(来源:AI 早报)

一句话总结今日

今天的主线是**“能力越过红线,安全成为主战场”**。Astra 能自己挖零日漏洞、谷歌与 Meta 同步把安全模型推到台前,说明 AI 已从”处理文本”跨进”操作真实数字系统”的深水区;而 Harvey、Cursor、Thinking Machines 纷纷把 Kimi、DeepSeek 当底座,则标定了另一条线——中国开放权重模型正从”国产替代”升级为”全球基础设施”。接下来半年,会看到更多”强能力 + 高管控”模型逐步开放,普通用户能用到的 AI 能力将肉眼可见地跃升。

相关推荐 自适应内嵌广告 接入百度联盟/AdSense后替换此处代码
底部广告 728x90 横幅广告 接入百度联盟/AdSense后替换此处代码

💬 评论与反馈

有什么想法?吐槽、建议、补充——直接说,每条都会看。

评论内容公开可见,联系方式仅用于回复

或者直接联系我们: