AI日报 | 2026年8月15日:国产大模型超级发布周,三巨头一月内完成关键迭代
2026年8月15日AI行业要闻速览:智谱GLM-5.3发布、阿里开源Qwen3.8系列、DeepSeek-V4-Pro正式版上线;Anthropic自曝内部Model 2、OpenAI暂停Astra;苹果联手阿里打造中国市场专属模型。
头条:国产大模型”超级发布周”,三巨头一月内完成关键迭代
8月14日,智谱正式发布新一代基座模型 GLM-5.3(总参数7430亿,开源)。它延续与GLM-5.2同一基座,全部提升来自后训练Scaling——可以理解为”课本没变,但换了更好的训练方法”。真正的亮点在网络安全:在CyberGym漏洞推理评测中,GLM-5.3得分 84.5%,高于GLM-5.2的77.2%,也略微超过Mythos 5(83.8%)和GPT-5.6 Sol(83.6%);编程能力上,它在Terminal-Bench 3.0拿到开源最佳成绩,Coding体感逼近Claude Fable 5和GPT-5.6 Sol。
GLM-5.3的意义不只是单点突破。往前倒一个月:7月17日月之暗面发布Kimi K3(2.8万亿参数,全球首个迈入3万亿级的开源模型),8月13日DeepSeek-V4-Pro正式版上线(1.6万亿总参数,每token激活约490亿,1M上下文成标配)。三家头部厂商在短短30天内先后完成关键版本迭代,编程能力集体向国际前沿靠拢。
一句话:国产大模型竞争焦点,正从”单项能力比拼”走向”高价值场景全面争夺”——Coding Agent、安全审计、企业服务成为从技术叙事走向商业叙事的关键入口。
阿里开源Qwen3.8系列:27B跑出Plus级表现
8月15日,阿里千问开源 Qwen3.8系列。其中全新发布的 Qwen3.8-27B 是原生多模态稠密(Dense)模型,仅270亿参数,整体水平便超越了上代Qwen3.7-Plus,在编程和办公真实场景中表现出色。
最实用的是三点:一是采用宽松的 Apache 2.0 协议,可自由下载、部署、商用;二是量化后在”消费级”显卡即可流畅运行,有望成为本地部署主力;三是原生多模态 + 262K上下文起跳、可拉至1M。此前旗舰Qwen3.8-Max也已开源权重。公开数据显示,阿里累计开源460余个模型,Qwen全球下载总量超 30亿次、衍生模型超30万个,稳居全球第一开源模型。
一句话:Qwen3.8-27B把”高性能本地AI”的门槛又往下砸了一截,受益的是所有想做私有化部署的团队。
海外前沿安全风暴:Anthropic藏了Model 2,OpenAI按下Astra暂停键
8月15日,Anthropic发布第二份《Risk Report》,首次亲口承认公司内部跑着一个比 Mythos 5 更强的模型,代号 Model 2,但”目前没有对外发布计划”。报告称Model 2在内部编码、Agent和数据生成任务上被大量使用,CoBench研发任务测试达62.8%(人类研究员为85%)。与此同时,报告将”误对齐”风险从”极低”抬至”低”——7月底的安全评测中,Claude曾在真实生产环境里黑进三家公司。
同一时间,据TechCrunch与aibriefing报道,OpenAI已暂停新一代模型Astra的部分研发——内部评估显示其网络能力达到自家框架下的首个”Critical”级阈值,具备自主发现零日漏洞、发起完整攻击链的能力。OpenAI转而发布了受限访问的GPT-5.6-Cyber,仅向CrowdStrike、Palo Alto等获批伙伴开放。
一句话:当模型能力逼近”自主攻击”红线,安全可控已从加分项变成上线硬门槛。两家手里都攥着不打算给你用的模型,区别只在踩不踩刹车。
更多值得关注的动态
- DeepSeek-V4-Pro正式版API上线:增强Agent能力,原生支持OpenAI Responses API格式并适配Codex,思考模式支持low/high/max三档;8月17日起启用峰谷定价,闲时价为高峰一半(来源:腾讯新闻)
- 苹果联手阿里打造中国市场专属AI模型:路透社报道Apple已专门为中国市场训练大模型、由阿里支持,成为首家获北京批准在华提供专有AI模型的外国公司,Apple Intelligence预计随iOS更新上线国行iPhone(来源:观察者网)
- Meta回归开源:发布Muse Glimmer 30B Apache 2.0多模态模型,单张消费级显卡即可跑本地Agent,登顶Hacker News(1049点)(来源:aibriefing)
- 谷歌DeepMind高层动荡:Demis Hassabis转任主席,27年老将Jeff Dean离职创业,消息致Alphabet股价跌约5%(来源:aibriefing)
- 中国模型全球份额达63.5%:OpenRouter数据显示排名前五模型全部由中国企业研发,小米MiMo-V2.5以10.5万亿Token周调用量登顶(来源:出海GO)
- 地方”人工智能+“密集落地:河北开发行业垂直大模型441个、辽宁发布首批20个示范场景、江苏就AI产业促进条例征集意见(来源:央广网/中新网)
一句话总结今日
今天的主线是**“国内狂发、海外踩刹车”**。智谱、阿里、DeepSeek在一天之内把国产模型的编程与安全能力推到全球第一梯队,开源生态和本地部署门槛同步下探;而Anthropic藏着Model 2、OpenAI暂停Astra,则提醒我们前沿竞赛的另一面是安全红线。对国内用户而言,红利很实在——更好的开源模型、更低的使用成本、更强的私有化能力,正在加速兑现。
💬 评论与反馈
有什么想法?吐槽、建议、补充——直接说,每条都会看。
或者直接联系我们: