AI日报 | 2026年8月14日:DeepSeek V4 Pro转正,国产开源同日围攻硅谷
2026年8月14日AI行业要闻速览:DeepSeek-V4-Pro正式版上线并官宣峰谷定价、Harness公测;阿里Qwen3.8-Max开源、xAI发布Grok 4.6;中国开源模型全球下载破百亿次;Anthropic拟10月IPO、新Claude嵌入C2PA水印;谷歌发布Gemini 3.7 Flash
头条:DeepSeek-V4-Pro 正式版上线,“涨价+Harness”二连击引爆社区
8月12日深夜至13日凌晨,DeepSeek 完成 V4 系列最后一块拼图——DeepSeek-V4-Pro-0813 正式版悄然上线,APP、网页端与 API 同步更新。这次更新的主角不是参数(仍是1.6T MoE、每 token 激活约49B),而是后训练把 Agent 能力狠狠堆了起来:原生支持 OpenAI Responses API 与 Anthropic API 双协议,针对性适配 Codex;思考模式新增 low/high/max 三档;上下文拉到 100万 token、单次最大输出 38.4万 token,能一口气吞下整个代码仓库再跑长任务。
基准最能说明问题:Terminal-Bench 跑出 87.9 分,与 Claude Fable 5 的 88 分仅差 0.1;CyberGym 安全攻防甚至以 83.3 反超 Fable 5 的 83.1;DeepSWE 从预览版 12.8 暴涨至 62.7。换句话说,一个完全开源的模型,在”能不能真把活干完”这件事上贴脸了全球最顶尖的闭源模型。
更戏剧性的是两小时后的”闪电二连击”:DeepSeek 官宣 API 将于 8月17日0点起实行峰谷定价,闲时价格为高峰(9–12点、14–18点)的一半。对比现行价,闲时输入(缓存命中)涨幅最高达 500%——这意味着它正主动告别”地板价”标签,用更高价格匹配更强性能、向高端市场延伸。紧接着13日深夜,DeepSeek Harness v0.1 公测并开源,采用”一切皆插件”的 Cordis 元框架,GitHub 星标半小时破万、已超 3万。一句话:模型送你进入 Agent 时代,框架把主动权交还开发者,而涨价则在提醒——免费午餐的窗口正在收窄。
阿里 Qwen3.8-Max 开源、xAI 发 Grok 4.6,全球模型”多箭齐发”
8月12日,AI 圈上演头部模型的同日撞车。阿里通过魔搭 ModelScope 社区正式开放 Qwen3.8-Max 权重(参数规模达 2.4万亿),并承诺本周内开放该模型的权重;马斯克旗下的 xAI 则发布 Grok 4.6,在真实世界专业任务评测 GDPVal-AAv2 中拿到 1753 Elo,高于 Claude Fable 5 Max 的 1741 与 GPT-5.6 Sol Max 的 1728,定价 2/6 美元每百万 token,并同步推出 Grok Build 编码 agent 与多 agent 的 Grok Bot 公开测试版。
两条新闻放在一起读,信号很清晰:大模型的赛点已从”参数多大、聊天多顺”转移到”谁更便宜地把长程活干完”。DeepSeek、阿里、xAI 三家同一时间窗口出手,瞄准的全是 Agent 工具链与总持有成本——这恰恰是中国开源阵营最擅长、也最能”贴脸开大”的维度。
Anthropic 拟10月 IPO、新 Claude 嵌入 C2PA 水印,商业化与监管同步加速
据多家媒体报道,Anthropic 正筹备 10月 IPO,估值或达 2万亿美元,有望成为 AI 领域规模最大的上市事件之一。与此同时,Anthropic 宣布 8月2日及之后发布的新 Claude 模型,将在生成文本与图像中嵌入隐形 C2PA 水印与数字签名溯源元数据,以符合欧盟《AI 法案》第50(2)条透明度要求,并配套开发供用户与第三方识别 AI 内容的检测工具。
这背后是一条被反复验证的主线:当模型自主能力逼近”危险阈值”,商业化路径先从”冲最大使用量”退回到”决定谁能碰、谁负责”。本周 OpenAI 也因新一代 Astra 模型在内部安全评估中达到”关键”网络能力等级而主动暂停部分测试——前沿能力的围栏,正从理论问题变成现实约束。
更多值得关注的动态
- 中国开源模型全球下载破100亿次:HuggingFace 报告显示中国开源模型下载占比达 41%,首次超过美国;MiniMax 开源 H3 三天登顶 HF 热度榜第一,月之暗面 Kimi K3 全量开源成为全球参数规模最大的开源模型(来源:经济日报 / 第一财经)
- 谷歌发布 Gemini 3.7 Flash:主打代码生成与调试能力提升,支持 AI 生产力助手 GeminiSpark,新增生化核等滥用风险防护;但旗舰 Gemini 3.5 Pro 仍无明确上市时间表,DeepMind 同期重组、Koray Kavukcuoglu 出任负责人(来源:格隆汇 / 智东西)
- Meta 回归开源权重:发布 30B 参数的 Muse Glimmer,可在单张消费级 GPU 上运行、Apache 2.0 许可,扎克伯格发表长文押注开源民主化并承诺开源旗舰 Muse Spark 1.2(来源:aibriefing.dev)
- OpenAI 发布 GPT-5.6 Sol:事实错误较上代减少 68%,并将最小规模的 Luna 层面向免费用户开放无限文本对话;同期高管 Brad Lightcap 离职创业(来源:腾讯新闻)
- 成都首笔”算力贷”落地:114万元授信发放至 AI 企业,依托”算力券”财政增信,单户最高授信 500 万元,探索”券贷协同”降低创新成本(来源:中国新闻网)
- “大空头”艾斯曼警告 AI 繁荣命门:当前 AI 产业回报高度依赖 OpenAI 与 Anthropic 两家,二者贡献微软、亚马逊、谷歌、甲骨文约 70% 的 AI 相关收入,中国低成本开源模型崛起可能引发全球价格战(来源:FX168)
一句话总结今日
今天的主线是**“国产开源集体转正,全球定价权博弈白热化”**。DeepSeek 用 V4-Pro 把 Agent 能力推到顶流门槛、用 Harness 把生态主动权交给开发者、又用峰谷定价划出商业化新边界;阿里、xAI 同日出招,把赛点钉死在”便宜且真能干活”上。与此同时,Anthropic 的天价 IPO 与 C2PA 水印提醒我们:当模型越来越强,“谁能碰、谁负责、谁付费”正取代”谁更聪明”,成为下一个生死线。对国内用户而言,红利很实在——更强的开源模型、更低的总成本、更完整的工具链,正在加速落到手边。
💬 评论与反馈
有什么想法?吐槽、建议、补充——直接说,每条都会看。
或者直接联系我们: