🤖 AI 新闻日报 – 2026年08月13日
2026年08月13日 · 自动生成
DeepSeek V4 Pro 正式版 API 上线,Agent 能力大幅增强
8月13日,DeepSeek V4 Pro 正式版更新至 API,调用模型名不变,新版本大幅增强 Agent 能力,支持 Responses API 和 Codex 接入。正式版定价为 3 元/百万 Token 输入、6 元/百万 Token 输出,缓存命中输入低至 0.025 元。基准测试显示,其在终端 Agent 测试 TerminalBench 得分 87.9 分,逼近 Fable 5 的 88.0 分,在 CyberGym、AutomationBench 等智能体评测上甚至反超 Fable 5。
阿里首次开源 Qwen-Max 级权重:Qwen3.8-2.4T-A95B
阿里 Qwen 团队宣布首次开源 Max 级旗舰模型权重 Qwen3.8-2.4T-A95B:总参数 2.4 万亿、每 Token 激活 95B,原生支持 262,144 Token 上下文并可扩展至约 100 万。模型延续 Qwen3.5 混合 MoE 架构(512 专家/激活 10 路由+1 共享),重点提升编程、办公、科研和长周期 Agent 任务端到端能力,云端版 Qwen3.8-Max 额外支持视觉输入与非思考模式。
英伟达发布首款开源模型 Nemotron 3.5 Lightning,专为 Agent 设计
英伟达推出最新大模型 Nemotron 3.5 Lightning,这也是黄仁勋公开表态支持开源后英伟达发布的首款开源模型。该模型轻量高效,可在普通笔记本或台式机单块 GPU 上流畅运行,专为智能体应用研发,通过蒸馏技术获得接近更大规模 Nemotron 系列模型的能力。模型已在 HuggingFace 及官网免费上线,全球开发者可自由下载、使用和修改。
SpaceX AI 发布 Grok 4.6,性能追平第一梯队
马斯克旗下 SpaceX AI 正式发布 Grok 4.6,重点提升长时间运行的 Agent 以及更复杂的交互和视觉任务,在 Artificial Analysis 智能指数拿到 61 分,与 GPT-5.6 Sol 持平、仅低于 Fable 5 的 62 分。定价方面,Grok 4.6 每百万输入/输出 Token 分别为 2 美元和 6 美元,输出价格仅为 GPT-5.6 Sol(5/30 美元)的五分之一,性价比直逼第一梯队。
国产算力”芯模协同”破局:华为昇腾适配 DeepSeek、燧原携手腾讯混元
上观新闻报道,国产大模型上下游告别单打独斗、加速共融生态。华为昇腾超节点全系列产品早已支持 DeepSeek V4,实现芯模同步优化;燧原科技与腾讯混元 Hy3 从设计阶段即投入联合研发,实现底层软硬件双向同步迭代,输入百万 Token 成本仅 1 元。芯模协同正从硬件层面撕开英伟达 CUDA 生态壁垒,国产算力从”可用”迈向”好用盈利”。
商汤大装置日均 Token 达 2.4 万亿,毛利率转正超 20%
商汤科技大装置事业群总裁杨帆透露,截至 7 月底商汤 AI 基础设施日均 Token 调用量达 2.4 万亿,若年底达成日均 10 万亿目标,全年服务规模将实现 25 倍增长;大装置已实现 20% 以上正向毛利率。商汤顺势推出自动化迁移工具,支持从英伟达生态近乎零成本迁移至国产芯片,并联合寒武纪、沐曦等近 20 家伙伴发起”银河计划”,共建 5 个万卡级国产智算集群。
无问芯穹跨 4000 公里算力集群协同训练验证成功,Token 成本一年降 10 倍
AI 原生基础设施公司无问芯穹披露,其 Agentic MaaS 平台日均 Token 调用量增长超 40 倍,超 95% 增量需求来自智能体。公司联合中国电信在新疆哈密—深圳两个算力集群间,成功验证跨 4000 公里超远距离跨域集群协同训练;首创跨集群异构 PD 分离架构,已在全球首次实现 6 种国内外芯片混合训练、算力利用率推高至 97% 以上,近一年 Token 成本削减 10 倍。
腾讯 Q2 财报:算力预付 514 亿元,AI 新业务经营亏损 105 亿元
腾讯 2026 年 Q2 财报显示,总营收 2047.85 亿元同比增长 11%,净利润 579.77 亿元;自由现金流 -138 亿元,剔除算力采购预付款后为 376 亿元,推算单季算力预付达 514 亿元。马化腾称本季度大幅增加算力采购,新增算力优先用于自研 Hy 模型训练与 AI 应用拓展,Hy4 计划近期上线。财报披露,五大”新 AI 产品”(Hy、元宝、CodeBuddy、WorkBuddy、小微)本季带来 105 亿元经营亏损。
微信原生 AI 助手”小微”开启灰度测试,渗透 16 个入口
腾讯 Q2 财报电话会披露,微信原生 AI 助手”小微”开启灰度测试,渗透微信从聊天页面到朋友圈的 16 个入口,主模型为自研 WeLM、部分回答结合 DeepSeek 完成。办公智能体应用 WorkBuddy 单月访问量突破 2000 万次保持国内第一,Hy3 较预览版智能体和代码能力提升 20-30%,OpenRouter Token 消耗量持续位列全球前三。
月之暗面与阿里达成约 2 万张英伟达芯片算力协议
据彭博社报道,月之暗面与主要投资者阿里巴巴达成算力协议,可使用约 2 万枚英伟达芯片组成的算力集群,占 Kimi 系列模型总算力相当大一部分。阿里作为最大互联网大厂投方累计投资 8 亿美元,按最新估值对应约 50 亿美元,账面获利约 42 亿美元。该消息曾推动阿里巴巴港股早盘涨超 7%,也再度凸显高端算力对中国 AI 厂商的持续重要性。
月之暗面冲刺港股:Pre-IPO 目标估值 500 亿美元
证券时报报道,月之暗面资本化节奏显著提速,已向全体股东下发港股上市决议草案、征集投票支持,同步与高盛、中金推进保荐洽谈,并行开展境外 VIE 红筹架构拆除,筹备最快 6 个月内完成港股 IPO。Pre-IPO 轮目标投前估值 500 亿美元,8 月正式启动融资谈判。支撑估值的是商业化指标:ARR 4 月突破 2 亿美元、6 月增至 3 亿美元,两个月收入增幅达 50%。
DeepSeek 推进新一轮融资,投前估值至少 4800 亿元
据报道,DeepSeek 已开始与潜在投资者接触,目标投前估值至少 4800 亿元,计划至少再募集 100 亿元,主要用于建设自有数据中心、采购更多 AI 芯片及布局 AI 智能体。此前 5 月底 DeepSeek 完成首轮融资约 70 亿美元、投后估值 520 亿美元,刷新国产大模型估值纪录,创始人梁文锋个人出资约 200 亿元为最大单一出资方。
智谱启动 314 亿港元配售融资,超六成投入自研芯片
国产大模型掀起融资热潮,智谱启动大规模股份配售计划融资约 314 亿港元,创国产大模型融资纪录,同时推进 A 股再融资 150 亿元构建”A+H”架构。智谱已启动定制 AI 处理器评估,计划将募资超六成投入芯片研发,打造适配行业大模型的专用算力芯片。商汤、科大讯飞等也分别完成 32.47 亿港元配售与 40 亿元定增,资本密集加码算力与模型研发。
上海:明年自主可控智算比例超 70%,国产算力生态加速成形
上观新闻报道,上海智能算力占全国比重达 8%,到明年自主可控智算比例要超过 70%,产业与政策双轮驱动下,国产大模型上下游正前所未有地拥抱共融生态。业内共识是,智能体应用爆发带来的推理算力需求将是训练算力的十倍乃至百倍,无问芯穹等企业正以”芯模协同 + 算力精调”双利器,构建与英伟达平行的独立生态。
