AI 新闻日报 – 2026年08月13日

🤖 AI 新闻日报 – 2026年08月13日

2026年08月13日 · 自动生成

🚀 模型与产品发布
模型发布AI硬件

DeepSeek V4 Pro 正式版 API 上线,Agent 能力大幅增强

8月13日,DeepSeek V4 Pro 正式版更新至 API,调用模型名不变,新版本大幅增强 Agent 能力,支持 Responses API 和 Codex 接入。正式版定价为 3 元/百万 Token 输入、6 元/百万 Token 输出,缓存命中输入低至 0.025 元。基准测试显示,其在终端 Agent 测试 TerminalBench 得分 87.9 分,逼近 Fable 5 的 88.0 分,在 CyberGym、AutomationBench 等智能体评测上甚至反超 Fable 5。

🔗 原文链接

模型发布国产AI

阿里首次开源 Qwen-Max 级权重:Qwen3.8-2.4T-A95B

阿里 Qwen 团队宣布首次开源 Max 级旗舰模型权重 Qwen3.8-2.4T-A95B:总参数 2.4 万亿、每 Token 激活 95B,原生支持 262,144 Token 上下文并可扩展至约 100 万。模型延续 Qwen3.5 混合 MoE 架构(512 专家/激活 10 路由+1 共享),重点提升编程、办公、科研和长周期 Agent 任务端到端能力,云端版 Qwen3.8-Max 额外支持视觉输入与非思考模式。

🔗 原文链接

模型发布AI硬件

英伟达发布首款开源模型 Nemotron 3.5 Lightning,专为 Agent 设计

英伟达推出最新大模型 Nemotron 3.5 Lightning,这也是黄仁勋公开表态支持开源后英伟达发布的首款开源模型。该模型轻量高效,可在普通笔记本或台式机单块 GPU 上流畅运行,专为智能体应用研发,通过蒸馏技术获得接近更大规模 Nemotron 系列模型的能力。模型已在 HuggingFace 及官网免费上线,全球开发者可自由下载、使用和修改。

🔗 原文链接

模型发布

SpaceX AI 发布 Grok 4.6,性能追平第一梯队

马斯克旗下 SpaceX AI 正式发布 Grok 4.6,重点提升长时间运行的 Agent 以及更复杂的交互和视觉任务,在 Artificial Analysis 智能指数拿到 61 分,与 GPT-5.6 Sol 持平、仅低于 Fable 5 的 62 分。定价方面,Grok 4.6 每百万输入/输出 Token 分别为 2 美元和 6 美元,输出价格仅为 GPT-5.6 Sol(5/30 美元)的五分之一,性价比直逼第一梯队。

🔗 原文链接

🇨🇳 中国 AI 动态
国产AIAI硬件

国产算力”芯模协同”破局:华为昇腾适配 DeepSeek、燧原携手腾讯混元

上观新闻报道,国产大模型上下游告别单打独斗、加速共融生态。华为昇腾超节点全系列产品早已支持 DeepSeek V4,实现芯模同步优化;燧原科技与腾讯混元 Hy3 从设计阶段即投入联合研发,实现底层软硬件双向同步迭代,输入百万 Token 成本仅 1 元。芯模协同正从硬件层面撕开英伟达 CUDA 生态壁垒,国产算力从”可用”迈向”好用盈利”。

🔗 原文链接

国产AIAI硬件

商汤大装置日均 Token 达 2.4 万亿,毛利率转正超 20%

商汤科技大装置事业群总裁杨帆透露,截至 7 月底商汤 AI 基础设施日均 Token 调用量达 2.4 万亿,若年底达成日均 10 万亿目标,全年服务规模将实现 25 倍增长;大装置已实现 20% 以上正向毛利率。商汤顺势推出自动化迁移工具,支持从英伟达生态近乎零成本迁移至国产芯片,并联合寒武纪、沐曦等近 20 家伙伴发起”银河计划”,共建 5 个万卡级国产智算集群。

🔗 原文链接

国产AIAI硬件

无问芯穹跨 4000 公里算力集群协同训练验证成功,Token 成本一年降 10 倍

AI 原生基础设施公司无问芯穹披露,其 Agentic MaaS 平台日均 Token 调用量增长超 40 倍,超 95% 增量需求来自智能体。公司联合中国电信在新疆哈密—深圳两个算力集群间,成功验证跨 4000 公里超远距离跨域集群协同训练;首创跨集群异构 PD 分离架构,已在全球首次实现 6 种国内外芯片混合训练、算力利用率推高至 97% 以上,近一年 Token 成本削减 10 倍。

🔗 原文链接

🏭 行业与市场竞争
市场竞争投资资讯

腾讯 Q2 财报:算力预付 514 亿元,AI 新业务经营亏损 105 亿元

腾讯 2026 年 Q2 财报显示,总营收 2047.85 亿元同比增长 11%,净利润 579.77 亿元;自由现金流 -138 亿元,剔除算力采购预付款后为 376 亿元,推算单季算力预付达 514 亿元。马化腾称本季度大幅增加算力采购,新增算力优先用于自研 Hy 模型训练与 AI 应用拓展,Hy4 计划近期上线。财报披露,五大”新 AI 产品”(Hy、元宝、CodeBuddy、WorkBuddy、小微)本季带来 105 亿元经营亏损。

🔗 原文链接

市场竞争

微信原生 AI 助手”小微”开启灰度测试,渗透 16 个入口

腾讯 Q2 财报电话会披露,微信原生 AI 助手”小微”开启灰度测试,渗透微信从聊天页面到朋友圈的 16 个入口,主模型为自研 WeLM、部分回答结合 DeepSeek 完成。办公智能体应用 WorkBuddy 单月访问量突破 2000 万次保持国内第一,Hy3 较预览版智能体和代码能力提升 20-30%,OpenRouter Token 消耗量持续位列全球前三。

🔗 原文链接

💰 投资资讯
投资资讯国产AI

月之暗面与阿里达成约 2 万张英伟达芯片算力协议

据彭博社报道,月之暗面与主要投资者阿里巴巴达成算力协议,可使用约 2 万枚英伟达芯片组成的算力集群,占 Kimi 系列模型总算力相当大一部分。阿里作为最大互联网大厂投方累计投资 8 亿美元,按最新估值对应约 50 亿美元,账面获利约 42 亿美元。该消息曾推动阿里巴巴港股早盘涨超 7%,也再度凸显高端算力对中国 AI 厂商的持续重要性。

🔗 原文链接

投资资讯国产AI

月之暗面冲刺港股:Pre-IPO 目标估值 500 亿美元

证券时报报道,月之暗面资本化节奏显著提速,已向全体股东下发港股上市决议草案、征集投票支持,同步与高盛、中金推进保荐洽谈,并行开展境外 VIE 红筹架构拆除,筹备最快 6 个月内完成港股 IPO。Pre-IPO 轮目标投前估值 500 亿美元,8 月正式启动融资谈判。支撑估值的是商业化指标:ARR 4 月突破 2 亿美元、6 月增至 3 亿美元,两个月收入增幅达 50%。

🔗 原文链接

投资资讯国产AI

DeepSeek 推进新一轮融资,投前估值至少 4800 亿元

据报道,DeepSeek 已开始与潜在投资者接触,目标投前估值至少 4800 亿元,计划至少再募集 100 亿元,主要用于建设自有数据中心、采购更多 AI 芯片及布局 AI 智能体。此前 5 月底 DeepSeek 完成首轮融资约 70 亿美元、投后估值 520 亿美元,刷新国产大模型估值纪录,创始人梁文锋个人出资约 200 亿元为最大单一出资方。

🔗 原文链接

投资资讯国产AI

智谱启动 314 亿港元配售融资,超六成投入自研芯片

国产大模型掀起融资热潮,智谱启动大规模股份配售计划融资约 314 亿港元,创国产大模型融资纪录,同时推进 A 股再融资 150 亿元构建”A+H”架构。智谱已启动定制 AI 处理器评估,计划将募资超六成投入芯片研发,打造适配行业大模型的专用算力芯片。商汤、科大讯飞等也分别完成 32.47 亿港元配售与 40 亿元定增,资本密集加码算力与模型研发。

🔗 原文链接

📋 政策与生态
政策监管

上海:明年自主可控智算比例超 70%,国产算力生态加速成形

上观新闻报道,上海智能算力占全国比重达 8%,到明年自主可控智算比例要超过 70%,产业与政策双轮驱动下,国产大模型上下游正前所未有地拥抱共融生态。业内共识是,智能体应用爆发带来的推理算力需求将是训练算力的十倍乃至百倍,无问芯穹等企业正以”芯模协同 + 算力精调”双利器,构建与英伟达平行的独立生态。

🔗 原文链接