🤖 AI 新闻日报 – 2026年08月26日
2026年08月26日 · 自动生成
🚀 模型与产品发布
OpenAI 首颗自研推理芯片 Jalapeño 实测成绩公布,每瓦性能超英伟达 GB300 最高 1.9 倍
8月25日,OpenAI 在 Hot Chips 2026 大会公布首款自研推理 ASIC 芯片 Jalapeño 的实测成绩。在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型上,Jalapeño 每瓦峰值吞吐量较英伟达 GB200/GB300 提升 1.5–1.9 倍,端到端延迟降低 1.7–3.6 倍,每百万 Token 成本最高降低 60%。芯片由 OpenAI 与博通联合开发、台积电 3nm 制程代工,从设计到流片仅 9 个月,计划 2026 年底小规模部署。
英伟达下一代 Vera Rubin 平台首测:DeepSeek V4 Pro 吞吐量暴涨 30 倍
英伟达在 Hot Chips 2026 首次公布下一代机柜 Vera Rubin NVL72 的片上实测数据。运行 DeepSeek-V4-Pro 执行 AgentX 智能体编码任务时,每兆瓦吞吐量较现役 GB300 NVL72 最高提升 30 倍,每百万 Token 成本最高暴降 35 倍。英伟达同时宣布推出首款 Agent 专用 Vera CPU(88 核 Olympus 架构),已被 SpaceX AI 规模化部署。性能跃升来自分离式服务、KV 感知路由、NVFP4 量化与第六代 NVLink 的协同设计。
苹果发布全新 Mac mini:首发 2nm M6 芯片,AI 性能最高达 M4 版 4 倍
8月25日晚,苹果官网更新发布搭载 M6 与 M5 Pro 芯片的全新 Mac mini 及 Mac Studio。M6 是苹果首款 2nm 制程芯片,配备 12 核 CPU、12 核 GPU 及双 16 核神经网络引擎,AI 性能最高达 M4 版 4 倍。实测在 LM Studio 运行大语言模型时,提示词处理速度达 M1 版 13.5 倍、M4 版 4.8 倍。国行起售价 6999 元,9 月 22 日正式发售。
Meta 发布 Muse Code 自主编程 Agent,内部测试减少 40% Bug 积压
Meta 推出 Muse Code,一款具备代码库级解析、单元测试编写和多文件重构能力的自主 AI 软件工程 Agent。该 Agent 在隔离的 Docker 沙箱中动态验证代码修改,通过蒙特卡洛树搜索的双循环规划架构确保高代码精度。Meta 内部工程试验显示,Bug 积压解决时间缩短 40%。
字节豆包发布「豆包工作」Agent 产品,AI 办公「四巨头」格局正式形成
8月25日,字节跳动旗下豆包推出面向生产力场景的 Agent 产品「豆包工作」,与飞书深度打通,可调用聊天、文档等上下文。此前 TRAE、扣子团队已并入豆包体系。至此,阿里、腾讯、百度、字节四巨头的 AI 办公竞争格局正式形成,Agent 能力将成为企业级市场的核心决胜因素。
🇨🇳 中国 AI 动态
中国开源 AI 模型全球使用率首次超越闭源模型,DeepSeek 连续三周调用量第一
据 OpenRouter 最新数据,8 月 22 日开源模型使用率达 62%,首次超过闭源模型的 38%。中国模型占据全球调用量前五中的四席,DeepSeek-V4-Flash 连续三周位居榜首。法律 AI 独角兽 Harvey 以 Kimi K3 为底座发布模型 Tenet,Cursor、Devin 等美国主流 AI 产品也纷纷采用 DeepSeek 或 Kimi 作为底层模型,中国开源模型正从「追跑」转向「领跑」。
法律 AI 独角兽 Harvey 采用 Kimi K3 做底座,中国模型进入美国 AI 产品供应链
法律 AI 独角兽 Harvey 发布首个基于开放权重后训练的模型 Tenet,以 Kimi K3 为基座,面向长时执行、连续调用工具的法律任务,LAB 基准完成数近底座两倍。通用模型能回答法律知识却难以完成真实法律任务,Harvey 选择用现成开放模型再加工。Cursor、Devin、Cosine 乃至 Thinking Machines 纷纷采用 Kimi 或 DeepSeek,中国开源模型正以底座、合成数据等形式进入美国 AI 产品供应链。
DeepSeek 上线 V4-Flash-Vision-Exp 视觉理解模型,完善 V4 产品矩阵
8月25日,DeepSeek 推出 V4-Flash-Vision-Exp 视觉理解模型,原生支持图片输入,可识人、读截图、看图表,并同步更新 Harness 至 v0.1.1-rc.1 提供官方支持。同时 V4-Pro 峰谷定价生效,高峰时段输出价涨至 27 元/百万 Tokens,标志着行业从低价抢客转向价值定价。
📊 行业与市场竞争
Ilya 旗下 SSI 新模型或于 8 月亮相,投资人称为「今年最重要的模型发布」
a16z 合伙人 Casado 预告获得一款新模型访问权限,称其为「今年最重要的模型发布」,多方线索指向 Ilya Sutskever 旗下 SSI 的首款模型。传闻焦点为基于 TTT(测试时训练)的持续学习突破——模型可在推理过程中实时更新部分权重,实现「边用边学」。若攻克灾难性遗忘,大模型训练与部署范式或被重写。SSI 以无收入之姿完成约 30 亿美元融资,估值达 320 亿美元。
高盛合伙人警告:过度依赖 AI 或造成「认知萎缩」,侵蚀华尔街学徒文化
高盛机构客户数字平台 Marquee 负责人 Chris Churchman 在播客中表示,过度依赖 AI 可能让人逐渐丧失独立推理能力。他担忧 AI 正接管初级员工的基础工作,侵蚀华尔街「学徒文化」,并透露压力测试中系统曾坦言「更擅长听起来严谨,而不是真正严谨」。
💰 投资资讯
阿里巴巴 800 亿港元配售落地,三年 AI 投资计划或上调至 4800 亿元
阿里巴巴 800 亿港元港股配售完成落地,加码 AI 基础设施投资。阿里此前提出三年超 3800 亿元的云和 AI 投资计划,截至 2026 年 6 月末已累计投入 1900 亿元。管理层明确表示实际投入将远超 3800 亿元,市场预期最终总规模可能上调至 4800 亿元。横向对比,腾讯上半年资本开支 847 亿元,字节跳动将全年 AI 投入上调 25% 至 2000 亿元,百度全年云和 AI 开支约 400–500 亿元。
月之暗面 Pre-IPO 目标估值 500 亿美元,最快六个月内赴港上市
月之暗面(Moonshot AI)7 月完成超 35 亿美元 F 轮融资,投后估值涨至 350 亿美元。因认购金额超出原定目标 3 倍有余,原定 8 月启动的 Pre-IPO 轮(G 轮)已提前开始,投前估值升至 500 亿美元。公司年内已完成 6 轮融资,累计融资额超 376 亿元人民币。同时,阿里被曝向月之暗面提供约 2 万枚英伟达芯片算力支持。
英伟达联手六大华尔街机构筹建 5000 亿美元 AI 算力融资平台
英伟达正式官宣与阿波罗、贝莱德、黑石、高盛、KKR 等全球顶级资本机构签署合作谅解备忘录,规划搭建独立 AI 算力融资平台,整体动员超 5000 亿美元第三方资本,专项用于全球 AI 算力基础设施建设。资金将重点投向高端算力集群搭建、AI 数据中心扩容与算力调度体系优化。此外,英伟达还被曝将以逾 300 亿美元估值投资 Perplexity。
字节跳动重组 ToB 业务:飞书团队并入豆包、GTM 并入火山引擎
8月7日,字节跳动重组 ToB 业务架构:飞书团队并入豆包体系,GTM(市场进入)团队并入火山引擎。这一调整标志着字节从多线并行转向单点突破,将办公 AI、模型能力和云基础设施全面整合,以应对与阿里、腾讯、百度在企业级 AI 市场的激烈竞争。
🏛️ 政策与生态
中消协提醒:AI 客服不能以「人工智能自动生成」为由逃避责任
中国消费者协会 8 月 25 日发布提醒,部署 AI 客服工具的经营者不能以「人工智能自动生成」「系统自动回复」等为由逃避责任。中消协指出,部分 AI 客服存在价格说明与实际不一致、优惠规则解释不准确等问题,敦促经营者建立责任承接机制并提供便捷人工客服。
