🤖 AI 新闻日报 – 2026年09月09日
2026年09月09日 · 自动生成
苹果举行9月发布会,新CEO Ternus上任8天首秀
苹果今日举行9月发布会,这是新任CEO John Ternus 9月1日上任后的首次公开发声。预计发布iPhone 18 Pro及传闻中的iPhone Ultra、Apple Watch Series 12与Ultra 4、折叠屏新品,以及Apple TV升级版——看点在于Siri是否能成为真正的智能家居中枢。苹果仍是唯一没有自研前沿大模型的大型科技公司,且与最重要的AI合作伙伴OpenAI存在诉讼纠纷,10月1日将开庭。
DeepSeek V4.1-Flash开启内测:原生多模态,速度更快
DeepSeek V4.1-Flash悄然开启中间版本内测。该版本采用全新模型结构,原生支持多模态能力,具备更强、更快、成本更低的特点,当前计费与V4-Flash相同。此前8月21日,DeepSeek上线多模态视觉理解模型V4-Flash-Vision-Exp,多模态Agent能力大幅提升;8月13日开发者工具DSH v0.1开放测试,在GitHub狂揽超7万颗星。
Arm发布新一代数据中心CPU Neoverse CSS N4
9月8日,Arm推出新一代数据中心CPU计算子系统Neoverse CSS N4,单颗芯片最高128核,性能最高提升2倍。同时披露首款自研服务器CPU Arm AGI CPU,最多136核、TDP 300W。在中国,火山引擎正基于AGI CPU构建下一代云服务,新紫光集团也将合作涵盖AGI CPU和Arm CSS。Arm数据中心权利金收入同比增长超1倍,Neoverse全球累计出货突破15亿颗核心。
国产大模型开源提速,进入工程化落地周期
9月9日证券日报报道,国产大模型密集上新且越来越多选择开源:面壁智能9月8日开源MiniCPM5-2B,阿里旗舰Qwen3.8-Max首次开放权重,智谱发布GLM-5.3,腾讯混元开源Hy4 preview。国家数据局数据显示,2026年6月我国日均词元调用量激增至近175万亿,稳居全球第一。OpenRouter平台开源模型处理词元占比从1月34%升至6月65%。头部厂商定价集体下探:Qwen3.8-Flash仅1元/百万词元,混元Hy4输入6元/百万词元。
供应链AI应用加速落地,采购周期缩短超50%
9月9日,中国物流与采购联合会发布《中国供应链发展报告(2025-2026)》,显示2025年我国供应链领域AI应用加速落地,生成式大模型、机器视觉、智能体、具身智能协同演进。采用智能采购的企业采购效率提升30%以上,采购周期缩短50%以上,物流供应链AI渗透率超37%。报告认为AI正从概念验证走向规模化商用。
重庆获批建设国家人工智能产业创新应用先导区
工信部近日批复重庆建设国家人工智能产业创新应用先导区。重庆已建成全国首个具身智能开源社区,培育基础级智能工厂1395个,城市治理大模型调用量超7100万次。未来将聚焦智能网联新能源汽车、具身智能等特色产业先行先试,打造西部AI产业高地。
算力涨价潮倒逼AI行业深度转型
9月9日经济日报刊文指出,高端GPU、存储芯片到云端推理服务全线涨价,头部云厂商相关服务最高涨幅超三成,中型AI应用服务商承压最重。业内认为这轮涨价将持续一年以上,行业正从”算力驱动”转向”效率驱动”,国产算力生态与”词元出海”成为新机遇。模型能力提升正在拓展AI应用空间,企业和用户也更加重视使用成本与投入产出比。
存储芯片严重短缺,明年AI基建投资将达1.3万亿美元
韩国券商KB Securities分析认为,随着AI基础设施投资以前所未有速度扩张,存储芯片市场面临严重供应短缺,三星电子、SK海力士库存已不足10天供应量。KB证券预计明年全球头部云服务商AI相关投资将达1.3万亿美元,同比增长60%。存储芯片在AI基建投资中的占比从去年14%升至今年的40%,明年将升至57%。苹果与铠侠正协商3至5年NAND闪存长约,且可能不设价格上限。
ChatGPT Ads广告业务200天突破10亿美元年化收入
OpenAI旗下ChatGPT Ads广告业务在上线200天后年化收入突破10亿美元,标志着AI助手的商业化路径正从订阅模式向广告变现拓展。与此同时,OpenAI企业业务收入已首次超过消费端,B端成为主战场。Gartner预测2026年全球AI支出将达2.59万亿美元,其中超1万亿美元用于软件、服务、网络安全和模型。
NVIDIA确认129.3亿美元收购Hugging Face,掌控开源模型生态
NVIDIA已确认以129.3亿美元收购Hugging Face,交易已达成。Hugging Face托管超过300万个公开AI模型、50万个数据集、100万个应用,拥有1800万开发者和超20万家企业用户。黄仁勋承诺平台保持开放且不要求使用NVIDIA算力,但业界关注AMD和Intel路径是否仍保持一等地位。这笔交易是2026年全球AI赛道金额最高的收购,英伟达从芯片层延伸至开源模型分发层。
法国Mistral AI完成30亿欧元D轮融资,估值超210亿欧元
9月8日,法国AI公司Mistral宣布完成30亿欧元(约合234亿元人民币)D轮融资,投后估值超210亿欧元,为欧洲科技公司迄今最大单轮股权融资。本轮由三星电子领投,EQT和PSG Equity共同领投,ASML、英伟达等跟投。资金将用于扩大前沿模型研究、提升算力及加速商业拓展。Mistral成立于2023年,业务已覆盖20个国家,为空客等超125家企业提供AI转型支持。
OpenAI采购马来西亚AI工厂算力,总容量超900兆瓦
9月8日,澳大利亚AI基础设施企业Firmus宣布与OpenAI达成多年期合作,OpenAI将采购其马来西亚两座AI工厂的专用算力并成为锚定客户,合作不涉及股权或合资。Firmus称已签约总算力容量超900兆瓦,在澳大利亚、新西兰、印尼、马来西亚拥有7座AI工厂,其中2座已运营、5座在建。这标志着OpenAI算力布局进一步向东南亚扩展。
四川首笔”Token算力场景”贷款投放,AI融资开辟新路径
9月8日,中国工商银行成都分行为成都高新区一家高新技术企业发放四川首笔”Token算力场景”贷款。与传统依赖房产、设备抵押的贷款不同,此次银行评估企业信用的核心依据是一张”算力账单”。Token(词元)是大模型处理、生成信息的最小计量单位,业内将其比作”AI时代的电费”。该笔贷款的成功投放,标志着算力资产在金融信贷领域取得实质性突破。
工信部部署万卡智算集群与国产算力芯片适配
9月8日消息,工信部印发相关规划,提出加快全国一体化算力网建设,构建”枢纽—区域—边缘”多层次算力设施体系,有序部署万卡、十万卡及以上智算集群,部署400G及以上高速传输技术,加大国产算力芯片适配。政策落地带动A股算力产业链情绪回暖,机构同步上修光模块等市场规模预期。信息通信”十五五”规划明确智能算力规模从2025年1590 EFLOPS跃升至2030年9800 EFLOPS,五年六倍增长。
全国首个数字法治AI整体解决方案”法仪大模型”发布
9月8日,司法部人工智能研究与应用重点实验室与北京市司法局联合发布全国首个数字法治人工智能整体解决方案”法仪大模型应用”。该模型由北京市司法局联合中科大脑等8家企业研发,落地12个场景化成果,功能输出精准度超90%。已在北京各级司法行政机关深度应用,累计办理业务20万次,并入选2026服贸会”北京方案展”。
