【每日AI资讯】2026年08月25日

今天是2026年8月25日,国际国内AI领域动作频频:英伟达推理芯片全面投产、国内大厂AI办公与机器人赛道融资火热、开源生态与AI基础设施并购升温。以下为您梳理今日重点资讯。

1. 英伟达 Groq 3 LPX 全面投产,Vera Rubin 每 Token 成本最高降 35 倍

英伟达宣布面向 AI 推理的 Groq 3 LPX 全面投产,并公布新一代 Vera Rubin 平台最新性能数据。在 DeepSeek V4 Pro 模型测试中,Vera Rubin NVL72 每兆瓦吞吐量最高达上一代 GB300 NVL72 的 30 倍,每 Token 成本最高降低 35 倍;Groq 3 LPX 在 Gemma 4 31B 模型、10 万 Token 上下文测试中达到每秒 3400 个输出 Token,主打低延迟推理。此外,SpaceXAI 计划将优化版 Vera Rubin NVL72 用于首代 Starmind AI 卫星,把 AI 算力从地面数据中心延伸至轨道计算。

来源:每日经济新闻

2. 字节跳动正式发布”豆包工作”,AI 办公 Agent 入口战开打

8月25日,字节跳动正式发布面向生产力场景的 Agent 产品与品牌”豆包工作”,整合 Coze、TRAE 及办公 Agent 能力,支持文档、表格、PPT、图片、视频、网页等多内容生成与编辑,并与飞书深度打通,可调用聊天记录、文档、会议纪要等企业上下文,继承飞书权限与审计体系。国内桌面端 AI 原生办公智能体 6 月总访问量已突破 6000 万次,腾讯 WorkBuddy、阿里”千问办公”、字节”豆包工作”三强卡位,AI 办公入口竞争全面升级。

来源:科创板日报

3. 小鹏机器人首轮融资超 9 亿美元,刷新中国具身智能纪录

小鹏披露旗下机器人业务完成首轮超 9 亿美元私募股权融资,投后估值超 63 亿美元(约 430 亿元),由 IDG 资本领投、高榕创投参投,腾讯与阿里巴巴战略入局,创国内具身智能行业单轮私募股权融资纪录。小鹏计划推动 IRON 人形机器人于 2026 年底规模量产,2027 年面向零售、服务等行业客户销售;Robotaxi 业务计划 2027 年实现无安全员载客运营。

来源:每日经济新闻

4. Hugging Face 传探索出售,估值或超 130 亿美元

据外媒报道,全球最大 AI 开源社区 Hugging Face 正探索潜在出售,交易估值可能超 130 亿美元,已聘请银行接触买家,讨论仍处早期。公司成立于 2016 年,汇集超 300 万个模型与 100 万个数据集,是开发者分发入口与开源 AI 生态的核心基础设施。此前支付巨头 Stripe 刚以超 80 亿美元收购模型路由平台 OpenRouter,显示 AI 价值正快速向模型之外的中间层平台扩散。

来源:腾讯研究院 AI 速递

5. 阿里 800 亿港元配售落地,港股史上最大增发全部投入 AI

阿里巴巴拟配售 7.1 亿股新股,募资约 800 亿港元(约 686 亿元),为 2019 年港股上市以来首次配售,净额 100% 投入全栈 AI 能力与基础设施建设,创港股史上最大后续股票发行纪录。蔡崇信、吴泳铭合计增持约 1.2 亿港元托底。阿里同步发布 Wan3.0 视频生成模型,支持最长 30 秒原生视频、1080p 分辨率、单次生成含音频,并可输入 PDF、幻灯片等多类文档。

来源:腾讯新闻·AI行业日报

6. Stripe 收购 OpenRouter,AI 基础设施并购升温

美国支付巨头 Stripe 确认收购 AI 模型聚合平台 OpenRouter,交易估值超 70 亿美元,成为 2026 年 AI 基础设施领域最大并购案之一。OpenRouter 成立于 2023 年,仅约 50 名员工,连接 80 多家供应商和 500 多个模型,月处理超 200 万亿 Token。这笔交易显示 AI 生态中间层正成为战略买家竞逐的焦点,Stripe 有望成为金融、AI 和数据基础设施合一的超级平台。

来源:腾讯新闻·AI大战每日速览

7. DeepSeek 发布多模态实验模型,首次补齐视觉能力

DeepSeek 在 API 平台上线实验性视觉理解模型 deepseek-v4-flash-vision-exp,首次为 V4 系列补齐图片输入能力,支持 JPEG/PNG/GIF/WebP 图像输入,视觉 Agent 基准接近 Claude Opus 4.8 水平,文本能力与 V4-Flash 正式版持平。图片按最多 384 Tokens 计费,无额外视觉附加费,价格与 V4-Flash 一致,较同类便宜近 20 倍。同步推出 Files API,开发者可上传图片后通过 file_id 跨请求复用。

来源:今日头条·AI新闻日报

8. 智谱发布 GLM-5.3,编程与安全能力逼近 Claude

智谱发布旗舰模型 GLM-5.3,使用与 GLM-5.2 相同的底座,主要通过更大规模后训练增强复杂编程、长程任务和网络安全能力。在 CyberGym 漏洞识别基准得分 84.5% 居首,超越 Anthropic Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%);在 269 个真实项目中识别出 2436 个漏洞,含 1097 个中高危。

来源:今日头条·AI新闻日报

9. 小米自研大模型加速芯片玄戒 O100 亮相

小米发布会上,玄戒 O100 端侧大模型加速芯片正式亮相,采用 6nm 3D 晶圆级堆叠方案,带宽达 1.22TB/s,运行端侧模型推理速度最高 330 Tokens/s;同场发布的 D100 为国内首款 3nm 智驾芯片,可本地运行 200B 参数大模型。AI 算力正从”集体采购 GPU”向”GPU + 自研 ASIC 异构计算”升级。

来源:21世纪经济报道

10. OpenAI 再降价并推出 ChatGPT Work,大模型价格战担忧升温

OpenAI 宣布 GPT-5.6 Sol 输出价降至每百万 Token 20 美元,不到一个月内第二次降价;谷歌 Gemini 3.7 Flash 以半价首发,Anthropic 取消原定涨价。分析认为开源模型挑战正迫使闭源厂商降价。同时 OpenAI 推出 ChatGPT Work(每月 20 美元),通过邮件、Slack 等工具把 Agent 能力推向会计师、医生、投资人等非技术用户,AI 商业模式从模型能力竞争转向性价比与落地效果比拼。

来源:环球网

以上为今日 AI 资讯精选,信息来源于公开报道,仅供参考。明日见!

【每日AI资讯】2026年08月25日

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Scroll to top
Copyright © 2026 Claude Code实战记录. 粤ICP备19017554号