AI 日报 · 2026-09-01(周二)

聚焦方向:AI Coding(AI 编程)× 具身智能

生成时间:2026-09-01 07:30 (GMT+8)

今日结论速览:DeepSeek 今日有 D ✅(V4-Flash-Vision-Exp 多模态权重开源、拟募资 74 亿美元 / 估值 740 亿美元冲击 2027 科创板 IPO);AI Coding 侧最大变量是 xAI 发布 Grok Code Fast 1 编程模型并限时免费接入主流 IDE(Cursor/Copilot/Cline 等)与 OpenAI 内测 Codex「持久模式」(最长连续 25 小时自主编程);具身智能侧最大变量是 第二届世界人形机器人运动会闭幕并开放全量数据集(2500+ 小时)工信部"十五五"将具身智能列入 6 大未来产业

口径说明:每条均标注「时效」与「来源」。时效分 当日近 2 日本周;来源给出可核验主体。字幕类内容标注"字幕由平台自动生成"。

实时数据源:① 多引擎新闻检索 + Exa(中英文媒体/社区);② GitHub Search API(日榜/周榜双周期,2026-09-01 07:34 抓取);③ livebench.ai(2026-06-25 发布实时榜,含每成功任务成本)、artificialanalysis.ai(Intelligence Index v4.1.1,页面最后更新 8/30)、llm-stats.com(2026-09-01 实时榜,368 模型);④ B 站 UP 主字幕口径:黑鸦Heya(1 个视频 / 32 行字幕已提取)、Icyの狼(24h 有更新含资讯类《[狼狼快报] V4-Flash-Vision 实验版开源》)、无机酸-_-(24h 更新为个人测评作品,未引用结论)。


目录

章节内容条目数
社区信源监控(一手线索,快于媒体)3 个信源
DeepSeek 专项 —— 今日有 D ✅6 条
今日 15 条精选(AI Coding 8 + 具身智能 7)15 条
社区快讯(待验证 / 低置信度)7 条
能力评分与价格表(三口径交叉验证)3 张表 + 性价比
GitHub 当日趋势榜日榜 + 周榜
AI 社会效益6 条
AI 经济效益6 条
方法论与免责声明

一、社区信源监控(今日一手线索,快于媒体)

本节来自三个长期跟踪的社区信源。社区口播往往比媒体稿早 6–24 小时,但置信度低于官方渠道,因此本节只做"线索"用途,凡进入第三章「15 条精选」的内容均已用官方或权威媒体二次核验。

信源状态一览(含字幕提炼要点)

信源最新内容类型字幕字幕提炼要点时效
黑鸦HeyaAI日报0831(BV1k1t86FELv)资讯类✅ 已采集 32 行DeepSeek V4-Flash-Vision-Exp 权重开源(MIT)、Claude $200 Max「20倍用量」仅限 5 小时窗口、Codex/Tibo 澄清、智谱 GLM coding plan 额度 9/1 自动按 150% 延续、OpenCode 2.0(16000+ PR)、Hy4 preview 调用激增排队已扩容当日(约 12h 前)
Icyの狼[狼狼快报] V4-Flash-Vision 实验版开源(BV1AUt86cEoD)资讯类✖ 未提取标题印证 DeepSeek 多模态开源 +「期待第三方部署」;另有 7h 前 2 条(ds0831 灰测、生日个人向)当日(约 12h 前)
无机酸-_-DSV4FVE/OpenCode Go 测评(BV1aDth62EJ1)个人测评作品✖ 未开启字幕当日(约 7h 前)

1.1 黑鸦Heya —— AI日报0831(资讯类,字幕由平台自动生成)

从口播正文里提取到的实质信息(已做同音字校正,例如 "deep sick" → DeepSeek、"智浦" → 智谱、"open call or" → OpenCode、"z code" → ZCode),其中标题层看不到的增量(字幕提炼要点)包括:

  1. DeepSeek V4-Flash-Vision-Exp 权重正式开源:口播确认模型权重放出,系 V4 系列首个视觉多模态实验模型,采用原汁原味 MIT 许可证——开源许可对第三方部署与商用最为友好。
  2. Claude $200 Max「20 倍用量」争议:口播指出 Anthropic 官网表述的"20 倍用量"仅适用于 5 小时会话窗口,周限额仅约为 $100 套餐的 2 倍;截至口播 Anthropic 尚未发布专门公开回应("虚标"争议)。
  3. Codex 负责人 Tibo 转发澄清:Codex 的 20 倍适用于周限额且无 5 小时限制——说明争议集中在 Anthropic 套餐口径,Codex 侧无此限制。
  4. 智谱 GLM coding plan 生效:ZCode 额度原定 9/1 到期,官方在用户群宣布自动按 150% 计算延续,无需用户操作——国产 coding 模型的用户留存动作。
  5. OpenCode 2.0 更新:号称史上最大规模更新,含超 16000 个 PR,覆盖安装/记忆/浏览器/安全等所有部分,支持全新安装与现有版本升级。
  6. 腾讯 Hy4 preview 调用激增排队:混元 4 preview 在 workbench 调用激增导致排队,官方称已扩容——侧面印证国产开源模型发布后的真实需求热度。

来源:B 站 UP 主「黑鸦Heya」AI日报0831(BV1k1t86FELv),字幕由平台自动生成,本节为要点摘录与同音字校正后的转述。

时效:当日(约 12h 前)。置信度🟡 大概率属实(DeepSeek 多模态开源与 Hy4 preview 已由多源官媒交叉验证;Claude 套餐口径为口播线索,Anthropic 未专门回应,见第四章 Q1)。

1.2 Icyの狼 —— 24h 内有更新(含资讯类)

1.3 无机酸-_- —— 24h 有更新但为个人测评作品,未开字幕

社区交叉验证:黑鸦Heya 与 Icyの狼两个独立社区信源同日发出"DeepSeek V4-Flash-Vision-Exp 开源"资讯,叠加网易/智东西/腾讯研究院等多家官媒口径,构成「社区先报 + 媒体后证」的强闭环,是第二章判定今日有 D 的核心依据;黑鸦Heya 字幕另补足了 Claude 套餐口径争议、智谱 GLM coding plan、OpenCode 2.0 等媒体尚未集中覆盖的增量。


二、DeepSeek 专项 —— 今日有 D ✅(非"今日无D")

过去 24 小时(8/31–9/1)DeepSeek 侧信息密度高,不适用"今日无D"。核心事件为 V4-Flash-Vision-Exp 多模态权重开源(8/31 放权重、9/1 凌晨全网深度解读持续发酵),并有 74 亿美元融资 / 740 亿估值 / 2027 科创板 IPO 的重磅配套消息。

D1 · DeepSeek-V4-Flash-Vision-Exp 多模态权重开源(V4 系列首个视觉多模态实验模型)

D2 · DeepSeek 拟募资约 74 亿美元、估值 740 亿美元,目标 2027 上海科创板 IPO

D3 · DeepSeek-V4-Pro-0813 跌出全球大模型调用榜,智谱登顶

D4 · DeepSeek Harness v0.1 开发者框架持续发酵(GitHub 星标两日破 3 万)

D5 · 美国拟出台"远程算力管制"新规点名 DeepSeek

D6 · DeepSeek 预测足球赛事(存在性记录)


三、今日 15 条精选

甲组 · AI Coding(8 条)

1. xAI 发布 Grok Code Fast 1:低成本编程模型限时免费接入主流 IDE

2. 腾讯开源 Hy4 preview(770B / 1M 上下文):内部盲测优于 GLM-5.3 与 Kimi K3

3. 智谱 GLM-5.3 权重公开(753B):HuggingFace 开放 BF16/FP8

4. Claude Code 安全更新:阻断模型切换钩子 + 受限模式

5. OpenAI 内测 Codex「持久模式」:最长连续自主工作 25 小时

6. Cursor Cloud Agents:无需仓库即可新建项目 + 浏览器预览

7. Codex CLI 0.151.0:扩展可改写 MCP 工具结果

8. OpenAI 终止向 Cursor 供应模型(11/12 起生效,SpaceX 收购触发)

乙组 · 具身智能(7 条)

9. 第二届世界人形机器人运动会闭幕 + 全量数据集开放(2500+ 小时)

10. 工信部"十五五":具身智能列入 6 大未来产业

11. 宇树登陆科创板:"人形机器人第一股"

12. Figure 发布众包数据平台 Index:1600 万段视频、已付 1500 万美元

13. Figure 03 攀爬工业梯 + 预热消费级家用机器人

14. 宇树 R1 降价至 2.99 万 + "订单繁荣/交付冷清"复盘

15. A 股人形机器人产业链中报普遍报喜


四、社区快讯(待验证 / 低置信度)

以下条目来自社区讨论或单一信源,尚未获得官方或多方核验,仅作趋势参考,不建议作为决策依据。

#内容来源类型时效置信度
Q1Anthropic Claude $200 Max 套餐"20 倍用量"仅适用于 5 小时窗口、周限额约 $100 套餐 2 倍,官方未专门回应;Codex/Tibo 澄清 Codex 无此限制B 站字幕线索 + 社区讨论,Anthropic 未回应当日🔴 待验证
Q2OpenCode/OpenCode Go 2.0 更新:史上最大规模,超 16000 个 PR,覆盖安装/记忆/浏览器/安全B 站字幕线索 + 社区当日🟡 大概率属实
Q3智谱 GLM coding plan 生效,ZCode 额度(原定 9/1 到期)自动按 150% 延续B 站字幕线索 + 用户群当日🟡 大概率属实
Q4美国拟出台远程算力出口管制草案,DeepSeek 被列为目标之一媒体报道,草案未定稿本周🔴 待验证
Q5Kimi 冲刺港股 IPO财经媒体本周🟡 大概率属实
Q6长鑫 LPDDR6 进入量产产业链消息本周🟡 大概率属实
Q7腾讯 Hy4 preview 调用激增导致排队,官方称已扩容B 站字幕线索 + 官方动态当日🟡 大概率属实

另有社区口播提到的"某厂商推出用于评估和改进其他 Skill 的 Skill"(见上期),本期未获新核验,暂不单列。


五、截至今日 AI 多项能力评分表(三口径交叉验证)

三个口径的方法论差异很大,不可直接横向比较分值,只能各自看排序:

5.1 口径 A · LiveBench 实时榜(Top 20 / 共 50+ 款)

#模型综合推理编程Agent编程数学数据分析语言指令跟随每成功任务成本
1Claude Fable 5 Max83.089.786.062.296.080.590.775.8$1.439
2GPT-5.6 Sol Max81.091.783.956.296.279.887.771.8$0.515
3GPT-5.5 Thinking xHigh80.289.782.154.095.981.687.470.7$0.435
4Claude 5 Opus Thinking Max80.191.281.465.295.774.688.763.8$0.699
5Kimi K3 (开源)79.290.781.462.284.478.785.571.4$0.348
6Gemini 3.7 Flash High78.887.878.958.393.568.085.579.9$0.157
7Qwen 3.8 Max (开源)78.588.272.964.691.378.479.774.1$0.275
8Grok 4.678.090.576.857.092.673.983.771.9$0.207
9GPT-5.4 Thinking xHigh78.088.177.553.894.179.382.670.2$0.387
10Muse Spark 1.2 xHigh78.090.077.557.691.276.578.674.3$0.375
11GPT-5.6 Terra Max77.990.678.254.994.979.382.964.6$0.352
12DeepSeek V4 Pro 0813 (开源)77.485.877.254.995.179.282.167.7$0.044
13Gemini 3.1 Pro Preview High77.084.076.544.191.078.585.479.1$0.286
14DeepSeek V4 Flash Vision Exp (开源)76.885.468.265.187.879.580.471.0$0.051
15Claude 4.7 Opus Thinking xHigh76.587.282.150.792.978.377.966.7$0.528
16Claude 4.8 Opus Thinking Max76.289.281.850.594.366.079.772.0$0.983
17Qwen 3.8 Flash Next (开源)76.287.472.661.685.874.274.677.1$0.042
18GLM-5.3 (开源)76.185.879.060.987.970.279.969.3$0.450
19Claude Sonnet 5 xHigh76.088.780.759.492.971.775.063.9$0.505
20Grok 4.575.887.268.656.590.873.082.871.5$0.131

编程类单项拔尖(不看总分)Claude Fable 5 Max 编程 86.0 为全场最高;DeepSeek V4 Flash Vision Exp(#14)Agent 编程 65.1 是多模态模型中罕见的 Agent 编程高分,呼应第二章 D1 的"多模态 + Agent"路线。DeepSeek V4 Pro 0813 每成功任务成本 $0.044、V4 Flash Vision Exp $0.051,分别为榜首 Claude Fable 5($1.439)的 1/33 与 1/28——成本维度断层领先。Agent 编程是全场最弱环节:50 款里最高仅 Claude 5 Opus Thinking Max 的 65.2,中位数约 54,说明多语言 Agent 化编程仍是明确的能力洼地。

展开:开源模型在 LiveBench 的位置与每成功任务成本
#模型综合编程Agent编程每成功任务成本备注
12DeepSeek V4 Pro 081377.477.254.9$0.044开源最高,成本极低
14DeepSeek V4 Flash Vision Exp76.868.265.1$0.051多模态 Agent 编程拔尖
18GLM-5.376.179.060.9$0.450开源第一梯队
17Qwen 3.8 Flash Next76.272.661.6$0.042开源小尺寸
5Kimi K379.281.462.2$0.348开源综合最高
7Qwen 3.8 Max78.572.964.6$0.275开源
21GLM-5.3 Flash71.679.056.8$0.031编程 79.0 与旗舰持平,成本全场最低

关键发现GLM-5.3-Flash编程分 79.0 与旗舰 GLM-5.3 完全持平,但每成功任务成本仅 $0.031(全场最低),是纯编程任务的极高性价比选择。

5.2 口径 B · Artificial Analysis 智能指数(Top 24 / 共 250+ 款,v4.1.1)

#模型厂商智能指数吞吐(t/s)首字延迟(s)每任务成本
1Claude Opus 5 (max)Anthropic635659.51$2.34
1Claude Opus 5 (xhigh)Anthropic635426.68$1.80
3Claude Fable 5Anthropic626292.73$3.14
4Claude Opus 5 (high)Anthropic615420.31$1.23
4GPT-5.6 Sol (max)OpenAI6175153.94$0.95
4Grok 4.6 (high)SpaceXAI615942.59$0.94
7Grok 4.6 (xhigh)SpaceXAI605839.75$1.23
7Kimi K3 (max)Kimi60394.03$0.84
7GLM-5.3 (max)Z AI60671.63$0.68
10GPT-5.6 Sol (xhigh)OpenAI597952.39$0.63
10Grok 4.6 (medium)SpaceXAI595933.90$0.78
10Claude Opus 5 (medium)Anthropic59524.19$0.72
13Qwen3.8 MaxAlibaba58252.57$0.91
13Qwen3.8 2.4T A95BAlibaba58282.54$0.81
15GLM-5.3-FlashZ AI57491.50$0.09
15GPT-5.6 Sol (high)OpenAI577320.01$0.43
15Muse Spark 1.2 (xhigh)Meta57$0.40
15GPT-5.6 Terra (max)OpenAI57110143.38$0.53
19Gemini 3.7 Flash (high)Google563309.35$0.40
19Qwen3.8-Flash-NextAlibaba56802.79$0.10
19Grok 4.5 (high)SpaceXAI565314.51$0.43
23Claude Sonnet 5 (max)Anthropic5586207.94$1.72
24DeepSeek V4 Pro 0813 (max)DeepSeek53721.62$0.27
24Gemini 3.7 Flash (medium)Google533324.71$0.26

三个值得注意的读数

  1. GLM-5.3 以 60 分并列第 7,是开源模型最高位,且首字延迟仅 1.63 秒——同档模型里延迟优势巨大(Claude Opus 5 max 59.51s、GPT-5.6 Sol max 153.94s)。
  2. GLM-5.3-Flash 57 分 / 每任务 $0.09,与 GPT-5.6 Sol (high) 同分但成本约 1/5。
  3. 国产模型延迟集体占优:GLM 系 1.5–1.6s、DeepSeek 系 1.28–1.65s、Qwen 系 2.5–2.8s,而 Claude/GPT 顶配档普遍数十到 200 秒。交互式编程场景延迟权重远高于分数

5.3 口径 C · llm-stats 综合分 + 混合价(Top 15 / 共 368 款,2026-09-01)

#模型综合分混合价/M吞吐开源标记
1GPT-5.6 Sol56.8$7.78101 c/s
2Claude Opus 555.8$7.2264 c/s
3Claude Mythos Preview55.7未发布
4Claude Fable 555.3$14.44101 c/s最贵
5Kimi K354.6$4.3398 c/s
6GLM-5.354.2$1.7369 c/s
7DeepSeek-V4-Pro-081352.9$0.48122 c/s吞吐最高
8Qwen3.8 Max52.7$2.0264 c/s
9GPT-5.6 Terra52.2$3.11116 c/s
10Hy4 preview51.5NEW
11Claude Opus 4.851.5$7.2246 c/s
12GLM-5.3-Flash51.1$0.1985 c/sNEW
13Gemini 3.7 Flash50.5$1.08121 c/s
14Muse Spark 1.150.3$1.58256 c/s
15Qwen3.8-Flash-Next49.7NEW

前 15 名中开源模型占 5 席(Kimi K3、GLM-5.3、DeepSeek-V4-Pro-0813、GLM-5.3-Flash、Qwen3.8-Flash-Next),且全部来自中国团队;本期新增 Hy4 preview(腾讯)与两款 Flash 模型。

5.4 性价比表(Price vs Performance)

计算方式:LiveBench 综合总分 ÷ llm-stats 混合价($/M token)。数值越高越划算;末列为归一化占比(以榜首为 100%)。

GLM-5.3-Flash
376.8
71.6 / $0.19
DeepSeek-V4-Pro-0813
161.3
77.4 / $0.48
Gemini 3.7 Flash
73.0
78.8 / $1.08
Muse Spark 1.1
47.7
75.3 / $1.58
GLM-5.3
44.0
76.1 / $1.73
Qwen3.8 Max
38.9
78.5 / $2.02
Claude Sonnet 5
26.3
76.0 / $2.89
GPT-5.6 Terra
25.0
77.9 / $3.11
Kimi K3
18.3
79.2 / $4.33
Claude Opus 5
11.1
80.1 / $7.22
GPT-5.6 Sol
10.4
81.0 / $7.78
Claude Fable 5
5.7
83.0 / $14.44

结论


六、GitHub 当日趋势榜(开源生态风向标)

6.1 日榜要点(2026-09-01 07:34 抓取)

位次项目方向
#4openclawAgent 运行时
#7obra/superpowersAI Skill 生态
#10affaan-m/ECCAgent harness
#11NousResearch/hermes-agentAgent 框架
#13deepseek-ai/deepseek-harnessDeepSeek Agent 框架("Everything is a Plugin")
#15anomalyco/opencode编程 Agent

6.2 周榜要点

位次项目方向
#4openclawAgent 运行时
#8obra/superpowersAI Skill 生态
#11affaan-m/ECCAgent harness
#12mattpocock/skillsAI Skill 教程
#13NousResearch/hermes-agentAgent 框架
#15deepseek-ai/deepseek-harnessDeepSeek Agent 框架

6.3 解读

日榜前 15 里有 6 个是 Agent / AI 基础设施项目(openclaw、superpowers、ECC、hermes-agent、opencode,加上本期 #13 的 deepseek-ai/deepseek-harness),密度与上周持平,仍是近期高位。三点观察:

  1. 热度重心从"模型"转向"跑模型的壳"。榜单上没有模型仓库占据高位,占位的全是 harness、运行时、Skill 管理这类中间层——与第三章第 8 条(OpenAI 断供 Cursor)指向同一件事:Agent 执行层正在标准化,成为独立竞争战场
  2. Skill 生态出现"元工具"层。obra/superpowers 稳居日榜 #7 / 周榜 #8,配合社区口播提到的"用于评估和改进其他 Skill 的 Skill",说明 Skill 已多到需要工具治理 Skill 本身。
  3. deepseek-harness 重回升温(日榜 #13 / 周榜 #15),与第二章 D4 形成"模型 + Harness = Agent"闭环叙事;openclaw 日榜 #4 / 周榜 #4,是唯一双榜高位项目,热度具备持续性。

来源:GitHub Search API 实时抓取(日榜 / 周榜双周期,2026-09-01 07:34)。时效:当日。置信度✅ 已确认(Star 量级为抓取时快照,随时变动)。


八、AI 社会效益(对社会运行与公共福祉的影响)

8.1 具身智能进入消费补贴目录:江苏首次将机器人纳入以旧换新

8 月 28 日江苏省发改委、财政厅、商务厅联合发布通告,具身智能机器人(含人形机器人、外骨骼助力机器人、机器狗)首次被纳入消费品以旧换新补贴范围,补贴品类从原有智能家居扩展为十大类智能产品。消费者在享受商家优惠后,政府按最终销售价格 15% 给予补贴,每人每细分品类可补 1 件,每件不超过 1500 元。政策自 8 月 29 日实施至 2026 年 12 月 31 日。

意义:具身智能第一次以"消费品"身份进入公共财政补贴目录,标志其从产业投资标的转向家庭可购商品。江苏是全国首个推出地方自主品类补贴的省份,示范效应值得跟踪。

来源:江苏省三部门联合通告 / 新华日报。时效:本周(8/29 生效)。置信度✅ 已确认

8.2 养老照护成为具身智能最明确的社会需求出口

2026 数博会上,上海理工大学机器智能研究院执行院长、卓益得机器人创始人李清都表示,研发仿生机器人的初衷就是聚焦"近人服务"、重点做好养老照护,并给出务实路径:养老机器人可先切入下棋、健康监测等高成功率场景来释放护工精力。他同时提出机器人进家庭必须守好三道安全关——物理防伤人、信息防泄露、AI 触觉防损

意义:把"高成功率场景优先"和"三道安全关"讲清楚,比宣传参数更有公共价值。老龄化是具身智能最刚性的社会需求,也是容错率最低的场景。

来源:2026 中国国际大数据产业博览会 / 澳门日报(中新社)。时效:本周。置信度✅ 已确认

8.3 情感陪伴机器人进入家庭引发伦理关注,监管已划定红线

优必选情感陪伴机器人已售出 1.3 万台并走进家庭,引发伦理担忧。网信办等五部门出台《人工智能拟人化互动服务管理暂行办法》划定红线,企业正参与伦理标准制定;违规出海欧盟最高可罚 3500 万欧元

意义:拟人化交互是 AI 与社会摩擦最直接的界面。监管在装机量刚过万台时就介入,节奏快于多数技术周期。

来源:网信办等五部门规章 / 行业报道。时效:本周。置信度🟡 大概率属实(办法已出台,罚则口径为报道引述)。

8.4 高危场景替代人工,是具身智能当下最扎实的社会价值

数博会现场展示:南方电网机器狗负重 200 公斤、爬坡 60 度,替代人工进入高危复杂环境作业;四足巡检机器人自主上下楼梯、穿越障碍;具身智能白酒检测机器人数秒完成基酒液位高精度计量。云深处、宇树等企业的四足与轮腿机器人已参与灾害侦察与物资投送,应急管理部出台指导意见并设立 6 个攻关方向。

意义:相比家庭陪伴,高危环境替代的社会效益更明确、伦理争议更小、付费方更清晰。这是当前最不需要讲故事的落地方向。

来源:2026 数博会 / 应急管理部指导意见 / 澳门日报。时效:本周。置信度✅ 已确认

8.5 训练数据合规指引发布,为数据供给立规

《人工智能训练数据合规使用指引》发布,为训练数据的来源、授权与使用边界提供操作依据。结合第三章第 9 条提到的"真实场景数据集开放"趋势——真实场景采集会大量涉及第一视角行为数据与场所信息,合规框架的及时到位直接决定这条数据路线能不能走通

来源:相关主管部门发布。时效:本周。置信度🟡 大概率属实(指引已发布,细则适用范围待实践检验)。

8.6 AI 进课堂:教育科研社会效益的新增量

Anthropic 推出 Claude for Teachers / Claude for Education,并发布教育场景专用连接与校园项目;OpenAI 同步将 ChatGPT for Teachers 推广至 55 个美国学区、覆盖超 10 万名教育者。Anthropic 设立 500 万美元基金资助 AI 对使用者幸福感影响的独立研究,并发布 Anthropic Economic Index 追踪 AI 在各类职业任务中的真实渗透。

意义:教育是从"消费级玩具"到"生产性基础设施"的关键入口。当头部模型厂同时把教师端工具、校园覆盖、影响研究三件事打包推进,AI 对人力资本的长期塑造开始有可观测指标。

来源:Anthropic 官方 / OpenAI 官方(2026-08 下旬)。时效:本周。置信度✅ 已确认(官方发布)。


九、AI 经济效益(产业价值与资本动向)

9.1 具身智能上半年融资 934.74 亿元,同比 5 倍,但资本已开始挤泡沫

正面数据:2026 上半年国内具身智能融资 934.74 亿元(同比 +5 倍),融资事件 322 笔(同比 +137%);7 月工业机器人产量增长 30.2%;全球人形机器人上半年出货 2.2 万台

反向信号:受限于泛化能力不足与量产成本,头部企业股价回落(宇树上市 4 天市值蒸发约 2000 亿),行业正从概念炒作转向真实场景落地。

判断:融资额与出货量同步高增,说明这一轮不是纯故事驱动;但股价回落与估值重定价同时出现,意味着估值已经跑在交付能力前面。观察指标应从"融了多少"转向"单台交付成本与真实场景成功率"。

来源:IT 桔子 / 行业出货统计 / 深圳特区报 / 东方财富。时效:本周。置信度✅ 已确认

9.2 机器人企业"一边融资一边投资",抢"数据喂模型、模型控本体"闭环

机器人主机厂亲自下场投资已成行业普遍现象,数据与模型是重点投资赛道。智元已投资至少 10 家具身智能产业链企业;深圳的乐聚、众擎、智平方均在加速对外投资。

判断:专家观点是谁先建成"数据喂模型、模型控本体"的生态闭环,谁就在未来的成本战和溢价战中掌握定价权

来源:深圳特区报 / 企业公开表态。时效:本周。置信度✅ 已确认

9.3 车企集体跨界:小鹏领跑,蔚来、零跑、广汽、一汽跟进

小鹏机器人 9 亿美元首轮融资、63 亿美元估值领跑;奇瑞旗下机器人业务 AiMOGA 据报道准备 IPO;比亚迪已发布人形机器人"小迪";长安、广汽、理想、上汽、赛力斯均在探索人形机器人;蔚来投资具身智能公司(任少卿创立的物理 AI 基础模型公司),零跑确认布局机器人业务,中国一汽将突破具身智能机器人技术列为十大重点技术任务之一。

判断:车企优势在硬件与规模化量产,短板在 AI 侧。小鹏用自研图灵芯片 + 端侧基座模型的路线,是目前车企阵营里对 AI 侧押注最重的一家。

来源:小鹏公告 / 多家外媒 / 融中财经 / RoboRadar。时效:本周。置信度✅ 已确认(小鹏数据)/🟡(奇瑞 IPO、蔚来标的为报道口径)。

9.4 密集融资与上市窗口:外骨骼、家庭机器人、灵巧手全线推进

9.5 AI Coding 侧:模型供货关系与价格成为商业变量,成本效率被重新定价

两件事叠加看:OpenAI 断供 Cursor(11/12 生效)说明模型供货已从纯商业采购变成带控制权条款的战略关系;而 xAI Grok Code Fast 1 限时免费接入主流 IDE(第三章第 1 条)进一步压低编程模型使用成本。同时 DeepSeek 拟募资 74 亿美元 / 估值 740 亿美元(第二章 D2)显示头部国产模型公司的资本化加速。

判断:AI Coding 成本结构正在被重新定价。对企业采购方,"能力/价格"之外要加两个维度:供货关系稳定性(会不会被断供)与 token 效率(同样额度实际能干多少活)。

来源:OpenAI 公告 / 各厂商官方 / xAI 官方 / 媒体。时效:当日 + 本周。置信度✅ 已确认

9.6 开源模型正在改变编程模型的成本曲线

llm-stats 前 15 名中开源占 5 席且全部来自中国团队;GLM-5.3 在 AA 口径以 60 分并列第 7、开源第一;GLM-5.3-Flash 以 Opus 4.8 约 1/40 的定价跑通;DeepSeek-V4-Pro-0813 以 $0.48/M 给到 LiveBench 77.4 分与 122 c/s 高吞吐、每成功任务成本仅 $0.044;腾讯 Hy4 preview 新晋榜单(第九章 9.5 印证其需求热度)。

判断能力差 14%、价格差 76 倍这个结构(见 5.4)意味着大量编程工作负载的经济最优解已不在闭源旗舰。闭源溢价的合理性正在收缩到"长程复杂 Agent 任务"这一个狭窄区间——而这恰好是 LiveBench Agent 编程列全场最弱(中位数约 54)的能力洼地。

来源:livebench.ai / artificialanalysis.ai / llm-stats.com / 智谱官方 / 腾讯官方。时效:当日。置信度✅ 已确认(榜单数据)/🟡("1/40 定价"为厂商口径)。


十、方法论与免责声明

10.1 信源分层与置信度标记

标记含义判定标准
✅ 已确认官方渠道发布,或 ≥2 个独立权威来源一致可作为决策依据
🟡 大概率属实单一权威来源,或官方事实明确但细节为媒体口径需自行核验细节
🔴 待验证社区流传 / 单一非权威来源 / 文书未公开仅作趋势参考

社区信源(第一章)用于抢时间,其内容凡进入第三章「15 条精选」的,均已用官方或权威媒体二次核验;未能核验的降级至第四章「社区快讯」。

10.2 B 站字幕采集口径

10.3 评分表口径与本地计算说明

10.4 覆盖范围与已知缺口

10.5 免责声明


AI 日报 · 2026-09-01 · 聚焦 AI Coding × 具身智能 · 共 15 条精选 + 6 条 DeepSeek 专项 + 7 条社区快讯