AI 日报 · 2026-09-10(周四)

覆盖方向:AI Coding × 具身智能

统计窗口:2026-09-09 07:30 → 2026-09-10 07:30(北京时间,过去 24 小时)

实时数据源(抓取于 2026-09-10 07:30):① LiveBench 官网实时榜(release 2026-06-25)② Artificial Analysis Intelligence Index(官网实时页,2026-09-10 直采)③ llm-stats.com(389 模型实时价/吞吐/分项)④ GitHub Trending(AI 专项日榜,2026-09-10 07:33 现场抓取)⑤ 社区信源交叉验证(公开渠道,详见第一节)

社区一手信源:X / 中文社区(知乎·V2EX·Linux.do·微信公众号聚合号)/ 海外社区(Hacker News·r/LocalLLaMA)/ 开发者社区(GitHub Releases·Hugging Face)/ 聚合线索号(机器之心·量子位·新智元·智猩猩AI·科创板日报·仿生人形日报·FutureX Physical AI Daily·quidproquo AI Daily·HeadsUpAI)

免责声明:本文由自动化流程汇总公开信源生成,逐条标注「时效 / 来源 / 置信度」,仅供参考,不构成投资或商业决策依据。社区单源未交叉验证者一律单列「社区快讯(待验证)」,不入正式条目。所有价格、评分以各榜单官网实时页为准,跨口径对比仅看量级。


目录

章节内容关键标记
社区信源监控与浏览器门禁披露未执行项透明标注
DeepSeek 专项今日有 D ✅(D1–D6)
15 条精选 · 甲组 AI Coding(8 条)8 条
15 条精选 · 乙组 具身智能(7 条)7 条
社区快讯(待验证单列存疑线索
三口径能力评分与价格表LiveBench / AA / llm-stats
Price vs Performance 性价比双视角条形图
AI 社会效益7 领域
AI 经济效益6 维度
方法论与免责声明

一、社区信源监控

1.1 浏览器就绪门禁(步骤 0 · 透明披露)

结论:本运行(自动化无人值守)未执行 B 站 UP 主字幕提取。

对照历史:09-05 至 09-09 连续多期均为同一原因(控制通道未连接,非门禁脚本失败)。建议后续运行前优先确认控制通道可用性,否则该环节会持续空转。

1.2 公开社区/二手信源交叉验证表(过去 24h)

#线索平台 / 来源发帖时效是否构成新闻交叉验证置信度
C1DeepSeek V4.1 Flash 发布 + Flash 系列降价DeepSeek 开放平台公告 · 财联社《科创板日报》· 证券时报 · 腾讯新闻 · 大河财立方09-09 17:29 ~ 09-09 23:05✅ 是(一手官方公告)5 源同向、含官方原文已确认
C2DeepSeek 聘请中信证券筹备科创板 IPO21世纪经济报道 · 财联社 · 南方财经 · 上证报(均引「知情人士」)09-09 21:05 ~ 09-09 23:05⚠️ 是但公司未官宣多源一致但均非官方待验证
C3Meta Muse 个人智能体上线(专属云 VM + Sentinel)中新经纬 · AIBase · MarkTechPost · OrcaRouter · aistify美西 09-08 / 中文 09-09✅ 是5 源同向,含技术拆解已确认
C4GitHub 趋势头部全为「Agent 工程方法论」项目GitHub Trending(AI 专项日榜,07:33 抓取)· quidproquo Digest09-10✅ 是榜单+digest 双源已确认
C5腾讯朱雀 AI-Infra-Guard v4.1.9 开源Help Net Security · CyberRecaps · news4hackers09-09✅ 是3 源同向已确认
C6OpenAI × MIT 量子实验自主运行每日 AI 早报聚合 · 腾讯新闻09-09⚠️ 是(未见 OpenAI 官网稿)仅聚合号,单源性质待验证
C7Anthropic 研究员 Jacob Coxon 因 AI 安全担忧辞职聚合号转述09-09⚠️ 是单源,未见一手声明待验证
C8算力涨价潮:头部云服务最高涨超三成经济日报近日(无精确日)✅ 是(权威媒体)单一权威源大概率

1.3 社区交叉验证结论


二、DeepSeek 专项

今日有 D ✅(窗口 09-09 07:30 → 09-10 07:30,共 6 条,含 1 条已确认官方公告 + 1 条官方定价变更 + 1 条待验证资本动作)

D1 · DeepSeek 官宣 V4.1 Flash 今日(9/10)前后正式发布,V4 Pro 请求自动路由降级计费

D2 · Flash 系列今日 12:00 起大幅降价,缓存命中降 60%(对比 V4 Pro 输出直降 70%)

计费项旧 V4 Flash旧 V4 Pro新 V4.1 Flash(空闲)高峰时段对比旧 Flash
输出4.5 元13.5 元4 元8 元−11%
输入(缓存未命中)1.5 元4.5 元1 元2 元−33%
输入(缓存命中)0.05 元0.15 元0.02 元0.04 元−60%

D3 · 拟聘中信证券筹备科创板 IPO,已进尽职调查阶段

D4 · 内测实测数据流出:峰值 400–507 tokens/s,代码类任务端到端提速 3.9–6 倍

D5 ·(背景 · 超 24h)DeepSeek 重点招聘约 150 名资深工程师

D6 ·(间接关联)知乎拟出资 15 亿元作 LP 投资 AI 与机器人基金

超窗剔除说明(防「旧闻当新发」)

事件真实首发日期处理
DeepSeek 部署 16 万颗华为昇腾 950DT / 乌兰察布 1GW彭博 2026-09-04 首发,09-09 二次放大剔除,超 24h
DeepSeek-V3.2 正式版 + V3.2-Speciale官网新闻页 2025-12-01(V3.2-Exp 2025-09-29)剔除,年份不符;官网横幅不作为发布日期依据
DeepSeek-V4-Pro(0813)GA2026-08 中下旬剔除,仅作对比基线
DeepSeek-V4-Flash-Vision-Exp权重 08-31 / API 08-21剔除,仅作对比基线

三、15 条精选 · 甲组:AI Coding(8 条)

A1 · Meta 发布个人智能体 Muse:每人一台专属云 VM,Sentinel 独立审批网络出口

A2 · 腾讯朱雀实验室开源 AI-Infra-Guard v4.1.9:专扫 AI 基础设施与 Agent 技能包

A3 · GitHub 趋势榜头部全被「Agent 工程方法论」占据,无一个新模型/新框架

#项目星标当日增量定位
1openclaw/openclaw389.3k跨 OS/平台的通用 Agent 执行器
2deepseek-ai/deepseek-harness217.4k"Everything is a Plugin" 插件化 harness
6obra/superpowers283.9k+690完整开发方法论,可跨 8+ harness(Claude Code / Codex / Cursor / Gemini CLI 等)安装
affaan-m/ECC255.0k+1,15168 agent + 286 skill + 94 命令 shim 的性能优化系统,含记忆与安全扫描
Tencent/teamai-cli2.85k+563团队统一分发 skill / rule / MCP 配置
cathrynlavery/diagram-design36.4k+2,286(当日最快)用 39 种编辑级图示替代 Mermaid

A4 · DaVinci Resolve 21.1 接入 Claude / Claude Code / ChatGPT Codex,Studio 版内置原生 MCP 服务器

A5 · OpenAI × MIT:GPT-5.6 Sol + Codex 端到端自主运行量子计算实验,40 项测量人类仅干预 4 次

A6 · Cursor 接入 Meta Muse Spark 1.3,并公开 CursorBench 3.2 成绩(Max 67.9%,$1.31/任务)

A7 · Claude Code 连发三点版本 2.1.261 / .265 / .266,修复自身引入的网关回归

A8 · 外滩大会 AI Coding 黑客松创吉尼斯纪录(15,577 件作品),11 家平台联合发布首份赛事技术规范


四、15 条精选 · 乙组:具身智能(7 条)

B1 · 京东启动「物理 AI 加速计划」,六项"全球第一"目标 + 五年采购 300 万台机器人

B2 · 京东物流「狼族」一次发布五款新品,"九狼"系列成型

B3 · 智元一天双发:AGILE2.0 感控一体模型 + GE-Act 2.0 原生世界—动作模型

B4 · NEURA Robotics 完成至多 14 亿美元 C 轮,成欧洲融资最高的人形机器人公司

B5 · 人社部发布第八批新职业:「具身智能机器人应用技术员」「智能体开发员」入列

B6 · 优必选披露上半年交付约 600 台 Walker S2 且工业客户复购,同步推进人形专用芯片

B7 · 证监会窗口指导收紧人形机器人 IPO;同日优地机器人港股上市首日暴涨 153.84%


五、社区快讯(待验证

以下线索仅有社区单源或聚合号转述,未获官方/权威二手印证,按规则单列,不计入 15 条精选

#线索来源时效存疑点缺哪一方验证
P1DeepSeek 聘请中信证券筹备科创板 IPO21财经/财联社/南方财经(均引「知情人士」)09-09 21:05DeepSeek 官方零确认;已有投行人士公开称"为时尚早"公司公告或辅导协议备案
P2OpenAI × MIT 量子计算实验自主运行(40 项仅干预 4 次)每日 AI 早报聚合号09-09无 OpenAI 官网稿 / 无论文OpenAI 或 MIT 官方发布
P3Anthropic 研究员 Jacob Coxon 因 AI 安全担忧辞职并退出行业(警告"明年年底局势可能失控")聚合号转述09-09未见本人一手声明或 Anthropic 回应本人公开声明 / Anthropic 回应
P4苹果新 Siri AI 支持简繁体中文但首发不含中国大陆(iOS/macOS 27 于 9/15 推送)聚合号转述09-10 凌晨发布会后未见 Apple 官网区域支持列表原文Apple 官方支持文档
P5DeepSeek V4.1 Flash 内测实测 507 tokens/s、马里奥 7 分钟 <2 元公众号实测 / 微信讨论串09-09~09-10个体非受控实测官方基准或第三方复现
P6Anthropic 公开评测并点名 OpenAI 模型提示注入风险与 Gemini Flash / Claude Opus 4.8 大致相当HeadsUpAI 转述 Anthropic 表态约 20h 前未见 Anthropic 原始评测报告Anthropic 官方报告
P7Anthropic 顶尖研究员称"到明年年底局势可能已失控"|Claude 会话凭据被窃、额度遭盗用(TechCrunch 调查,Anthropic 已确认TechCrunch / 聚合号09-09~09-10影响面与退款口径不明Anthropic 官方安全公告

六、三口径能力评分与价格表(截至 2026-09-10)

口径说明:三家评测机构的方法论、权重与采样时间完全不同,分数不可直接横向换算。下表并列呈现,用于观察「谁在哪个口径下领先」与「能力差距 vs 价格差距」的量级关系。

6.1 LiveBench(官网实时榜,release 2026-06-25 · 23 项客观任务 / 7 大类 · 每半年刷新)

#模型总评推理编码智能体编码数学数据分析语言指令遵循每成功任务成本
1Claude Fable 5.1 Max Effort83.491.786.466.197.080.389.573.0$1.212
2Claude Fable 5 Max Effort83.089.786.062.296.080.590.775.8$1.439
3GPT-6 Astra Max Effort82.292.780.457.396.883.089.475.6$0.736
4Muse Spark 1.3 xHigh Effort81.689.781.164.195.979.682.878.0$0.219
5GPT-5.6 Sol Max Effort81.091.783.956.296.279.887.771.8$0.515
6GPT-5.5 Thinking xHigh80.289.782.154.095.981.687.470.7$0.435
7Claude 5 Opus Thinking Max80.191.281.465.295.774.688.763.8$0.699
8Kimi K3(开源)79.290.781.462.284.478.785.571.4$0.348
9Gemini 3.7 Flash High78.887.878.958.393.568.085.579.9$0.157
10Qwen 3.8 Max(开源)78.588.272.964.691.378.479.774.1$0.275
11Grok 4.678.090.576.857.092.673.983.771.9$0.207
14DeepSeek V4 Pro 0813(开源)77.485.877.254.995.179.282.167.7$0.044
17DeepSeek V4 Flash Vision Exp(开源)76.885.468.265.187.879.580.471.0$0.051
21GLM-5.3(开源)76.185.879.060.987.970.279.969.3$0.450
23Gemini 3.8 Flash High75.889.372.554.291.654.087.881.4$0.307
38GLM-5.3 Flash(开源)71.677.679.056.881.276.477.352.8$0.031

读法:LiveBench 是三口径中唯一同时给出"每成功任务成本"的榜单,因此最适合做真实账单推演。极差:每成功任务成本从 GLM-5.3-Flash 的 $0.031 到 Claude Fable 5 Max Effort 的 $1.439,相差 46 倍,而总评分只差 11.8 分(约 14%)——这个"能力小差距 / 成本大差距"的结构是本季度最稳定的结论。

6.2 Artificial Analysis Intelligence Index(官网实时页,2026-09-10 直采 · 含每任务成本与速度)

#模型智能指数每任务成本输出速度 tok/s首块延迟 s总响应 s上下文
1Claude Fable 5.1 (max with fallback)53$7.6367286.06293.491M
1GPT-6 Astra (max)53$3.2654328.62337.891.1M
3GPT-6 Astra (xhigh)53$2.3151208.73218.621.1M
4Claude Fable 5.1 (high with fallback)51$3.915424.8734.121M
5Claude Opus 5 (max)51$5.865281.6491.251M
6Muse Spark 1.3 (max)48$1.6022626.9238.001M
7GPT-5.6 Sol (max)47$1.9968140.25147.601M
8GLM-5.3 (max)(开源最佳)45$2.01602.8644.421M
9Grok 4.6 (high)44$1.865541.3950.45500k
9Kimi K3 (max)(开源)44$2.00373.7972.011.05M
11GLM-5.3-Flash(开源)42$0.25722.4737.311M
12Gemini 3.8 Flash (high)41$1.2427313.8415.681M
13Qwen3.8 Max(开源)40$2.67392.4565.861M
14DeepSeek V4 Pro 0813 (max)(开源)36$0.67781.6233.461M
15DeepSeek V4 Flash Vision (max)(开源)35$0.311190.9422.001M

读法:AA 本日可直采实时页(此前多期为 JS 渲染失败需用快照,本日已解决,故不再使用 v4.1.1 快照)。Fable 5.1 与 GPT-6 Astra 并列 53 居首;开源最佳为 GLM-5.3(45)Kimi K3(44) 紧随。值得注意的错位:Muse Spark 1.3 (max) 智能指数 48 排第 6,但输出速度 226 tok/s 是头部唯一三位数——AA 的「智能」口径不奖励速度,而 Agent 实际体感高度依赖速度,这是"跑分 vs 体感"背离的又一例证(呼应 D4 社区实测)。

6.3 llm-stats(389 模型实时榜 · 综合 LLM Stats Score,含分项与混合价 8:1)

#模型综合分推理编码智能体上下文速度混合价 $/M许可
1GPT-6 Astra60.358.248.546.41.1M83 c/s$11.90闭源
2Claude Fable 5.156.353.335.041.91.0M49 c/s$11.90闭源
3GPT-5.6 Sol55.154.346.041.31.1M138 c/s$6.19闭源
4Muse Spark 1.355.152.641.940.61.0M84 c/s$0.10闭源
5Claude Opus 555.154.042.040.01.0M70 c/s$5.95闭源
6GLM-5.353.452.843.139.81.0M235 c/s$1.33开源
7Kimi K353.352.143.539.61.0M31 c/s$3.39开源
8DeepSeek-V4-Pro-081352.450.141.438.21.0M139 c/s$0.46开源
9Qwen3.8 Max52.050.739.937.81.0M148 c/s$1.81开源
10Gemini 3.8 Flash51.247.539.336.11.0M234 c/s$0.89闭源
11Hy4 preview(腾讯)51.050.840.036.8开源
12GPT-5.6 Terra51.049.342.438.11.1M$2.48闭源
13Claude Opus 4.851.050.441.935.51.0M59 c/s$5.95闭源
Claude Mythos Preview55.055.845.036.6UNRELEASED

读法:llm-stats 与 AA/LiveBench 的排序分歧明显——AA 里并列第一的 GPT-6 Astra 在此居首一致,但 Claude Fable 5.1 在 llm-stats 第 2、在 LiveBench 第 1、在 AA 并列第 1,而 DeepSeek-V4-Pro-0813 在 llm-stats 仅第 8、LiveBench 第 14、AA 第 14。三家对"谁最强"有分歧,但对"谁最便宜"高度一致(DeepSeek / GLM / Qwen / Muse Spark)。注意:V4.1 Flash 今日发布,三家榜单尚未收录(截至 07:33),因此本期三表仍以 V4 Pro 0813 为 DeepSeek 代表——这是新模型发布后的常态滞后,下期应开始反映。

6.4 GitHub 趋势榜(AI 专项日榜 · 2026-09-10 07:33 抓取)

#项目星标Fork语言定位
1openclaw/openclaw389.3k81.8kTypeScript跨 OS/平台的通用 Agent 执行器
2deepseek-ai/deepseek-harness217.4k25.7kTypeScript"Everything is a Plugin" 插件化 harness
3n8n-io/n8n203.9k60.6kTypeScript原生 AI 能力的工作流自动化
4Significant-Gravitas/AutoGPT187.2k46.0kPython自主 Agent 经典项目
5f/prompts.chat175k 段位HTMLPrompt 集合
6langgenius/dify155.2k24.5kTypeScriptAgentic 工作流 / RAG
7langflow-ai/langflow154.5k10.1kPython可视化 Agent 编排
8open-webui/open-webui151.5k22.1kPython本地/自托管模型前端
9msitarzewski/agency-agents151.3k24.3kShell一整套"AI 代理公司"
10langchain-ai/langchain146.0k24.4kPythonAgent 工程平台
11Shubhamsaboo/awesome-llm-apps136.9k20.1kPython100+ Agent / Skill / RAG 应用
12harry0703/MoneyPrinterTurbo122.0k18.8kPythonAI 一键生成短视频

当日最快上升(digest 口径):cathrynlavery/diagram-design +2,286、affaan-m/ECC +1,151、obra/superpowers +690、Tencent/teamai-cli +563、TauricResearch/TradingAgents +367。头部关键词 = Agent 执行面 + 技能/方法论的系统化治理


七、Price vs Performance 性价比(双视角)

计算方法:视角 A = llm-stats 综合分 ÷ llm-stats 混合价(8 输入:1 输出);视角 B = LiveBench 总评 ÷ LiveBench 每成功任务成本。两者均为单口径内自洽的合成指标,仅用于看量级与排序,不可跨视角直接比较。

视角 A · llm-stats 综合分 / 混合价

Muse Spark 1.3
551.0
55.1 / $0.10
DeepSeek-V4-Pro-0813
113.9
52.4 / $0.46
Gemini 3.8 Flash
57.5
51.2 / $0.89
GLM-5.3
40.2
53.4 / $1.33
Qwen3.8 Max
28.7
52.0 / $1.81
GPT-5.6 Terra
20.6
51.0 / $2.48
Kimi K3
15.7
53.3 / $3.39
Claude Opus 5
9.26
55.1 / $5.95
GPT-5.6 Sol
8.90
55.1 / $6.19
GPT-6 Astra
5.07
60.3 / $11.90
Claude Fable 5.1
4.73
56.3 / $11.90

视角 B · LiveBench 总评 / 每成功任务成本

GLM-5.3 Flash(开源)
2309
71.6 / $0.031
Qwen 3.8 Flash Next(开源)
1814
76.2 / $0.042
DeepSeek V4 Pro 0813(开源)
1759
77.4 / $0.044
DeepSeek V4 Flash Vision Exp(开源)
1506
76.8 / $0.051
DeepSeek V4 Flash 0731(开源)
1237
74.2 / $0.060
Grok 4.5
579
75.8 / $0.131
Gemini 3.7 Flash High
502
78.8 / $0.157
Muse Spark 1.3 xHigh
373
81.6 / $0.219
Qwen 3.8 Max(开源)
285
78.5 / $0.275
Kimi K3(开源)
228
79.2 / $0.348
GLM-5.3(开源)
169
76.1 / $0.450
GPT-5.6 Sol Max
157
81.0 / $0.515
GPT-6 Astra Max
112
82.2 / $0.736
Claude Fable 5.1 Max
69
83.4 / $1.212

关键洞察

  1. 能力差距 vs 价格差距的剪刀差继续扩大。视角 A 中最强模型 GPT-6 Astra(60.3)与性价比之王 Muse Spark 1.3(55.1)能力仅差 9.4%,价格差 119 倍($11.90 vs $0.10)。视角 B 中 Claude Fable 5.1 Max(83.4)与 GLM-5.3 Flash(71.6)能力差 14.1%,每成功任务成本差 39 倍($1.212 vs $0.031)。结论未变:绝大多数生产负载买不到"最强"的边际收益。
  2. 两个视角的共同赢家是开源低价模型。视角 B 前 5 名全部是开源(含 3 个 DeepSeek 系列);视角 A 中 DeepSeek-V4-Pro-0813 是唯一进入前 2 的开源模型($0.46)。这说明"开源 + 低价"已经不只是成本优势,而是同时在绝对能力上逼近闭源。
  3. DeepSeek 今日降价会进一步强化这个位置。D2 显示 V4.1 Flash 输出价 4 元/百万(约 $0.56)、缓存命中 0.02 元/百万(约 $0.0028)——缓存命中场景的成本比上表任何模型都低一个数量级。但要注意:这是中国区人民币闲时价,与 llm-stats 的美元混合价口径不同,且高峰时段翻倍,不能与表中数字直接相减。
  4. Muse Spark 1.3 的 $0.10 需复核。llm-stats 显示该价,但 Muse Spark 1.3 的标准档公开价为 $1.25 输入 / $4.25 输出(标准档),$0.10/$0.20 为允许 Meta 用其流量训练的 Contributor 档。若按标准档重算,其性价比指数将从 551 降至约 10 左右,跌出前三这是本期最容易被误读的数字
  5. V4.1 Flash 尚未入榜。三家评测机构截至 07:33 均未收录 V4.1 Flash,本期性价比表仍是"上一代"格局。若官方宣称的"全面超越 V4 Pro、速度翻倍、价格更低"在第三方基准上得到验证,下期视角 B 的 DeepSeek 条目会显著上移——这是下期最值得盯的变量

八、AI 社会效益

领域事件时效来源置信度
就业结构人社部等发布第八批新职业:11 个新职业 + 23 个新工种,「具身智能机器人应用技术员」列为新职业,「智能体开发员」「低空物流员」为新增工种;数字职业占新增新职业 45.5%,累计已发布 121 个新职业09-0921世纪经济报道 · 腾讯新闻已确认
就业结构京东「物理 AI 加速计划」承诺 5 年机器人售后服务网络覆盖 100+ 国家,创造超 10 万个机器人售后工程师岗位;3 年助力 100 家本体厂降本、100 家供应商业绩倍增09-09京东 JDD 官方 · 中国江苏网已确认(目标口径)
教育科研外滩黑客松·AI Coding 大赛以 15,577 件作品创吉尼斯纪录;上万参赛者中近七成未满 18 岁、最小 6 岁,9 岁选手夺冠(作品两天迭代至 V7.4)09-09~09-10外滩大会官方 · 新华社系已确认
医疗健康国内首款 AI 辅助研发原创药(西湖大学等联合研发,盐酸伊司特韦片)获国家药监局附条件批准上市;Frost & Sullivan 预测国内 AI 医疗市场 2023 年 88 亿 → 2033 年 3157 亿元,CAGR 43.1%;全球已有超 173 个 AI 发现药物项目处于活跃临床阶段近日(无精确日)国家药监局 · 弗若斯特沙利文已确认(获批)/ 大概率(预测)
政务服务 / 法治全国首个数字法治人工智能整体解决方案「法仪大模型应用」在京发布,覆盖行政复议、合法性审核等 12 个司法行政场景,输出精准度超 90%、覆盖 99% 业务情况,已在北京市各级司法行政机关深度应用,累计办理各类业务 20 万次09-08(略超窗,作背景)司法部重点实验室 · 北京市司法局已确认
公共安全 / 风险治理最高人民法院发布 9 件反不正当竞争典型案例,某公司销售抢单「物理外挂」(点滑器)致平台订单分配机制失灵,判赔 300 万元,一审已生效近日(无精确日)最高人民法院大概率
风险治理腾讯朱雀实验室开源 AI-Infra-Guard v4.1.9,可扫描 MCP server 与 agent skill 的 14 类风险(详见 A2);工行、招行、中国电信、联想、vivo、B站已在用09-09Help Net Security 等已确认
数字鸿沟苹果新 Siri AI 支持英语、简繁体中文等 16 种语言,但官方标注首发不支持中国大陆,iOS/macOS 27 于 09-15 推送,国行用户仍需等待09-10 凌晨聚合号转述(未见 Apple 原文)待验证
风险治理(人才)Anthropic 研究员 Jacob Coxon 辞职并退出 AI 行业,警告"各大 AI 公司竞相研发人类恐难掌控的自我改进系统……到明年年底局势可能已经失控"09-09聚合号转述待验证

关键洞察

本日社会效益的重心在「制度与人才供给开始追上技术速度」。三条线索同向:人社部新增「具身智能机器人应用技术员」职业(09-09)、京东承诺 10 万个售后工程师岗位(09-09)、外滩大会 AI Coding 大赛近七成参赛者未满 18 岁(09-09)——职业标准、岗位需求、基础教育三条线在同一天出现进展,这在过去一年的日报里是第一次。它意味着具身智能与 AI Coding 正在从"技术议题"变成"劳动力市场议题"。

同时需要警惕的是另一面:AI 越强,攻击面越大。同一天出现的还有 Claude 会话凭据被盗用刷额度(TechCrunch 调查,Anthropic 已确认)、最高法整治"物理外挂"、Anthropic 研究员因安全担忧离职。腾讯开源 AI-Infra-Guard 是对这一面的正面回应,但其自身"无鉴权"的设计缺陷恰恰说明——AI 安全工具链的成熟度,还落后于 AI 能力本身一到两个身位

待观察线索


九、AI 经济效益

维度事件 / 数据时效来源置信度
投融资 · 海外Mistral AI 完成 30 亿欧元 D 轮,投后估值超 210 亿欧元;三星电子领投,欧盟基金及老股东联合领投,ASML、英伟达跟投;已服务空客等 125 家大型企业09-09Mistral 官方 · 媒体已确认
投融资 · 海外NEURA Robotics 完成至多 14 亿美元 C 轮(Tether 领投,Amazon/NVIDIA/Qualcomm/Bosch/Schaeffler/EIB 跟投);2026 年至今全球机器人公司融资 558 亿美元,接近去年两倍09-09~09-10Tech Funding News 等已确认
投融资 · 国内具身智能初创 费莫一科技(PHYMI)完成近亿美元种子轮(IDG 资本领投,云启、滴滴、复星锐正、耀途、禾赛跟投);创始人刘念邱为元戎启行前技术合伙人09-09投中网已确认
投融资 · 国内物理 AI 企业深度智控(DeepCtrls)完成数亿元 B+ 轮(宁德时代领投,阿美投资、太平创新、广发信德跟投)近日媒体大概率
投融资 · 国内千诀科技完成数亿元 A+ 轮(距 6 月 A 轮仅约三个月,元禾厚望、筱光资本等参投)——具身智能热钱正从"本体"流向"大脑"09-09媒体大概率
资本市场优地机器人 09-09 登陆港交所主板:发行价 14.45 港元,收盘 36.68 港元,+153.84%,市值破 150 亿港元;中国第三大商用服务机器人厂商,累计售出超 11.4 万台,2025 年亏损收窄至 1.11 亿元09-09港交所公开数据已确认
资本市场证监会向头部投行下发非正式窗口指导,从营收真实性、盈利稳定性、技术创新性、商业化落地能力四维收紧人形机器人 IPO 审核;宇树科技上市后市值大幅回撤为导火索近期(无精确日)媒体多源转述待验证
资本市场DeepSeek 拟聘中信证券筹备科创板 IPO(详见 D3);两轮累计募资超 1000 亿元,投前估值 5000 亿元09-09财联社等引「知情人士」待验证
产业规模IT桔子:2026 上半年国内具身智能赛道融资总额 935 亿元,远超 2025 全年 379 亿元;东吴证券预测 2027 年具身智能市场规模有望达 6328 亿元09-08 报道(H1 数据)IT桔子 · 东吴证券研报已确认(统计数据)
企业降本增效DeepSeek Flash 系列今日 12:00 起降价:缓存命中 −60%、未命中 −33%、输出 −11%;对比 V4 Pro 输出 −70%(详见 D2)09-10 12:00 生效DeepSeek 官方已确认
企业降本增效京东物流「超脑」3.0 将亿级包裹路径规划从分钟级压缩至秒级,具身模型物流多任务执行成功率 96.7%;Muse Spark 1.3 比 1.2 少 20% tool calls、少 25% tokens09-09京东官方 · Meta 官方已确认
区域 / 基建谷歌宣布未来两年在芬兰投资至少 130 亿欧元(约 151 亿美元)建 AI 基础设施(欧洲史上最大单笔投资),与 Fortum 签 22 年购电协议锁定洛维萨核电站电量(谷歌在美国以外首份核电 PPA),建设期预计创造超 3.7 万个岗位09-09谷歌官方已确认
区域 / 基建北京发布「十五五」高精尖产业及数字经济发展规划:构建词元结算体系、打造词元工厂;截至 2026-06 我国日均词元调用量突破 500 万亿,北京占比超一半;已建成 8.2 万 P 智算中心,预计 2027 年达 20 万 P09-09北京市政府已确认
金融创新广东推出首个词元经济专项金融产品「Token 贷」,将词元消耗、算力合约、数字经营数据纳入授信评估;多地银行同步落地算力贷、模型贷近日(无精确日)媒体大概率
成本压力算力涨价潮:全球算力涨价持续,头部云厂商相关服务最高涨幅超三成;中型 AI 应用服务商算力成本占营收 30%–60%;专家称算力价格中枢将长期上移近日(无精确日)经济日报大概率
股权/基金知乎拟以 15 亿元自有现金认购砺思资本旗下 AI 与机器人基金 LP 权益(占基金权益 ≤30%,估算基金目标总规模约 50 亿元);砺思曾参与 DeepSeek 首轮融资09-09知乎公告已确认

关键洞察

本日经济效益呈"资本高位、监管收口、成本上行"三线并行的结构。

待观察线索


十、方法论与免责声明

10.1 信息采集与时效核验

  1. 统计窗口:北京时间 2026-09-09 07:30 → 2026-09-10 07:30。凡首发时间早于窗口或无法核验具体日期者,一律标注为「背景」或「超窗剔除」,不进入 15 条精选
  2. 时效硬核验(本期执行情况)
  3. 每个"今日新闻"条目均回溯到官方一手来源(开放平台公告 / 公司 release notes / 政府部委发布 / 交易所公开数据 / 评测机构官网实时页),确认年-月-日且年份 = 2026
  4. DeepSeek 专项严格对照官方新闻/开放平台公告:V4.1 Flash 官方通知日期为 2026-09-09、计划发布 2026-09-10,为 2026 年新版本,与长期挂在官网的 V3.2 横幅(实际发布 2025-12-01)无关;定价变更生效时点 2026-09-10 12:00 已在官方价页核到。
  5. 明确剔除:16 万颗昇腾 950DT / 乌兰察布 1GW(彭博 2026-09-04 首发,超窗);DeepSeek-V3.2 正式版与 V3.2-Speciale(2025-12-01,年份不符);V4-Pro 0813 与 V4-Flash-Vision-Exp(仅作对比基线)。
  6. 矛盾自检:三家评测榜单截至 07:33 均未收录 V4.1 Flash,与"今日发布"一致(新模型存在入榜滞后),不构成矛盾信号;已在 6.3 节透明标注该滞后。
  7. 来源分级
  8. 已确认:官方公告 / Release Notes / 政府部委发布 / 交易所公开数据 / ≥3 家独立媒体同向印证。
  9. 大概率:1 家权威媒体或平台级更新 + 1 个二手源印证。
  10. 待验证:仅社区单源、或全部引述"知情人士"而公司未官宣。
  11. 无法核验的处理:来源只提事件但无可验证日期的(如最高法典型案例、算力涨价潮、法仪大模型),明确标注「近日(无精确日)」并降为「大概率」,不冒充当日新闻。

10.2 评分与价格数据的使用限制

10.3 未执行项与局限

10.4 署名

AI 日报 · 自动化生成 | 数据采集窗口 2026-09-09 07:30 → 2026-09-10 07:30(北京时间)| 生成时间 2026-09-10 07:30