覆盖方向:AI Coding × 具身智能
统计窗口:2026-09-09 07:30 → 2026-09-10 07:30(北京时间,过去 24 小时)
实时数据源(抓取于 2026-09-10 07:30):① LiveBench 官网实时榜(release 2026-06-25)② Artificial Analysis Intelligence Index(官网实时页,2026-09-10 直采)③ llm-stats.com(389 模型实时价/吞吐/分项)④ GitHub Trending(AI 专项日榜,2026-09-10 07:33 现场抓取)⑤ 社区信源交叉验证(公开渠道,详见第一节)
社区一手信源:X / 中文社区(知乎·V2EX·Linux.do·微信公众号聚合号)/ 海外社区(Hacker News·r/LocalLLaMA)/ 开发者社区(GitHub Releases·Hugging Face)/ 聚合线索号(机器之心·量子位·新智元·智猩猩AI·科创板日报·仿生人形日报·FutureX Physical AI Daily·quidproquo AI Daily·HeadsUpAI)
免责声明:本文由自动化流程汇总公开信源生成,逐条标注「时效 / 来源 / 置信度」,仅供参考,不构成投资或商业决策依据。社区单源未交叉验证者一律单列「社区快讯(待验证)」,不入正式条目。所有价格、评分以各榜单官网实时页为准,跨口径对比仅看量级。
| 章节 | 内容 | 关键标记 |
|---|---|---|
| 一 | 社区信源监控与浏览器门禁披露 | 未执行项透明标注 |
| 二 | DeepSeek 专项 | 今日有 D ✅(D1–D6) |
| 三 | 15 条精选 · 甲组 AI Coding(8 条) | 8 条 |
| 四 | 15 条精选 · 乙组 具身智能(7 条) | 7 条 |
| 五 | 社区快讯(待验证) | 单列存疑线索 |
| 六 | 三口径能力评分与价格表 | LiveBench / AA / llm-stats |
| 七 | Price vs Performance 性价比 | 双视角条形图 |
| 八 | AI 社会效益 | 7 领域 |
| 九 | AI 经济效益 | 6 维度 |
| 十 | 方法论与免责声明 | — |
结论:本运行(自动化无人值守)未执行 B 站 UP 主字幕提取。
_probe/subtitles_2026-09-10.md 不存在)。对照历史:09-05 至 09-09 连续多期均为同一原因(控制通道未连接,非门禁脚本失败)。建议后续运行前优先确认控制通道可用性,否则该环节会持续空转。
| # | 线索 | 平台 / 来源 | 发帖时效 | 是否构成新闻 | 交叉验证 | 置信度 |
|---|---|---|---|---|---|---|
| C1 | DeepSeek V4.1 Flash 发布 + Flash 系列降价 | DeepSeek 开放平台公告 · 财联社《科创板日报》· 证券时报 · 腾讯新闻 · 大河财立方 | 09-09 17:29 ~ 09-09 23:05 | ✅ 是(一手官方公告) | 5 源同向、含官方原文 | 已确认 |
| C2 | DeepSeek 聘请中信证券筹备科创板 IPO | 21世纪经济报道 · 财联社 · 南方财经 · 上证报(均引「知情人士」) | 09-09 21:05 ~ 09-09 23:05 | ⚠️ 是但公司未官宣 | 多源一致但均非官方 | 待验证 |
| C3 | Meta Muse 个人智能体上线(专属云 VM + Sentinel) | 中新经纬 · AIBase · MarkTechPost · OrcaRouter · aistify | 美西 09-08 / 中文 09-09 | ✅ 是 | 5 源同向,含技术拆解 | 已确认 |
| C4 | GitHub 趋势头部全为「Agent 工程方法论」项目 | GitHub Trending(AI 专项日榜,07:33 抓取)· quidproquo Digest | 09-10 | ✅ 是 | 榜单+digest 双源 | 已确认 |
| C5 | 腾讯朱雀 AI-Infra-Guard v4.1.9 开源 | Help Net Security · CyberRecaps · news4hackers | 09-09 | ✅ 是 | 3 源同向 | 已确认 |
| C6 | OpenAI × MIT 量子实验自主运行 | 每日 AI 早报聚合 · 腾讯新闻 | 09-09 | ⚠️ 是(未见 OpenAI 官网稿) | 仅聚合号,单源性质 | 待验证 |
| C7 | Anthropic 研究员 Jacob Coxon 因 AI 安全担忧辞职 | 聚合号转述 | 09-09 | ⚠️ 是 | 单源,未见一手声明 | 待验证 |
| C8 | 算力涨价潮:头部云服务最高涨超三成 | 经济日报 | 近日(无精确日) | ✅ 是(权威媒体) | 单一权威源 | 大概率 |
今日有 D ✅(窗口 09-09 07:30 → 09-10 07:30,共 6 条,含 1 条已确认官方公告 + 1 条官方定价变更 + 1 条待验证资本动作)
| 计费项 | 旧 V4 Flash | 旧 V4 Pro | 新 V4.1 Flash(空闲) | 高峰时段 | 对比旧 Flash |
|---|---|---|---|---|---|
| 输出 | 4.5 元 | 13.5 元 | 4 元 | 8 元 | −11% |
| 输入(缓存未命中) | 1.5 元 | 4.5 元 | 1 元 | 2 元 | −33% |
| 输入(缓存命中) | 0.05 元 | 0.15 元 | 0.02 元 | 0.04 元 | −60% |
expires-on-0910 标识,暗示将下线。官方摘要称峰值约 400 tokens/s(现 V4 约 97 tokens/s);网友实测峰值冲至 507 tokens/s。分场景提速:49k tokens 长上下文检索 5.2×、SVG 代码生成 6.0×、算法题(Manacher)4.6×、SQL 查询 5.0×、asyncio 重构 3.9×。有开发者用 V4.1 Flash 在 7 分钟内生成可运行的 HTML 版超级马里奥小游戏(含金币/敌人/水管),成本不到 2 元。| 事件 | 真实首发日期 | 处理 |
|---|---|---|
| DeepSeek 部署 16 万颗华为昇腾 950DT / 乌兰察布 1GW | 彭博 2026-09-04 首发,09-09 二次放大 | 剔除,超 24h |
| DeepSeek-V3.2 正式版 + V3.2-Speciale | 官网新闻页 2025-12-01(V3.2-Exp 2025-09-29) | 剔除,年份不符;官网横幅不作为发布日期依据 |
| DeepSeek-V4-Pro(0813)GA | 2026-08 中下旬 | 剔除,仅作对比基线 |
| DeepSeek-V4-Flash-Vision-Exp | 权重 08-31 / API 08-21 | 剔除,仅作对比基线 |
| # | 项目 | 星标 | 当日增量 | 定位 |
|---|---|---|---|---|
| 1 | openclaw/openclaw | 389.3k | — | 跨 OS/平台的通用 Agent 执行器 |
| 2 | deepseek-ai/deepseek-harness | 217.4k | — | "Everything is a Plugin" 插件化 harness |
| 6 | obra/superpowers | 283.9k | +690 | 完整开发方法论,可跨 8+ harness(Claude Code / Codex / Cursor / Gemini CLI 等)安装 |
| — | affaan-m/ECC | 255.0k | +1,151 | 68 agent + 286 skill + 94 命令 shim 的性能优化系统,含记忆与安全扫描 |
| — | Tencent/teamai-cli | 2.85k | +563 | 团队统一分发 skill / rule / MCP 配置 |
| — | cathrynlavery/diagram-design | 36.4k | +2,286(当日最快) | 用 39 种编辑级图示替代 Mermaid |
DeferredToolResults.approvals 校验;Mastra 1.65 把 trace 查询收敛为跨 ClickHouse / DuckDB / Postgres 的一致合约,并补上租户级批量删除。user.email / user.groups 遥测,同时导致此前惰性的环境变量 CLAUDE_CODE_USE_GATEWAY 开始自行强制 Cloud 网关登录,破坏既有的 LLM 网关/代理配置;2.1.266 专门回滚该回归。同批变更还包括:--plugin-dir 目录级插件加载、工具结果落盘 1GB 上限(截断会在预览中标注)、/status 与 claude doctor 新增组织策略加载失败诊断行、bashOutputMaxChars / taskOutputMaxChars 上限提至 128K、大型子智能体系统提示改为文件传参、ant apply 命令让团队把 agent/环境/skill/记忆库/部署作为版本锁定代码管理。以下线索仅有社区单源或聚合号转述,未获官方/权威二手印证,按规则单列,不计入 15 条精选。
| # | 线索 | 来源 | 时效 | 存疑点 | 缺哪一方验证 |
|---|---|---|---|---|---|
| P1 | DeepSeek 聘请中信证券筹备科创板 IPO | 21财经/财联社/南方财经(均引「知情人士」) | 09-09 21:05 | DeepSeek 官方零确认;已有投行人士公开称"为时尚早" | 公司公告或辅导协议备案 |
| P2 | OpenAI × MIT 量子计算实验自主运行(40 项仅干预 4 次) | 每日 AI 早报聚合号 | 09-09 | 无 OpenAI 官网稿 / 无论文 | OpenAI 或 MIT 官方发布 |
| P3 | Anthropic 研究员 Jacob Coxon 因 AI 安全担忧辞职并退出行业(警告"明年年底局势可能失控") | 聚合号转述 | 09-09 | 未见本人一手声明或 Anthropic 回应 | 本人公开声明 / Anthropic 回应 |
| P4 | 苹果新 Siri AI 支持简繁体中文但首发不含中国大陆(iOS/macOS 27 于 9/15 推送) | 聚合号转述 | 09-10 凌晨发布会后 | 未见 Apple 官网区域支持列表原文 | Apple 官方支持文档 |
| P5 | DeepSeek V4.1 Flash 内测实测 507 tokens/s、马里奥 7 分钟 <2 元 | 公众号实测 / 微信讨论串 | 09-09~09-10 | 个体非受控实测 | 官方基准或第三方复现 |
| P6 | Anthropic 公开评测并点名 OpenAI 模型提示注入风险与 Gemini Flash / Claude Opus 4.8 大致相当 | HeadsUpAI 转述 Anthropic 表态 | 约 20h 前 | 未见 Anthropic 原始评测报告 | Anthropic 官方报告 |
| P7 | Anthropic 顶尖研究员称"到明年年底局势可能已失控"|Claude 会话凭据被窃、额度遭盗用(TechCrunch 调查,Anthropic 已确认) | TechCrunch / 聚合号 | 09-09~09-10 | 影响面与退款口径不明 | Anthropic 官方安全公告 |
口径说明:三家评测机构的方法论、权重与采样时间完全不同,分数不可直接横向换算。下表并列呈现,用于观察「谁在哪个口径下领先」与「能力差距 vs 价格差距」的量级关系。
| # | 模型 | 总评 | 推理 | 编码 | 智能体编码 | 数学 | 数据分析 | 语言 | 指令遵循 | 每成功任务成本 |
|---|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Fable 5.1 Max Effort | 83.4 | 91.7 | 86.4 | 66.1 | 97.0 | 80.3 | 89.5 | 73.0 | $1.212 |
| 2 | Claude Fable 5 Max Effort | 83.0 | 89.7 | 86.0 | 62.2 | 96.0 | 80.5 | 90.7 | 75.8 | $1.439 |
| 3 | GPT-6 Astra Max Effort | 82.2 | 92.7 | 80.4 | 57.3 | 96.8 | 83.0 | 89.4 | 75.6 | $0.736 |
| 4 | Muse Spark 1.3 xHigh Effort | 81.6 | 89.7 | 81.1 | 64.1 | 95.9 | 79.6 | 82.8 | 78.0 | $0.219 |
| 5 | GPT-5.6 Sol Max Effort | 81.0 | 91.7 | 83.9 | 56.2 | 96.2 | 79.8 | 87.7 | 71.8 | $0.515 |
| 6 | GPT-5.5 Thinking xHigh | 80.2 | 89.7 | 82.1 | 54.0 | 95.9 | 81.6 | 87.4 | 70.7 | $0.435 |
| 7 | Claude 5 Opus Thinking Max | 80.1 | 91.2 | 81.4 | 65.2 | 95.7 | 74.6 | 88.7 | 63.8 | $0.699 |
| 8 | Kimi K3(开源) | 79.2 | 90.7 | 81.4 | 62.2 | 84.4 | 78.7 | 85.5 | 71.4 | $0.348 |
| 9 | Gemini 3.7 Flash High | 78.8 | 87.8 | 78.9 | 58.3 | 93.5 | 68.0 | 85.5 | 79.9 | $0.157 |
| 10 | Qwen 3.8 Max(开源) | 78.5 | 88.2 | 72.9 | 64.6 | 91.3 | 78.4 | 79.7 | 74.1 | $0.275 |
| 11 | Grok 4.6 | 78.0 | 90.5 | 76.8 | 57.0 | 92.6 | 73.9 | 83.7 | 71.9 | $0.207 |
| 14 | DeepSeek V4 Pro 0813(开源) | 77.4 | 85.8 | 77.2 | 54.9 | 95.1 | 79.2 | 82.1 | 67.7 | $0.044 |
| 17 | DeepSeek V4 Flash Vision Exp(开源) | 76.8 | 85.4 | 68.2 | 65.1 | 87.8 | 79.5 | 80.4 | 71.0 | $0.051 |
| 21 | GLM-5.3(开源) | 76.1 | 85.8 | 79.0 | 60.9 | 87.9 | 70.2 | 79.9 | 69.3 | $0.450 |
| 23 | Gemini 3.8 Flash High | 75.8 | 89.3 | 72.5 | 54.2 | 91.6 | 54.0 | 87.8 | 81.4 | $0.307 |
| 38 | GLM-5.3 Flash(开源) | 71.6 | 77.6 | 79.0 | 56.8 | 81.2 | 76.4 | 77.3 | 52.8 | $0.031 |
读法:LiveBench 是三口径中唯一同时给出"每成功任务成本"的榜单,因此最适合做真实账单推演。极差:每成功任务成本从 GLM-5.3-Flash 的 $0.031 到 Claude Fable 5 Max Effort 的 $1.439,相差 46 倍,而总评分只差 11.8 分(约 14%)——这个"能力小差距 / 成本大差距"的结构是本季度最稳定的结论。
| # | 模型 | 智能指数 | 每任务成本 | 输出速度 tok/s | 首块延迟 s | 总响应 s | 上下文 |
|---|---|---|---|---|---|---|---|
| 1 | Claude Fable 5.1 (max with fallback) | 53 | $7.63 | 67 | 286.06 | 293.49 | 1M |
| 1 | GPT-6 Astra (max) | 53 | $3.26 | 54 | 328.62 | 337.89 | 1.1M |
| 3 | GPT-6 Astra (xhigh) | 53 | $2.31 | 51 | 208.73 | 218.62 | 1.1M |
| 4 | Claude Fable 5.1 (high with fallback) | 51 | $3.91 | 54 | 24.87 | 34.12 | 1M |
| 5 | Claude Opus 5 (max) | 51 | $5.86 | 52 | 81.64 | 91.25 | 1M |
| 6 | Muse Spark 1.3 (max) | 48 | $1.60 | 226 | 26.92 | 38.00 | 1M |
| 7 | GPT-5.6 Sol (max) | 47 | $1.99 | 68 | 140.25 | 147.60 | 1M |
| 8 | GLM-5.3 (max)(开源最佳) | 45 | $2.01 | 60 | 2.86 | 44.42 | 1M |
| 9 | Grok 4.6 (high) | 44 | $1.86 | 55 | 41.39 | 50.45 | 500k |
| 9 | Kimi K3 (max)(开源) | 44 | $2.00 | 37 | 3.79 | 72.01 | 1.05M |
| 11 | GLM-5.3-Flash(开源) | 42 | $0.25 | 72 | 2.47 | 37.31 | 1M |
| 12 | Gemini 3.8 Flash (high) | 41 | $1.24 | 273 | 13.84 | 15.68 | 1M |
| 13 | Qwen3.8 Max(开源) | 40 | $2.67 | 39 | 2.45 | 65.86 | 1M |
| 14 | DeepSeek V4 Pro 0813 (max)(开源) | 36 | $0.67 | 78 | 1.62 | 33.46 | 1M |
| 15 | DeepSeek V4 Flash Vision (max)(开源) | 35 | $0.31 | 119 | 0.94 | 22.00 | 1M |
读法:AA 本日可直采实时页(此前多期为 JS 渲染失败需用快照,本日已解决,故不再使用 v4.1.1 快照)。Fable 5.1 与 GPT-6 Astra 并列 53 居首;开源最佳为 GLM-5.3(45),Kimi K3(44) 紧随。值得注意的错位:Muse Spark 1.3 (max) 智能指数 48 排第 6,但输出速度 226 tok/s 是头部唯一三位数——AA 的「智能」口径不奖励速度,而 Agent 实际体感高度依赖速度,这是"跑分 vs 体感"背离的又一例证(呼应 D4 社区实测)。
| # | 模型 | 综合分 | 推理 | 编码 | 智能体 | 上下文 | 速度 | 混合价 $/M | 许可 |
|---|---|---|---|---|---|---|---|---|---|
| 1 | GPT-6 Astra | 60.3 | 58.2 | 48.5 | 46.4 | 1.1M | 83 c/s | $11.90 | 闭源 |
| 2 | Claude Fable 5.1 | 56.3 | 53.3 | 35.0 | 41.9 | 1.0M | 49 c/s | $11.90 | 闭源 |
| 3 | GPT-5.6 Sol | 55.1 | 54.3 | 46.0 | 41.3 | 1.1M | 138 c/s | $6.19 | 闭源 |
| 4 | Muse Spark 1.3 | 55.1 | 52.6 | 41.9 | 40.6 | 1.0M | 84 c/s | $0.10 | 闭源 |
| 5 | Claude Opus 5 | 55.1 | 54.0 | 42.0 | 40.0 | 1.0M | 70 c/s | $5.95 | 闭源 |
| 6 | GLM-5.3 | 53.4 | 52.8 | 43.1 | 39.8 | 1.0M | 235 c/s | $1.33 | 开源 |
| 7 | Kimi K3 | 53.3 | 52.1 | 43.5 | 39.6 | 1.0M | 31 c/s | $3.39 | 开源 |
| 8 | DeepSeek-V4-Pro-0813 | 52.4 | 50.1 | 41.4 | 38.2 | 1.0M | 139 c/s | $0.46 | 开源 |
| 9 | Qwen3.8 Max | 52.0 | 50.7 | 39.9 | 37.8 | 1.0M | 148 c/s | $1.81 | 开源 |
| 10 | Gemini 3.8 Flash | 51.2 | 47.5 | 39.3 | 36.1 | 1.0M | 234 c/s | $0.89 | 闭源 |
| 11 | Hy4 preview(腾讯) | 51.0 | 50.8 | 40.0 | 36.8 | — | — | — | 开源 |
| 12 | GPT-5.6 Terra | 51.0 | 49.3 | 42.4 | 38.1 | 1.1M | — | $2.48 | 闭源 |
| 13 | Claude Opus 4.8 | 51.0 | 50.4 | 41.9 | 35.5 | 1.0M | 59 c/s | $5.95 | 闭源 |
| — | Claude Mythos Preview | 55.0 | 55.8 | 45.0 | 36.6 | — | — | — | UNRELEASED |
读法:llm-stats 与 AA/LiveBench 的排序分歧明显——AA 里并列第一的 GPT-6 Astra 在此居首一致,但 Claude Fable 5.1 在 llm-stats 第 2、在 LiveBench 第 1、在 AA 并列第 1,而 DeepSeek-V4-Pro-0813 在 llm-stats 仅第 8、LiveBench 第 14、AA 第 14。三家对"谁最强"有分歧,但对"谁最便宜"高度一致(DeepSeek / GLM / Qwen / Muse Spark)。注意:V4.1 Flash 今日发布,三家榜单尚未收录(截至 07:33),因此本期三表仍以 V4 Pro 0813 为 DeepSeek 代表——这是新模型发布后的常态滞后,下期应开始反映。
| # | 项目 | 星标 | Fork | 语言 | 定位 |
|---|---|---|---|---|---|
| 1 | openclaw/openclaw | 389.3k | 81.8k | TypeScript | 跨 OS/平台的通用 Agent 执行器 |
| 2 | deepseek-ai/deepseek-harness | 217.4k | 25.7k | TypeScript | "Everything is a Plugin" 插件化 harness |
| 3 | n8n-io/n8n | 203.9k | 60.6k | TypeScript | 原生 AI 能力的工作流自动化 |
| 4 | Significant-Gravitas/AutoGPT | 187.2k | 46.0k | Python | 自主 Agent 经典项目 |
| 5 | f/prompts.chat | 175k 段位 | — | HTML | Prompt 集合 |
| 6 | langgenius/dify | 155.2k | 24.5k | TypeScript | Agentic 工作流 / RAG |
| 7 | langflow-ai/langflow | 154.5k | 10.1k | Python | 可视化 Agent 编排 |
| 8 | open-webui/open-webui | 151.5k | 22.1k | Python | 本地/自托管模型前端 |
| 9 | msitarzewski/agency-agents | 151.3k | 24.3k | Shell | 一整套"AI 代理公司" |
| 10 | langchain-ai/langchain | 146.0k | 24.4k | Python | Agent 工程平台 |
| 11 | Shubhamsaboo/awesome-llm-apps | 136.9k | 20.1k | Python | 100+ Agent / Skill / RAG 应用 |
| 12 | harry0703/MoneyPrinterTurbo | 122.0k | 18.8k | Python | AI 一键生成短视频 |
当日最快上升(digest 口径):cathrynlavery/diagram-design +2,286、affaan-m/ECC +1,151、obra/superpowers +690、Tencent/teamai-cli +563、TauricResearch/TradingAgents +367。头部关键词 = Agent 执行面 + 技能/方法论的系统化治理。
计算方法:视角 A = llm-stats 综合分 ÷ llm-stats 混合价(8 输入:1 输出);视角 B = LiveBench 总评 ÷ LiveBench 每成功任务成本。两者均为单口径内自洽的合成指标,仅用于看量级与排序,不可跨视角直接比较。
| 领域 | 事件 | 时效 | 来源 | 置信度 |
|---|---|---|---|---|
| 就业结构 | 人社部等发布第八批新职业:11 个新职业 + 23 个新工种,「具身智能机器人应用技术员」列为新职业,「智能体开发员」「低空物流员」为新增工种;数字职业占新增新职业 45.5%,累计已发布 121 个新职业 | 09-09 | 21世纪经济报道 · 腾讯新闻 | 已确认 |
| 就业结构 | 京东「物理 AI 加速计划」承诺 5 年机器人售后服务网络覆盖 100+ 国家,创造超 10 万个机器人售后工程师岗位;3 年助力 100 家本体厂降本、100 家供应商业绩倍增 | 09-09 | 京东 JDD 官方 · 中国江苏网 | 已确认(目标口径) |
| 教育科研 | 外滩黑客松·AI Coding 大赛以 15,577 件作品创吉尼斯纪录;上万参赛者中近七成未满 18 岁、最小 6 岁,9 岁选手夺冠(作品两天迭代至 V7.4) | 09-09~09-10 | 外滩大会官方 · 新华社系 | 已确认 |
| 医疗健康 | 国内首款 AI 辅助研发原创药(西湖大学等联合研发,盐酸伊司特韦片)获国家药监局附条件批准上市;Frost & Sullivan 预测国内 AI 医疗市场 2023 年 88 亿 → 2033 年 3157 亿元,CAGR 43.1%;全球已有超 173 个 AI 发现药物项目处于活跃临床阶段 | 近日(无精确日) | 国家药监局 · 弗若斯特沙利文 | 已确认(获批)/ 大概率(预测) |
| 政务服务 / 法治 | 全国首个数字法治人工智能整体解决方案「法仪大模型应用」在京发布,覆盖行政复议、合法性审核等 12 个司法行政场景,输出精准度超 90%、覆盖 99% 业务情况,已在北京市各级司法行政机关深度应用,累计办理各类业务 20 万次 | 09-08(略超窗,作背景) | 司法部重点实验室 · 北京市司法局 | 已确认 |
| 公共安全 / 风险治理 | 最高人民法院发布 9 件反不正当竞争典型案例,某公司销售抢单「物理外挂」(点滑器)致平台订单分配机制失灵,判赔 300 万元,一审已生效 | 近日(无精确日) | 最高人民法院 | 大概率 |
| 风险治理 | 腾讯朱雀实验室开源 AI-Infra-Guard v4.1.9,可扫描 MCP server 与 agent skill 的 14 类风险(详见 A2);工行、招行、中国电信、联想、vivo、B站已在用 | 09-09 | Help Net Security 等 | 已确认 |
| 数字鸿沟 | 苹果新 Siri AI 支持英语、简繁体中文等 16 种语言,但官方标注首发不支持中国大陆,iOS/macOS 27 于 09-15 推送,国行用户仍需等待 | 09-10 凌晨 | 聚合号转述(未见 Apple 原文) | 待验证 |
| 风险治理(人才) | Anthropic 研究员 Jacob Coxon 辞职并退出 AI 行业,警告"各大 AI 公司竞相研发人类恐难掌控的自我改进系统……到明年年底局势可能已经失控" | 09-09 | 聚合号转述 | 待验证 |
本日社会效益的重心在「制度与人才供给开始追上技术速度」。三条线索同向:人社部新增「具身智能机器人应用技术员」职业(09-09)、京东承诺 10 万个售后工程师岗位(09-09)、外滩大会 AI Coding 大赛近七成参赛者未满 18 岁(09-09)——职业标准、岗位需求、基础教育三条线在同一天出现进展,这在过去一年的日报里是第一次。它意味着具身智能与 AI Coding 正在从"技术议题"变成"劳动力市场议题"。
同时需要警惕的是另一面:AI 越强,攻击面越大。同一天出现的还有 Claude 会话凭据被盗用刷额度(TechCrunch 调查,Anthropic 已确认)、最高法整治"物理外挂"、Anthropic 研究员因安全担忧离职。腾讯开源 AI-Infra-Guard 是对这一面的正面回应,但其自身"无鉴权"的设计缺陷恰恰说明——AI 安全工具链的成熟度,还落后于 AI 能力本身一到两个身位。
| 维度 | 事件 / 数据 | 时效 | 来源 | 置信度 |
|---|---|---|---|---|
| 投融资 · 海外 | Mistral AI 完成 30 亿欧元 D 轮,投后估值超 210 亿欧元;三星电子领投,欧盟基金及老股东联合领投,ASML、英伟达跟投;已服务空客等 125 家大型企业 | 09-09 | Mistral 官方 · 媒体 | 已确认 |
| 投融资 · 海外 | NEURA Robotics 完成至多 14 亿美元 C 轮(Tether 领投,Amazon/NVIDIA/Qualcomm/Bosch/Schaeffler/EIB 跟投);2026 年至今全球机器人公司融资 558 亿美元,接近去年两倍 | 09-09~09-10 | Tech Funding News 等 | 已确认 |
| 投融资 · 国内 | 具身智能初创 费莫一科技(PHYMI)完成近亿美元种子轮(IDG 资本领投,云启、滴滴、复星锐正、耀途、禾赛跟投);创始人刘念邱为元戎启行前技术合伙人 | 09-09 | 投中网 | 已确认 |
| 投融资 · 国内 | 物理 AI 企业深度智控(DeepCtrls)完成数亿元 B+ 轮(宁德时代领投,阿美投资、太平创新、广发信德跟投) | 近日 | 媒体 | 大概率 |
| 投融资 · 国内 | 千诀科技完成数亿元 A+ 轮(距 6 月 A 轮仅约三个月,元禾厚望、筱光资本等参投)——具身智能热钱正从"本体"流向"大脑" | 09-09 | 媒体 | 大概率 |
| 资本市场 | 优地机器人 09-09 登陆港交所主板:发行价 14.45 港元,收盘 36.68 港元,+153.84%,市值破 150 亿港元;中国第三大商用服务机器人厂商,累计售出超 11.4 万台,2025 年亏损收窄至 1.11 亿元 | 09-09 | 港交所公开数据 | 已确认 |
| 资本市场 | 证监会向头部投行下发非正式窗口指导,从营收真实性、盈利稳定性、技术创新性、商业化落地能力四维收紧人形机器人 IPO 审核;宇树科技上市后市值大幅回撤为导火索 | 近期(无精确日) | 媒体多源转述 | 待验证 |
| 资本市场 | DeepSeek 拟聘中信证券筹备科创板 IPO(详见 D3);两轮累计募资超 1000 亿元,投前估值 5000 亿元 | 09-09 | 财联社等引「知情人士」 | 待验证 |
| 产业规模 | IT桔子:2026 上半年国内具身智能赛道融资总额 935 亿元,远超 2025 全年 379 亿元;东吴证券预测 2027 年具身智能市场规模有望达 6328 亿元 | 09-08 报道(H1 数据) | IT桔子 · 东吴证券研报 | 已确认(统计数据) |
| 企业降本增效 | DeepSeek Flash 系列今日 12:00 起降价:缓存命中 −60%、未命中 −33%、输出 −11%;对比 V4 Pro 输出 −70%(详见 D2) | 09-10 12:00 生效 | DeepSeek 官方 | 已确认 |
| 企业降本增效 | 京东物流「超脑」3.0 将亿级包裹路径规划从分钟级压缩至秒级,具身模型物流多任务执行成功率 96.7%;Muse Spark 1.3 比 1.2 少 20% tool calls、少 25% tokens | 09-09 | 京东官方 · Meta 官方 | 已确认 |
| 区域 / 基建 | 谷歌宣布未来两年在芬兰投资至少 130 亿欧元(约 151 亿美元)建 AI 基础设施(欧洲史上最大单笔投资),与 Fortum 签 22 年购电协议锁定洛维萨核电站电量(谷歌在美国以外首份核电 PPA),建设期预计创造超 3.7 万个岗位 | 09-09 | 谷歌官方 | 已确认 |
| 区域 / 基建 | 北京发布「十五五」高精尖产业及数字经济发展规划:构建词元结算体系、打造词元工厂;截至 2026-06 我国日均词元调用量突破 500 万亿,北京占比超一半;已建成 8.2 万 P 智算中心,预计 2027 年达 20 万 P | 09-09 | 北京市政府 | 已确认 |
| 金融创新 | 广东推出首个词元经济专项金融产品「Token 贷」,将词元消耗、算力合约、数字经营数据纳入授信评估;多地银行同步落地算力贷、模型贷 | 近日(无精确日) | 媒体 | 大概率 |
| 成本压力 | 算力涨价潮:全球算力涨价持续,头部云厂商相关服务最高涨幅超三成;中型 AI 应用服务商算力成本占营收 30%–60%;专家称算力价格中枢将长期上移 | 近日(无精确日) | 经济日报 | 大概率 |
| 股权/基金 | 知乎拟以 15 亿元自有现金认购砺思资本旗下 AI 与机器人基金 LP 权益(占基金权益 ≤30%,估算基金目标总规模约 50 亿元);砺思曾参与 DeepSeek 首轮融资 | 09-09 | 知乎公告 | 已确认 |
本日经济效益呈"资本高位、监管收口、成本上行"三线并行的结构。
AI 日报 · 自动化生成 | 数据采集窗口 2026-09-09 07:30 → 2026-09-10 07:30(北京时间)| 生成时间 2026-09-10 07:30