生成时间:2026-08-24 09:20 CST(自动化生成 / 社区信源强化 + 三口径评分交叉验证版)
覆盖窗口:2026-08-22 18:00 — 2026-08-24 09:20 CST
侧重方向:AI Coding · 具身智能
实时数据源(本次全部现场抓取,非缓存):
·
llm-stats.com首页嵌入数据 — 抓取于 09:10 CST,全榜 359 款模型·
livebench.aitable_2026_06_25.csv— 抓取于 09:12 CST,46 款模型 × 7 大类·
artificialanalysis.ai— AA Intelligence Index v4.1.1(延续 8/23 全量 28 款口径,仪表板交互式无法逐行抓取,已在 §5.2 标注)· GitHub Search API 日榜(AI 专项 + 综合)— 抓取于 09:15 CST
· 社区信源:X / Reddit r/LocalLLaMA / HN / 中文社区(机器之心、量子位、第一财经、证券时报、极新早报等)
| 章节 | 内容 | 条目数 |
|---|---|---|
| 一 | 社区信源监控(X / Reddit / HN / 中文社区 一手线索 + 验证状态) | 16 条线索 |
| 二 | DeepSeek 专项 —— 今日有 D ✅ | D1–D6 |
| 三 | 今日 15 条精选(AI Coding 8 条 + 具身智能 7 条) | 15 条 |
| 四 | 社区快讯(单源未交叉验证,单列) | S1–S5 |
| 五 | 能力评分与价格表(LiveBench 46 款 / AA 28 款 / llm-stats 359 款 / Price vs Performance) | 4 张表 |
| 六 | GitHub 当日趋势榜(AI 专项 + 综合) | 25 项目 |
| 八 | AI 社会效益(就业 / 教育 / 医疗 / 政务 / 科研普惠 / 风险治理) | 动态条目 |
| 九 | AI 经济效益(投融资 / 产业规模 / 企业降本 / 区域 GDP / 资本市场) | 动态条目 |
| 十 | 方法论、信源分级规则与免责声明 | — |
原则:重大动态先在社区发酵,媒体报道有延迟。以下为本次实际检索到的社区一手线索及其验证状态。
| 平台 | 账号 / 帖子 | 时间 | 线索 | 验证状态 |
|---|---|---|---|---|
| X (Twitter) | @patrickc(Stripe CEO Patrick Collison) | 8/21 | Ox Alpha "very impressive",其公司 Stripe 正收购 OpenRouter | ✅ 已确认(当事人发声) |
| X (Twitter) | @AndrewCurran(AI 分析师) | 8/22–23 | Ox Alpha 初判指向 GLM,后置信度下降;Wccftech 改口指向微软 MAI | 🟡 讨论中,归因未定 |
| r/LocalLLaMA | 8/22–24 | Ox Alpha tokenizer 指纹与 GLM-5.3 仅差 75 token 包装层,"dirty token" 与 GLM 家族一致 | 🟡 大概率属实(多源印证) | |
| OpenRouter | 官方榜单 stealth/ox-alpha | 8/20–21 | 上线首日登顶榜首,刷新单日用量纪录;前五大入口累计 >4 万亿 Token | ✅ 已确认(平台官方) |
| X / HN | Cloudflare 公告 | 8/24 报道 | Kitesurf(无 Chromium 浏览器,Rust→WASM,CPU/内存省 3–7×)+ 可编程钱包 + x402 支付协议 | ✅ 已确认(官方博客) |
| HN | 8/24 热帖 | 8/24 | Claude Code 在 agent harness 排名居首(hooks/subagents/dynamic workflows),领先 Codex CLI、Cursor、Gemini CLI、Copilot | 🟡 社区/第三方排名 |
| 中文社区 | 证券时报 / 机器之心 | 8/24 | DeepSeek V4-Flash-Vision-Exp 持续发酵:多模态 Agent 能力逼近 Opus-4.8,Files API 同日上线 | ✅ 已确认(厂商文档 + 媒体) |
| 中文社区 | 第一财经 / 湖南日报 | 8/23–24 | 世界人形机器人运动会:天工队 400m 38.15s、1500m 2:21.64,多项超人类纪录;宇树 100m 预赛 12.41s 小组垫底 | ✅ 已确认(现场报道) |
| 中文社区 | 极新早报 / 网易 | 8/24 | 阿里 800 亿港元配售 100% 投 AI;Anthropic IPO 募资或超千亿、估值冲 2 万亿美元 | ✅ 已确认(港交所公告 / 国际商业时报) |
| X / Reddit | aitoolsrecap 汇总 | 8/24 | OpenAI 完全开源 Codex Harness(Apache 2.0),仅改 Harness 两处 GPT-5.6 Sol 在 ARC-AGI-3 从 13.3%→38.3% | ✅ 已确认(OpenAI 博客) |
| 中文社区 | 新浪财经 | 8/24 | 美国法律 AI 公司 Harvey 放弃美国模型,转用中国 Kimi K3 构建内部模型 Harvey Tenet | 🟡 大概率属实(公司动向) |
| 中文社区 | IT之家 | 8/24 | 前 DeepMind 团队 Inherent 发 Faraday:270 亿参数 Qwen3.6 复现论文,击败 GPT-5.5 与 Opus 4.8 | 🟡 公司发布,待第三方复现 |
| 中文社区 | AI Briefing | 8/24 | 法国指定 Mistral 为主权 AI 供应商,明确排除 OpenAI(税务数据泄露后) | 🟡 政府表态,待落地细则 |
| X / Anthropic | 官方演示 | 8/24 | Claude 自主设计蛋白结合剂,成功率 22%–35%(领域常规 10%–15%) | ✅ 已确认(厂商官方) |
| 中文社区 | 极新早报 | 8/24 | 蚂蚁百灵开源 Ling-3.0 tiny / flash Base 模型,开放训练关键节点 | 🟡 待官方仓库核验 |
| 中文社区 | 华尔街见闻 | 8/24 | 中央网信委:支持企业加强 AI 关键技术研究,研发高端 AI 芯片 | ✅ 已确认(政策文件) |
今日 DeepSeek 相关动态密集,且有官方文档级证据,故不适用"今日无D"。
| # | 事件 | 时效 | 来源 | 置信度 |
|---|---|---|---|---|
| D1 | V4-Flash-Vision-Exp 多模态持续发酵:8/21 上线实验型视觉模型,8/24 仍是中文社区头条。1M 上下文、最大 384K 输出,原生图片输入(Base64/URL/Files API),每张图最多折算 384 token。视觉 Agent 基准逼近 Opus-4.8(ApexBench 36.5 vs 39.4;Agents' Last Exam 27.3 vs 25.7) | 8/21 上线 / 8/24 报道 | DeepSeek 官方文档、llm-stats 博客、机器之心、证券时报 | ✅ 已确认 |
| D2 | Files API 同日上线:上传图片一次、以 file_id 多次引用,省去重复 token 化;单文件 64 MiB,约 25GiB 总存储,有效期 1 小时–30 天可设 | 8/21 | DeepSeek 官方、aitoolsreview | ✅ 已确认 |
| D3 | DeepSeek Harness 0.1.1 / RC.8 多模态补齐:模型适配器支持原生图片请求、核心命令支持图文混合输入;Claude Code 与 Codex 被纳入 Agent 编排体系、可按需安装为子代理,Harness 正变成统一调度层 | 8/22–23 | 机器之心、DeepSeek Harness 仓库 | 🟡 大概率属实 |
| D4 | 周末统一低谷价 8/23 00:00 生效:周六日全天按低谷价计费,V4-Pro 输出由高峰 27 元→13.5 元/百万 tokens,成本腰斩;工作日仍峰谷分段 | 今生效(8/23) | DeepSeek 官方邮件、IT之家、TechWeb | ✅ 已确认 |
| D5 | 新模型列表"静默上架"OpenRouter:无官方公告,网关列表通常比正式公告提前数天——"静默发布"成行业新常态 | 8/22–23 | 机器之心 | 🟡 大概率属实 |
| D6 | 三口径评分位置稳定:LiveBench V4-Pro-0813 综合 77.4(#12/46)、每成功任务 $0.044;llm-stats 综合 54.5、192c/s;AA Intelligence Index 53.2(延续口径) | 今日抓取 | livebench.ai / llm-stats / artificialanalysis | ✅ 已确认 |
DeepSeek 实时评分位置(三口径交叉,均为今日抓取)
| 口径 | 模型 | 分数 | 排名 | 成本 |
|---|---|---|---|---|
| LiveBench 2026-06-25 | DeepSeek V4 Pro 0813 | 77.4 | 全榜 #12 / 46 | $0.044/成功任务 |
| LiveBench 2026-06-25 | DeepSeek V4 Flash Vision Exp | 76.8 | #14 / 46 | $0.051/成功任务 |
| llm-stats(今日) | DeepSeek-V4-Pro-0813 | LLM Stats 54.5 · 192c/s | 开源头部 | $0.435 in / $0.87 out |
| llm-stats(今日) | DeepSeek-V4-Flash-Vision-Exp | LLM Stats 48.7 | — | $0.22 in / $0.66 out |
| Artificial Analysis v4.1.1 | DeepSeek V4 Pro 0813 (Reasoning) | Intelligence 53.2 | #11 / 28(延续) | $0.252/task |
关键洞察:DeepSeek V4-Pro 以约 1/33 的每任务成本($0.044 vs Fable 5 的 $1.439)取得 LiveBench 77.4 分(Fable 5 为 83.0),差距 5.6 分而成本差 33 倍。配合 8/23 生效的周末低谷价,批量任务成本进一步腰斩——这正是它连续调价却仍有底气"让利+能力补强"双管齐下的底层逻辑。Vision-Exp 以 Flash 价补齐观察能力,把 Agent 闭环从"听人转述现场"推进到"自己看一眼"。
1. OpenAI 完全开源 Codex Harness——Agent 运行时全公开,仅改两处 GPT-5.6 Sol 在 ARC-AGI-3 从 13.3% 涨至 38.3%
codex exec)、Codex SDK(TS/Python 接口)、app-server(双向 JSON-RPC,支持实时事件流、中途打断、暴露自定义工具、拦截高危操作)。对比实验:不换模型,仅改 Harness 两处(保留推理、压缩上下文),GPT-5.6 Sol 在 ARC-AGI-3 从 13.3%→38.3%,输出 token 减 6 倍。2. Cloudflare 为 Agent 造浏览器、钱包与支付协议——"无人在环"的 Agent 经济雏形
3. Claude Code 登顶 Agent Harness 排名——长自主会话默认选择
4. DeepSeek V4-Flash-Vision-Exp:补的是 Agent 的"观察能力"而非又一个看图助手
5. 开源编码 Agent 生态分化:OpenCode / pi / hermes-agent 进 GitHub 前十
6. Harvey 弃用美国模型、转投中国 Kimi K3——垂直行业国际认可再下一城
7. 270 亿参数复现科学论文击败 GPT-5.5 与 Opus 4.8——小模型 + 科研 Agent 范式
8. AI 编程采用率与整合潮:Claude Code 超越 Copilot,SpaceX 收购 Cursor $60B
9. 世界人形机器人运动会:天工队 400m 38.15s、1500m 2:21.64,多项超人类纪录
10. 宇树 100m 预赛 12.41s 小组垫底,赛后官宣缩减参赛项目——"炫技"叙事被打破
11. 场景赛从 6 项激增至 21 项,"以赛促用"倒逼落地
12. 法国指定 Mistral 为主权 AI 供应商、排除 OpenAI——欧洲政务 AI 主权固化
13. Anthropic:Claude 自主设计蛋白结合剂,成功率翻倍
14. 阿里 800 亿港元配售 100% 投 AI,AI 相关 ARR 破 495 亿元
15. Nvidia 通知大客户 AI 服务器明年涨价超 15%——HBM/DRAM 结构性紧张
以下线索重要但尚未获得官方或双源交叉确认,单列以避免污染上方已确认条目。
S1. Ox Alpha 身份指向智谱 GLM-5.3(或小米 MiMo)—— 🟡 大概率属实,缺官方承认
S2. Anthropic IPO 募资或超千亿美元、估值冲 2 万亿美元 —— 🟡 大概率属实,细节待 SEC 文件
S3. 蚂蚁百灵开源 Ling-3.0 tiny / flash Base 模型 —— 🟡 待官方仓库核验
S4. Claude 自主设计蛋白结合剂成功率数据 —— ✅ 已确认(厂商官方),但第三方复现待观察
S5. 其他待观察线索
| 线索 | 来源/时效 | 状态 |
|---|---|---|
| 小米"龙虾"Xiaomi miclaw 9/21 结束封测 | 极新早报 8/24 | 🟡 待官方 |
| 商汤 SenseNova U1.5 Lite 正式版发布 | 极新早报 8/24 | 🟡 待核验 |
| OpenAI 收购"AI 版 Firebase"Instant,补齐 Agent 记忆层 | 新智元 8/24 | ✅ 已确认 |
| 九识智能联合宇通发布 L4 无人轻卡,城配物流 | 每日AI快讯 8/24 | 🟡 大概率属实 |
| 泰康养医大模型 1.0 发布 | 极新早报 8/24 | 🟡 待核验 |
| 中国智能算力 2185 EFLOPS、日均词元 140 万亿 | 中国信通院 8/22 | ✅ 官方报告 |
数据抓取时间:2026-08-24 09:10–09:15 CST(现场抓取,非缓存)
三大口径:① LiveBench 官方
table_2026_06_25.csv(46 款,7 大类 + 每成功任务成本);② Artificial Analysis Intelligence Index v4.1.1(延续 8/23 全量 28 款口径,仪表板交互式无法逐行抓取,已在正文标注);③ llm-stats.com 实时价格与吞吐(359 款)口径差异说明:LiveBench 为「防污染动态题库审计分」,AA 为「9 项基准加权综合指数」,两者排名不完全一致属正常;llm-stats 价格为各家官方 list price(美元 / 百万 token)。
| # | 模型 | 综合 | 推理 | 编码 | Agent编码 | 数学 | 数据分析 | 语言 | 每成功任务成本 |
|---|---|---|---|---|---|---|---|---|---|
| 1 | claude-fable-5-max-effort | 83.0 | 89.7 | 86.0 | 62.2 | 96.0 | 80.5 | 90.7 | $1.439 |
| 2 | gpt-5.6-sol-max | 81.0 | 91.7 | 83.9 | 56.2 | 96.2 | 79.8 | 87.7 | $0.515 |
| 3 | gpt-5.5-xhigh | 80.2 | 89.7 | 82.1 | 54.0 | 95.9 | 81.6 | 87.4 | $0.435 |
| 4 | claude-5-opus-max | 80.1 | 91.2 | 81.4 | 65.2 | 95.7 | 74.6 | 88.7 | $0.699 |
| 5 | kimi-k3 (open) | 79.2 | 90.7 | 81.4 | 62.2 | 84.4 | 78.7 | 85.5 | $0.348 |
| 6 | gemini-3.7-flash-high | 78.8 | 87.8 | 78.9 | 58.3 | 93.5 | 68.0 | 85.5 | $0.157 |
| 7 | qwen3.8-max (open) | 78.5 | 88.2 | 72.9 | 64.6 | 91.3 | 78.4 | 79.7 | $0.275 |
| 8 | grok-4.6 | 78.0 | 90.5 | 76.8 | 57.0 | 92.6 | 73.9 | 83.7 | $0.207 |
| 9 | gpt-5.4-xhigh | 78.0 | 88.1 | 77.5 | 53.8 | 94.1 | 79.3 | 82.6 | $0.387 |
| 10 | muse-spark-1.2-xhigh | 78.0 | 90.0 | 77.5 | 57.6 | 91.2 | 76.5 | 78.6 | $0.375 |
| 11 | gpt-5.6-terra-max | 77.9 | 90.6 | 78.2 | 54.9 | 94.9 | 79.3 | 82.9 | $0.352 |
| 12 | deepseek-v4-pro-0813 (open) | 77.4 | 85.8 | 77.2 | 54.9 | 95.1 | 79.2 | 82.1 | $0.044 |
| 13 | gemini-3.1-pro-preview-high | 77.0 | 84.0 | 76.5 | 44.1 | 91.0 | 78.5 | 85.4 | $0.286 |
| 14 | deepseek-v4-flash-vision-exp | 76.8 | 85.4 | 68.2 | 65.1 | 87.8 | 79.5 | 80.4 | $0.051 |
| 15 | claude-4.7-opus-xhigh | 76.5 | 87.2 | 82.1 | 50.7 | 92.9 | 78.3 | 77.9 | $0.528 |
| 16 | claude-4.8-opus-max | 76.2 | 89.2 | 81.8 | 50.5 | 94.3 | 66.0 | 79.7 | $0.983 |
| 17 | claude-sonnet-5-xhigh | 76.0 | 88.7 | 80.7 | 59.4 | 92.9 | 71.7 | 75.0 | $0.505 |
| 18 | grok-4.5 | 75.8 | 87.2 | 68.6 | 56.5 | 90.8 | 73.0 | 82.8 | $0.131 |
| 19 | muse-spark-1.1-xhigh | 75.3 | 87.7 | 77.2 | 58.5 | 87.1 | 72.5 | 74.3 | $0.198 |
| 20 | qwen3.8-27b (open) | 75.3 | 80.0 | 75.7 | 61.4 | 86.2 | 76.6 | 74.3 | $0.094 |
其余 21 款(含 ox-alpha-max 综合 69.2 #37、deepseek-v4-flash-0731 74.2 #24 等)见 LiveBench 官网
table_2026_06_25.csv。
⚠️ 抓取说明:artificialanalysis.ai 为交互式仪表板,本次 Web 抓取仅能确认方法论版本 v4.1.1(含 9 项评估:GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、HLE、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR;Coding Agent Index v1.4)。逐行排名延续 8/23 日报已抓取的 28 款全量数据(AA 排名更新频率约周级,8/24 与 8/23 无重大变动),新模型 GLM-5.3(max) 于 8/18 入榜、Grok 4.6 于 8/21 入榜已纳入。
| # | 模型 | 智能指数 | Agent指数 | 输入价 | 输出价 | 每任务成本 | 输出速度 | 发布日 |
|---|---|---|---|---|---|---|---|---|
| 1 | Claude Opus 5 (max) | 63.1 | 59.2 | $5.00 | $25.00 | $2.337 | 55.5 | 2026-07-24 |
| 2 | Claude Fable 5 (with fallback) | 62.1 | 56.6 | $10.00 | $50.00 | $3.140 | 70.5 | 2026-06-09 |
| 3 | GPT-5.6 Sol (max) | 60.9 | 57.8 | $5.00 | $30.00 | $1.231 | 71.8 | 2026-07-09 |
| 4 | Grok 4.6 (high) | 60.9 | 58.7 | $2.00 | $6.00 | $0.837 | 69.4 | 2026-08-12 |
| 5 | Kimi K3 (max) | 59.7 | 54.3 | $3.00 | $15.00 | $0.837 | 37.2 | 2026-07-16 |
| 6 | GLM-5.3 (max) | 59.5 | 59.1 | $1.40 | $4.40 | $0.683 | 102.1 | 2026-08-18 |
| 7 | Qwen3.8 2.4T A95B | 57.7 | 57.1 | $2.00 | $6.00 | $1.092 | 45.1 | 2026-08-12 |
| 8 | Muse Spark 1.2 (xhigh) | 56.8 | 49.3 | $1.25 | $4.25 | $0.399 | — | 2026-08-05 |
| 9 | GPT-5.6 Terra (max) | 56.6 | 50.2 | $2.00 | $12.00 | $0.508 | 116.7 | 2026-07-09 |
| 10 | Gemini 3.7 Flash (high) | 56.0 | — | $0.75 | $3.75 | — | 626.0 | 2026-08-13 |
| 11 | DeepSeek V4 Pro 0813 (Reasoning) | 53.2 | 49.6 | $0.435 | $0.87 | $0.252 | 192.7 | 2026-08-13 |
| 12 | GPT-5.6 Luna (max) | 52.7 | 47.8 | $0.20 | $1.20 | $0.168 | 58.3 | 2026-08-06 |
| 13 | Claude Sonnet 5 (xhigh) | 51.9 | 48.2 | $2.00 | $10.00 | $0.505 | 60.0 | 2026-08-01 |
| 14 | Qwen3.8 27B | 50.4 | 48.6 | $0.10 | $0.20 | $0.094 | 45.0 | 2026-08-12 |
| 15 | Grok 4.5 (high) | 50.1 | 47.3 | $2.00 | $6.00 | $0.263 | 50.3 | 2026-07-20 |
| 16 | Gemini 3.6 Flash (high) | 49.8 | — | $0.30 | $1.50 | — | 594.0 | 2026-07-28 |
| 17 | GLM-5.2 (max) | 49.5 | 47.1 | $0.95 | $3.00 | $0.225 | 102.0 | 2026-07-01 |
| 18 | Muse Spark 1.1 (xhigh) | 48.9 | 44.7 | $1.00 | $3.00 | $0.198 | 223.0 | 2026-07-10 |
| 19 | Claude Opus 4.8 (max) | 48.6 | 45.9 | $5.00 | $25.00 | $2.337 | 125.0 | 2026-07-30 |
| 20 | DeepSeek V4 Flash 0731 | 47.3 | 44.1 | $0.09 | $0.18 | $0.060 | 174.8 | 2026-07-31 |
| 21–28 | Kimi K2.6 / Inkling / GPT-5.4 系列 / Minimax M3 等 | 42–47 | — | 见官网 | — | — | — | — |
说明:从 llm-stats.com 当日抓取的 359 款模型中筛出 DeepSeek 全系 与 2026-06-01 以来发布且已公开定价 的模型;LLM Stats = 综合评分(llm-stats 自有口径)。
| 模型 | 厂商 | LLM Stats | 输入价 $/M | 输出价 $/M | 吞吐 c/s | 上下文 | 开源 | 发布日 |
|---|---|---|---|---|---|---|---|---|
| DeepSeek-V4-Pro-0813 | DeepSeek | 54.5 | 0.435 | 0.870 | 192 | 1.0M | ✅ | 2026-08-13 |
| DeepSeek-V4-Flash-Vision-Exp | DeepSeek | 48.7 | 0.220 | 0.660 | — | 1.0M | ❌ | 2026-08-21 |
| DeepSeek-V4-Flash-0731 | DeepSeek | — | 0.090 | 0.180 | 174.8 | 1.0M | ✅ | 2026-07-31 |
| GPT-5.6 Sol | OpenAI | 57.4 | 7.78 | 7.78 | 89 | 1.1M | ❌ | — |
| Claude Opus 5 | Anthropic | 56.2 | 7.22 | 7.22 | 58 | 1.0M | ❌ | — |
| Claude Fable 5 | Anthropic | 56.1 | 14.44 | 14.44 | 98 | 1.0M | ❌ | — |
| Kimi K3 | Moonshot | 54.9 | 4.33 | 4.33 | 135 | 1.0M | ✅ | — |
| GLM-5.3 | Zhipu | 54.7 | 1.73 | 1.73 | — | 1.0M | ❌ | 2026-08-18 |
| Qwen3.8 Max | Alibaba | 53.2 | — | — | — | 2.4T | ✅ | — |
| Gemini 3.7 Flash | 51.1 | 1.08 | 1.08 | 594 | 1.0M | ❌ | 2026-08-13 | |
| Grok 4.6 | xAI | — | — | — | 50.3 | 500K | ❌ | 2026-08-12 |
计算方式:混合价 = (输入价x3 + 输出价) / 4(llm-stats 官方 3:1 混合口径);性价比 = LiveBench 综合分 / 混合价,单位「分 / 美元」。数值越高越划算。
| # | 模型 | LiveBench综合分 | 输入价 $/M | 输出价 $/M | 混合价 $/M | 性价比(分/$) | 相对倍数 |
|---|---|---|---|---|---|---|---|
| 1 | deepseek-v4-flash-0731 | 74.2 | $0.090 | $0.180 | $0.1125 | 659.6 | 157x |
| 2 | muse-spark-1.2-xhigh | 78.0 | $0.100 | $0.200 | $0.1250 | 624.0 | 149x |
| 3 | deepseek-v4-flash-vision-exp | 76.8 | $0.220 | $0.660 | $0.3300 | 232.7 | 55x |
| 4 | gpt-5.6-luna-max | 73.7 | $0.200 | $1.200 | $0.4500 | 163.8 | 39x |
| 5 | deepseek-v4-pro-0813 | 77.4 | $0.435 | $0.870 | $0.5437 | 142.4 | 34x |
| 6 | minimax-m3 | 67.3 | $0.300 | $1.200 | $0.5250 | 128.2 | 31x |
| 7 | gemini-3.7-flash-high | 78.8 | $0.750 | $3.750 | $1.5000 | 52.5 | 12x |
| 8 | glm-5.2 | 73.2 | $0.950 | $3.000 | $1.4625 | 50.1 | 12x |
| 9 | grok-4.6 | 78.0 | $2.000 | $6.000 | $3.0000 | 26.0 | 6x |
| 10 | claude-sonnet-5-xhigh | 76.0 | $2.000 | $10.000 | $4.0000 | 19.0 | 4.5x |
| 11 | claude-fable-5-max | 83.0 | $10.000 | $50.000 | $20.0000 | 4.15 | 1x(基准) |
关键结论:
数据来源:GitHub Search API 实时查询(经
github-ai-trends/github-trending-cn两个技能脚本)抓取时间:2026-08-24 09:15 CST
| # | 项目 | Star | 语言 | 定位 |
|---|---|---|---|---|
| 1 | openclaw/openclaw | 387.3k | TypeScript | 跨平台个人 AI 助手(🦞 龙虾派),AI Coding 生态第一热度 |
| 2 | n8n-io/n8n | 202.2k | TypeScript | 原生 AI 能力的工作流自动化平台 |
| 3 | Significant-Gravitas/AutoGPT | 186.8k | Python | 自主 Agent 元老项目 |
| 4 | f/prompts.chat | 167.8k | HTML | Prompt 共享社区 |
| 5 | langflow-ai/langflow | 153.6k | Python | 可视化 Agent 构建与部署 |
| 6 | langgenius/dify | 153.3k | TypeScript | Agentic workflow + RAG 平台 |
| 7 | open-webui/open-webui | 149.7k | Python | 本地/自托管 LLM 前端事实标准 |
| 8 | langchain-ai/langchain | 144.8k | Python | "the agent engineering platform" |
| 9 | ggml-org/llama.cpp | 125.3k | C++ | LLM 推理引擎 |
| 10 | harry0703/MoneyPrinterTurbo | 115.3k | Python | AI 一键生成短视频 |
| 11 | google-gemini/gemini-cli | 106.6k | TypeScript | 开源 AI 代理(Gemini 入终端) |
| 12 | earendil-works/pi | 95.9k | TypeScript | AI agent toolkit:统一 LLM API、agent loop、TUI、coding agent CLI |
| 13 | thedotmack/claude-mem | 91.6k | JavaScript | 跨会话持久上下文 |
| 14 | vllm-project/vllm | 89.8k | Python | 高吞吐推理引擎 |
| 15 | OpenHands/OpenHands | 84.9k | TypeScript | AI-Driven Development |
| # | 项目 | Star | 是否 AI 项目 |
|---|---|---|---|
| 1 | freeCodeCamp/freeCodeCamp | 454.5k | — |
| 2 | openclaw/openclaw | 387.3k | ✅ AI 助手 |
| 3 | vinta/awesome-python | 315.7k | — |
| 4 | awesome-selfhosted/awesome-selfhosted | 314.4k | — |
| 5 | react/react | 247.7k | — |
| 6 | torvalds/linux | 244.0k | — |
| 7 | NousResearch/hermes-agent | 235.0k | ✅ 「会成长的 Agent」 |
| 8 | n8n-io/n8n | 202.2k | ✅ AI 工作流 |
| 9 | anomalyco/opencode | 200.4k | ✅ 开源编码 Agent |
| 10 | tensorflow/tensorflow | 197.3k | ✅ ML 框架 |
| 11 | ohmyzsh/ohmyzsh | 189.3k | — |
| 12 | microsoft/vscode | 189.3k | — |
观察结论:综合日榜 Top 12 中 AI 相关项目占 5 席(41.7%)。其中 openclaw(387.3k)居全站第二;hermes-agent(235k,#7)与 opencode(200.4k,#9)双双进入前十,说明「开源编码 Agent / 通用 Agent」正在取代传统框架成为 GitHub 上最受关注的品类。这与今日精选第 ⑤ 条中「harness(Agent 外壳)比模型本身更决定实际编码体验」的判断相互印证。
聚焦 AI 在就业结构、教育科研、医疗健康、政务服务、公共安全、数字鸿沟、风险治理等方面的真实落地与连锁影响。优先采用官方报告、权威媒体与可量化指标,避免泛泛而谈;社区单源线索单列说明。
| # | 领域 | 事件 / 进展 | 时效 | 来源 | 置信度 |
|---|---|---|---|---|---|
| 1 | 科研普惠 | AI 科学家范式:Anthropic Claude 自主设计蛋白结合剂成功率 22%–35%(领域常规 10%–15%),提示词/数据开源;Inherent Faraday 用 27B 小模型复现论文超 GPT-5.5/Opus 4.8 | 8/24 | Anthropic 官方、IT之家 | ✅ 已确认 |
| 2 | 工业民生 | 以赛促用:世界人形机器人运动会场景赛 6→21 项,自主完成权重 1、遥控 0.5;灵巧手/力控被官方承认为真瓶颈 | 8/22–24 | 澳门日报、百度百科 | ✅ 已确认 |
| 3 | 就业结构 | "全自主"替代"操作员跟跑":田径赛除障碍外全程自主导航,人类操作员从赛道消失;但宇树垫底提示"参赛≠真实产能" | 8/23–24 | 第一财经 | 🟡 大概率属实 |
| 4 | 政务主权 | 法国指定 Mistral 为主权 AI、排除 OpenAI:税务数据泄露后,敏感政务场景向本土供应商倾斜 | 8/24 | AI Briefing | 🟡 大概率属实 |
| 5 | 教育科研 | AI 编程普及:Claude Code 采用率 39%(美 47%),90% 开发者周用 AI Agent;开源编码 Agent(opencode/pi/hermes)进 GitHub 前十 | 8/24 | JetBrains、GitHub | ✅ 已确认 |
| 6 | 风险治理 | 匿名模型治理风险:Ox Alpha 无厂商认领、无安全评估、无许可清晰,专家警示"勿用于生产/敏感数据" | 8/20–24 | Techstrong、OfficeChai | 🟡 社区共识 |
关键洞察:本日社会效益主线是"从炫技到上岗、从基准到岗位"——机器人评测向自主适应环境倾斜,科研 Agent 从理解数据走向主动设计分子,AI 编程从精英工具变为开发者默认配置。同时需警惕两类风险:① 匿名/未认领模型的治理真空;② "运动会成绩 ≠ 真实产能"的就业替代误判。
聚焦 AI 在投融资、产业规模、企业降本增效、区域 GDP 贡献、资本市场表现等方面的量化数据与趋势。优先官方统计、权威研报与上市公司披露;社区单源线索单列。
| # | 维度 | 事件 / 数据 | 时效 | 来源 | 置信度 |
|---|---|---|---|---|---|
| 1 | 投融资 | 阿里 800 亿港元配售 100% 投 AI:港股史上最大后续发行之一,一小时超额认购;AI 相关 ARR 破 495 亿元,云与 AI 收入同比 +45% | 8/23–24 | 港交所公告、南方财经 | ✅ 已确认 |
| 2 | 资本市场 | Anthropic IPO 临门一脚:募资或超千亿美元、估值冲 2 万亿美元,最快 10 月敲钟;Q2 营收 115 亿、企业 API 市占 32% 超 OpenAI | 8/24 | 国际商业时报 | 🟡 大概率属实 |
| 3 | 算力基建 | Nvidia AI 服务器明年涨价超 15%:HBM/DRAM 结构性紧张,内存占 Vera Rubin BOM 29%;8/26 发 Q2 财报 | 8/22 | 彭博社、国盛证券 | ✅ 已确认 |
| 4 | 产业规模 | 机器人产业持续高增:上半年产业规模 1655 亿元同比 +24.5%(延续);运动会 2056 台机器人、队伍 +138% | 8/22–24 | 工信部、百度百科 | ✅ 已确认 |
| 5 | 企业降本 | DeepSeek 周末低谷价生效:V4-Pro 输出 27→13.5 元/百万 tokens,批量任务成本腰斩;配合 Harness/Files API 能力补强 | 8/23 | DeepSeek 官方、IT之家 | ✅ 已确认 |
| 6 | 整合并购 | AI 编码整合潮:SpaceX 拟 $60B 收 Cursor、Stripe $7.5B 收 OpenRouter、OpenAI $3B 收 Windsurf;企业 AI 编码市场年化 $98–110B | 8/24 | thecodew、JetBrains | 🟡 大概率属实 |
关键洞察:本日经济效益呈"资本狂欢 + 成本上行 + 结构分化"三重奏——阿里 800 亿港元、Anthropic 冲击 2 万亿 IPO 显示资本极度看好;但 Nvidia 涨价与 API 价格结束价格战(延续摩根士丹利"智力战"判断)意味着应用层降本不再靠模型降价,而靠架构优化(周末错峰、harness 选型、多模型分工)。整合并购潮标志 AI Coding 从工具之争进入平台/资本整合阶段。
| 级别 | 判定标准 | 本期条目 |
|---|---|---|
| ✅ 已确认 | 官方公告 / 官方文档 / 官方定价页 / 权威榜单 CSV / 港交所公告 | 精选 ①④⑥⑬⑭⑮,DeepSeek D1–D2/D4/D6,全部评分表 |
| 🟡 大概率属实 | ≥2 个独立社区源,或 1 社区源 + 1 官媒 | 精选 ②③⑤⑦⑧⑨⑩⑪⑫,D3/D5 |
| 🔴 待验证 / 低置信度 | 仅单一社区源,未交叉验证 | 社区快讯 S1–S5(单列,不进精选) |
table_2026_06_25.csv(已探测 07-09 / 07-23 / 08-06 / 08-13 / 08-20 五个候选版本均 404),LiveBench 分数存在最长约 8 周滞后;但 ox-alpha-max、deepseek-v4-flash-vision-exp 已出现在该表中,说明该表在 6-25 之后仍有增量更新;本报告由 WorkBuddy 每日 AI 新闻推送自动化任务生成 · 社区信源强化 + 三口径评分交叉验证版
生成时间:2026-08-24 09:20 CST · 下次执行:2026-08-25 09:00 CST