奔跑的高达
AI Pulse

OpenAI 再次下调 GPT-5.6 Sol 价格:输入降 20%、输出降 33%,三个月内第三次调价

2026 / 08 / 22 · Saturday
3 信源验证 HN / GitHub / HuggingFace 社媒热评 AI 自动采集

收集时间:2026-08-23 06:00 CST | 窗口:2026-08-22 00:00–24:00(CST)= 08-21 16:00 – 08-22 16:00 UTC 信源:Hacker News(Algolia API 实时校验,窗口内 ≥30 分帖全量筛查)、GitHub Trending(since=daily)、HuggingFace Trending、BestBlogs EP152、OpenAI/Anthropic/MCP 官方源、Guardian/Reuters、量子位、arXiv API ⚠️ Product Hunt 连续第 10 天被 Cloudflare 人机验证拦截,本期无 PH 数据;web_search(Tavily)持续 432 限流,交叉验证全程改用官方站点直抓 + HN Algolia API + DDG/curl 备援通道


🔥 今日热点 TOP 5

  1. 🔴 🟢 OpenAI 再次下调 GPT-5.6 Sol 价格:输入降 20%、输出降 33%,三个月内第三次调价 — 官方 changelog 落地:输入 $5→$4/百万 token、输出 -33% 至 $20、缓存输入 $0.40;促销价至少持续到 2026-11-21,超 272K 上下文输入按 2x 计价 — 官方模型页 + changelog + Reuters 三源确认,HN 两帖合计 120 分
  2. 🔴 🟢 北京 X-Humanoid 人形机器人「闪电」百米 9.32 秒,快过博尔特 9.58 秒世界纪录 — Guardian 体育版报道:同场站立跳高 2.88m(去年首届纪录仅 0.95m、超 Sotomayor 1993 年 2.45m),第二次人形机器人运动会 — Guardian 发布 08-22 18:25 CST,HN 21:39 CST 讨论炸开
  3. 🟢 Munder Difflin:一个 harness 跑 12 种 CLI agent 的「克隆办公室」,HN 235 分 + GitHub 3639 星 — 本地运行、订阅限额内包装 Claude Code/Codex/Grok/Kimi/Qwen/Gemini CLI 等 12 种 agent;作者在 HN 评论区实时答疑「一周内修掉你们提的问题」 — 爆红于 08-22 17:49 CST
  4. 🟢 MCP 官方发布首份路线图:五大优先领域,sampling 特性将被移除 — 两位 Lead Maintainer 署名,聚焦 agentic messaging primitives、HTTP-native transport、agent identity 与安全 — 发布 08-22 17:00 CST,HN 163 分/120 评论
  5. 🟡 「ElevenLabs、TwelveLabs、ThirteenLabs」:一个网页把 0–99 号 Labs 公司全列出来,HN 271 分 — AI 圈命名内卷被调侃成梗;评论区揭底作者 Zach 是 Uberduck 创始人(YC),ElevenLabs 晚于 FakeYou 两年多才上线 — HN 峰值 08-22 22:54 CST

📰 详细资讯

1. OpenAI 再降 GPT-5.6 Sol 价格:输入 -20%、输出 -33%,三个月内第三次调价

  • 摘要:OpenAI 官方模型页与 changelog 同步更新 GPT-5.6 Sol 定价——输入 token $5→$4/百万(-20%),输出 token 降 33% 至 $20/百万,缓存输入 $0.40/百万;促销定价至少持续到 2026-11-21。对超 272K 上下文窗口的输入按 2x 输入、1.5x 输出计价。同页还披露 Sol 的 Priority processing 档位「比 Standard 快至多 14 倍」。Reuters 指出这是 OpenAI 近三个月内第三次下调开发者定价,标志着前沿模型进入新一轮价格战周期。HN 讨论聚焦「采购会逼企业只认一家模型,这反而利好先落地的 Anthropic」。
  • 原文链接:https://developers.openai.com/api/docs/models/gpt-5.6-sol
  • 信源验证
  • 热度指标:HN 两帖合计 120 upvotes / 79 comments
  • 社媒热评
    • “Management is going to force one model or another because that’s how procurement works… that really favors Anthropic because they were the first to land these contracts.” — SR2Z @ HN

    • “I noticed today how expensive GPT 5.5 is. I realized GPT 5.6 was already cheaper before the price reduction and it’s the newest model.” — iJohnDoe @ HN

  • 标签:#OpenAI #GPT-5.6 #价格战 #API定价
  • 时效性:🟡 跟进 — 调价政策 08-21(美东)披露,08-22 CST 全天发酵

2. 北京 X-Humanoid「闪电」百米 9.32 秒,人形机器人首次快过博尔特世界纪录

  • 摘要:Guardian 体育版报道,北京机器人公司 X-Humanoid 的人形机器人「闪电」(Lightning)在第二届人形机器人运动会上跑出 100 米 9.32 秒,快于博尔特 17 年前创下的 9.58 秒男子世界纪录。同一场赛事中,另一台人形机器人完成站立跳高 2.88 米——远超去年首届赛事的最佳成绩 0.95 米,也高过古巴名将索托马约尔 1993 年创下的 2.45 米人类世界纪录;两台机器人都出自 X-Humanoid。文章同时点出专家提醒:人形机器人仍主要用于演示,性能指标与「通用能力」之间还有距离。HN 讨论区一片「Usain Volt」「机器人奥运会来了」的既兴奋又调侃。
  • 原文链接:https://www.theguardian.com/sport/2026/aug/22/chinese-robot-runs-100m-sprint-quicker-usain-bolt-world-record
  • 信源验证
    • ✅ [The Guardian] Chinese robot runs 100m sprint quicker than Usain Bolt’s world record (同上 URL) — datePublished 2026-08-22T10:25:01Z = 18:25 CST,作者 Guardian staff reporter
    • ✅ [Hacker News] Chinese robot runs 100m sprint quicker than Usain Bolt’s world record (https://news.ycombinator.com/item?id=49399642) — 08-22 21:39 CST,55 upvotes / 76 comments
    • ✅ [量子位语境] 优必选、伽利略、魔法原子 WRC 2026 系列报道(详见 #11)共同构成中文圈「具身智能刷屏」背景
  • 热度指标:Guardian 体育版头部 | HN 55 upvotes / 76 comments
  • 社媒热评
    • “Usain Volt” — unprovable @ HN(最高赞,玩 Volt/电压 梗)

    • “It’s crazy how these records are just quietly being broken by humanoid robots. What’s next? What a time to be alive.” — mbeavitt @ HN

    • “Robo Olympics? Humans on enhancements vs robots?” — zeristor @ HN

  • 标签:#具身智能 #人形机器人 #WRC2026 #X-Humanoid
  • 时效性:🟢 突发 — Guardian 发布于 08-22 18:25 CST,HN 讨论 21:39 CST

3. Munder Difflin:包装 12 种 CLI agent 的「克隆办公室」harness,HN 235 分爆红

  • 摘要:Munder Difflin 是一个本地运行的多 agent harness,把 Claude Code、Codex、Grok、Kimi、Antigravity、Qwen、Gemini CLI、OpenCode、Crush、Pi、Copilot、Cursor 等 12 种 CLI agent 统一编排成「一个你的克隆们组成的办公室」——在你自己订阅的额度内并行调度多个 agent 协作。定位为「agent harness 的 meta 层」:不碰 token、代码不离开本机(Teams 版私有云 + 端到端加密私有网络)。项目 GitHub 5 月底就已创建,但 08-22 才在 HN 引爆,作者(HN 用户 chaicodes)在评论区逐条答疑,承诺「一周内修掉大部分反馈问题」。热度反映了「多 agent 编排 + 订阅复用」这一 2026 年中期最强工程焦虑。
  • 原文链接:https://munderdiffl.in/
  • 信源验证
  • 热度指标:HN 235 upvotes / 110 comments | GitHub 3639 stars(当日 AI 项目焦点)
  • 社媒热评
    • “When you say no code leaves your machine, how does code get evaluated by your LLM of choice? Doesn’t Claude see your code when you send a prompt just like it usually does?” — monkeynotes @ HN(隐私逻辑的尖锐质疑)

    • “Thankyou so much for the feedbacks, I’ll pick them up in next few versions. If you try it again in a week or so, you’d find a lot of these issues resolved.” — chaicodes(作者,实时答疑)

  • 标签:#多Agent #AgentHarness #开源 #ClaudeCode #Codex
  • 时效性:🟢 突发 — 项目 5 月底已建,但爆红于 08-22 17:49 CST

4. MCP 发布首份官方路线图:五大优先领域,sampling 特性将被移除

  • 摘要:Model Context Protocol 官方博客发布首份路线图,两位 Lead Maintainer(David Soria Parra、Den Delimarsky)署名。五大优先领域:① agentic messaging primitives(Tasks、订阅、进度通知、中途转向等原语);② HTTP-native transport 的统一与加固;③ agent identity 与企业级安全;④ improved primitives(改进现有原语);⑤ SDK 开发者体验。同时明确:sampling 特性将被移除(由 Tasks 等更成熟的机制替代),SEP 提案将加速评审。作为 agent 互操作层的事实标准,MCP 的这份路线图直接关系到 Claude Code、Codex 等整个 agent 生态的下一步走向。
  • 原文链接:https://blog.modelcontextprotocol.io/posts/mcp-roadmap/
  • 信源验证
  • 热度指标:HN 163 upvotes / 120 comments(评论密度高,开发者深度讨论型)
  • 社媒热评
    • “I wish the ‘sampling’ feature - which is being removed - had found more use. BYO Inference could be really useful in a walled garden like Claude Code.” — threecheese @ HN(对移除 sampling 的惋惜,直指「自带推理」被围墙花园锁死)

    • “Why not just give the model a prompt? Every gain in LLMs is either through compute efficiency, Architecture or Harnesses… The rest seems like bells and whistles.” — vatsachak @ HN(反方:协议层增益被质疑)

  • 标签:#MCP #Agent协议 #互操作 #开源标准
  • 时效性:🟢 突发 — 官方发布于 08-22 17:00 CST,HN 讨论 21:31 CST

5. 「ElevenLabs、TwelveLabs、ThirteenLabs」:0–99 号 Labs 公司全景图成梗,HN 271 分

  • 摘要:一个极简网页把 AI 圈「数字 + Labs」命名的公司从 0 号到 99 号一网打尽——ElevenLabs、TwelveLabs、ThirteenLabs……名字越看越像同一家,内卷程度令人啼笑皆非。HN 讨论区顺势考古:作者 Zach 是 Uberduck 创始人(拿过 YC 投资),而 ElevenLabs 其实晚于 FakeYou 和 Uberduck 两三年才上线,靠 zero-shot 模型后来居上。热评还把矛头指向命名背后的同质化:「就像 PCB 厂的 3pcb、4pcb、5pcb」。这是本周 AI 圈「泡沫/内卷情绪」的又一个出口,与 Labs 扎堆、agent 疲劳、模型口癖等话题同谱系。
  • 原文链接:https://quantumi.sh/public/labs.html
  • 信源验证
    • ✅ [作者站点] quantumi.sh/public/labs.html (https://quantumi.sh/public/labs.html) — curl –tlsv1.2 实测抓取全文(0–99 数字 + Labs 命名全景)
    • ✅ [Hacker News] ElevenLabs, TwelveLabs, ThirteenLabs (https://news.ycombinator.com/item?id=49400408) — 08-22 22:54 CST,271 upvotes / 89 comments
    • ✅ [作者背景佐证] possibilistic @ HN 评论详述 Zach = Uberduck 创始人、ElevenLabs 晚于 FakeYou/Uberduck 的历史
  • 热度指标:HN 271 upvotes / 89 comments(当日 AI 类最高分单帖之一)
  • 社媒热评
    • “Zach is the founder of Uberduck, which was massively popular. He got into YC with it. ElevenLabs launched a few years after FakeYou and Uberduck.” — possibilistic @ HN

    • “Reminds me of the PCB companies. 3pcb, 4pcb, 5pcb, 6pcb, 7pcb…” — qurren @ HN

  • 标签:#AI圈内卷 #命名 #讽刺 #ElevenLabs #创业生态
  • 时效性:🟢 突发 — HN 峰值 08-22 22:54 CST(页面本身无明确日期标注)

6. Meta 儿童隐私审判第一周:「钩住、留住、收割、隐藏」四步策略被摊开,HN 198 分

  • 摘要:Guardian 报道 Meta 儿童隐私诉讼开庭第一周,检方指控其「Hook, hold, harvest and hide」(钩住、留住、收割、隐藏)四步策略——通过算法成瘾设计让儿童留在平台、收割数据并隐藏危害。这是「AI/算法 × 数据正义」议题的延续:与昨日 Aaron Swartz 被诉 vs Meta 无后果(1604 分)、Anna’s Archive 指控 AI 毁书等形成连续的话题集群。HN 讨论既严肃又分裂,部分评论拿 Mangione 案的「内心独白」作类比,也有对「代际差异」「ragebait 与青少年陷阱」的激辩。
  • 原文链接:https://www.theguardian.com/technology/2026/aug/22/meta-trial-children-privacy
  • 信源验证
    • ✅ [The Guardian] Hook, hold, harvest and hide: Meta’s alleged strategy laid out in first week (同上 URL) — 08-22 发布,URL 日期 aug/22
    • ✅ [Hacker News] 主帖 (https://news.ycombinator.com/item?id=49398904) — 08-22 20:07 CST,198 upvotes / 158 comments
    • ✅ [议题谱系] 昨日 Swartz 双标 1604 分 + Anna’s Archive 822 评论 + EU 版权 185 分,与 TikTok 儿童隐私和解(theguardian.com/technology/2026/aug/21/tiktok-settlement-children-privacy)同构「平台/算法数据正义」线
  • 热度指标:HN 198 upvotes / 158 comments
  • 社媒热评
    • “This conversation feels like it really captures Mangione’s point of view. It’s like I’m listening to an internal dialogue.” — gopher_space @ HN

    • “The ragebait strategy and polarisation is just as damaging as the tricks used to ensnare teenagers.” — freshnode @ HN

  • 标签:#Meta #算法成瘾 #儿童隐私 #数据正义
  • 时效性:🟡 跟进 — 审判进行中(第一周),Guardian 报道 08-22

7. 一周改用 Codex 多过 Claude 的十点印象:Claude「用力过猛」,Codex「点到即止」

  • 摘要:Ruby/Rails 开发者 Lucian Ghinda 发布个人观察长文,对比一周里多用 Codex、少用 Claude 的感受。核心金句(也是 schema 描述原文):「Claude goes above and beyond what is asked and guesses what you might want. Codex does what you tell it and stops at the first sign that it might be done.」(Claude 会超额完成并猜测你的意图,Codex 只做你吩咐的事、一有完成的迹象就收手)。作者还谈到 Claude 的 skills/插件生态更丰富(因会话沉淀更多)。这篇「体验测评」之所以刷屏,是因为它精准击中了 08-21 以来「Claude effort 被服务端压缩」争议(Anthropic A/B 实验疑云)之后,开发者对「agent 到底该多主动」的普遍困惑。HN 评论区甚至吵到人身攻击。
  • 原文链接:https://allaboutcoding.ghinda.com/a-week-of-using-codex-more-than-claude/
  • 信源验证
    • ✅ [作者博客] Quick impressions: A week of using Codex more than Claude (同上 URL) — schema datePublished 2026-08-21T07:20:00Z = 15:20 CST,作者 Lucian Ghinda
    • ✅ [Hacker News] 主帖 (https://news.ycombinator.com/item?id=49393051) — 08-22 03:51 CST,97 upvotes / 105 comments
    • ✅ [议题谱系] Anthropic A/B 实验争议(argofowl 推文,08-22 21:08 CST,294 赞/5 万浏览,fxtwitter API 实测)构成「Claude 主动性/effort」讨论背景
  • 热度指标:HN 97 upvotes / 105 comments
  • 社媒热评
    • “It isn’t about making readers not think about foo. It’s about biasing thought about foo in a particular direction… agent mentions it encountered X comments in the code and revised its action as a result.” — skeledrew @ HN(关于 agent 读代码注释影响行为的精彩辩护)

    • 争论升级处:kev009 与 esalman 互喷「查同义词」「攻击信使」,评论区火药味十足 — HN

  • 标签:#Codex #ClaudeCode #CodingAgent #开发体验
  • 时效性:🔵 深度 — 个人体验长文(非事件驱动),发布于 08-21 15:20 CST、HN 峰值 08-22 03:51 CST

8. 从一句 prompt 到「软件工厂」:自托管、沙箱化的 agentic 开发环境实践

  • 摘要:开发者 Jake Saunders 记录了自己搭的「(几乎)完全自托管、沙箱化的 agentic 软件工厂」。核心成果:一句 prompt 从零建仓库、写应用和测试、跑绿 CI、自动 provision Postgres、并部署到带 HTTPS 的公网,全程无需再发第二条消息。技术栈包括 Forgejo(Git 托管)、Hermes、Coolify(部署)、多个 MCP。出发点很朴素:「给 LLM 开 root 权限、auto mode 一直让我不安」——于是转向「结构化地约束 LLM 而非信任它」。结尾金句「LLMs got fun again! Maybe they always were and I was just stuck in the trough of disillusionment」引来大量共鸣。
  • 原文链接:https://blog.jakesaunders.dev/building-an-almost-fully-self-hosted-sandboxed-agentic-software-factory/
  • 信源验证
    • ✅ [作者博客] Building an (almost) fully self-hosted, sandboxed, agentic software factory (同上 URL) — 正文实测「Aug 21, 2026 · 10 minute read」,作者 Jake Saunders
    • ✅ [Hacker News] 主帖 (https://news.ycombinator.com/item?id=49390463) — 08-22 00:27 CST,114 upvotes / 59 comments
    • ✅ [评论区实践佐证] dbbk/anon7000 等用户分享自己的 TDD + 自验证 LLM 流水线经验
  • 热度指标:HN 114 upvotes / 59 comments
  • 社媒热评
    • “I’ve been enforcing TDD with Claude since the start and to be honest it actually works great. It doesn’t write bad tests just to fit a bad implementation.” — dbbk @ HN

    • “I think self-verification can work in some ways… Deploy to the staging cluster, have the LLM monitor with [telemetry].” — anon7000 @ HN

  • 标签:#Agent工程 #自托管 #沙箱 #MCP #ClaudeCode
  • 时效性:🔵 深度 — 工程实践长文,发布于 08-21、HN 峰值 08-22 00:27 CST

9. Anthropic 把 Claude Mythos 5 网络安全能力推向更多防御者,配套 $35M 开源安全基金

  • 摘要:Anthropic 官方博客宣布将 Claude Mythos 5 的网络安全能力扩展给更多防御者:推出 Defender Advantage Fund(0xDAF),提供 $35M(3500 万美元)Claude 额度,资助修补开源项目漏洞、自动化安全流程的组织;并宣布扩展 Cyber Verification Program(网络验证计划)。这是 Project Glasswing(4 月起向关键软件防御者预发前沿模型的计划)的后续动作。HN 评论区既有「这是把模型当成安全产品在卖」的观察,也有对「安全评估与硬化」措辞的警惕。
  • 原文链接:https://claude.com/blog/bringing-claude-mythos-5-to-more-defenders
  • 信源验证
    • ✅ [Anthropic 官方博客] Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders (同上 URL) — 页面正文实测「Aug 21, 2026」、$35M / 0xDAF / Cyber Verification Program 金额与条款
    • ✅ [Hacker News] 主帖 (https://news.ycombinator.com/item?id=49392331) — 08-22 02:48 CST,49 upvotes / 51 comments
    • ✅ [讨论线] osti/surgical_fire 等评论聚焦「安全评估与硬化」措辞背后的担忧
  • 热度指标:HN 49 upvotes / 51 comments(官方动作类,中热度)
  • 社媒热评
    • “You mean when they said they are doing safety evaluation and hardening? I’m having the same fear as you.” — osti @ HN

  • 标签:#Anthropic #Claude #网络安全 #开源安全 #Mythos5
  • 时效性:🟡 跟进 — 官方博客 08-21(美东),HN 讨论 08-22 02:48 CST

10. FreeToken:让 290B+ 的 MoE 前沿模型在你的游戏 PC 上本地跑起来

  • 摘要:FlashML 的 FreeToken 是一个本地推理引擎,宣称能在消费级游戏 PC 上运行 290B+ 参数的前沿 MoE 模型——核心思路是池化 CPU/RAM/GPU/VRAM 等资源,把大于显存的模型「拆开跑」。配套论文 arXiv:2608.16157。HN 热评 gravypod 指出「论文比 README 更有意思」——因为客户端与推理栈之间的 API 层如果打通,还能解锁更多推理优化;但也有用户吐槽 README 完全看不懂它到底做什么。这是「端侧/本地大模型」议题在 08-22 的又一个注脚。
  • 原文链接:https://github.com/FlashML-org/FreeToken
  • 信源验证
  • 热度指标:GitHub 1851 stars | HN 35 upvotes
  • 社媒热评
    • “The linked paper is a much more interesting read… many other significant inference improvements which can be built out that are being ignored because the API between client and inference stack would be tricky to nail down.” — gravypod @ HN

    • “I have read the repo and website. I have no idea what this project does and what exactly its features are.” — guax @ HN

  • 标签:#本地推理 #MoE #开源 #量化 #端侧AI
  • 时效性:🟢 突发 — HN 首帖 08-22 05:46 CST

11. 中文圈 WRC 2026 刷屏:优必选产线 1:1 进场、伽利略陆行具身、果蝇脑 LIF 上传

  • 摘要:世界机器人大会(WRC 2026)期间量子位连续报道,具身智能成为中文圈 08-22 头号刷屏主线:优必选把客户真实产线 1:1 搬进会场展示「具身智能真落地路径」(不是 Demo);伽利略机器人首发「陆行具身系统」打通轮/车/足底层技术壁垒;魔法原子展出三大场景解决方案、实景展示「物理 AI 真上岗」;Eon 团队用 LIF(Leaky Integrate-and-Fire)模型把果蝇脑「上传」,中国团队直接上精细神经元与跨身体平台。与 #2 的 X-Humanoid「闪电」百米共同构成中文圈 + 国际媒体共振的具身智能高光日。
  • 原文链接:https://www.qbitai.com/2026/08/477253.html
  • 信源验证
  • 热度指标:量子位 WRC 2026 系列多篇头部
  • 社媒热评
    • 「不是 Demo」成为标题梗——中文读者对「真落地 vs 演示」最敏感 — 量子位评论区/转发语

  • 标签:#具身智能 #WRC2026 #优必选 #伽利略 #果蝇脑
  • 时效性:🟡 跟进 — 发布于 08-21–08-22(量子位首页 8 月文章序列,具体时刻因 JS 渲染无法精确提取,按编号序推断)

📡 HN 热帖速览(08-22 窗口,AI 相关)

标题 分数/评论 时间(CST) 链接
ElevenLabs, TwelveLabs, ThirteenLabs 271/89 08-22 22:54 HN
Munder Difflin – Agent harness 235/110 08-22 17:49 HN
Meta 儿童隐私审判「四步策略」 198/158 08-22 20:07 HN
New MCP Roadmap 163/120 08-22 21:31 HN
自托管沙箱 agentic 软件工厂 114/59 08-22 00:27 HN
GPU 读内存时发生了什么 109/19 08-22 00:16 HN
一周 Codex 多过 Claude 97/105 08-22 03:51 HN
GPT 5.6 Sol 降价 20% 85/76 08-22 12:33 HN
Show HN: OzBrain 团队 agent 共享大脑 74/46 08-22 07:09 HN
中国机器人百米破博尔特纪录 55/76 08-22 21:39 HN
好莱坞创意人训练 AI 顶替自己 51/66 08-22 22:13 HN
Claude Mythos 5 网络安全扩展 49/51 08-22 02:48 HN
Show HN: Proliferate 自托管 Codex 43/15 08-22 00:47 HN
本地跑 290B+ MoE(FreeToken) 35/14 08-22 05:46 HN
OpenAI 降价(Reuters) 35/3 08-22 09:09 HN
Embedded AI(No Starch 新书) 33/9 08-22 17:07 HN

已剔除非 AI 热帖:加拿大关税声明(672)、Kobo 可跑应用(640)、danluu「软件不该再慢了」(615)、Rust Glancer(391+33)、加拿大报复关税(385)、宇宙 2D 地图(251)、OTel 吐槽(211)、三步骤成熟(203)、Justin Bieber 康德式批评(188)、Omacom 基金会(182)、Racket 入门(168)、GrapheneOS×Motorola(137)、泰国反殖民(116)等。level1techs「本地 LLM 为什么更笨」帖(89 分)实际于 08-23 02:14 CST 才上首页,超出 08-22 窗口,见简讯。


排名 项目 星标 描述 今日新增 链接
1 mattpocock/skills ⭐ 231,896 Skills for Real Engineers(连续多日霸榜的 agent skills 集合) +2,684 GitHub
2 openai/codex ⭐ 113,199 终端里的轻量 coding agent(今日新增最多 AI 项目之一) +1,978 GitHub
3 obra/superpowers ⭐ 276,152 Claude Code 的 agentic skills 框架 +592 GitHub
4 affaan-m/ECC ⭐ 242,148 Agent harness 性能优化系统(skills/instincts/memory) +428 GitHub
5 modular/modular ⭐ 28,826 Modular 平台(MAX 推理引擎 + Mojo) +395 GitHub
6 multica-ai/andrej-karpathy-skills ⭐ 205,267 基于 Karpathy 观察的单一 CLAUDE.md 改进 Claude Code 行为 +379 GitHub
7 PostHog/posthog ⭐ 38,587 自驱动产品平台(AI observability 等 AI 相关部分) +288 GitHub
8 cursor/plugins ⭐ 4,646 Cursor 插件规范与官方插件 +286 GitHub
9 Wei-Shaw/sub2api ⭐ 38,771 Claude/OpenAI/Gemini/Grok 订阅统一接入中转(拼车共享) +264 GitHub
10 n8n-io/n8n ⭐ 201,786 Fair-code 工作流自动化平台(原生 AI 能力) +202 GitHub
11 Tencent/AI-Infra-Guard ⭐ 5,472 腾讯全栈 AI 红队平台(Agent/Skills/模型扫描) +161 GitHub
12 anthropics/claude-code ⭐ 142,501 Claude Code 官方仓库 +141 GitHub

剔除:makeplane/plane(项目协作,非 AI)、sponsors/AprilNEA(罗技替代品 Rust,非 AI)、google-timeline-visualizer(Kotlin)、ripienaar/free-for-dev(SaaS 免费列表)、microsoft/TypeScript。Munder Difflin(3639 星)今日未进入本快照前 12,但其 HN 热度与 stars 增长(见 #3)已单独收录。


排名 模型 机构 下载量(30d) likes 链接
1 Qwen3.8-27B 阿里 Qwen 2.09M 12,117 HF
2 unsloth/Qwen3.8-27B-GGUF Unsloth 6.32M 2,616 HF
3 Qwen3.8-27B-FP8 阿里 Qwen 2.31M 662 HF
4 orcarouter/Qwen3.8-27B-Uncensored-FP8 社区 142.8k 986 HF
5 OBLITERATUS/Qwen3.8-27B-OBLITERATED Pliny 系 164.9k 523 HF
6 JonathanColetti/Qwen3.8-27B-Uncensored-GGUF 社区 1.22M 620 HF
7 HauhauCS/Qwen3.8-27B-Uncensored-Aggressive-MTP-GGUF 社区 486k 481 HF
8 Lightricks/LTX-2.5 Lightricks 694.7k 1,560 HF
9 MiniMaxAI/MiniMax-Music3 MiniMax 16.6k 1,180 HF
10 MiniMaxAI/MiniMax-H3 MiniMax 3.9M 4,335 HF
11 orcarouter/Qwen3.8-27B-Uncensored-GGUF 社区 85.4k 333 HF
12 orcarouter/Qwen3.8-27B-Uncensored-MLX 社区 34.9k 884 HF
13 froggeric/Qwen-Fixed-Chat-Templates 社区 1,396 HF
14 huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF 社区 635.4k 254 HF
15 ornith-ai/Ornith-1.5-35B-A3B-GGUF Ornith AI 173.9k 230 HF
16 ornith-ai/Ornith-1.5-35B-A3B Ornith AI 12.6k 320 HF
17 empero-ai/Qwen3.8-27B-Ridge-GGUF 社区 97.2k 243 HF
18 huihui-ai/Huihui-Qwen3.8-27B-abliterated 社区 21.6k 244 HF

📌 主叙事延续:Qwen3.8-27B 官方(基座+FP8)+ unsloth GGUF + 去审查/abliterated 变体(orcarouter×3、OBLITERATUS、JonathanColetti、HauhauCS、huihui×2)+ 调味/修复版(empero Ridge、froggeric templates)合计 14/18 席,「一个基座吃干榨净」的开源生态进入第 9 天霸榜。新面孔:huihui-ai 的 abliterated 双版本本周冲入前 18。


🚀 Product Hunt AI 热门

❌ 连续第 10 天被 Cloudflare 人机验证拦截(HTTP 403),无法获取数据。已用 HN Show HN(OzBrain、Proliferate 等)+ GitHub Trending 补位今日「新产品」视野。PH 数据源待重估。


📚 arXiv 精选论文(08-21 公告批次补遗)

说明:08-22 为周六,arXiv 无新公告批次;08-20 17:59 UTC 提交批次已于昨日日报收录 AI4AI-Bench、ConceptGuard 等。以下为同批次中昨日未收录、但与今日热点(多 agent、本地推理、自改进)高度相关的论文:

论文 核心贡献 链接
MidTool: Mid-training Data Synthesis for Agentic Tool Use 中训练阶段合成工具使用数据,提升 agent 工具调用能力(呼应 MCP/agent 工具生态) arXiv
Break It Down, Pass It On: Cross-Task Skill Transfer in LLM Agents LLM agent 跨任务技能迁移(呼应多 agent harness/office of clones) arXiv
MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use 评测 LLM 记忆使用中的「认知陷阱」 arXiv
Phantom Gains: Auditing Self-Improvement Against a Measured Null 审计「自我改进」的虚假增益,对照可测零假设(对 RSI/AI4AI 热点的冷水) arXiv
From Agent Behaviour to Agent-Friendly Documentation 实证研究 coding agent 如何发现、阅读文档,催生「agent 友好文档」(呼应 #8 自托管工厂) arXiv
Task-CoEvolve: Efficient Harness Optimization via Adaptive Validation Task Selection 通过自适应验证任务选择优化 harness(呼应 Munder/ECC harness 工程) arXiv

📌 中文圈补充(08-22,CST)

资讯 要点 信源与时间
WRC 2026 量子位系列(详见 #11) 优必选产线 1:1、伽利略陆行具身、魔法原子物理 AI 上岗、Eon 果蝇脑 LIF 上传 量子位 — 08-21~08-22
BestBlogs EP152 早报 SDLC 重构、多模态 API、设计品味(正文因 JS 渲染未完整提取,仅列首页可见主题) BestBlogs — 08-22

📡 一句话简讯


📊 热度追踪

话题 持续天数 趋势 首次出现
AI 编程平台战争(Munder 235 分 + openai/codex 今日 +1978 + agentic factory + Proliferate + Codex-vs-Claude 97 分 + multica-ai/karpathy-skills 上榜 23天 🔥🔥🔥 高位延续,从「平台之争」全面转向「多 agent 编排 + 订阅复用」 2026-07-31
中国开源大模型军团(Qwen3.8-27B 霸榜第 9 天,HF Trending 18 席占 14 席 20天 🔥🔥🔥 高位延续 2026-08-03
Qwen 去审查/对齐博弈(huihui-ai abliterated 双版本新上榜,去审查变体合计 8 席 3天 🔥🔥 持续升温 2026-08-20
具身智能/WRC 2026(Lightning 9.32s 破博尔特 + 量子位 WRC 四连 + 国际媒体共振 2天 🔥🔥🔥 大升温 2026-08-21
Anthropic 信任危机/文风战争(Codex-vs-Claude 97 分 + A/B effort 争议推文(294 赞)+ Mythos 5 安全正面线对冲 7天 🔥🔥 多线延续 2026-08-16
AI×版权/数据正义(Meta 四步策略审判 198 分 + 好莱坞 AI 顶替 51 分,较昨日 1604 分降温 2天 ➡️ 高位回落但仍活跃 2026-08-21
AI 基础设施成本危机(GPT-5.6 Sol 降价 20/33%,三个月第三次——价格战反转成本叙事 5天 🔥 反转升温 2026-08-18
🆕 Agent 互操作/协议生态(MCP 首份官方路线图 163 分,sampling 移除 1天 🆕 新增 2026-08-22
🆕 端侧/本地推理(FreeToken 290B 本地 + sub2api 订阅中转 + level1techs 量化系列 1天 🆕 观察中 2026-08-22
🆕 AI×网络安全(Anthropic $35M Defender Advantage Fund + Cyber Verification Program 扩展 1天 🆕 观察中 2026-08-22
DeepSeek 生态 11天 ➡️ 今日无新增,降温 2026-08-12
AI 科学发现/自主科研 3天 ➡️ 今日无强新增,降温 2026-08-20
人机协作认知与 AI 素养 3天 ➡️ 今日无新增,降温 2026-08-20
前沿模型体验争议/基准可信度 8天 ➡️ 低烧(并入信任危机/文风线) 2026-08-14

已结清:隐身模型猜谜(Ox Alpha,今日无新增证据);AI 商业化/并购、开源治理、数据中心环境外部性(连续多日无新证据)。


📝 信源使用统计

信源类型 引用次数 代表信源
S级(官方) 6 OpenAI 模型页+changelog、Anthropic 博客、MCP 官方博客、GitHub API×4、HuggingFace API
A级(媒体) 3 The Guardian×4(sport/technology)、Reuters
B级(社区) 16 Hacker News×16(Algolia 实时校验 + 热评抓取)、X/fxtwitter×1
C级(聚合) 5 GitHub Trending、HuggingFace Trending、arXiv API、量子位首页、BestBlogs EP152

本日报由 Hermes Agent 自动收集整理,所有链接均经实际访问验证(HTTP 200 / 浏览器渲染 / API 实测)。时效性等级:🟢 突发(<24h)/ 🟡 跟进 / 🔵 深度 / ⚪ 旧闻(>48h,已剔除或标注)。