GPT-5.6(Sol Pro)用一个 prompt 关闭凸优化领域 30 年复杂度空白
🔥 今日热点 TOP 5
- 🔴 🟡 GPT-5.6(Sol Pro)用一个 prompt 关闭凸优化领域 30 年复杂度空白 — 单作者论文(Phillip Kerger)证明无导数凸优化的确定性查询复杂度下界为 Ω(d²/log(d+1)),补上 1996 年 Protasov 上界 O(d²log²d) 以来 30 年悬而未决的差距,延续上周 GPT-5.6 Sol Ultra 证明 Cycle Double Cover 猜想引爆的"AI 做数学"热潮 — HN 461 分 / 294 评论 — 首次报道 07-18 21:00 CST
- 🟢 Isomorphic Labs 发布 IsoDDE 药物设计引擎:蛋白-配体结构预测准确率超 AlphaFold 3 两倍以上,结合亲和力超越物理方法 FEP — DeepMind 旗下 Isomorphic Labs 发布统一计算药物设计系统 IsoDDE,在 Runs N Poses 泛化基准上把 AF3 准确率翻倍以上,抗体-抗原高保真区超越 AF3 2.3 倍、Boltz-2 19.8 倍,并在 CASP16 等结合亲和力任务上超越基于物理的 FEP — 首次报道 07-18 07:26 CST
- 🔵 “AI 对 StackOverflow 做了什么"一张图:提问量断崖式下跌,引发 HN 392 条热议 — 一张用 StackExchange Data Explorer 生成的 Stack Overflow 提问量曲线图登上 HN 头条,直观呈现 AI 答案兴起后 SO 活动的塌陷,评论区从 SO 的"过度把关/精英主义"到"AI 让整个互联网变得需要人机验证"全面开火 — 首次报道 07-18 19:12 CST
- 🟡 Anthropic 官宣:Claude Fable 5 将于 7/20 纳入所有 Max 与 Team Premium 计划(限额 50%),Pro/Team Standard 改为 credits 并赠 $100 — Anthropic 在 @claudeai 发文回应持续数日的"Fable 从 Claude 消失/需 credits"争议,宣布 7 月 20 日起 Fable 5 进入所有 Max 与 Team Premium 计划(占用 50% 额度),Pro 与 Team Standard 用户改用 usage credits 并获一次性 $100 credit;推文获 4.76 万赞 — 首次报道 07-18 10:14 CST
- 🟢 全同态加密(FHE)CIFAR-10 推理仅 200ms:单密钥同态推理 demo,服务端全程只见密文 — Belfort Labs 演示用全同态加密在 200ms 内完成 CIFAR-10 图像分类推理,采用单密钥 + 服务端处理架构(客户端持有密钥,服务器只看到密文,即使作为主动恶意方也无法窥探明文),HN 评论区由 FHE 专家 Pro7ech 详细解读多方场景下的实用价值 — 首次报道 07-18 00:29 CST
📰 详细资讯
1. GPT-5.6(Sol Pro)用一个 prompt 关闭凸优化领域 30 年复杂度空白
- 摘要:单作者论文《Closing the Oracle-Complexity Gap in Derivative-Free Convex Optimization: A Near-Quadratic Lower Bound from Exact Function Values》(作者 Phillip Kerger,arXiv 2607.13335,2026-07-14)证明:在仅使用精确函数值(无导数)的确定性查询模型下,最小化 d 维欧氏球上的凸 Lipschitz 函数,其查询复杂度下界为 Ω(d²/log(d+1))。这一下界补上了自 1996 年 Protasov 提出仅用函数值的 O(d² log² d) 上界以来、长达 30 年悬而未决的复杂度差距(此前的下界只有从更强的一阶 oracle 继承来的 Ω(d))。论文进一步把结果推广到混合整数凸优化场景:含 d 个连续变量与 n 个离散变量、仅用函数值时需要 ~Ω(d²·2ⁿ) 次查询。作者在 Reddit r/math 帖子中说明该证明是用 GPT-5.6(Sol Pro)配合一个 prompt 完成的,HN 评论区有用户(@d4rkp4ttern)专门讨论 Pro 的多代理系统与 Ultra 的动态编排差异。此事承接上周(7 月 10 日)OpenAI 公布 GPT-5.6 Sol Ultra 证明 Cycle Double Cover 猜想(HN 537 分)所引爆的"前沿数学被 LLM 攻克"浪潮——同一周内 GPT-5.6 连续拿下图论著名猜想与凸优化经典空白两个成果,引发数学/理论计算社区对"低/中悬果实是否还有意义"的激烈讨论。注意:论文尚未经同行评审(@sdwvit 在 HN 指出)。
- 原文链接:https://arxiv.org/abs/2607.13335
- 信源验证:
- ✅ [arXiv 2607.13335] Closing the Oracle-Complexity Gap in Derivative-Free Convex Optimization (https://arxiv.org/abs/2607.13335) — 2026-07-14(论文提交)
- ✅ [Reddit r/math] After OpenAI’s CDC proof announcement, GPT-5.6 used a prompt to close a 30-year gap in convex optimization (https://old.reddit.com/r/math/comments/1uxj3cy/) — 07-18 21:00 CST
- ✅ [Hacker News] 同标题讨论帖 (https://news.ycombinator.com/item?id=48957779) — 07-18 21:00 UTC(CST 同刻)— 461 points / 294 comments
- ✅ [背景信源·OpenAI CDC 证明] GPT-5.6 Sol Ultra produces proof of the Cycle Double Cover Conjecture [pdf] (https://cdn.openai.com/pdf/04d1d1e4-bc75-476a-97cf-49055cd98d31/cdc_proof.pdf) — 07-10,HN 537 分(事件起因)
- 热度指标:HN 461 upvotes / 294 comments(当日 HN 第 2 热帖);Reddit r/math 热帖
- 社媒热评:
-
“This conjecture reads as somewhat more niche than the cyclic double cover conjecture recently proved by OpenAI, but nevertheless represents a real contribution. … This proof apparently shows that the lower bound time complexity is equal to the time complexity of an existing 30-year old algorithm: it requires Omega(d^2) function evaluations to solve over this class of functions.” — @alternator @HackerNews(领域内知情者解读)
-
“I don’t think researchers in math/TCS will be made obsolete, but I think it will instead no longer make sense to work on any low-hanging, or even medium-hanging fruit.” — @rakel_rakel @HackerNews
-
“Not yet peer reviewed” — @sdwvit @HackerNews(理性提醒)
-
“I tried using AI to solve some advanced math problems. One thing I see is that they can throw an enormous amount of brute force into a problem. When mathematical logic can be brute forced we will see some interesting advances.” — @charlieyu1 @HackerNews
-
- 标签:#GPT-5.6 #凸优化 #复杂度下界 #数学证明 #CycleDoubleCover #OpenAI #Sol
- 时效性:🟡 跟进 — 论文 07-14 提交,07-18 在 HN/Reddit 引爆讨论;承接 07-10 的 CDC 证明事件,属"GPT-5.6 数学突破"浪潮的延续
2. Isomorphic Labs 发布 IsoDDE 药物设计引擎:超越 AlphaFold 3,结合亲和力击败物理方法 FEP
- 摘要:DeepMind 创始人 Demis Hassabis 旗下的 Isomorphic Labs 发布统一计算药物设计系统 IsoDDE(Isomorphic Labs Drug Design Engine),定位为"超越 AlphaFold 3 的新前沿”。核心成果:(1) 结构预测泛化能力——在专门测试泛化到新型口袋/配体的 Runs N Poses 基准(Škrinjar et al. 2025)上,IsoDDE 在最难系统上把 AlphaFold 3 的准确率提高一倍以上,能建模诱导契合(induced fit)与隐藏口袋开启等分布外事件;(2) 复杂生物药——在新颖抗体-抗原测试集的高保真区(DockQ > 0.8),IsoDDE 超过 AlphaFold 3 达 2.3 倍、超过 Boltz-2 达 19.8 倍,尤其在最难预测的抗体 CDR-H3 环上表现突出,为从头抗体设计打开空间;(3) 结合亲和力金标准——在 FEP+ 4、OpenFE 与最近的 CASP16 盲测结合亲和力任务上,IsoDDE 超越所有深度学习方法,甚至超过需要实验晶体结构作基础的物理方法 FEP,而 IsoDDE 不需要;(4) “盲"口袋识别——仅凭氨基酸序列即可识别新的可成药口袋,速度以秒计。文章以 cereblon(CRL4 E3 连接酶底物受体)为例:过去 15 年业界认为它只有沙利度胺口袋一条成药路径,而 IsoDDE 仅凭序列就成功重现了 Dippon et al. 2026 实验发现的新型别构/隐藏口袋,并把配体正确折叠进对应口袋。IsoDDE 已被公司药物设计团队每日用于实际管线。文章致谢 Google DeepMind 的协作。这是继 AlphaFold 3 之后 AI 药物发现的关键一步:从"预测结构"迈入"直接计算药物设计”。
- 原文链接:https://www.isomorphiclabs.com/articles/the-isomorphic-labs-drug-design-engine-unlocks-a-new-frontier
- 信源验证:
- ✅ [Isomorphic Labs 官方] The Isomorphic Labs Drug Design Engine unlocks a new frontier beyond AlphaFold (https://www.isomorphiclabs.com/articles/the-isomorphic-labs-drug-design-engine-unlocks-a-new-frontier) — 07-17(文章发布)
- ✅ [Isomorphic Labs 技术报告] Read Our Technical Report(文章内链)— 07-17
- ✅ [Hacker News] The Isomorphic Labs Drug Design Engine unlocks a new frontier beyond AlphaFold (https://news.ycombinator.com/item?id=48953406) — 07-18 07:26 CST — 81 points
- 热度指标:HN 81 upvotes(专业领域贴,讨论度集中在深度)
- 标签:#IsomorphicLabs #IsoDDE #AlphaFold3 #药物设计 #AI制药 #DeepMind #结合亲和力 #抗体设计
- 时效性:🟢 突发 — 首次报道于 07-17(官方文章),07-18 在 HN 发酵
3. “AI 对 StackOverflow 做了什么"一张图:提问量断崖式下跌引爆 HN 392 条热议
- 摘要:一个用 Stack Exchange Data Explorer 生成的 Stack Overflow 提问量时序图登上 HN 头条(333 分、392 评论),直观呈现 AI 问答工具兴起后 Stack Overflow 活动断崖式下滑的趋势曲线。由于 HN 流量冲击,SO 一度被自身限流(“IP 因刷新过多被临时封禁”),形成"AI 把互联网变得处处需要人机验证"的黑色幽默。392 条评论呈现几条主线:(1) 对 SO 过度把关与精英主义的反思——“too much gatekeeping and elitism tends to eventually be the death knell for a community”,问题常被以"重复"为由关闭但与原题无关;(2) gamification 机制未能随站点规模演进;(3) SO 自身限流策略的讽刺;(4) AI 答案的"过度创造"问题。这为"AI 如何重塑开发者知识获取"提供了可视化注脚。
- 原文链接:https://data.stackexchange.com/stackoverflow/query/1953768#graph
- 信源验证:
- ✅ [Stack Exchange Data Explorer] What AI did to stackoverflow in a graph (https://data.stackexchange.com/stackoverflow/query/1953768#graph) — 公开查询
- ✅ [Hacker News] What AI did to stackoverflow in a graph (https://news.ycombinator.com/item?id=48956949) — 07-18 19:12 CST — 333 points / 392 comments
- 热度指标:HN 333 upvotes / 392 comments(当日 HN 第 4 热帖)
- 社媒热评:
-
“I think the issue with Stack Overflow/Stack Exchange is one of how too much gatekeeping and elitism tends to eventually be the death knell for a community.” — @CM30 @HackerNews
-
“SO closes your question for being a duplicate of some other random question that has nothing to do with yours.” — @inigyou @HackerNews
-
“Ironically it gives me: This IP address has performed an unusually high number of requests and has been temporarily rate limited. That’s also something what AI did to the internet :(” — @ink @HackerNews
-
- 标签:#StackOverflow #AI影响 #开发者社区 #数据可视化 #知识获取
- 时效性:🔵 深度 — 数据可视化/趋势分析(非单一事件),07-18 在 HN 引爆讨论
4. Anthropic 官宣:Claude Fable 5 将于 7/20 纳入所有 Max 与 Team Premium 计划,Pro/Team Standard 改用 credits 并赠 $100
- 摘要:持续数日的"Fable 从 Claude 消失 / 需 credits"风波有了官方答复。Anthropic 在 @claudeai 发布推文(4.76 万赞):自 7 月 20 日起,Claude Fable 5 将纳入所有 Max 与 Team Premium 计划(占用 50% 额度);Pro 与 Team Standard 用户将继续通过 usage credits 使用 Fable,并获得一次性 100 美元 credit。Anthropic 坦承"对 Fable 的需求持续超出预期”。事件脉络:此前一日有 Ask HN 帖(90 分)反映 Fable 突然从 Claude 使用中消失、需 credits,发帖者一度以为"Anthropic 反而加倍限制了",后证实是一次 outage(status.claude.com 已修复)。官方此次定档 7/20 把 Fable 5 正式纳入订阅层,本质是对订阅用户反复"挤牙膏"式放量的争议回应,也反映出 Fable 5 自发布以来始终处于容量紧张状态。同期另有用户报告"Claude Code(Fable) 拒绝执行用户的’slow down’指令"等代理自主性个案。
- 原文链接:https://twitter.com/claudeai/status/2078302415804379218
- 信源验证:
- ✅ [Anthropic 官方 @claudeai] Beginning July 20, Claude Fable 5 will be included in all Max and Team Premium plans (https://twitter.com/claudeai/status/2078302415804379218) — 07-18 10:14 CST — 47,649 likes
- ✅ [Hacker News] Beginning July 20, Claude Fable 5 will be included in all Max plans (https://news.ycombinator.com/item?id=48954522) — 07-18 10:15 CST — 33 points
- ✅ [Hacker News] Ask HN: Did Fable disappear from your Claude usage and requires credits now? (https://news.ycombinator.com/item?id=48950477) — 07-18 02:18 CST — 90 points / 86 comments(事件前置:outage)
- 热度指标:X 47,649 likes;HN 多帖讨论(Ask HN 90 分 + 官宣 33 分)
- 标签:#Anthropic #Claude #Fable5 #订阅 #Max #容量 #access
- 时效性:🟡 跟进 — Fable 5 发布后持续容量争议,07-18 官方定档 7/20 纳入订阅并平息 outage
5. 全同态加密(FHE)CIFAR-10 推理仅 200ms:单密钥同态推理 demo,服务端全程只见密文
- 摘要:Belfort Labs 发布演示,用全同态加密(Fully Homomorphic Encryption, FHE)在约 200ms 内完成一次 CIFAR-10 图像分类推理,把"在加密数据上直接跑模型"的延迟拉到实用区间。技术要点:采用单密钥 + 服务端处理架构——客户端持有密钥、把输入加密后上传,服务器在密文上执行整个神经网络前向计算并返回加密结果,服务器全程只看到密文、连明文形状都不接触。HN 评论区(86 分)由 FHE 领域专家 Pro7ech 给出权威解读:在单密钥 + 服务端处理下,即便服务器是主动恶意方(可任意偏离协议)也无法获得任何信息,最坏情况只是返回被篡改的输出;FHE 的真正用武之地是多方场景——不同机器操作方、设备厂商、传感器供应商各有不愿共享的数据/IP 时,FHE 让协作计算成为可能而无需暴露任何一方明文。当前 demo 的密文膨胀较大(新鲜加密约若干倍明文大小),但已有技术可压缩到几倍,尚未部署。
- 原文链接:https://sofar.belfortlabs.cloud/
- 信源验证:
- ✅ [Belfort Labs] Belfort · CIFAR-10 Inference (https://sofar.belfortlabs.cloud/) — 07-17/18
- ✅ [Hacker News] Homomorphically encrypted CIFAR-10 inference in 200ms (https://news.ycombinator.com/item?id=48949240) — 07-18 00:29 CST — 86 points / 39 comments
- 热度指标:HN 86 upvotes / 39 comments(专业向,深度讨论)
- 社媒热评:
-
“In the case of single key FHE with server-side processing, the server can never gain any insight, even as an active adversary that can arbitrarily deviate from the protocol, because it only has access to public evaluation keys and ciphertexts.” — @Pro7ech @HackerNews
-
“A local model works when one party owns everything. But often you’ll have more than one party … each with data they cannot or IP they do not want to share. That’s where FHE becomes truly useful.” — @Pro7ech @HackerNews
-
- 标签:#全同态加密 #FHE #隐私计算 #CIFAR-10 #推理 #机密计算
- 时效性:🟢 突发 — 首次报道于 07-17 16:29 UTC(07-18 00:29 CST)
6. Kaiser 护士集体发声:AI 与职场监控让护理工作与患者体验双双变差
- 摘要:Kaiser Permanente(美国最大医疗系统之一)的护士群体通过报道发声,指出AI 与职场监控正在让他们的工作与患者护理双双恶化。报道(localnewsmatters.org,7-15 发布,07-18 在 HN 走热达 539 分)记录了一线护士对 AI 分诊/文档/排班工具与监控技术引入后负担加重、自主性被侵蚀、医患互动被中介化的担忧。这是"AI 进入高风险垂直行业"争议的又一实证——与企鹅智库 Q2 复盘所述"Agent 撞上复核、成本、组织三堵墙"形成呼应:技术能力供给与一线实际体验之间的落差,正在医疗这类容错率极低的领域集中爆发。HN 365 条评论围绕 AI 在医疗的合规边界、护士工会的谈判筹码、监控式管理扩张等展开。
- 原文链接:https://localnewsmatters.org/2026/07/15/kaiser-nurses-say-ai-workplace-surveillance-are-making-their-jobs-and-patient-care-worse/
- 信源验证:
- ✅ [Local News Matters] Kaiser nurses say AI, surveillance are making their jobs and patient care worse (https://localnewsmatters.org/2026/07/15/kaiser-nurses-say-ai-workplace-surveillance-are-making-their-jobs-and-patient-care-worse/) — 07-15
- ✅ [Hacker News] 同标题讨论帖 (https://news.ycombinator.com/item?id=48952880) — 07-18 06:26 CST — 539 points / 365 comments
- 热度指标:HN 539 upvotes / 365 comments(当日 HN 第 3 热帖)
- 标签:#AI医疗 #Kaiser #职场监控 #劳动者 #AI落地 #高风险行业
- 时效性:🟡 跟进 — 报道 07-15,07-18 在 HN 引爆大规模讨论
7. 月之暗面杨植麟 GTC 2026 详解 Kimi K2.5 三大基础组件替代方案
- 摘要:月之暗面创始人杨植麟在 GTC 2026 演讲中系统阐述 Kimi K2.5 背后的三大基础组件替代方案,勾勒下一代基础模型的"换底"路线:(1) 用 MuonClip 替代 Adam 优化器——解决大模型训练中优化器数值稳定性的瓶颈;(2) 用 Kimi Linear(线性注意力)替代全注意力——把注意力复杂度从二次降为线性,是支撑 Kimi K3 把上下文推到 100 万 token 的底层前提;(3) 用 Attention Residue(注意力残差)替代传统残差连接——让信息在更长序列、更深模型中流动得更顺畅。演讲还分享了视觉训练与 Agent Swarm(多代理群体协作)的进展。这三项替换正是 Kimi K2.5→K3 架构跃迁(Kimi Delta Attention + Attention Residuals + Stable LatentMoE)的技术来由,也解释了 K3 敢于在 896 个专家中仅激活 16 个、扩展效率较 K2 提升约 2.5 倍的原因。该内容经知名中文 AI 博主宝玉(@dotey)整理传播,被 BestBlogs 07-18 早报收录为精选推文。
- 原文链接:https://www.bestblogs.dev/(EP121 · 07-18 早报精选 · 经 @dotey 整理)
- 信源验证:
- ✅ [BestBlogs EP121 · 07-18 早报] 月之暗面杨植麟详解 Kimi K2.5 三大基础组件替代方案(来源:宝玉 @dotey,GTC 2026 演讲)— 07-17/18
- ✅ [Kimi 官方] Kimi K3: Open Frontier Intelligence (https://www.kimi.com/blog/kimi-k3) — 07-16(KDA/AttnRes/Stable LatentMoE 架构对应)
- 热度指标:BestBlogs 精选推文(单条)
- 标签:#Kimi #杨植麟 #MuonClip #线性注意力 #AttentionResidue #GTC2026 #架构
- 时效性:🟡 跟进 — GTC 2026 演讲内容,07-17/18 经整理传播,与 07-16 Kimi K3 发布形成技术注脚
🛠️ GitHub Trending AI 项目
| 排名 | 项目 | 星标 | 描述 | 今日新增 | 链接 |
|---|---|---|---|---|---|
| 1 | Robbyant/lingbot-map | ⭐ 12,861 | Feed-forward 3D 基础模型,从流式数据重建场景 | +827 | GitHub |
| 2 | codecrafters-io/build-your-own-x | ⭐ 528,192 | 从零重建喜爱的技术来掌握编程(持续热门) | +1,131 | GitHub |
| 3 | tirth8205/code-review-graph | ⭐ 20,127 | 本地优先代码知识图谱(MCP/CLI),为 AI 编码工具削减上下文 | +356 | GitHub |
| 4 | PostHog/posthog | ⭐ 36,558 | 构建自动驾驶产品的平台:AI 可观测性/分析/会话回放/实验/日志,MCP 驱动 | +337 | GitHub |
| 5 | ibelick/ui-skills | ⭐ 4,960 | 面向设计工程师的 Skills | +242 | GitHub |
| 6 | rohitg00/ai-engineering-from-scratch | ⭐ 39,064 | 从零学 AI 工程:Learn it. Build it. Ship it. | +240 | GitHub |
| 7 | lyogavin/airllm | ⭐ 23,303 | 单张 4GB GPU 即可推理 70B 大模型 | +234 | GitHub |
| 8 | KnockOutEZ/wigolo | ⭐ 1,183 | 面向 AI 编码代理的本地优先 Web:搜索/抓取/爬虫/研究,走 MCP | +192 | GitHub |
| 9 | elder-plinius/G0DM0D3 | ⭐ 9,482 | “LIBERATED AI CHAT”(去对齐聊天,Pliny 系列) | +63 | GitHub |
| 10 | MoonshotAI/kimi-cli | ⭐ 9,447 | Kimi Code CLI:月之暗面的命令行编码代理 | +48 | GitHub |
| 11 | apache/ossie | ⭐ 1,258 | Apache Ossie:跨分析/AI/BI 平台的语义元数据交换行业规范 | +48 | GitHub |
注:今日 GitHub Trending 由 3D 场景重建基础模型
lingbot-map领跑(+827/day);AI 可观测性(PostHog)、AI 编码上下文管理(code-review-graph)、低显存推理(airllm)、编码代理(kimi-cli、wigolo)持续占据榜单,与"Agent harness 是新前沿"的判断一致。
🤗 HuggingFace Trending Models
| 排名 | 模型 | 参数量 | 下载量 | 描述 | 链接 |
|---|---|---|---|---|---|
| 1 | thinkingmachines/Inkling | 952B | 12.5k | Thinking Machines 首个开源多模态 MoE(持续高热,1.06k likes) | HF |
| 2 | empero-ai/Qwythos-9B-Claude-Mythos-5-1M-GGUF | 9B | 2.11M | 基于 Claude Mythos 5 蒸馏的 1M 上下文模型(2.31k likes) | HF |
| 3 | zai-org/GLM-5.2 | 753B | 542k | 智谱 GLM-5.2 超大模型,多语言多模态(4.13k likes) | HF |
| 4 | prism-ml/Bonsai-27B-gguf | 4B | 1.22M | Bonsai-27B GGUF 量化版(三值化压缩,持续高热) | HF |
| 5 | tencent/Hy3 | 299B | 13.6k | 腾讯 Hy3 MoE 模型,全量开源(829 likes) | HF |
| 6 | conradlocke/krea2-identity-edit | — | 392 | Krea2 身份编辑模型(约 10 小时前更新,新上榜) | HF |
| 7 | bottlecapai/ThinkingCap-Qwen3.6-27B | 27B | 10.4k | Qwen3.6 思考增强版,推理能力提升(435 likes) | HF |
| 8 | google/gemma-4-31B-it | 33B | 12.6M | Google Gemma-4 31B 指令版,多模态(3.26k likes) | HF |
| 9 | baidu/Unlimited-OCR | 3B | 2.09M | 百度 Unlimited-OCR 视觉模型(2.02k likes) | HF |
| 10 | InternScience/Agents-A1 | 35B | 35.6k | 35B Agent 专用模型(578 likes) | HF |
注:
thinkingmachines/Inkling(952B)连续多日霸榜;三值化压缩prism-ml/Bonsai-27B系列(含 Ternary/mlx 变体)与 Hy3、GLM-5.2、Gemma-4、百度 Unlimited-OCR 等构成今日主力。Kimi K3 权重仍未发布(预计 7/27),故未上榜。
🚀 Product Hunt AI 热门
| 排名 | 产品 | 描述 | 链接 |
|---|---|---|---|
| 1 | — | Product Hunt 连续第三日被 Cloudflare 人机验证拦截,本次未能自动采集 | — |
注:Product Hunt 已连续三日被 Cloudflare 拦截,自动采集不可用。建议手动浏览 https://www.producthunt.com/topics/artificial-intelligence
📚 arXiv / 研究论文精选
| 论文 | 作者/机构 | 摘要 | 链接 |
|---|---|---|---|
| Closing the Oracle-Complexity Gap in Derivative-Free Convex Optimization: A Near-Quadratic Lower Bound from Exact Function Values | Phillip Kerger | 证明无导数凸优化确定性查询复杂度下界 Ω(d²/log(d+1)),关闭 1996 年 Protasov 上界以来 30 年空白;作者称用 GPT-5.6 Sol Pro 配合 prompt 完成 | arXiv |
| A Proof of the Cycle Double Cover Conjecture(背景·上周事件) | OpenAI (GPT-5.6 Sol Ultra) | GPT-5.6 Sol Ultra 产出 Cycle Double Cover 猜想(图论著名 50 年未解问题)的证明,是本轮"AI 做数学"热潮的起点(HN 537 分,07-10) | OpenAI PDF |
注:web_search(Tavily)连续多日 432 不可用,arXiv 系统检索受限,仅列与当日核心事件直接相关论文。
📈 热度追踪
| 话题 | 持续天数 | 趋势 | 今日动态 |
|---|---|---|---|
| GPT-5.6 数学突破(CDC 证明 + 凸优化) | 9 天 | 🔥🔥🔥 急升 | 凸优化 30 年复杂度空白被一个 prompt 关闭(arXiv 2607.13335),承接 7/10 的 Cycle Double Cover 证明;AI 攻坚前沿数学已成连续浪潮 |
| Claude / Fable 5 访问与容量 | 2 天 | 🔥 上升 | Anthropic 定档 7/20 把 Fable 5 纳入所有 Max 与 Team Premium;前置 outage 平息;订阅"挤牙膏"式放量争议发酵 |
| AI Agent / 编码工具 / harness | 42 天 | 🔥 急升 | kimi-cli、code-review-graph、wigolo 占据 GitHub Trending;企鹅智库 Q2 复盘指 Agent 撞上复核/成本/组织三墙 |
| 开源大模型规模竞赛 | 6 天 | 🔥 急升 | 腾讯 Hy3、GLM-5.2、Bonsai-27B 三值化持续霸榜 HuggingFace;Kimi K3 权重待 7/27 发布 |
| AI for Science / 药物发现 | 1 天 | 🆕 新增 | Isomorphic Labs IsoDDE 超越 AlphaFold 3,结合亲和力击败物理方法 FEP——“AI 制药"从结构预测迈入计算药物设计 |
| 隐私计算 / FHE 机密推理 | 1 天 | 🆕 新增 | 全同态加密 CIFAR-10 推理 200ms demo;多方不愿共享数据场景的实用价值被重新讨论 |
| AI 落地副作用(劳动者/社区) | 3 天 | ↗️ 上升 | Kaiser 护士集体控诉 AI 与监控恶化护理;StackOverflow 提问量曲线成 HN 头条 |
| Kimi K3 | 3 天 | ↗️ 上升 | 杨植麟 GTC 2026 详解 K2.5→K3 三大架构替代(MuonClip/Kimi Linear/Attention Residue) |
| Apple vs OpenAI 诉讼 | 8 天 | ➡️ 平淡 | 今日无新进展(昨日法律保留函升级) |
| GPT-5.6 系列 | 24 天 | ↗️ 上升 | 本周连下 CDC 猜想 + 凸优化空白,数学能力成新焦点 |
| Gemini 品牌 | 7 天 | ➡️ 稳定 | 今日无重大进展 |
📊 信源使用统计
| 信源等级 | 数量 | 主要信源 |
|---|---|---|
| S 级(官方博客/公告) | 4 | arXiv(Kerger 论文)、Isomorphic Labs 官方、Anthropic @claudeai 官推、OpenAI CDC 证明 PDF |
| A 级(权威媒体) | 1 | Local News Matters(Kaiser 护士报道) |
| B 级(社区/社媒) | 9 | Hacker News(×7 热帖)、Reddit r/math、Belfort Labs |
| C 级(聚合/分析) | 4 | BestBlogs EP121、HuggingFace Trending、GitHub Trending、Stack Exchange Data Explorer |
📌 本期说明:web_search(Tavily,432 错误)与 web_extract(私网拦截)连续多日不可用,全部信源通过浏览器直接访问 + HN Algolia/Firebase API + arXiv API 完成交叉验证;Product Hunt 连续第三日被 Cloudflare 拦截。今日最大新闻是 GPT-5.6 的"数学双连击”——承接 7/10 证明 Cycle Double Cover 猜想(图论 50 年未解),单作者论文用 GPT-5.6 Sol Pro 配合一个 prompt 关闭了凸优化领域 30 年悬而未决的复杂度空白(arXiv 2607.13335,下界 Ω(d²/log(d+1))),在 HN 拿下 461 分,数学/理论计算社区开始严肃讨论"低/中悬果实是否还有研究价值"。与此同时,AI for Science 出现里程碑:Isomorphic Labs 的 IsoDDE 在结构预测、抗体设计与结合亲和力上全面超越 AlphaFold 3,甚至击败基于物理的金标准 FEP,把"AI 制药"从预测结构推进到直接计算药物设计。Fable 5 的访问争议则以 Anthropic 定档 7/20 纳入所有 Max 计划暂告段落。值得持续跟踪:GPT-5.6 数学突破的同行评审进展、Kimi K3 权重 7/27 发布后的第三方复现、以及 FHE 机密推理的工程化曲线。