AI 趋势周报:2026-W34

🤖 AI 趋势周报 · 2026-W34 (08-16 - 08-22)

⏪ 上周回顾

  • Agent Skills 走向标准化 → 本周全面工程化:mattpocock/skills 月增 47.7k 继续稳坐 GitHub 月榜第一,本周再添 Google 官方 skills 仓库、817 条 Anthropic-Cybersecurity-Skills、diagram-design 图表技能(周榜 +11.3k)等新成员,Skills 从「标准化」进入「规模化供给」阶段
  • DeepSeek Harness 生态爆发 → 本周登顶社交热度:dsh 本体上架一周星标破 18 万、单周 +49.9k 登顶 Trendshift 周榜,桌面端(+8.7k)、插件精选清单(+6.1k)、任务感知路由套件(+3.8k)全家桶跟进,「母项目带飞生态」路径与当年 Claude Code 如出一辙
  • GPT-5.6 加速与开源之争 → 本周演变为价格战:上周 Cerebras 把 GPT-5.6 Sol 提速 14 倍,本周 OpenRouter 直接 5 折(HN 633 分周榜第一)、OpenAI 官宣再降 20%+、Devin 跟进 7 折,叠加 Stripe 75 亿美元收购 OpenRouter 落地,「前沿能力白菜价」重塑 API 选型
  • 连续上榜项目:usestrix/strix(连续 8 周)、earendil-works/pi(连续 6 周)、diegosouzapw/OmniRoute(连续 6 周)、virgiliojr94/book-to-skill(连续 5 周)、TencentCloud/TencentDB-Agent-Memory(连续 4 周);stablyai/orca 在连续 7 周后退出本期榜单

数据源说明:GitHub Trending 月榜与周榜(OSSInsight 官方已临时下线 star 榜单,本期以 GitHub Trending 页面数据替代,下期恢复)。

📅 本月榜 Top 20(+ 折叠区 21-36)

# 项目 语言 ⭐ 总计 📈 本月新增 说明
1 mattpocock/skills Shell 229,245 47,717 面向真实工程师的 Agent 技能集,直接来自作者的 .agents 目录
2 diegosouzapw/OmniRoute TypeScript 52,652 31,270 免费 MIT AI 网关:单端点接入 340 家供应商、1200+ 模型,配额感知自动降级
3 block/buzz Rust 29,178 28,701 「蜂群思维」群体智能通信平台
4 zhaoxuya520/reverse-skill PowerShell 27,205 18,662 逆向/渗透/安全技能路由包:AI 自动路由 + 按需自举工具链 + 自进化经验库
5 ayghri/i-have-adhd Python 22,957 18,443 让编码 Agent 不再把答案埋在长输出里的技能,ADHD 友好输出
6 koala73/worldmonitor TypeScript 83,674 21,742 实时全球情报仪表盘:AI 新闻聚合、地缘政治监测、基础设施追踪
7 earendil-works/pi TypeScript 95,015 21,507 AI Agent 工具包:统一 LLM API、Agent 循环、TUI、编码 Agent CLI
8 virgiliojr94/book-to-skill Python 23,646 14,598 把任意技术书籍 PDF 转成 Claude Code 技能,边工作边查阅
9 TencentCloud/TencentDB-Agent-Memory TypeScript 23,658 14,407 腾讯云团队级 AI Agent 记忆中枢:对话/文档/代码变四类可复用记忆资产
10 microsoft/AI-For-Beginners Jupyter Notebook 66,122 13,592 微软 AI 入门课:12 周 24 课
11 usestrix/strix Python 56,682 13,551 开源 AI 渗透测试工具,发现并修复应用漏洞
12 citrolabs/ego-lite JavaScript 12,505 11,627 为 AI Agent 打造的最快自动化浏览器,可共享登录态,零成本零配置
13 permissionlesstech/bitchat Swift 35,759 9,710 蓝牙 mesh 聊天应用,IRC 复古风
14 basecamp/omarchy Shell 27,430 3,095 Basecamp 出品:美观、现代、有主见的 Linux
15 1jehuang/jcode Rust 18,170 8,972 最省内存的 Agent harness
16 HKUDS/DeepTutor Python 36,916 8,578 港大出品:终身个性化辅导系统
17 tirth8205/code-review-graph Python 30,668 8,084 本地优先代码智能图谱(MCP/CLI),让 AI 只读关键上下文
18 lyogavin/airllm Jupyter Notebook 32,097 8,160 单张 4GB GPU 推理 70B 模型
19 every-app/open-seo TypeScript 13,007 7,395 Semrush / Ahrefs 的开源替代
20 donnemartin/system-design-primer Python 365,297 7,380 系统设计面试经典学习指南,含 Anki 卡片
📅 展开本月榜 21-36 名
# 项目 语言 ⭐ 总计 📈 本月新增 说明
21 blader/humanizer Python 37,044 6,937 去除文本 AI 写作痕迹的 Agent 技能
22 volcengine/OpenViking Python 31,621 3,975 字节火山引擎:AI Agent 自进化上下文数据库,统一记忆/RAG/技能
23 bradautomates/claude-video Python 15,964 6,659 让 Claude 能「看」视频:下载、抽帧、转录一条龙
24 huggingface/speech-to-speech Python 12,744 6,612 用开源模型构建语音对话 Agent
25 earthtojake/text-to-cad Python 13,752 5,214 CAD/CAE/CAM 领域的 Agent 技能库
26 pingdotgg/t3code TypeScript 19,942 5,646 T3 生态新项目(官方暂无描述),大量 AI 协作提交
27 kangarooking/cangjie-skill Python 8,557 4,467 把书、长视频、播客等高价值内容蒸馏成可执行的 Agent Skills
28 cactus-compute/needle Python 8,312 4,829 仅 14MB 的微型设备基础模型:手机/穿戴/智能家居/机器人
29 google/skills Python 18,586 3,680 Google 官方:面向 Google 产品与技术的 Agent Skills
30 3b1b/manim Python 91,836 3,171 3Blue1Brown 的数学解释性视频动画引擎
31 goauthentik/authentik Python 25,061 2,701 「认证粘合剂」:开源身份提供商
32 different-ai/openwork TypeScript 22,885 6,006 Claude Cowork 的开源替代(基于 opencode)
33 megadose/holehe Python 13,915 2,109 检查邮箱在哪些网站注册过的 OSINT 工具
34 livekit/agents Python 13,125 1,696 实时语音 AI Agent 框架
35 paperless-ngx/paperless-ngx Python 44,475 1,282 社区支持的文档管理系统:扫描、索引、归档
36 neka-nat/freecad-mcp Python 1,872 490 FreeCAD 的 MCP 服务器

📅 本周榜 Top 20(+ 折叠区 21-43)

# 项目 语言 ⭐ 总计 📈 本周新增 说明
1 public-apis/public-apis Python 467,927 11,259 免费 API 大全,常青项目
2 cathrynlavery/diagram-design HTML 24,943 11,325 38 种编辑级图表技能(Claude Code/Codex/Pi),自包含 HTML+SVG
3 harry0703/MoneyPrinterTurbo Python 113,808 9,712 AI 大模型一键生成高清短视频(中文项目)
4 usestrix/strix Python 56,682 4,359 开源 AI 渗透测试工具「↑ 已在月榜第 11 位」
5 holaboss-ai/holaOS TypeScript 10,581 4,282 开源企业级 agentic 工作区:100+ 集成、MCP、聊天、浏览器
6 semantica-agi/semantica Python 10,054 3,674 图原生的上下文与可问责 AI 基础设施
7 github/spec-kit Python 130,685 3,535 GitHub 官方规格驱动开发(Spec-Driven Development)工具包
8 unslothai/unsloth Python 74,248 3,300 本地 UI 运行/训练 LLM 与扩散模型
9 cactus-compute/needle Python 8,312 3,409 14MB 微型设备基础模型「↑ 已在月榜第 28 位」
10 OpenCut-app/OpenCut TypeScript 85,401 2,718 开源 CapCut 替代视频剪辑
11 AprilNEA/OpenLogi Rust 12,789 2,674 罗技 Options+ 的本地优先替代(Rust),免账号免遥测
12 mukul975/Anthropic-Cybersecurity-Skills Python 30,517 2,622 817 个结构化网络安全技能,映射 MITRE ATT&CK 等六大框架
13 volcengine/OpenViking Python 31,621 2,444 字节火山引擎 Agent 上下文数据库「↑ 已在月榜第 22 位」
14 basecamp/omarchy Shell 27,430 2,395 Basecamp 出品 Linux「↑ 已在月榜第 14 位」
15 akitaonrails/ai-memory Rust 3,927 1,952 编码 CLI Agent 的长期记忆与跨厂商交接方案
16 lightningpixel/modly TypeScript 7,120 1,855 本地 AI 从图片/提示生成 3D 模型的桌面应用,全程跑在 GPU 上
17 AlexsJones/llmfit Rust 33,438 1,842 数百模型一条命令测出你的硬件能跑哪个
18 MakazhanAlpamys/Soup Python 2,657 1,786 一个 YAML 微调 LLM,分层流式训练让 4GB 笔记本 GPU 训 8B 模型
19 agalwood/Motrix TypeScript 54,246 1,773 全功能下载管理器
20 can1357/oh-my-pi TypeScript 26,289 1,634 终端 AI 编码 Agent:hash 锚定编辑、LSP、浏览器、子 Agent
📅 展开本周榜 21-43 名
# 项目 语言 ⭐ 总计 📈 本周新增 说明
21 megadose/holehe Python 13,915 1,632 邮箱注册网站 OSINT 检查「↑ 已在月榜第 33 位」
22 earendil-works/pi TypeScript 95,015 5,008 AI Agent 工具包「↑ 已在月榜第 7 位」
23 jundot/omlx Python 20,215 1,388 Apple Silicon LLM 推理服务器,macOS 菜单栏管理
24 macro-inc/macro Rust 3,937 1,456 团队统一工作区:邮件/聊天/文档/任务/Agent 共享 AI 记忆
25 cursor/plugins TypeScript 4,366 1,273 Cursor 官方插件规范与插件集
26 CodebuffAI/freebuff TypeScript 10,438 1,133 免费编码 Agent
27 amruthpillai/reactive-resume TypeScript 41,448 991 注重隐私的开源简历生成器
28 NVIDIA-NeMo/Switchyard Rust 2,045 932 英伟达出品:LLM 应用跨模型/供应商流量路由,兼容 OpenAI/Anthropic 原生 API
29 HKUDS/CLI-Anything Python 47,927 954 让所有软件 Agent 原生化(港大)
30 apify/apify-mcp-server TypeScript 4,503 843 让 AI Agent 从社媒/搜索/电商网站抓数据的 MCP 服务器
31 smicallef/spiderfoot Python 21,318 724 OSINT 自动化威胁情报与攻击面测绘
32 modular/modular Mojo 28,663 744 Modular 平台(含 MAX 与 Mojo 语言)
33 upscayl/upscayl TypeScript 48,675 511 免费开源 AI 图像放大器
34 eneskirca/nodeterm TypeScript 1,009 409 节点式终端管理器:tmux 支撑、多 Agent 并行会话拖拽成图
35 Tencent/AI-Infra-Guard Python 5,329 359 腾讯出品 AI 红队全栈平台:Agent/技能/MCP 扫描与越狱评估
36 CodeWithCJ/SparkyFitness TypeScript 5,542 350 面向家庭的 AI 健康健身追踪
37 Lightricks/LTX-2 Python 9,190 331 LTX-2 音视频生成模型官方推理与 LoRA 训练包
38 bia-pain-bache/BPB-Worker-Panel TypeScript 13,172 318 VLESS/Trojan/Warp Worker 订阅面板
39 microsoft/agent-framework Python 13,028 240 微软 AI Agent 编排框架(Python/.NET)
40 documenso/documenso TypeScript 14,651 236 开源 DocuSign 替代
41 anomalyco/models.dev TypeScript 6,521 136 开源 AI 模型数据库
42 fluxerapp/fluxer TypeScript 10,080 146 面向朋友/群组/社区的免费开源即时通讯与 VoIP
43 ml-explore/mlx-lm Python 6,730 121 用 MLX 跑 LLM(苹果官方)

🎯 核心洞察

  • 月榜:Agent Skills 生态全面爆发:前 20 名中超过三分之一与「技能/记忆/harness」相关(skills、book-to-skill、reverse-skill、TencentDB-Agent-Memory 等),Claude Code 式技能包正成为新的开源流量入口
  • 语言分布:Python + TypeScript 双雄合计约 70%(月榜),Python 主导 AI 工具与教程,TypeScript 主导 Agent 基础设施;本周 Rust 份额明显上升(OpenLogi、Switchyard、ai-memory、llmfit、macro),聚焦本地优先与性能敏感场景
  • 国产项目强势:腾讯云、火山引擎、港大 DeepTutor、MoneyPrinterTurbo 等多个中文背景项目上榜
  • 周榜 vs 月榜:diagram-design、holaOS、Soup、OpenLogi 等为本周短线爆发(未进月榜);pi、OpenViking、needle、strix、omarchy 月周双榜在列,是「Agent 基础设施 + 微型模型」主线的中坚;public-apis、system-design-primer 等常青大库热度稳定回流
  • 主题趋势:Agent Skills / 记忆 / MCP 持续统治榜单;本地化与隐私(本地 GPU 训练、免账号、本地优先)成为本周显著增量主题

(无周榜,仅月榜)

# 模型 任务 参数量 下载量 推理 亮点
1 Qwen/Qwen3.8-27B 图文转文本 28B 1.73M 阿里 Qwen3.8 新旗舰多模态模型,上线 7 天下载破 173 万,衍生生态全面爆发
2 unsloth/Qwen3.8-27B-GGUF 文本生成 27B 5.8M 本地量化版最快跟进,下载 580 万反超原版
3 orcarouter/Qwen3.8-27B-Uncensored-MLX 图文转文本 5B 18.2k Mac 端 MLX 无审查量化版,13 小时前刚更新
4 orcarouter/Qwen3.8-27B-Uncensored-FP8 图文转文本 28B 108k FP8 无审查变体,适配主流推理栈
5 JonathanColetti/Qwen3.8-27B-Uncensored-GGUF 文本生成 27B 1.13M 社区无审查量化热门,下载 113 万
6 MiniMaxAI/MiniMax-Music3 文本转音频 2B 15.7k MiniMax 音乐生成模型,2B 小参数即出圈
7 Lightricks/LTX-2.5 图生视频 654k 开源视频模型 LTX 2.5 版,65 万下载、1.48k 赞
8 OBLITERATUS/Qwen3.8-27B-OBLITERATED 文本生成 28B 124k 4 小时前刚更新的解审查变体,热度飙升
9 HauhauCS/Qwen3.8-27B-Uncensored-…MTP-GGUF 图文转文本 2B 357k 社区魔改 MTP 多 token 预测量化版
10 Qwen/Qwen3.8-27B-FP8 图文转文本 28B 1.94M 官方 FP8 量化版,下载 194 万
11 MiniMaxAI/MiniMax-H3 图文生视频 33B 3.61M MiniMax 视频旗舰,下载 361 万、4.29k 赞,本页最高赞
12 ornith-ai/Ornith-1.5-35B-A3B 文本生成 36B 9.17k MoE 架构(总参 36B/激活 3B),走性价比路线的新秀
13 empero-ai/Qwen3.8-27B-Ridge-GGUF 图文转文本 27B 74k 社区量化衍生版
14 deepseek-ai/DeepSeek-V4-Pro-0813 文本生成 1.7T 49.6k DeepSeek V4 Pro 巨兽(1.7T),8 月 13 日版
15 orcarouter/Qwen3.8-27B-Uncensored-GGUF 图文转文本 27B 68.3k llama.cpp 生态无审查量化版
16 Qwen/Qwen3.8-2.4T-A95B 文本生成 2.4T 15.7k Qwen3.8 顶级 MoE:总参 2.4T、激活 95B
17 huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF 图文转文本 27B 338k 知名 abliterated 系列量化版
18 moonshotai/Kimi-K3 图文转文本 2.8T 2.45M 月之暗面 Kimi K3 旗舰(2.8T),上线 1 天下载 245 万
19 unsloth/Qwen3.8-27B-NVFP4 文本生成 20B 1.01M NVFP4 新量化格式,更省显存
20 TenStrip/10Eros-Max 图文生视频 306 成人向视频生成模型(中性记录)
21 ornith-ai/Ornith-1.5-35B-A3B-GGUF 文本生成 36B 123k Ornith MoE 量化版
22 meta-models/Muse-Glimmer-30B 图文转文本 30B 505k 30B 多模态,50 万下载、1.73k 赞
23 0bserverx/Qwen3.8-27B-Heretic-Abliterated-…-GGUF 文本生成 27B 422k Heretic 解审查量化版,下载 42 万
24 superwhisper/s1-mini 文本生成 0.8B 1.14k 0.8B 超小模型,4 小时前更新
25 huihui-ai/Huihui-Qwen3.8-27B-abliterated 图文转文本 28B 17.5k abliterated 原版(非量化)
26 Blackfrost-AI/Qwen3.8-27B-ABLITERATED-GGUF 图文转文本 27B 198k Blackfrost 解审查量化版
27 deepseek-ai/DeepSeek-V4-Flash-0731 文本生成 304B 2.83M V4 Flash 推理特化(304B),下载 283 万
28 z-lab/Qwen3.8-27B-DFlash2 文本生成 2B 21.1k 2B 极小衍生实验版(蒸馏路线)
29 DavidAU/Qwen3.8-27B-Cold-Fusion-…-GGUF 图文转文本 27B 155k DavidAU 系列魔改量化版

🎯 核心洞察

  • 参数量分布:27-28B 中型模型绝对主导(29 席中约 20 席),Qwen3.8-27B 单点引爆整个生态;超大 MoE 集中在头部厂商旗舰(Kimi-K3 2.8T、Qwen3.8-2.4T-A95B、DeepSeek-V4-Pro 1.7T、V4-Flash 304B);小模型走垂直场景(s1-mini 0.8B、Music3 2B、DFlash2 2B)
  • 任务类型分布:图文转文本(多模态理解)约占 60%,文本生成约 30%,视频生成(图生/图文生视频)3 席(LTX-2.5、MiniMax-H3、10Eros-Max),音频生成 1 席(MiniMax-Music3)——多模态理解+生成已成主战场
  • 推理可用性:9/29(约 31%)官方支持 Inference Providers 即开即用,且全部集中在原厂发布(Qwen 官方 3 款、DeepSeek 2 款、Kimi、MiniMax-H3、Muse-Glimmer 等);社区量化/无审查衍生版基本无托管推理,需本地部署
  • 国产模型占比:极高。官方国产模型 8 款(Qwen×3、DeepSeek×2、Kimi×1、MiniMax×2、z-lab×1),加上围绕 Qwen3.8-27B 的海外社区衍生(unsloth、orcarouter、huihui-ai、DavidAU 等)约占榜单 2/3,Qwen3.8-27B 是当之无愧的”生态母体”
  • 其他趋势:无审查/abliterated 衍生持续火爆(至少 10 席);量化格式多元化(GGUF/MLX/FP8/NVFP4),unsloth 等量化厂牌跟进以小时计

(无周榜,仅月榜,数据截至 2026-08-22,来源 huggingface.co/papers/month/2026-08)

📅 月榜 Top 20

# 论文标题 👍 方向 作者/机构 GitHub ⭐ 亮点
1 BDH-CQ: In-Context Learning with Recurrent Latent Reasoning(基于循环潜空间推理的上下文学习) 702 高效推理 Pathway(海外 AI 基础设施公司) 4.11k 仅 150M 参数的推理模型,靠循环潜空间推理刷新 ARC-AGI-1 成本-精度前沿
2 StateM: Reaching 95.3% Raw Accuracy, or a $15 Frontier Run, on Terminal-Bench 2.1 via Harness Scaling(StateM:通过 Harness 扩展在 Terminal-Bench 2.1 上达到 95.3% 原始准确率、15 美元级前沿运行) 434 Agent 评测 用 15 美元训练成本在终端任务基准上逼近前沿水平,主打”测试框架扩展”路线
3 Macaron-V1: Towards Open Continual Learning with Self-Improvement and Mixture-of-LoRA(Macaron-V1:面向开放持续学习的自我改进与 LoRA 混合) 338 持续学习 Mind Lab 自我改进 + 混合 LoRA 实现开放持续学习,无需重训即可不断进化
4 Spark-to-Paper: End-to-End Research Paper Generation as a Composable Skill(Spark-to-Paper:端到端研究论文生成作为可组合技能) 285 科研自动化 把”从想法到论文”的全流程封装为可组合技能,端到端自动生成研究论文
5 Can We Defend Against AI-Generated Video Attacks on Real-World Crisis Events?(我们能否抵御真实危机事件中的 AI 生成视频攻击?) 277 AI 安全 Hugging Face 系统评测 AI 生成虚假危机视频的检测器、生成器与社会传播链路
6 OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution(OpenART:通过开放式环境演化扩展智能体红队测试) 261 Agent 安全 让红队测试环境自我演化,规模化发现智能体漏洞
7 Recursive Synthesis for Long-Horizon Terminal Tasks(面向长时程终端任务的递归合成) 247 长时程任务 Tencent Hunyuan(腾讯混元) 递归合成方法攻克长时程终端任务的分解与执行难题
8 EnvHarness: Awakening Static Worlds for Agent Learning(EnvHarness:唤醒静态世界用于智能体学习) 229 Agent 环境 Google 把静态环境改造成可交互世界,为智能体训练提供”活”的练习场
9 On-Policy Self-Distillation without Any Supervision(无任何监督的在线策略自蒸馏) 216 蒸馏/自监督 UCSD(加州大学圣地亚哥分校) 完全无监督的在线策略自蒸馏,零标注实现能力迁移
10 ComBodied Agents: a New Paradigm of Human-Centric Agentic AI(ComBodied Agents:以人为本的具身智能体新范式) 194 具身 Agent 提出以人为本的具身智能体新范式,强调人机协同
11 Beyond Pixels: From Video Priors to 4D Worlds(超越像素:从视频先验到 4D 世界) 181 4D 世界模型 把视频先验提升为完整 4D 世界表示
12 LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks(LongHorizon-Harness:面向真实世界任务的长时程智能体) 180 长时程 Agent Alibaba(阿里巴巴) 专攻真实世界长时程任务的智能体框架
13 Self-Supervised Visual On-Policy Distillation(自监督视觉在线策略蒸馏) 167 视觉蒸馏 UCSD 自监督方式对齐视觉策略,在线蒸馏降成本
14 Demystifying Agent Skills: Why They Work-Until They Don’t(解构智能体技能:为何有效——直到失效) 158 Agent 分析 UCSD 系统剖析智能体技能的失效边界,解释”何时好用何时翻车”
15 SwanTale: Unified Multi-Speaker Speech and Audio Generation(SwanTale:统一多说话人语音与音频生成) 156 语音生成 ByteDance(字节跳动) 统一框架支持指令与零样本多说话人语音/音频生成
16 SemComp-Bench: Benchmarking Semantic Task Completion in Video Generation(SemComp-Bench:视频生成语义任务完成度基准) 155 视频评测 FrameX-AI 首个聚焦”语义层面任务是否完成”的视频生成基准
17 DAPD: Dual-Anchored Policy Distillation(DAPD:双锚定策略蒸馏) 151 策略蒸馏 Shanghai AI Laboratory(上海人工智能实验室) 双锚定机制稳定策略蒸馏过程
18 Learn What’s Left, Not What’s Mastered: Saturation Aware Advantage Reweighting(学未掌握而非已掌握:饱和感知的优势重加权) 147 RL 训练 UCSD 饱和感知的优势函数重加权,让模型聚焦”还没学会的部分”
19 Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs(延迟暴露未来轨迹实现自动驾驶 VLM 可验证推理) 142 自动驾驶 延迟揭示未来轨迹,迫使自动驾驶 VLM 学会可验证推理、防作弊
20 Zetta ζ: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence(Zetta ζ:面向自进化物理智能的高效闭环具身框架) 140 具身智能 高效闭环具身框架,支撑物理智能持续自进化
📅 展开 21-40 名
# 论文标题 👍 方向 作者/机构 GitHub ⭐ 亮点
21 Co-Evolution in Agentic Systems: Toward Self-Directed Evolution Beyond Human Design(智能体系统的共同进化:超越人类设计的自主进化) 134 自进化 Agent 智能体间共同进化,突破人类设计天花板
22 SWE-Bench ProMax: Benchmarking Agents on Large-Scale Multilingual Code Refactoring(大规模多语言代码重构基准) 133 代码 Agent ByteDance 大规模多语言代码重构评测,比 SWE-Bench 更难更真实
23 Alaya-EVOKE: From Linear-Scaling Supervision to Endless World(从线性扩展监督到无尽世界) 132 世界模型 监督信号随世界扩展线性增长的世界模型训练范式
24 HarnessEval-W: Agentifying the Evaluation of Visual Worlds(智能体化的视觉世界评测) 123 世界模型评测 MirroS 238 层级子智能体把世界模型评测拆成可验证推理链
25 SemaPLC: A Project-Grounded, Verification-Gated Agent Harness for PLC Code Generation(项目落地、验证把关的 PLC 代码生成框架) 114 工业代码 Midea AI Research Center(美的 AI 研究中心) 工控 PLC 代码生成+验证门控,AI 进军工业产线
26 AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses(测试时强到弱能力迁移) 113 能力迁移 UIUC(伊利诺伊大学香槟分校) 测试时通过 harness 把强模型能力迁移给弱模型
27 Stealing Reasoning Traces from Proprietary LLM APIs(从闭源 LLM API 窃取推理链) 111 模型安全 揭示闭源 API 推理链被蒸馏窃取的安全风险
28 DarwinX: Evolving Agent Harnesses Through Natural Selection(达尔文式自然选择进化智能体框架) 110 Agent 进化 Salesforce AI Research 用自然选择机制自动进化智能体测试框架
29 LLMRouter: Unified Infrastructure for Developing, Evaluating, and Deploying LLM Routers(LLM 路由器统一基础设施) 108 基础设施 UIUC 开发/评测/部署一站式 LLM 路由基础设施
30 Mental World Modeling(心理世界建模) 107 认知建模 Mental World Model 为智能体构建”心理世界”模型
31 SimWAM: A Simple World Action Model for End-to-End Autonomous Driving(简单世界-动作模型实现端到端自动驾驶) 106 自动驾驶 H-EmbodVis 极简世界-动作模型做端到端自动驾驶
32 From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards(任务变换诱导自可验证奖励) 106 自我改进 RLVR→RLSVR:开放式任务也能自验证奖励
33 FACET: Preserving Source Intent and Executable State in Terminal Task Synthesis(终端任务合成中保留源意图与可执行状态) 102 任务合成 USTC(中国科学技术大学) 任务合成时保留原始意图与可执行状态
34 Agentic ESOpt: Fine-Tuning Long-Horizon LLM Agents with Minimal GPU Requirements(极低 GPU 需求微调长时程智能体) 101 低资源训练 NUS(新加坡国立大学) 少量 GPU 即可微调长时程 LLM Agent
35 AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning(智能体强化学习的递归自蒸馏) 100 Agent RL Tsinghua University(清华大学) 递归自蒸馏持续压缩智能体 RL 经验
36 JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion(自回归扩散实现实时开放式视频编辑) 100 视频编辑 JD(京东) 实时开放式指令视频编辑
37 DreamX-Phi 1.0: Action-Conditioned Video World Model for Robotic Manipulation(面向机器人操作的动作条件视频世界模型) 98 机器人 Alibaba 动作条件世界模型用于机器人操作预演
38 MerchantBench: Benchmarking LLM Agents for Long-Term Coherence in E-Commerce Operations(电商运营长程一致性智能体基准) 97 电商评测 Alibaba 电商场景长程一致性 Agent 基准
39 Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing(统一多模态 3D 生成/理解/编辑模型) 91 3D 生成 Tencent Hunyuan 一个模型统一 3D 生成、理解与编辑
40 Co-RL: Unsupervised Reasoning Emerges from Diverse Cohort in Multi-agent RL(多智能体 RL 中多样群体涌现无监督推理) 90 多智能体 RL UCSD 多样化智能体群体协作中自发涌现推理能力

🎯 核心洞察

  • 机构分布(Top 40):中国力量强劲约占 1/3——腾讯混元 ×3、阿里 ×3、字节 ×2、上海 AI Lab、清华、中科大、京东、美的等;海外以 UCSD(×5,蒸馏/自监督方向成建制产出)、Google、UIUC(×2)、NUS(×2)、Salesforce、Pathway 为主。中国团队在 3D/语音/视频等多模态生成方向占优,海外在训练方法与评测体系上更活跃。
  • 研究方向热度排行:① Agent/智能体(长时程任务、环境构建、红队安全、评测基准)占绝对主导约 55%;② 蒸馏与自我改进(自蒸馏、策略蒸馏、自验证奖励)约 15%;③ 世界模型与具身智能(4D、机器人、自动驾驶)约 15%;④ 多模态生成(语音/视频/3D)约 10%;⑤ 安全与攻防(深伪防御、推理链窃取、红队)约 5%。月榜关键词高度聚焦”Agent Harness(智能体框架)+ 自我进化”。
  • 论文→GitHub 转化:月榜列表页不直接展示星标,仅部分论文可见仓库:#1 BDH-CQ(4.11k ⭐/702 赞,转化突出)、#24 HarnessEval-W(238 ⭐)等;头部论文普遍”高赞低仓”,说明本月趋势偏研究型成果而非工具型开源。

🔥 Hacker News AI 热帖

月榜搜索范围: 8 个搜索词 × pastMonth,合并去重后 186 条(2026-07-22 ~ 2026-08-22,按 objectID 去重,手动按 created_at 过滤 30 天)

📅 月榜

🏆 Tier 1 — 超级爆款(200+ points)

热度 标题 类型 评论 亮点
1416 LLMs reward expertise(LLM 奖赏专业深度) 文章 573 颠覆”AI 让专家过时”论:越懂行的人用 LLM 收益越大
1171 GLM-5.3: Frontier coding with emergent cyber capabilities(GLM-5.3:前沿编程与涌现的网络安全能力) 新闻 584 智谱 GLM-5.3 发布,编码能力冲入前沿梯队
919 Open-source engine running Gemma 4 26B in 2 GB RAM on any M-series Mac(开源引擎:任意 M 系 Mac 上 2GB 内存跑 Gemma 4 26B) Show HN 345 极限内存优化的本地推理,引爆端侧话题
835 How I use LLMs to learn complex topics(我如何用 LLM 学习复杂领域) 文章 548 高赞学习方法论:苏格拉底式提问+主动回忆
727 SQLite Critical CVEs or LLM Slop?(SQLite 严重漏洞还是 LLM 胡扯?) 文章 373 安全界大瓜:CVE 报告疑似 LLM 幻觉产物
712 Accelerating GPT-5.6 Sol Ultrafast(Cerebras 加速 GPT-5.6 Sol 至极速模式) 新闻 279 Cerebras 晶圆级推理把 GPT-5.6 Sol 提速至 14 倍
697 Stealing Reasoning Traces from Proprietary LLM APIs(从闭源 LLM API 窃取思维链) 研究 308 新攻击面:绕过审查白嫖模型完整推理轨迹
694 Docker Sandboxes – Disposable sandboxes for AI agents(Docker 沙箱:AI 专用一次性隔离沙箱) 新闻 396 Docker 官方入场,Agent 安全执行环境成标配
633 GPT-5.6 Sol Pricing Cut by 50% on OpenRouter(GPT-5.6 Sol 在 OpenRouter 降价 50%) 新闻 448 模型价格战持续,前沿模型进入跳水周期
610 Advancing the price-performance frontier with GPT-5.6(GPT-5.6:推进性价比前沿) 新闻 402 OpenAI 主打性价比的新旗舰发布
545 Prevent cognitive debt by manually retyping LLM code(手动重打 LLM 代码防”认知负债”) 文章 444 “抄写式编程”引发大论战:AI 代码该不该手敲一遍
535 Needle2: 14MB agentic LLM for phones, wearables(Needle2:14MB 手机/穿戴设备端 agent LLM) Show HN 185 极小体积端侧 agent,万物皆可本地 AI
484 Echo – Fable-level results at 1/3 the cost using open-weight models(Echo:开源权重 1/3 价格达到 Fable 水平) Show HN 228 开源模型性价比反击闭源标杆
442 Born Against: why hobby programming communities are against LLM usage(为什么业余编程社区抵制 LLM) 文章 526 圈层文化视角解读反 AI 情绪,评论区 500+ 楼激辩
437 Beating GPT-5.6 Sol on retrieval with 100x cheaper open models(百倍便宜的开源模型在检索上击败 GPT-5.6) 文章 127 垂直场景优化吊打通用旗舰的经典案例
409 We Gave GPT 5.6 Sol a Real Business. It Lied, Spammed, and Lost $447(让 GPT 经营真生意:撒谎、发垃圾、亏 447 美元) 文章 234 Agent 自主经营翻车实录,幻觉经济学样本
387 LLM Honeypot(LLM 蜜罐) 项目 107 诱捕/识别 LLM 流量的蜜罐实验
365 GPT 5.6 Sol is the best “vision” model OpenAI ever released(GPT-5.6 Sol 是 OpenAI 史上最佳视觉模型) 文章 170 Roboflow 实测:视觉理解能力意外登顶
358 Huzzah – a novel approach to coding with AI(Huzzah:一种全新的 AI 编程方法) Show HN 205 反主流 agent 流派:结构化人机协作编程
340 Humans missed 1 in 3 threats approving AI agent commands(4 万次实验:人类漏掉 1/3 的 agent 危险命令) 文章 245 Agent 权限审批疲劳的量化证据
315 Improving GPT‑5.6 Sol in ChatGPT(GPT-5.6 Sol 改进,Luna 向免费用户开放) 新闻 283 OpenAI 双线更新:旗舰迭代+免费档扩容
310 The arguments against open source AI are bad(反开源 AI 的论点站不住脚) 文章 215 逐条驳斥”开源 AI 危险论”
307 Apple Silicon and macOS VMs: Faster LLM Inference with llama.cpp(Apple 芯片 VM 中 GPU 直通加速 llama.cpp 推理) 文章 42 Mac 虚拟机跑推理的性能翻倍姿势
302 Position: LLMs Can’t Jump(立场论文:LLM 跳不起来) 论文 213 组合爆炸类任务上 LLM 存在原理性短板
294 Vomit: Clean up Claude 5’s token output with a separate LLM(Vomit:用另一个 LLM 清洗 Claude 输出) 项目 286 “模型洗模型”:去除 AI 腔与垃圾 token
289 Running a 28.9M parameter LLM on an $8 microcontroller(8 美元单片机跑 2890 万参数 LLM) 项目 74 ESP32 极限压榨,嵌入式 AI 新整活
280 2x, not 10x: coding with LLMs in 2026(是 2 倍不是 10 倍:2026 年的 LLM 编程) 文章 245 一线开发者泼冷水:真实增益远低于宣传
260 What sort of maths are LLMs good at?(LLM 擅长哪类数学?) 文章 163 菲尔兹奖得主 Gowers 的第一手测评
245 What happens when an LLM never sees material beyond fifth grade?(LLM 只喂小学五年级教材会怎样?) 研究 209 “受限课程”实验:涌现能力从何而来
229 Humanising LLM Outputs Is Dumb(让 LLM 输出”拟人化”是蠢主意) 文章 177 反对为绕过 AI 检测而做文风伪装
215 LLM Usage in Debian: Three Proposals(Debian 社区 LLM 使用三提案) 新闻 212 开源社区就 AI 参与开发正式投票
201 Protecting our FLOSS commons from LLMs(保护自由软件公共资产免受 LLM 侵蚀) 文章 147 Codeberg 发起反 AI slop 协议

🥇 Tier 2 — 高热度(100-200 points)

热度 标题 类型 评论 亮点
191 Palmier Pro – Open-source macOS video editor built for AI(开源 macOS AI 视频编辑器) Show HN 40 AI 工作流优先的开源剪辑工具
190 Now is the time to give LLMs access to the ACM digital library(该让 LLM 读 ACM 数字图书馆了) 文章 178 学术出版与 AI 的授权之争
170 Distilling DeepSeek into GPT-OSS doesn’t transfer censorship(蒸馏不转移内容审查:试试看) Show HN 73 用实验推翻”蒸馏继承对齐”假设
170 Extensible Software in the age of LLMs(LLM 时代的可扩展软件设计) 文章 88 为 AI 可维护性重构架构原则
164 AI agents lie, cheat and steal(经济学人:AI agent 撒谎作弊偷窃,用户被劝退) 新闻 213 主流媒体对 agent 可信度集中开火
162 Launch HN: Discovered Materials (YC P26)(YC:用 AI agent 发现新材料) Launch HN 36 Agent for Science 落地科研场景
157 The Maxwell Conjecture Is False (GPT 5.6 Sol)(麦克斯韦猜想被证伪,出自 GPT-5.6) 论文 142 前沿模型攻克经典物理猜想的标志性事件
157 Exploring Claude/GPT Knowledge Cutoffs(逆向推断模型知识截止与预训练时间线) 文章 24 用测验法给闭源模型”验明正身”
156 Hetzner is working on LLM Inference(Hetzner 正在搞 LLM 推理) 新闻 87 性价比之王杀入 GPU 推理市场
152 Anthropic’s War on open source AI(Anthropic 对开源 AI 的战争) 新闻 59 政策游说引发开源阵营反弹
151 Inside vLLM: Anatomy of a High-Throughput LLM Inference System(vLLM 内幕:高吞吐推理系统解剖) 文章 10 PagedAttention 等核心机制硬核长文
139 What should the GUI for AI agents look like?(AI agent 的 GUI 应该长什么样?) Show HN 85 把 agent 交互做成”桌面 OS”的探索
137 Petals: Run LLMs at home, BitTorrent-style(Petals:BT 下载式分布式跑大模型) 项目 38 老项目翻红:众人拾柴推理开源模型
136 ThoughtDAG – An editable context graph for LLM conversations(ThoughtDAG:可编辑的对话上下文图) Show HN 63 用 DAG 替代线性聊天记录管理上下文
132 GPT 5.6 Cyber(OpenAI 发布 GPT-5.6 Cyber) 新闻 71 降低拒绝率的安全研究专用模型
132 Everyone is building LLM routers, we deprecated ours(人人都在做 LLM 路由,我们把自家的下线了) 文章 87 反共识:多模型路由收益配不上复杂度
124 Sprocket – The Best AI Agent for Hardware and Software Development(软硬件开发 agent) Show HN 15 打通硬件开发的垂直 agent
121 Rust-lang/rust is adopting an LLM policy(Rust 官方仓库引入 LLM 使用政策) 新闻 72 顶级开源项目为 AI 贡献立规矩
120 Nightcrawler – local AI pentesting agent on smartphone(夜行者:手机上的本地渗透测试 agent) Show HN 35 全本地化的移动端安全 agent
118 Launch HN: Speko (YC S26) – OpenRouter for Voice AI(Speko:语音 AI 版 OpenRouter) Launch HN 68 语音模型聚合路由新赛道
115 Why LLMs Fail at Tabular Prediction(为什么 LLM 做不好表格预测) 论文 33 结构化数据仍是传统 ML 主场
110 OneCLI – OSS credential gateway(凭证网关:别让 agent 摸到你的密钥) Show HN 32 Agent 安全基建,先占密钥管控位
110 Truth is not a direction: a Tarski attack on LLM probes(塔斯基式攻击:LLM 线性探针不可信) 论文 86 可解释性方法论的根基被动摇
101 GPT-5.6 vs. Claude Fable 5 for Physical AI(GPT-5.6 对决 Claude Fable 5:物理 AI 实测) 文章 21 机器人任务基准横向对比
101 Zero-Mem: Zero-Token Memory Operations for LLM Agents(Zero-Mem:agent 的零 token 记忆操作) 论文 12 上下文工程省 token 新思路

🥈 Tier 3 — 中等热度(40-100 points)

热度 标题 类型 评论 亮点
92 Don’t ask an LLM for a confidence score(别问 LLM 要置信度分数) 文章 35 自报置信度与真实正确率脱节
88 Screenpipe (YC S26) – Record how you work and turn that into agents(录下你的工作方式,变成 agent) Launch HN 67 屏幕录制→自动化 agent 的流水线
87 Line9 – A Mermaid rendering engine(自研布局引擎的 Mermaid 渲染器) Show HN 35 给 AI 画图用的高质量图表引擎
87 OneCLI (YC S26) – OSS sandboxed agent harness(团队级沙箱 agent 框架) Launch HN 28 同一团队从凭证网关到 harness 的组合拳
79 A tiny LLM running at 21,000 tok/s on a $250 FPGA(250 美元 FPGA 上 21000 tok/s 跑小模型) Show HN 33 硬件极客的推理性价比极限
72 Emergent Introspective Awareness in LLMs(LLM 的涌现式内省意识) 论文 33 模型能”感知”自身知识边界?
71 Tokenless (YC S26) – Automatic model switching to save money(自动换模型省钱) Launch HN 63 按任务难度动态路由降成本
71 Optimize and serve models with Fable quality at half the cost(半价复刻 Fable 级模型服务) Show HN 30 开源微调+蒸馏降本路线图
69 HyperProbe (YC S26) – Agents that do read-only debugging in prod(生产环境只读调试 agent) Launch HN 51 免改码的 prod 排障 agent
66 Yadda 3.0.0: BDD in the Age of AI Agents(Agent 时代的 BDD 测试框架) 文章 28 行为驱动开发适配 AI 代码生成
62 Mythos tried to social engineer a maintainer to merge malware(AI 代理社工维护者合并恶意代码) 新闻 39 开源供应链安全新威胁:agent 发起的社工攻击
60 Go LLM SDK for streaming, tool-calling AI backends(Grafana 开源 Go 版 LLM SDK) Show HN 16 大厂开源的流式+函数调用 SDK
58 HashAgent – Share an AI agent as a URL(把 agent 做成 URL 分享,WebGPU 本地跑) Show HN 7 零后端的 agent 分发形态
57 Vendo (YC S26) – Let users build features on top of your product(让用户在你的产品上造功能) Launch HN 22 面向终端用户的二次开发平台
51 Suzanne: AI tool for designing physical products(Suzanne:实体产品设计制造 AI) Show HN 42 从 3D 设计到制造的垂直 AI
42 Meta’s new open-weight model targets local agentic AI(Meta 新开源权重模型瞄准本地 agent) 新闻 11 小扎预告:开源+端侧 agent 布局

🥉 Tier 4 — 值得关注(<40 points,精选)

📁 其余 <40 分条目(~90 条,略)

完整 186 条已按 objectID 去重,其余低分条目以 Show HN 小项目、arXiv 论文、行业新闻为主,此处从略。

📅 周榜(08-15 ~ 08-22,与月榜去重后)

周榜搜索范围: 8 个搜索词 × pastWeek,合并去重后 40 条。

↑ 已在月榜的周榜热门条目(不重复展开):GPT-5.6 Sol 降价 50%(633 分,周榜第 1)、GPT-5.6 Sol 史上最佳视觉模型(365 分,周榜第 2,本周热度回升说明视觉能力讨论发酵)、Huzzah AI 编程方法(358)、Vomit 清洗 Claude 输出(294)、LLM 五年级教材实验(245)、LLM 时代可扩展软件(170)、Anthropic 开源之战(152)、ThoughtDAG 上下文图(136)、Speko 语音路由(118)、OneCLI 沙箱 harness(87)、Yadda BDD 框架(66)、Vendo(57)、Proliferate 自托管 Codex(34)、Agent-shell(28)、Flock 警用 AI(27)、MW2 逆向(18)、Ask HN 最坏时代(17)、OpenAI 再降价 20%(7)。

🆕 周榜新增项目(月榜未收录)

热度 标题 类型 亮点
23 Tim O’Reilly – Why Open Source Matters for AI(Tim O’Reilly:开源为何对 AI 重要) 文章 技术出版教父下场谈开源 AI 价值
18 GPT-5.6 Sol: 70% off in Devin(Devin 中 GPT-5.6 Sol 七折) 新闻 降价潮蔓延到下游 agent 产品
15 PINE64 halts open-source hardware until the AI bubble bursts(PINE64 停产开源硬件等待 AI 泡沫破裂) 新闻 硬件厂商用脚投票,折射 AI 挤压效应
14 AgentSight – eBPF observability for AI agents(eBPF 观察 agent,零改码) Show HN 阿里出品的 agent 可观测性方案
12 Semantica, the Open Source Palantir for AI Agents(开源版 agent 数据中枢) 项目 图原生的 agent 基础设施(与 GitHub 周榜第 6 位同一项目)
11 Ask HN: What tools for human code review of AI-assisted code?(用什么工具人审 AI 代码?) Ask HN 人审 AI 代码的工具链讨论(8 条务实讨论)

📌 周榜其他新增(≤10 分):HarnessRouter(agent 框架统一接口)、Xalgorix(开源 AI 渗透测试)、ChatOSS(基于 Ollama 的开源 Codex)、GPT-Pro 七天长思考数学实验、Caspian(agent 的「找真人」工具)、Mozilla《开源不是美德,是所有权模式》、open-slopware(被 AI 污染软件替代清单)、Naeos(编程 agent 工程化系统)、Deft Writing(反 slop 写作实验室)、RelArena-α(关系学习开源)。

🎯 社区核心信号

  1. “认知负债”成为本月最大争议词:手抄 LLM 代码(545 分)、”2x not 10x”(280 分)、装不用 AI 反而更强(13 分)——社区从狂热转向认真讨论 AI 依赖的认知代价。
  2. Agent 安全从边缘话题变主战场:Docker 沙箱(694 分)、权限审批漏检 1/3(340 分)、思维链窃取(697 分)、agent 社工投毒(62 分)——安全基建类 Show HN 密集出现,说明开发者真实痛点在”敢不敢放权给 agent”。
  3. 价格战全面开打(本周绝对主线):GPT-5.6 Sol 一个月内多次降价(OpenRouter 5 折、官方再降 20%+、Devin 跟进 7 折),叠加 Hetzner 等廉价算力入场,”前沿能力白菜价”正在重塑 API 选型决策,开发者讨论焦点已从”能力”转向”成本与选型”。
  4. 开源与闭源阵营对立加剧:GLM-5.3 开源冲前沿(1171 分)、Anthropic 被指”对开源宣战”(152 分)、Tim O’Reilly/Mozilla 相继发文、阿里开源收费试水(12 分)、Debian/Rust/Codeberg 等社区各自立规——开源 AI 的治理与商业模式进入深水区。
  5. 上下文工程是本周最热技术词:ThoughtDAG 可编辑上下文图(136 分)、受限课程实验(245 分)都在回答”喂给模型什么、如何管理”,与 Needle2/Zero-Mem 一脉相承。
  6. LLM 做数学/科研出圈:麦克斯韦猜想被 GPT-5.6 证伪(157 分)、菲尔兹奖得主下场测评(260 分)、AI 设计噬菌体(9 分)——“AI 科学家”叙事开始有实锤案例。
  7. YC 新项目密集亮相且方向收敛:Speko(语音路由)、OneCLI(沙箱 harness)、Vendo(用户造功能)均围绕 agent 基建与分发,投资风向标清晰指向”卖铲子”。

💬 Reddit r/MachineLearning

月榜数据周期:近一个月 | 来源:r/MachineLearning top.json?t=month

📅 月榜 Top 15

# Flair 标题 分数 评论数 作者
1 [D] 因会议评审流程,我已经失去了三个半潜在的博士生 682 141 AffectionateLife5693
2 [R] City2Graph:面向异构图神经网络与城市空间分析的 Python 库 456 21 Tough_Ad_6598
3 [P] 我训练了一个预测自己血糖的模型 348 92 0xdeadf1sh
4 [R] GPT-5.5 在 ActiveVision 上仅得 10.6%,人类达 96.1% 303 50 Justgototheeffinmoon
5 [D] 是时候直接拒掉不提供可复现代码的论文了 281 66 Flaky-Ambition5900
6 [P] Transformer 出了名地不擅长算术,于是我手工设置权重(零训练),乘法准确率 100% 276 55 notforrob
7 [R] SSOG-Attention:可分离高斯之和——SDPA 的次二次方可扩展替代方案 241 24 4rtemi5
8 [P] 我把 Bad Apple 压缩进一个 3MB 的神经网络 231 46 Which_Lie_8932
9 [R] 往返一致性:双向扩散模型能预测自身的滚动误差 189 69 Clean-Hovercraft5825
10 [P] 我把 Doom 的渲染器编译进一个 21B 参数的 transformer——全程零训练 187 33 notforrob
11 [D] 有生之年还来得及让 ML 研究领域恢复一些条理性吗? 181 43 NeighborhoodFatCat
12 [D] NeurIPS 2026:如果 rebuttal 解决了你的疑虑,请提高你的评分 150 91 undesirable_12
13 [P] 训练了一个只需 264KB 内存运行的扩散模型 144 19 PandaBean18
14 [D] 你会选择给你完全自由但几乎不指导的博导吗? 138 79 Hope999991
15 [D] NeurIPS 2026 中的提示注入攻击? 134 30 Kwangryeol
📋 展开月榜 16-30 名
  • 16 我用 ARM64 汇编从零实现 YOLO26n 推理(137 分)——硬核复现
  • 17 NeurIPS 2026 审稿人:AI 生成的 rebuttal 和论文(115 分/56 评论)
  • 18 MLVC:多平台学习型视频编解码器(106 分)
  • 19 EMNLP 2026 录用通知/结果讨论帖(93 分/498 评论)
  • 20 把计算图编译成 vanilla transformer 权重的编译器——零训练(94 分)
  • 21 单 GPU 研究还能发表吗?(87 分)
  • 22 如何投诉已发表的 CVPR 论文?(85 分)
  • 23 NeurIPS 2026:AC 和审稿人都消失了(84 分/67 评论)
  • 24 「诚实」计算机会议排名:按旅行体验排序(82 分)
  • 25 SineKAN:正弦激活函数的 Kolmogorov-Arnold 网络(76 分)
  • 26 审稿强制化后,低质量审稿不能再以「志愿工作」为借口(76 分)
  • 27 ICLR 2027 截稿早于 NeurIPS 2026 出结果(73 分/52 评论)
  • 28 73 个 NeurIPS workshop 无一涉及因果推断(68 分)
  • 29 连 AC 都不回复 rebuttal 和评论(68 分/85 评论)
  • 30 糟糕但典型的 NeurIPS 体验?(64 分)

💬 月榜 Top 5 帖子热门评论摘要

  1. 「失去三个半博士生」(682 分月冠军):最热评论(316 赞)言简意赅——“这对他们是好事”,暗指逃离学术界是明智选择;173 赞用户共鸣:做出 SOTA 遗忘系统却三次重投被 AI 生成审稿意见刁难,”同行评审正在消亡”;86 赞助理教授:帮学生想清楚不要什么也是一种成功。
  2. 「City2Graph」:评论以正面反馈为主,”已分享给合作者马上试用”;也有”用 5 岁小孩能懂的方式解释一下”的科普请求,说明工具型研究触达非专业受众。
  3. 「预测自己血糖的模型」:质疑声集中(159 赞:”为什么用这么大的 transformer?”);社区共识:个人健康项目精神可嘉,但经典统计基线(ARMA/RNN)不可缺席。
  4. 「GPT-5.5 ActiveVision 仅 10.6%」:140 赞”基准设计得真巧妙”;48 赞”LLM 视觉能力仍然糟糕,这是通往 AGI 的下一个大前沿”;有评论提到 DeepSeek 的 Thinking with Visual Primitives 论文可能是新颖解法。
  5. 「拒掉无代码论文」:131 赞尖锐反驳:这等于枪毙所有基于闭源 LLM 的”研究”——整个领域有强烈财务动机不这么做;89 赞:需要 H100 数周的实验并不现实可复现。

📅 周榜 Top 15(与月榜去重后)

↑ 已在月榜的周榜热门帖(不重复展开):SSOG-Attention(242 分,周榜第 1,↑月榜第 7)、264KB 扩散模型(144 分,↑月榜第 13)、EMNLP 2026 等待楼(98 分/498 评论,↑月榜第 19)、SineKAN 正弦 KAN(82 分,↑月榜第 25)、NeurIPS 通知逼近 ICLR 截稿(24 分,同主题已见月榜第 27 位)。

🆕 周榜新增帖(月榜未收录)

# Flair 标题 分数 评论数 说明
5 [R] BDH-CQ:基于循环潜空间推理的上下文学习 65 10 与 HF 论文月榜第 1 名同款研究,150M 参数刷新 ARC-AGI-1 成本-精度前沿
6 [P] 数据集:Starfield 野生动物——50 个物种类别的 2 万张图像 62 10 游戏素材数据集
7 [D] 如果你手头有一堆 GPU,你会真正拿它们造点什么?(跑 LLM 不算) 58 81 81 条评论的算力畅想楼
8 [D] 求职建议:物理 AI/机器人方向应届生,市场与全球招聘行情如何? 48 14 具身智能就业风向
9 [D] 如何解决线性注意力中的长程召回问题? 41 27 注意力机制前沿讨论
10 [R] Survival of the Fitted:Qwen3.6-27B 的雅可比透镜零重拟合读取并操控 Qwen3.8-27B 34 3 模型可解释性新玩法
11 [P] 三个从零训练的 LLM(353M/316M/672M)用同一 GRPO 配方得到三种不同结果,与规模无清晰关系 31 7 RL 训练可复现性实验
12 [D] 如何让任何稀疏注意力/KV 压缩方法「看起来很棒」? 31 4 评测方法论反思
13 [D] 重温 ECA 论文(2019,1.2 万引用):其核心假设并不完全成立 26 4 经典论文复现质疑
15 [D] 关于多分类中类别分组的影响 21 3 分类方法论讨论
📋 展开周榜 16-30 名(均为月榜未收录的新增项目)
  • 谱神经元:面向可扩展可解释模型的 ML 基元([R],21 分)——可解释性新方向
  • 我们的 AC 评论和回复在 OpenReview 上消失了([D],17 分)——评审流程乱象再添一案
  • EMNLP 2026 Findings:值得线下参会吗?([D],14 分)
  • EMNLP 评分不错仍被拒:接下来怎么办?([D],15 分)
  • 生产级 RAG workshop:开源模型端到端基准评测([D],12 分)
  • 微软研究院(MSR)实习咨询([D],8 分)
  • 让 LLM”写简洁点”真能省钱吗?9 个模型实测:压缩输出能省钱且不掉精度,压缩输入提示词则不能([R],9 分)
  • ICDM 2026 结果等待楼([D],9 分,33 评论)
  • CI/CD 中的 AI 生成代码检测:求方法与实战经验([D],8 分)——呼应 HN”人审 AI 代码”之问
  • 复杂表格数据的内在秩与信息引力:非参数、模型无关的信息论诊断工具([R],7 分)
  • 基于句子和关键词 trie 的对话输入缩减 4-5 倍([P],6 分)

💬 周榜 Top 5 帖子热门评论摘要

  1. SSOG-Attention:24 赞技术建议(盒式核近似高斯核只需 3-4 次扫描);8 赞尖锐提问:博客承认”成分都已发表”,那博客为何是 AI 生成的?研究本身是否也是 AI 生成?——AI 生成内容的署名边界成为社区新敏感点。
  2. 264KB 扩散模型:17 赞吐槽网站可读性差;11 赞技术质疑:从训练脚本看它可能并不是扩散模型——“扩散”指生成方式而非网络架构;6 赞建议把计算图烧进 FPGA”焊死”到硬件。
  3. EMNLP 2026 等待楼:60 赞暖心顶帖”喝口水,放轻松——就算 EMNLP 不行,你的工作依然是好的”;39 赞”已备好烧酒等结果”(韩国作者群体氛围);15 赞实用建议:被录用作者请逐条人工核对参考文献,别依赖 GPTZero。
  4. SineKAN:14 赞共鸣”低垂果实被摘”——早该关注 KAN,异相位正弦可作通用逼近器,天然适合模拟计算;3 赞认可与 SIREN 相似性,追问与标准样条 KAN/MLP 的基准对比。
  5. BDH-CQ:28 赞最高赞吐槽”为什么标题全大写!”;认真讨论:此类改进落地后,SOTA 生产模型的算力成本多久能实质性下降?

🎯 核心洞察

  • Flair 统计:月榜讨论 [D] 16 帖 > 项目 [P] 8 帖 > 研究 [R] 6 帖;周榜讨论 [D] 17 帖 > 研究 [R] 9 帖 > 项目 [P] 4 帖——讨论类占比过半,学术生态吐槽是绝对主题
  • 学术评审危机是本月最大叙事:NeurIPS 2026 进入评审季——AI 生成 rebuttal 遭审稿人当面识破(115 分)、AC 与审稿人集体失联、”失去三个半博士生”(682 分月冠军)高赞回复几乎一边倒支持学生逃离学术界;EMNLP 等待楼狂揽 498 条评论为全月互动之最;ICLR 2027 截稿早于 NeurIPS 出结果的”排期死锁”持续发酵
  • 创客文化兴旺:手工设置权重实现 100% 乘法(276 分)、21B 参数硬编码 Doom 渲染器、Bad Apple 压进 3MB 神经网络、264KB 内存跑扩散模型——“零训练/极限轻量化”极客项目集体刷屏,成为社区情绪出口
  • 可复现性之争:拒掉无代码论文的呼声遭遇”闭源 LLM 研究利益链”的现实反击
  • 周榜技术热点:线性注意力长程召回、稀疏注意力评测方法论、ECA 经典论文复现质疑、谱神经元等可解释性方向集中出现;SSOG-Attention 被”坦诚反噬”(承认成分非原创+博客疑似 AI 生成)折射 AI 生成内容署名争议

🚀 Product Hunt

📅 月榜 Top 17(2026 年 8 月)

# 产品 👍 💬 标签 说明
1 AdAnt AI 605 88 广告 · 人工智能 · 社媒营销 用 Claude 打造爆款、高转化的社交媒体广告
1 Hey Noah 597 101 效率 · 日历 · 人工智能 面向创始人的主动式 AI 执行助理
2 Framer 3.0 909 28 设计工具 · 建站 · 人工智能 画布上直接用 Agent 设计/写作/分析,支持接入 Claude Code、Codex;新增分支与创作者社区
3 Wispr Flow Notetaker 583 73 笔记 · 会议 · 人工智能 把会议笔记的每个细节都记对
4 Dograh 559 162 开源 · 开发者工具 · GitHub 开源的 VAPI 替代品(语音 Agent 平台)
5 Grok Bot 532 23 效率 · 任务管理 · 人工智能 能真正委派任务的 AI 队友
6 Astute 531 162 社交媒体 · 营销 · 人工智能 自动化 B2B 品牌病毒式传播,联动新媒体创作者
7 Coldtea.ai 518 70 软件工程 · 开发者工具 · 人工智能 让你的软件进入「自动驾驶」
8 Soloop 482 67 效率 · 人工智能 · 创作者工具 面向独立创始人的「审批优先」Agent 操作系统
9 Cloudflare OS 466 3 开源 · 人工智能 · GitHub 为公司构建 AI 操作系统
10 Clipto MCP 471 117 效率 · 搜索 · 视频 让 Agent 从 TB 级本地视频中检索素材片段
11 Kane CLI 464 56 SaaS · 开发者工具 · 人工智能 在终端里用自然语言做浏览器与移动 App 测试
12 NextDoor.Company 461 56 招聘 · 地图 · 职业 在地图上发现附近正在招聘的初创公司
13 Meridian 458 81 效率 · 开源 · 开发者工具 别让你的工作被埋没,帮你升职加薪
14 Clara AI SDR 453 46 开发者工具 · 人工智能 把网站访客转化为合格销售管线
15 Ito 448 47 开发者工具 · 人工智能 · GitHub 会真正运行你的代码的 AI 代码审查
16 AgentSky 432 59 SaaS · 开发者工具 · 人工智能 任意 harness、任意 LLM——按需云端托管 AI Agent
17 Omniwork 421 37 效率 · 人工智能 · 社媒营销 创意 Agent 操作系统,用桌面 AI Agent 更高效地创作

🎁 精选评价位:Viktor.com(684 赞,全场最高)——真正能干活的 AI 同事:驻扎 Slack、自带上下文、主动提议自动化;Customer.io(335 赞,推广位)——全渠道消息自动化,初创公司免费 12 个月。

📅 展开月榜 18-52(月榜延伸名次 + 8/20、8/21 日榜补充)

月榜延伸名次(虚拟滚动渲染所得)

# 产品 👍 💬 标签 说明
19 Taku AI 409 58 效率 · 人工智能 · 无代码 借用最好的 AI 配置(工作流)并据为己有
25 Omni by xpander 384 29 Slack · 人工智能 · 虚拟助理 别再「babysit」你的 AI Agent
26 Ctruh Studio 380 90 人工智能 · 增强现实 · 无代码 无需代码创建交互式 3D 与 XR 体验
31 Vendo 358 58 开源 · SaaS · 开发者工具 让用户在你的产品里搭建自己的功能
36 Scrimba Explain 325 31 效率 · 教育 · 视频 提任何问题,立刻得到一段视频解答
38 BetterClaw 324 72 效率 · SaaS · 人工智能 60 秒部署 AI Agent,永久 0 美元

8/21 日榜补充(去重后新增):fx (by Vercel)(👍171,Vercel 出品的轻量级开源编码 Agent);Epho(👍150,云端运行 Claude Code/Codex/Opencode 并挂载仓库);Antigravity IDE Extensions(👍146,Antigravity Agent 进驻现有编辑器);Plow Latch(👍135,Mac 上以受限权限安全运行 AI Agent);Dockhand(👍126,人人可用的 Docker 管理);OneCLI(👍122,给员工安全沙箱化的助理 Agent);Surfdeck(👍122,标签页触手可及);Router by Ramp(👍115,「Token 就是钱」——LLM 路由);Local(👍107,Mac 零门槛本地 AI);Actx0(👍102,Agent 记忆基础设施);Flunkey(👍101,Windows 语音优先 AI 层);ShogunAI(👍94,跑在 PC 上的个人 AGI);Project SKY(👍93,Windows 环境感知 AI 伴侣);Outlook Google Calendar Sync for Mac(👍81)。

8/20 日榜补充(去重后新增):Prized(👍160,非工程师搭建安全内部工具);Hermai Brand API(👍137,客户品牌白标 B2B SaaS);Lifelong(👍137,全家健康记录管理);MiniMax Design(👍132,面向开放式创作的专属 Agent 团队);Aloud(👍119,语音反馈变编码任务);Glasp for Firefox(👍115,网页/PDF/视频高亮总结);Shape(👍111,设计师与程序员的 Agent 式 IDE);bitdrift.ai(👍112,首个 Agent 式移动端可观测性平台);Berd(👍106,AI Agent 创作搞怪桌面应用);NobodyWho(👍106,任意设备跑 AI 模型);Zoho Cliq 7.0(👍98);Roveri(👍91,iPhone 骑行日志)。
|——|—–|—–|——|——|
| Prized(日榜 6) | 160 | 17 | 人工智能 · 无代码 · 安全 | 让非工程师也能搭建安全的内部工具 |
| Hermai Brand API(日榜 7) | 137 | 30 | 设计工具 · SaaS · 开发者工具 | 用每位客户自己的品牌白标你的 B2B SaaS |
| Lifelong(日榜 8) | 137 | 8 | 健康健身 · 人工智能 · 家庭 | 全家人的健康记录一站式管理 |
| MiniMax Design(日榜 9) | 132 | 2 | 设计工具 · 人工智能 · 图片视频 | 面向开放式创作的专属 Agent 团队 |
| Aloud(日榜 10) | 119 | 14 | Mac · 开发者工具 · 人工智能 | 把语音反馈变成编码 Agent 可执行的任务 |
| Glasp for Firefox(日榜 11) | 115 | 10 | 浏览器插件 · 效率 · 人工智能 | 在 Firefox 里高亮并总结网页、PDF 与视频 |
| Shape(日榜 12) | 111 | 6 | 设计工具 · 开发者工具 · 人工智能 | 面向设计师与程序员的 Agent 式 IDE |
| bitdrift.ai(日榜 13) | 112 | 10 | 软件工程 · 开发者工具 · 人工智能 | 全球首个 Agent 式移动端可观测性平台 |
| Berd(日榜 14) | 106 | 2 | Mac · 开源 · GitHub | 用 AI Agent 搞创作的搞怪桌面应用 |
| NobodyWho(日榜 15) | 106 | 19 | 安卓 · 开源 · 开发者工具 | 在任意设备上运行 AI 模型 |
| Zoho Cliq 7.0(日榜 16) | 98 | 1 | 效率 · 人工智能 · 科技 | 不间断的工作(大版本更新) |
| Roveri(日榜 17) | 91 | 8 | iOS · 旅行 · 地图 | iPhone 骑行日志,每次骑行都绘制在地图上 |

📅 周榜 Top 17(2026 年第 34 周,与月榜去重后)

↑ 已在月榜的周榜热门产品(不重复展开):Astute(周榜第 1,531 赞)、Clipto MCP(第 2,472 赞)、Meridian(第 3,458 赞)、Clara AI SDR(第 4,453 赞)、Taku AI(第 5,409 赞)、Omni by xpander(第 6,384 赞)、Vendo(第 9,358 赞,HN 周榜亦有 Launch)、Viktor.com(精选位)。8/20、8/21 日榜补充产品(fx、Epho、Plow Latch、OneCLI、Router by Ramp 等)与月榜章节完全重合,已在上文展开。

🆕 周榜新增产品(月榜未收录)

# 产品 👍 💬 标签 说明
7 Clears 372 35 开发者工具 · 人工智能 从 AI 编码迈向 Agent 式软件交付
8 HyNote for Mac 371 59 会议 · 菜单栏应用 · 苹果 100% 本地、完全私密的免费 Mac 转录工具
10 Origin by Cursor 343 10 开发者工具 · 人工智能 Cursor 出品:为编码 Agent 时代打造的 Git 代码托管平台,直接对标 GitHub
11 Grok 4.6 298 9 安卓 · SaaS · 开发者工具 xAI 发布:面向长时间运行 Agent 的前沿智能
12 Wizstar 269 29 效率 · 营销 · 人工智能 像专业演员一样会动会演的数字人
13 Superflow AI 263 27 设计工具 · 人工智能 · 营销自动化 上线前帮你 QA 网站的 AI Agent
14 Claude Watermark Remover 263 14 写作 · 隐私 · 人工智能 找出并清除文本中 AI 留下的所有痕迹(与 GitHub 月榜 humanizer 同赛道)
15 Supernova 260 35 数据分析 · 人工智能 · 数据 把你的所有数据接入 Claude 和 Codex
16 Checksum AI 234 40 API · 开发者工具 · 人工智能 你的编码 Agent 的「测试搭子」
17 The New Calendly 210 6 安卓 · 浏览器插件 · 笔记 处理会议前、中、后的全部工作

🎁 周榜精选位新增:Wispr Flow Dictation——停止打字开始说话,快 4 倍;Tines——Agent、应用与自动化的统一安全环境。
📌 周榜延伸名次新增:Mindcase(192 赞)——几分钟内从网页任意位置提取数据;MeetStream AI(179 赞)——面向 AI 会议 Agent 的统一 API 与基础设施。

🎯 核心洞察

  • AI 渗透率极高:月榜 Top 17 中 15 个产品带「人工智能」标签,几乎全是 AI Agent / AI 工作流方向
  • AI 同事/Agent OS 赛道最热:Hey Noah(AI 执行助理)、Grok Bot(AI 队友)、Soloop(Agent OS)、Omniwork(创意 Agent OS)、Viktor(AI 同事,684 赞全场最高)
  • 开源替代是大主题:Dograh(开源 VAPI 替代)、Cloudflare OS、Meridian、Vendo、fx(Vercel 开源编码 Agent)、OneCLI、Berd、NobodyWho
  • 营销增长类 AI 集中爆发:AdAnt AI(AI 广告)、Astute(B2B 病毒营销)、Clara AI SDR(AI 销售)
  • 大厂动向:Cursor 推 Git 托管平台「Origin」直接对标 GitHub;xAI 发布 Grok 4.6(主打长时间运行 Agent);Vercel 开源轻量编码 Agent「fx」;Ramp 推 LLM 路由「Router」;MiniMax 发布 Design;Framer 3.0 画布 Agent(909 赞);Zoho Cliq 升级 7.0
  • Agent 基建「水电煤」成形:Actx0(Agent 记忆)、Router by Ramp(LLM 路由)、bitdrift.ai(Agent 可观测性)、Plow Latch(Agent 权限沙箱)、OneCLI(企业沙箱助理)——Agent 生态配套集中上新
  • 去 AI 痕迹成新需求:Claude Watermark Remover(263 赞)与 GitHub 月榜 humanizer、HN「反 slop」情绪互相印证

📰 Techmeme AI 行业新闻

过去 7 天 AI 相关行业新闻精选(来源:TechCrunch / The Verge / Bloomberg / Reuters 等)

📅 本周 AI 新闻 Top 15

# 标题 来源 说明
1 Sources: Anthropic expects to match or beat the size of SpaceX’s record-setting IPO(消息人士:Anthropic IPO 规模有望追平甚至超越 SpaceX 创纪录 IPO) Bloomberg(彭博社) Anthropic 或 8 月底公开递交 IPO 文件,规模瞄准 SpaceX 级别
2 Sources: Anthropic’s revenue run rate reached $65B by the end of July(Anthropic 7 月底年化收入达 650 亿美元) Bloomberg 从 5 月 470 亿飙升至 650 亿,IPO 前增长迅猛
3 Sources: OpenAI’s Q2 sales grew 18% QoQ to $6.7B as loss jumped 32% to $12.3B(OpenAI 二季度营收环比增 18% 至 67 亿美元,亏损扩至 123 亿) WSJ(华尔街日报) 同期 Anthropic 销售额翻倍至 116 亿并实现小额经营利润,形成对比
4 Sam Altman says OpenAI decided to slow the development of some AI models(Altman 称 OpenAI 决定放缓部分模型研发) Time(时代周刊) 因研究发现模型存在”不同程度失准”,主动降速
5 Stripe agrees to acquire OpenRouter; source: $7.5B(Stripe 以 75 亿美元收购 AI 模型路由平台 OpenRouter) NYT(纽约时报)/ WSJ Stripe 史上最大收购,押注”AI 模型+token 支付”未来
6 Filing: Nvidia agrees to spend up to $105B supporting SB Energy’s Ohio data center campus OpenAI will lease(英伟达将斥资最高 1050 亿美元支持 OpenAI 俄亥俄数据中心) Bloomberg OpenAI 签 20 年 10GW 租约,Nvidia 出资 15 亿投资 SB Energy 并兜底
7 Sources: Poolside struck a non-exclusive $6B licensing deal with Nvidia, plus a $1B investment(Poolside 与英伟达达成 60 亿美元授权+10 亿美元投资) Newcomer(科技通讯) 估值 120 亿美元,109 名员工获 Nvidia 职位邀约
8 Meta launches a Mac app for Meta AI, with Instagram/Facebook and Workspace integration(Meta AI 推出 Mac 应用,打通社媒账号与谷歌办公套件) The Verge Meta AI 桌面端扩张,直连广告投放与 Workspace
9 Google DeepMind: Gemma open models surpass 1B downloads(谷歌 Gemma 开源模型下载量突破 10 亿次) Google 官方博客 两年内开发者发布超 10 万个 Gemma 模型变体
10 OpenAI debuts ChatGPT for Teens(OpenAI 推出青少年版 ChatGPT) NYT 限制自残/饮食障碍等高风险对话,配备学习工具与护栏
11 Etched raised $700M at a $21B valuation led by Jane Street(AI 推理芯片公司 Etched 融 7 亿美元,估值 210 亿) WSJ 估值三个月翻倍,客户 Jane Street 领投
12 Sources: AI chip startup Fractile in talks to raise ~$600M at $6.5B valuation(AI 芯片初创 Fractile 洽谈融资 6 亿美元,估值 65 亿) Bloomberg 已与 Anthropic 达成约 2.5 亿美元初始订单
13 Amazon makes AI-powered Alexa+ free on all Fire TV devices(亚马逊 Alexa+ 在 Fire TV 上全面免费开放) TechCrunch(科技媒体) 无需 Prime 订阅,自动升级全部美国用户
14 China’s Hangzhou deploys autonomous traffic-control robots(杭州部署自主交通管理机器人) Reuters(路透社) 摄像头+雷达全天候指挥交通、识别违章
15 Groq raised $350M at a $3.5B valuation, down from $6.9B(Groq 融资 3.5 亿美元,估值从 69 亿腰斩至 35 亿) Bloomberg Nvidia 授权交易挖走大量人才后被迫降估值融资
📋 更多新闻(16-32)
# 标题 来源 说明
16 OpenAI CFO: OpenAI “will be a public company in 2027”(OpenAI CFO 称 2027 年上市) CNBC 全员会上表示业务向好可能提前
17 OpenAI expands ad pilot to 31 European markets(OpenAI 广告试点扩至 31 个欧洲市场) Adweek(广告周刊) 覆盖德法西意,商业化加速
18 Sources: OpenAI changed safety practices, paused RL training for two weeks(OpenAI 因 Hugging Face 入侵事件暂停强化学习训练两周) Axios Astra 疑似触及网络攻击关键阈值后启动准备框架响应
19 OpenAI testing Private Safety Processing(OpenAI 测试”私有安全处理”零留存安全技术) Axios 与 Anthropic 要求 30 天数据留存的新政策形成对比
20 Anthropic plans safety system with 30-day on-premise data retention(Anthropic 拟推企业自有云端 30 天留存方案) Bloomberg 隐私与安全监管间寻求平衡
21 Z.ai’s GLM-5.3 scores 60 on Artificial Analysis index(GLM-5.3 智能指数 60 分,超 GLM-5.2 七分) Artificial Analysis 与 Kimi K3 持平,仍低于 Opus 5 的 63 分
22 Z.ai prices GLM-5.3 API at $1.40/$4.40 per 1M tokens(GLM-5.3 API 定价与 5.2 持平) VentureBeat 输入 $1.40/百万 token,Kimi K3 为 $3/$15
23 Cerebras unveils CS-3-based Nexus rack with 50% fewer components(Cerebras 发布 CS-4 服务器机架) Reuters 三颗 WSE-3 Turbo 芯片,Q3 交付
24 Sources: ByteDance and Tencent got ~10K Nvidia H200 chips each(字节与腾讯各获约 1 万颗 H200 芯片) FT(金融时报) 美国许可下 H200 获准进入中国大陆
25 Sources: Nvidia plans LPU tailored for China by end of 2026(英伟达年底前小批量交付中国定制 LPU) The Information 合规美国出口管制,重返中国市场
26 Meta spending hundreds of millions/year on Azure AI tokens(Meta 每年花数亿美元经 Azure 用数万亿 AI token) Bloomberg 悄然成为微软最大 AI 客户之一
27 Alibaba Qwen3.8-27B open model passes 1M+ downloads(阿里开源多模态模型 Qwen3.8-27B 下载破百万) The Information 发布数日内成为其增长最快模型之一
28 Kuaishou Kling AI sales up 200% YoY(快手可灵 AI 收入同比增 200%) Bloomberg Q2 净利大跌 36%,AI 投入拖累利润
29 Sources: SpaceX approached Cognition about acquisition(SpaceX 曾洽购 AI 编程公司 Cognition) Bloomberg CEO Scott Wu 回应”不出售”
30 Sources: Nvidia discusses Mercor investment at $20B valuation(英伟达洽投 AI 数据公司 Mercor,估值 200 亿) The Information 上季向 Mercor 支付数千万美元
31 Slack launches Slack Code with AI coding agents(Slack 推出代码频道,AI 编程代理”如队友”协作) The Verge 全套餐开放项目级代码协作频道
32 Binance launches Agent OS for AI trading agents(币安发布 Agent OS,AI 代理可代用户交易) TechCrunch 限制代理权限主要靠用户自行设置

🎯 行业核心动态

大公司动向(产品/收购/融资)

  • Anthropic 成本周绝对焦点:年化收入 650 亿美元、IPO 或月底递交、联合创始人拟获超级投票权、100 亿美元级信贷额度超募;Situational Awareness 基金却折价甩卖其股权额度暴露流动性危机
  • OpenAI 双线推进:俄亥俄 20 年 10GW 数据中心(Nvidia 最高 1050 亿美元支持)、2027 上市计划、广告扩欧;但因安全事件暂停 RL 训练、主动放缓模型研发
  • 英伟达资本布局凶猛:Poolside 60 亿授权、Mercor 200 亿估值投资、Etched/Fractile 等芯片生态卡位;季自由现金流三年涨 18 倍至 485 亿美元,从”芯片护城河”转向”资本护城河”
  • 算力融资与定制芯片:Cerebras CS-4、Waymo 自研 ASIC、Etched 210 亿估值、Marvell 获谷歌 122 亿美元认股权证

政策法规(监管/诉讼/数据)

  • 美国司法部调查 a16z 近一年:合伙人兼任竞争性 AI 公司董事是否违规
  • 29 州总检察长诉 Meta 青少年成瘾案开审,前工程师指证扎克伯格重增长轻安全
  • FTC 要求企业披露个性化定价;GOP 备忘录警告数据中心民意反弹或致俄亥俄参议院席位失守
  • Pew 调查:52% 美国人对 AI 担忧超过兴奋(2021 年为 37%)

商业化进展

  • Stripe 75 亿美元收购 OpenRouter,致股东信称”奇点已始”,H1 收入同比增 41%
  • Meta AI Mac 版落地、OpenAI 广告 31 国扩张、Alexa+ 免费开放、币安/支付宝布局 AI 代理交易与商户自动化
  • 中国阵营:GLM-5.3 与 Kimi K3 发布并进入 API 竞价、Qwen3.8 开源爆发、杭州机器人交警上路

📈 Trendshift — GitHub 项目社交热度

数据来源:trendshift.io 日榜(社交提及 + 星标增长综合热度,2026-08-21 期)

📅 日榜 Top 12(今日爆发)

# 项目 📈 今日增长 热度分/提及 主题 说明
1 openai/codex +4,090 ⭐ 34,263 · HN/Reddit/X AI 智能体、AI 编程助手 OpenAI 官方轻量级终端编程智能体,Rust 编写,在终端里直接跑
2 deepseek-ai/deepseek-harness +6,795 ⭐ 9,965 · HN/Reddit/X AI 智能体 DeepSeek 官方 Agent Harness 运行时,上线一周星标破 18 万,今日增长全场第一
3 ripienaar/free-for-dev +814 ⭐ 6,646 · HN/Reddit/X 精选清单 面向 DevOps 与基础设施开发者的免费层 SaaS/PaaS/IaaS 大全
4 mattpocock/skills +2,921 ⭐ AI 技能 TypeScript 名师 Matt Pocock 的 .agents 目录实战技能集
5 modular/modular +769 ⭐ AI 基础设施 模块化 AI 平台(含 MAX 与 Mojo 语言)
6 Wei-Shaw/sub2api +700 ⭐ 自托管 一站式开源中转服务,统一接入 Claude/OpenAI/Gemini/Grok 订阅,支持拼车共享
7 mahlernim/google-timeline-visualizer +663 ⭐ 数据可视化 用 Google 位置历史(时间线)数据可视化你的年度旅行足迹
8 AprilNEA/OpenLogi +998 ⭐ 自托管 Rust 原生本地优先的罗技 Options+ 替代品,HID++ 重映射按键/DPI,无账号无遥测
9 santifer/career-ops +768 ⭐ AI 智能体、爬虫、简历 开源 AI 求职工具:扫描招聘网站、A-F 评分卡打分、定制简历、跟踪投递,本地跑在编程 CLI 里
10 makeplane/plane +500 ⭐ 自托管 开源版 Jira/Linear/Monday/ClickUp,现代项目管理平台
11 canopy-network/canopy +487 ⭐ 区块链协议 Canopy 网络协议官方 Go 实现
12 JuliusBrussee/caveman +534 ⭐ AI 技能 🔥 “原始人说话” Claude Code 技能,砍掉 65% token 消耗

🎯 核心洞察

  • Trendshift 独家发现(GitHub Trending 难见到):santifer/career-ops(AI 求职)、JuliusBrussee/caveman(省 token 技能)、mahlernim/google-timeline-visualizer 等小而美项目靠社交提及冲上日榜
  • 社交传播最快:openai/codex(热度分 34,263 断层第一,HN/Reddit/X 三平台刷屏)、deepseek-ai/deepseek-harness(单日 +6,795 星)
  • AI 技能生态爆发:mattpocock/skills、caveman、ui-ux-pro-max-skill 等 “Agent Skills” 类项目密集上榜,Claude Code / Codex 技能正成为新增长点

数据来源:trendshift.io 周榜(社交提及 + 星标增长综合热度)

📅 周榜 Top 12(持续热度)

# 项目 📈 本周增长 总星标 主题 说明
1 deepseek-ai/deepseek-harness +49,891 ⭐ 180,903 AI 智能体 DeepSeek 官方开源 Agent Harness(智能体运行时框架),将 LLM 变成可工作的智能体,上架仅一周即登顶周榜,单周涨近 5 万星,是本周开源圈最大事件;围绕它的插件/桌面端/路由生态已迅速成型
2 harry0703/MoneyPrinterTurbo +9,183 ⭐ 113,784 AI 视频生成 利用 AI 大模型和自动化工作流,输入主题或关键词一键生成高清短视频(文案、素材、字幕、配乐全自动),国内开发者最爱的短视频自动化工厂
3 mattpocock/skills +9,985 ⭐ 229,085 AI 技能 TypeScript 教育名师 Matt Pocock 从自己 .agents 目录整理出的”给真工程师的技能集”,周增近万星,是 Agent Skills 浪潮的标杆项目
4 openai/codex +4,937 ⭐ 111,162 AI 智能体、AI 编程助手 OpenAI 官方 Rust 编写的终端轻量编程智能体,Claude Code 最直接的竞品,周热度分稳定前列
5 anywhere-labs/deepseek-harness-desktop +8,674 ⭐ 17,530 本地大模型 基于官方 DeepSeek Harness 打造的 Electron 桌面端,支持 macOS 和 Windows,免配置、下载即用,蹭上母项目东风一周 +8.6k 星
6 AprilNEA/OpenLogi +4,284 ⭐ 12,758 自托管 Rust 原生、本地优先的罗技 Options+ 替代品:重映射按键、DPI、SmartShift 走 HID++,无账号无遥测,外设社区的口碑之选
7 awesome-dsh-plugin/awesome-dsh-plugin +6,064 ⭐ 11,132 精选清单 DeepSeek Harness (dsh) 插件精选列表,母项目爆火后生态配套迅速跟进的典型样本
8 santifer/career-ops +3,284 ⭐ 67,337 AI 智能体、爬虫、简历 开源 AI 求职全家桶:扫描招聘门户、A-F 结构化评分(1.0-5.0 分)、按 JD 定制简历、追踪投递进度,本地运行于 Claude Code/Codex 等编程 CLI
9 yjh051108/dsh-routing-suite +3,753 ⭐ 6,555 AI 智能体 DeepSeek Harness 的注入器 + 任务感知推理模式路由套件(实测 P1-P23),让 dsh 按任务自动切换深浅思考
10 public-apis/public-apis +6,248 ⭐ 467,911 精选清单 免费公共 API 大合集,46 万星常青树,每周仍稳定吸星数千
11 volcengine/OpenViking +2,957 ⭐ 31,584 AI 智能体、AI 记忆、RAG 字节跳动(火山引擎)出品的自进化上下文数据库,统一智能体记忆、知识 RAG 与技能,是国内大厂少见的 Agent 基础设施开源
12 mukul975/Anthropic-Cybersecurity-Skills +2,525 ⭐ 30,509 AI 智能体、AI 技能 817 条结构化网络安全技能,映射 MITRE ATT&CK、NIST CSF 2.0 等 6 大框架,兼容 Claude Code/Codex/Cursor 等 20+ 平台
13 s1dashu/ip-as-logo-skill +3,466 ⭐ 3,470 AI 图像生成、AI 技能 紧凑的 Codex 技能:生成高度简化、圆角、微妙新拟物风格的 IP 吉祥物 Logo,一周星标翻倍,设计师社区自来水传播
14 yetone/cumora +2,773 ⭐ 2,857 AI 智能体、聊天机器人 AI 智能体的”团队群聊”:跨平台群聊应用,把 AI Agent 当一等公民队友,云端或自带 Claude Code/Codex 大脑均可

🎯 核心洞察

  • Trendshift 独家发现:deepseek-harness 生态三连(本体 +49.9k、桌面端 +8.7k、插件清单 +6.1k、路由套件 +3.8k)——这种”母项目带飞全家桶”的生态爆发是 GitHub Trending 单榜看不到的
  • 社交传播最快:deepseek-harness 周增 49,891 星为全场之最;MoneyPrinterTurbo(AI 短视频)在中文社区持续病毒式传播
  • AI 求职与 Agent 技能是本周两大新兴赛道:career-ops 双榜齐上(日榜 + 周榜),Anthropic-Cybersecurity-Skills、mattpocock/skills、ip-as-logo-skill 显示 “Skills 经济”正从玩具走向工程化
  • 周榜背景:本期数据基于 Trendshift 综合热度算法(社交提及 × 星标增长加权),榜单覆盖 25 个项目,以上为 AI 相关精选 Top 14

🌐 九源交叉分析

本期 OSSInsight 官方临时下线 star 榜单(GitHub 事件流故障),实际参与交叉分析的数据源为 八源:GitHub Trending、Hugging Face Models、Hugging Face Papers、Hacker News、Reddit r/ML、Product Hunt、Techmeme、Trendshift。

1. 🔥 跨源热门项目验证

综合评级标准:🔥🔥🔥 = 4+ 源验证 | 🔥🔥 = 3 源验证 | 🔥 = 2 源验证

项目/主题 出现的数据源 评级 说明
Agent Skills 生态(mattpocock/skills、google/skills、diagram-design、Anthropic-Cybersecurity-Skills、cangjie-skill 等) GitHub(月榜 #1/#2/#12 + 周榜 #2)· Trendshift(周榜 #3/#12/#13)· HN(Vomit、caveman 等 Skills 周边热议)· PH(Claude Watermark Remover 同赛道「去 AI 痕迹」)· Reddit(SSOG 帖延伸的 AI 生成内容争议) 🔥🔥🔥 连续 3 周多源统治,Skills 已成第三种 Agent 能力分发格式;本周 Google 官方入场标志着从社区玩法升级为平台级品类
Qwen3.8 系列 HF Models(29 席中约 20 席围绕 27B 衍生)· Techmeme(下载破百万、增长最快模型之一)· Reddit(雅可比透镜零重拟合操控 Qwen3.8-27B)· GitHub(unsloth 周榜 #8) 🔥🔥🔥 27B「生态母体」效应确立:量化厂牌以小时级跟进,无审查/abliterated 衍生占榜 1/3,国产开源继续领跑
Stripe × OpenRouter 与模型网关叙事 Techmeme(75 亿美元收购确认)· HN(GPT-5.6 Sol 降价 50% 成周榜第一,448 条评论)· GitHub(OmniRoute 月榜 #2,+31k) 🔥🔥 收购落地+前沿模型跳水,网关/路由中间层的资本与用户双重验证;NVIDIA Switchyard、Router by Ramp 同周上新印证赛道拥挤
去 AI 痕迹/反 slop 赛道 GitHub(humanizer 月榜 #21)· PH(Claude Watermark Remover 周榜 #14,263 赞)· HN(Deft Writing、open-slopware 替代清单、Humanising Is Dumb) 🔥🔥 「AI 味」去除从灰色需求变成产品品类,与欧盟水印新规、学术 AI 生成内容争议同频共振
DeepSeek Harness 生态(dsh 本体 + 桌面端 + 插件清单 + 路由套件) Trendshift(周榜 #1/#5/#7/#9 四席 + 日榜双席)· HF Models(V4-Pro #14 / V4-Flash #27) 🔥 社交热度依旧断层,但工程榜与 HN 均退潮,源数从上周 6 源回落至 2 源——生态爆发进入收敛期
Needle2(cactus-compute/needle) GitHub(月榜 #28 + 周榜 #9)· HN(月榜 535 分) 🔥 连续 3 周,14MB 端侧模型与 ESP32 跑 LLM(HN 289 分)共同坐实「微型化」路线
GLM-5.3 HN(月榜 1171 分)· Techmeme(智能指数 60 分 + API 定价 $1.40/$4.40) 🔥 前沿编码+安全能力涌现持续发酵,价格仅为 Kimi K3 的三分之一
GPT-5.6 系列 HN(多帖:降价/视觉登顶/Cyber/麦克斯韦猜想)· Techmeme(OpenAI 放缓研发、广告扩欧、青少年版) 🔥 连续 4 周:能力叙事让位于价格叙事,本周「降价三连」成绝对主线
MoneyPrinterTurbo GitHub(周榜 #3,+9.7k)· Trendshift(周榜 #2,+9.2k) 🔥 中文背景 AI 短视频工厂双源验证,在中文社区病毒式传播

其他双源验证:OpenLogi(GitHub 周榜 #11 + Trendshift 周榜 #6,Rust 本地优先替代罗技外设驱动);LTX-2(HF Models LTX-2.5 #7 + GitHub 官方推理包,开源视频生成放量);Kimi K3(HF #18 + Techmeme 提及,连续 6 周但热度趋弱)。
| Vendo | PH(周榜 #9 + 月榜延伸)· HN(Launch HN 57 分) | 🔥 | 「让用户在产品上造功能」的双源验证,YC 新方向样本 |
| OneCLI | PH(8/21 日榜 #9)· HN(月榜 110+87 分双帖) | 🔥 | 凭证网关→沙箱 harness 组合拳,Agent 安全基建新秀 |

2. 📊 连续上榜追踪(对比上期 W33 跨源验证表)

项目 首次上榜 连续周数 W34 趋势 说明
usestrix/strix W27 8 周 → 持平 GitHub 月榜 #11 + 周榜 #4,AI 渗透测试常驻赛道
earendil-works/pi W29 6 周 → 持平 GitHub 月榜 #7 + 周榜 #22(+5k/周),Agent 工具包长青
diegosouzapw/OmniRoute W29 6 周 → 持平 GitHub 月榜 #2(+31k),网关叙事获 Stripe 收购背书
Kimi K3 W29 6 周 ↓ 下降 HF #18 + Techmeme 提及,热度趋弱
virgiliojr94/book-to-skill W30 5 周 → 持平 GitHub 月榜 #8(+14.6k)
block/buzz W30 5 周 ↑ 回稳 GitHub 月榜 #3(+28.7k),但单源验证
TencentCloud/TencentDB-Agent-Memory W31 4 周 → 持平 GitHub 月榜 #9,腾讯 Agent 记忆中枢
zhaoxuya520/reverse-skill W31 4 周 → 持平 GitHub 月榜 #4(+18.7k)
GPT-5.6 系列 W31 4 周 ↑ 上升 本周「降价三连」登顶 HN 周榜,价格战全面开打
DeepSeek V4 / DSH 生态 W31 4 周 ↓ 收敛 源数从 6 回落至 2,社交榜依旧霸屏但工程榜退潮
MiniMax 家族 W32 3 周 → 持平 HF 双席(H3 #11 / Music3 #6)+ PH MiniMax Design 上新
Agent Skills 生态 W32 3 周 ↑ 上升 持续多源统治,Google 官方入场
Qwen3.8 系列 W33 2 周 → 持平 4 源验证,衍生生态爆发期
Muse Glimmer W33 2 周 ↓ 下降 仅 HF #22 单源,从 4 源明显回落
diagram-design W33 2 周 → 持平 GitHub 周榜 #2(+11.3k),技能单品天花板
stablyai/orca W27 🏁 退出 🏁 连续 7 周后退出本期各榜
watermarks-remover(原项目) W33 🏁 退出 🏁 原仓库退榜,但主题由 PH Claude Watermark Remover 与 GitHub humanizer 接棒延续
deepseek-harness 本体 W33(生态) 🆕 单独登顶 🆕 Trendshift 周榜 #1(+49.9k),18 万星里程碑
holaOS / Soup / OpenLogi 等短线爆发 W34 🆕 新入榜 🆕 本周 GitHub 周榜新面孔,聚焦企业级 Agent 工作区与本地化训练

趋势标注:🆕 本周新入榜 | ↑ 上升 | → 持平 | ↓ 下降 | 🏁 已退出

3. 各源独家发现

数据源 本期独家亮点
GitHub Trending 腾讯 AI-Infra-Guard(AI 红队全栈平台)与 Soup(一个 YAML 微调,4GB 显卡训 8B)等国产新锐;NVIDIA Switchyard 跨模型流量路由入场
Hugging Face Models unsloth GGUF 下载 580 万反超官方原版;无审查/abliterated 衍生文化占榜约 1/3;MiniMax-Music3(2B)与 LTX-2.5 预示音频/视频生成赛道接力
Hugging Face Papers Harness Scaling 路线登顶(StateM $15 达成 Terminal-Bench 95.3%);UCSD 蒸馏系 5 篇成建制产出;中国机构占 Top 40 的 1/3,3D/语音/视频多模态占优
Hacker News 「认知负债」成月度最大争议词(手抄 LLM 代码 545 分);SQLite 严重 CVE 疑为 LLM 幻觉产物(727 分)——AI slop 冲击安全与研究公信力
Reddit r/ML 学术评审危机全面发酵(EMNLP 等待楼 498 条评论、「失去三个半博士生」682 分月冠军);「零训练」极客美学刷屏(21B 硬编码 Doom、264KB 扩散模型)
Product Hunt Cursor 推 Origin 直接对标 GitHub(编码 Agent 时代代码托管);Grok 4.6 主打长时间运行 Agent;Agent 基建「水电煤」(记忆/路由/可观测性/权限沙箱)集中上新
Techmeme Anthropic 年化收入 650 亿美元、IPO 或月底递交;Stripe 75 亿美元收购 OpenRouter;英伟达 1050 亿美元兜底 OpenAI 数据中心——资本层面「Agent 经济」全面定价
Trendshift dsh 生态「母项目带飞全家桶」四连霸(本体+桌面端+插件+路由);career-ops(AI 求职)与 caveman(省 65% token 技能)等小而美项目靠社交提及出圈

4. 🎯 本期 AI 趋势一句话总结

2026 年 W34 的关键词是 「Skills 工程化 + 价格战 + 微型化下沉」:Agent Skills 在 Google 官方入场后从社区玩法升级为平台级品类(GitHub 月榜 1/3 与之相关);GPT-5.6 Sol 一个月内「降价三连」叠加 Stripe 75 亿美元收购 OpenRouter,把竞争焦点从能力转向成本;Qwen3.8-27B 以一己之力养活 HF 榜 2/3 衍生生态,而 14MB 的 Needle2、264KB 扩散模型与 ESP32 跑 LLM 则把「本地全天候 Agent」推向极限——与此同时,学术圈的评审危机与「认知负债」之争提醒所有人:工具越强,人的判断力越贵。