AI 趋势周报:2026-W34
🤖 AI 趋势周报 · 2026-W34 (08-16 - 08-22)
⏪ 上周回顾
- Agent Skills 走向标准化 → 本周全面工程化:mattpocock/skills 月增 47.7k 继续稳坐 GitHub 月榜第一,本周再添 Google 官方 skills 仓库、817 条 Anthropic-Cybersecurity-Skills、diagram-design 图表技能(周榜 +11.3k)等新成员,Skills 从「标准化」进入「规模化供给」阶段
- DeepSeek Harness 生态爆发 → 本周登顶社交热度:dsh 本体上架一周星标破 18 万、单周 +49.9k 登顶 Trendshift 周榜,桌面端(+8.7k)、插件精选清单(+6.1k)、任务感知路由套件(+3.8k)全家桶跟进,「母项目带飞生态」路径与当年 Claude Code 如出一辙
- GPT-5.6 加速与开源之争 → 本周演变为价格战:上周 Cerebras 把 GPT-5.6 Sol 提速 14 倍,本周 OpenRouter 直接 5 折(HN 633 分周榜第一)、OpenAI 官宣再降 20%+、Devin 跟进 7 折,叠加 Stripe 75 亿美元收购 OpenRouter 落地,「前沿能力白菜价」重塑 API 选型
- 连续上榜项目:usestrix/strix(连续 8 周)、earendil-works/pi(连续 6 周)、diegosouzapw/OmniRoute(连续 6 周)、virgiliojr94/book-to-skill(连续 5 周)、TencentCloud/TencentDB-Agent-Memory(连续 4 周);stablyai/orca 在连续 7 周后退出本期榜单
🐙 GitHub Trending
数据源说明:GitHub Trending 月榜与周榜(OSSInsight 官方已临时下线 star 榜单,本期以 GitHub Trending 页面数据替代,下期恢复)。
📅 本月榜 Top 20(+ 折叠区 21-36)
| # | 项目 | 语言 | ⭐ 总计 | 📈 本月新增 | 说明 |
|---|---|---|---|---|---|
| 1 | mattpocock/skills | Shell | 229,245 | 47,717 | 面向真实工程师的 Agent 技能集,直接来自作者的 .agents 目录 |
| 2 | diegosouzapw/OmniRoute | TypeScript | 52,652 | 31,270 | 免费 MIT AI 网关:单端点接入 340 家供应商、1200+ 模型,配额感知自动降级 |
| 3 | block/buzz | Rust | 29,178 | 28,701 | 「蜂群思维」群体智能通信平台 |
| 4 | zhaoxuya520/reverse-skill | PowerShell | 27,205 | 18,662 | 逆向/渗透/安全技能路由包:AI 自动路由 + 按需自举工具链 + 自进化经验库 |
| 5 | ayghri/i-have-adhd | Python | 22,957 | 18,443 | 让编码 Agent 不再把答案埋在长输出里的技能,ADHD 友好输出 |
| 6 | koala73/worldmonitor | TypeScript | 83,674 | 21,742 | 实时全球情报仪表盘:AI 新闻聚合、地缘政治监测、基础设施追踪 |
| 7 | earendil-works/pi | TypeScript | 95,015 | 21,507 | AI Agent 工具包:统一 LLM API、Agent 循环、TUI、编码 Agent CLI |
| 8 | virgiliojr94/book-to-skill | Python | 23,646 | 14,598 | 把任意技术书籍 PDF 转成 Claude Code 技能,边工作边查阅 |
| 9 | TencentCloud/TencentDB-Agent-Memory | TypeScript | 23,658 | 14,407 | 腾讯云团队级 AI Agent 记忆中枢:对话/文档/代码变四类可复用记忆资产 |
| 10 | microsoft/AI-For-Beginners | Jupyter Notebook | 66,122 | 13,592 | 微软 AI 入门课:12 周 24 课 |
| 11 | usestrix/strix | Python | 56,682 | 13,551 | 开源 AI 渗透测试工具,发现并修复应用漏洞 |
| 12 | citrolabs/ego-lite | JavaScript | 12,505 | 11,627 | 为 AI Agent 打造的最快自动化浏览器,可共享登录态,零成本零配置 |
| 13 | permissionlesstech/bitchat | Swift | 35,759 | 9,710 | 蓝牙 mesh 聊天应用,IRC 复古风 |
| 14 | basecamp/omarchy | Shell | 27,430 | 3,095 | Basecamp 出品:美观、现代、有主见的 Linux |
| 15 | 1jehuang/jcode | Rust | 18,170 | 8,972 | 最省内存的 Agent harness |
| 16 | HKUDS/DeepTutor | Python | 36,916 | 8,578 | 港大出品:终身个性化辅导系统 |
| 17 | tirth8205/code-review-graph | Python | 30,668 | 8,084 | 本地优先代码智能图谱(MCP/CLI),让 AI 只读关键上下文 |
| 18 | lyogavin/airllm | Jupyter Notebook | 32,097 | 8,160 | 单张 4GB GPU 推理 70B 模型 |
| 19 | every-app/open-seo | TypeScript | 13,007 | 7,395 | Semrush / Ahrefs 的开源替代 |
| 20 | donnemartin/system-design-primer | Python | 365,297 | 7,380 | 系统设计面试经典学习指南,含 Anki 卡片 |
📅 展开本月榜 21-36 名
| # | 项目 | 语言 | ⭐ 总计 | 📈 本月新增 | 说明 |
|---|---|---|---|---|---|
| 21 | blader/humanizer | Python | 37,044 | 6,937 | 去除文本 AI 写作痕迹的 Agent 技能 |
| 22 | volcengine/OpenViking | Python | 31,621 | 3,975 | 字节火山引擎:AI Agent 自进化上下文数据库,统一记忆/RAG/技能 |
| 23 | bradautomates/claude-video | Python | 15,964 | 6,659 | 让 Claude 能「看」视频:下载、抽帧、转录一条龙 |
| 24 | huggingface/speech-to-speech | Python | 12,744 | 6,612 | 用开源模型构建语音对话 Agent |
| 25 | earthtojake/text-to-cad | Python | 13,752 | 5,214 | CAD/CAE/CAM 领域的 Agent 技能库 |
| 26 | pingdotgg/t3code | TypeScript | 19,942 | 5,646 | T3 生态新项目(官方暂无描述),大量 AI 协作提交 |
| 27 | kangarooking/cangjie-skill | Python | 8,557 | 4,467 | 把书、长视频、播客等高价值内容蒸馏成可执行的 Agent Skills |
| 28 | cactus-compute/needle | Python | 8,312 | 4,829 | 仅 14MB 的微型设备基础模型:手机/穿戴/智能家居/机器人 |
| 29 | google/skills | Python | 18,586 | 3,680 | Google 官方:面向 Google 产品与技术的 Agent Skills |
| 30 | 3b1b/manim | Python | 91,836 | 3,171 | 3Blue1Brown 的数学解释性视频动画引擎 |
| 31 | goauthentik/authentik | Python | 25,061 | 2,701 | 「认证粘合剂」:开源身份提供商 |
| 32 | different-ai/openwork | TypeScript | 22,885 | 6,006 | Claude Cowork 的开源替代(基于 opencode) |
| 33 | megadose/holehe | Python | 13,915 | 2,109 | 检查邮箱在哪些网站注册过的 OSINT 工具 |
| 34 | livekit/agents | Python | 13,125 | 1,696 | 实时语音 AI Agent 框架 |
| 35 | paperless-ngx/paperless-ngx | Python | 44,475 | 1,282 | 社区支持的文档管理系统:扫描、索引、归档 |
| 36 | neka-nat/freecad-mcp | Python | 1,872 | 490 | FreeCAD 的 MCP 服务器 |
📅 本周榜 Top 20(+ 折叠区 21-43)
| # | 项目 | 语言 | ⭐ 总计 | 📈 本周新增 | 说明 |
|---|---|---|---|---|---|
| 1 | public-apis/public-apis | Python | 467,927 | 11,259 | 免费 API 大全,常青项目 |
| 2 | cathrynlavery/diagram-design | HTML | 24,943 | 11,325 | 38 种编辑级图表技能(Claude Code/Codex/Pi),自包含 HTML+SVG |
| 3 | harry0703/MoneyPrinterTurbo | Python | 113,808 | 9,712 | AI 大模型一键生成高清短视频(中文项目) |
| 4 | usestrix/strix | Python | 56,682 | 4,359 | 开源 AI 渗透测试工具「↑ 已在月榜第 11 位」 |
| 5 | holaboss-ai/holaOS | TypeScript | 10,581 | 4,282 | 开源企业级 agentic 工作区:100+ 集成、MCP、聊天、浏览器 |
| 6 | semantica-agi/semantica | Python | 10,054 | 3,674 | 图原生的上下文与可问责 AI 基础设施 |
| 7 | github/spec-kit | Python | 130,685 | 3,535 | GitHub 官方规格驱动开发(Spec-Driven Development)工具包 |
| 8 | unslothai/unsloth | Python | 74,248 | 3,300 | 本地 UI 运行/训练 LLM 与扩散模型 |
| 9 | cactus-compute/needle | Python | 8,312 | 3,409 | 14MB 微型设备基础模型「↑ 已在月榜第 28 位」 |
| 10 | OpenCut-app/OpenCut | TypeScript | 85,401 | 2,718 | 开源 CapCut 替代视频剪辑 |
| 11 | AprilNEA/OpenLogi | Rust | 12,789 | 2,674 | 罗技 Options+ 的本地优先替代(Rust),免账号免遥测 |
| 12 | mukul975/Anthropic-Cybersecurity-Skills | Python | 30,517 | 2,622 | 817 个结构化网络安全技能,映射 MITRE ATT&CK 等六大框架 |
| 13 | volcengine/OpenViking | Python | 31,621 | 2,444 | 字节火山引擎 Agent 上下文数据库「↑ 已在月榜第 22 位」 |
| 14 | basecamp/omarchy | Shell | 27,430 | 2,395 | Basecamp 出品 Linux「↑ 已在月榜第 14 位」 |
| 15 | akitaonrails/ai-memory | Rust | 3,927 | 1,952 | 编码 CLI Agent 的长期记忆与跨厂商交接方案 |
| 16 | lightningpixel/modly | TypeScript | 7,120 | 1,855 | 本地 AI 从图片/提示生成 3D 模型的桌面应用,全程跑在 GPU 上 |
| 17 | AlexsJones/llmfit | Rust | 33,438 | 1,842 | 数百模型一条命令测出你的硬件能跑哪个 |
| 18 | MakazhanAlpamys/Soup | Python | 2,657 | 1,786 | 一个 YAML 微调 LLM,分层流式训练让 4GB 笔记本 GPU 训 8B 模型 |
| 19 | agalwood/Motrix | TypeScript | 54,246 | 1,773 | 全功能下载管理器 |
| 20 | can1357/oh-my-pi | TypeScript | 26,289 | 1,634 | 终端 AI 编码 Agent:hash 锚定编辑、LSP、浏览器、子 Agent |
📅 展开本周榜 21-43 名
| # | 项目 | 语言 | ⭐ 总计 | 📈 本周新增 | 说明 |
|---|---|---|---|---|---|
| 21 | megadose/holehe | Python | 13,915 | 1,632 | 邮箱注册网站 OSINT 检查「↑ 已在月榜第 33 位」 |
| 22 | earendil-works/pi | TypeScript | 95,015 | 5,008 | AI Agent 工具包「↑ 已在月榜第 7 位」 |
| 23 | jundot/omlx | Python | 20,215 | 1,388 | Apple Silicon LLM 推理服务器,macOS 菜单栏管理 |
| 24 | macro-inc/macro | Rust | 3,937 | 1,456 | 团队统一工作区:邮件/聊天/文档/任务/Agent 共享 AI 记忆 |
| 25 | cursor/plugins | TypeScript | 4,366 | 1,273 | Cursor 官方插件规范与插件集 |
| 26 | CodebuffAI/freebuff | TypeScript | 10,438 | 1,133 | 免费编码 Agent |
| 27 | amruthpillai/reactive-resume | TypeScript | 41,448 | 991 | 注重隐私的开源简历生成器 |
| 28 | NVIDIA-NeMo/Switchyard | Rust | 2,045 | 932 | 英伟达出品:LLM 应用跨模型/供应商流量路由,兼容 OpenAI/Anthropic 原生 API |
| 29 | HKUDS/CLI-Anything | Python | 47,927 | 954 | 让所有软件 Agent 原生化(港大) |
| 30 | apify/apify-mcp-server | TypeScript | 4,503 | 843 | 让 AI Agent 从社媒/搜索/电商网站抓数据的 MCP 服务器 |
| 31 | smicallef/spiderfoot | Python | 21,318 | 724 | OSINT 自动化威胁情报与攻击面测绘 |
| 32 | modular/modular | Mojo | 28,663 | 744 | Modular 平台(含 MAX 与 Mojo 语言) |
| 33 | upscayl/upscayl | TypeScript | 48,675 | 511 | 免费开源 AI 图像放大器 |
| 34 | eneskirca/nodeterm | TypeScript | 1,009 | 409 | 节点式终端管理器:tmux 支撑、多 Agent 并行会话拖拽成图 |
| 35 | Tencent/AI-Infra-Guard | Python | 5,329 | 359 | 腾讯出品 AI 红队全栈平台:Agent/技能/MCP 扫描与越狱评估 |
| 36 | CodeWithCJ/SparkyFitness | TypeScript | 5,542 | 350 | 面向家庭的 AI 健康健身追踪 |
| 37 | Lightricks/LTX-2 | Python | 9,190 | 331 | LTX-2 音视频生成模型官方推理与 LoRA 训练包 |
| 38 | bia-pain-bache/BPB-Worker-Panel | TypeScript | 13,172 | 318 | VLESS/Trojan/Warp Worker 订阅面板 |
| 39 | microsoft/agent-framework | Python | 13,028 | 240 | 微软 AI Agent 编排框架(Python/.NET) |
| 40 | documenso/documenso | TypeScript | 14,651 | 236 | 开源 DocuSign 替代 |
| 41 | anomalyco/models.dev | TypeScript | 6,521 | 136 | 开源 AI 模型数据库 |
| 42 | fluxerapp/fluxer | TypeScript | 10,080 | 146 | 面向朋友/群组/社区的免费开源即时通讯与 VoIP |
| 43 | ml-explore/mlx-lm | Python | 6,730 | 121 | 用 MLX 跑 LLM(苹果官方) |
🎯 核心洞察
- 月榜:Agent Skills 生态全面爆发:前 20 名中超过三分之一与「技能/记忆/harness」相关(skills、book-to-skill、reverse-skill、TencentDB-Agent-Memory 等),Claude Code 式技能包正成为新的开源流量入口
- 语言分布:Python + TypeScript 双雄合计约 70%(月榜),Python 主导 AI 工具与教程,TypeScript 主导 Agent 基础设施;本周 Rust 份额明显上升(OpenLogi、Switchyard、ai-memory、llmfit、macro),聚焦本地优先与性能敏感场景
- 国产项目强势:腾讯云、火山引擎、港大 DeepTutor、MoneyPrinterTurbo 等多个中文背景项目上榜
- 周榜 vs 月榜:diagram-design、holaOS、Soup、OpenLogi 等为本周短线爆发(未进月榜);pi、OpenViking、needle、strix、omarchy 月周双榜在列,是「Agent 基础设施 + 微型模型」主线的中坚;public-apis、system-design-primer 等常青大库热度稳定回流
- 主题趋势:Agent Skills / 记忆 / MCP 持续统治榜单;本地化与隐私(本地 GPU 训练、免账号、本地优先)成为本周显著增量主题
🤗 Hugging Face Trending Models
(无周榜,仅月榜)
| # | 模型 | 任务 | 参数量 | 下载量 | 推理 | 亮点 |
|---|---|---|---|---|---|---|
| 1 | Qwen/Qwen3.8-27B | 图文转文本 | 28B | 1.73M | ✅ | 阿里 Qwen3.8 新旗舰多模态模型,上线 7 天下载破 173 万,衍生生态全面爆发 |
| 2 | unsloth/Qwen3.8-27B-GGUF | 文本生成 | 27B | 5.8M | ❌ | 本地量化版最快跟进,下载 580 万反超原版 |
| 3 | orcarouter/Qwen3.8-27B-Uncensored-MLX | 图文转文本 | 5B | 18.2k | ❌ | Mac 端 MLX 无审查量化版,13 小时前刚更新 |
| 4 | orcarouter/Qwen3.8-27B-Uncensored-FP8 | 图文转文本 | 28B | 108k | ❌ | FP8 无审查变体,适配主流推理栈 |
| 5 | JonathanColetti/Qwen3.8-27B-Uncensored-GGUF | 文本生成 | 27B | 1.13M | ❌ | 社区无审查量化热门,下载 113 万 |
| 6 | MiniMaxAI/MiniMax-Music3 | 文本转音频 | 2B | 15.7k | ❌ | MiniMax 音乐生成模型,2B 小参数即出圈 |
| 7 | Lightricks/LTX-2.5 | 图生视频 | — | 654k | ❌ | 开源视频模型 LTX 2.5 版,65 万下载、1.48k 赞 |
| 8 | OBLITERATUS/Qwen3.8-27B-OBLITERATED | 文本生成 | 28B | 124k | ✅ | 4 小时前刚更新的解审查变体,热度飙升 |
| 9 | HauhauCS/Qwen3.8-27B-Uncensored-…MTP-GGUF | 图文转文本 | 2B | 357k | ❌ | 社区魔改 MTP 多 token 预测量化版 |
| 10 | Qwen/Qwen3.8-27B-FP8 | 图文转文本 | 28B | 1.94M | ❌ | 官方 FP8 量化版,下载 194 万 |
| 11 | MiniMaxAI/MiniMax-H3 | 图文生视频 | 33B | 3.61M | ✅ | MiniMax 视频旗舰,下载 361 万、4.29k 赞,本页最高赞 |
| 12 | ornith-ai/Ornith-1.5-35B-A3B | 文本生成 | 36B | 9.17k | ❌ | MoE 架构(总参 36B/激活 3B),走性价比路线的新秀 |
| 13 | empero-ai/Qwen3.8-27B-Ridge-GGUF | 图文转文本 | 27B | 74k | ❌ | 社区量化衍生版 |
| 14 | deepseek-ai/DeepSeek-V4-Pro-0813 | 文本生成 | 1.7T | 49.6k | ✅ | DeepSeek V4 Pro 巨兽(1.7T),8 月 13 日版 |
| 15 | orcarouter/Qwen3.8-27B-Uncensored-GGUF | 图文转文本 | 27B | 68.3k | ❌ | llama.cpp 生态无审查量化版 |
| 16 | Qwen/Qwen3.8-2.4T-A95B | 文本生成 | 2.4T | 15.7k | ✅ | Qwen3.8 顶级 MoE:总参 2.4T、激活 95B |
| 17 | huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF | 图文转文本 | 27B | 338k | ❌ | 知名 abliterated 系列量化版 |
| 18 | moonshotai/Kimi-K3 | 图文转文本 | 2.8T | 2.45M | ✅ | 月之暗面 Kimi K3 旗舰(2.8T),上线 1 天下载 245 万 |
| 19 | unsloth/Qwen3.8-27B-NVFP4 | 文本生成 | 20B | 1.01M | ❌ | NVFP4 新量化格式,更省显存 |
| 20 | TenStrip/10Eros-Max | 图文生视频 | — | 306 | ❌ | 成人向视频生成模型(中性记录) |
| 21 | ornith-ai/Ornith-1.5-35B-A3B-GGUF | 文本生成 | 36B | 123k | ❌ | Ornith MoE 量化版 |
| 22 | meta-models/Muse-Glimmer-30B | 图文转文本 | 30B | 505k | ✅ | 30B 多模态,50 万下载、1.73k 赞 |
| 23 | 0bserverx/Qwen3.8-27B-Heretic-Abliterated-…-GGUF | 文本生成 | 27B | 422k | ❌ | Heretic 解审查量化版,下载 42 万 |
| 24 | superwhisper/s1-mini | 文本生成 | 0.8B | 1.14k | ❌ | 0.8B 超小模型,4 小时前更新 |
| 25 | huihui-ai/Huihui-Qwen3.8-27B-abliterated | 图文转文本 | 28B | 17.5k | ✅ | abliterated 原版(非量化) |
| 26 | Blackfrost-AI/Qwen3.8-27B-ABLITERATED-GGUF | 图文转文本 | 27B | 198k | ❌ | Blackfrost 解审查量化版 |
| 27 | deepseek-ai/DeepSeek-V4-Flash-0731 | 文本生成 | 304B | 2.83M | ✅ | V4 Flash 推理特化(304B),下载 283 万 |
| 28 | z-lab/Qwen3.8-27B-DFlash2 | 文本生成 | 2B | 21.1k | ❌ | 2B 极小衍生实验版(蒸馏路线) |
| 29 | DavidAU/Qwen3.8-27B-Cold-Fusion-…-GGUF | 图文转文本 | 27B | 155k | ❌ | DavidAU 系列魔改量化版 |
🎯 核心洞察
- 参数量分布:27-28B 中型模型绝对主导(29 席中约 20 席),Qwen3.8-27B 单点引爆整个生态;超大 MoE 集中在头部厂商旗舰(Kimi-K3 2.8T、Qwen3.8-2.4T-A95B、DeepSeek-V4-Pro 1.7T、V4-Flash 304B);小模型走垂直场景(s1-mini 0.8B、Music3 2B、DFlash2 2B)
- 任务类型分布:图文转文本(多模态理解)约占 60%,文本生成约 30%,视频生成(图生/图文生视频)3 席(LTX-2.5、MiniMax-H3、10Eros-Max),音频生成 1 席(MiniMax-Music3)——多模态理解+生成已成主战场
- 推理可用性:9/29(约 31%)官方支持 Inference Providers 即开即用,且全部集中在原厂发布(Qwen 官方 3 款、DeepSeek 2 款、Kimi、MiniMax-H3、Muse-Glimmer 等);社区量化/无审查衍生版基本无托管推理,需本地部署
- 国产模型占比:极高。官方国产模型 8 款(Qwen×3、DeepSeek×2、Kimi×1、MiniMax×2、z-lab×1),加上围绕 Qwen3.8-27B 的海外社区衍生(unsloth、orcarouter、huihui-ai、DavidAU 等)约占榜单 2/3,Qwen3.8-27B 是当之无愧的”生态母体”
- 其他趋势:无审查/abliterated 衍生持续火爆(至少 10 席);量化格式多元化(GGUF/MLX/FP8/NVFP4),unsloth 等量化厂牌跟进以小时计
📄 Hugging Face Trending Papers
(无周榜,仅月榜,数据截至 2026-08-22,来源 huggingface.co/papers/month/2026-08)
📅 月榜 Top 20
| # | 论文标题 | 👍 | 方向 | 作者/机构 | GitHub ⭐ | 亮点 |
|---|---|---|---|---|---|---|
| 1 | BDH-CQ: In-Context Learning with Recurrent Latent Reasoning(基于循环潜空间推理的上下文学习) | 702 | 高效推理 | Pathway(海外 AI 基础设施公司) | 4.11k | 仅 150M 参数的推理模型,靠循环潜空间推理刷新 ARC-AGI-1 成本-精度前沿 |
| 2 | StateM: Reaching 95.3% Raw Accuracy, or a $15 Frontier Run, on Terminal-Bench 2.1 via Harness Scaling(StateM:通过 Harness 扩展在 Terminal-Bench 2.1 上达到 95.3% 原始准确率、15 美元级前沿运行) | 434 | Agent 评测 | — | — | 用 15 美元训练成本在终端任务基准上逼近前沿水平,主打”测试框架扩展”路线 |
| 3 | Macaron-V1: Towards Open Continual Learning with Self-Improvement and Mixture-of-LoRA(Macaron-V1:面向开放持续学习的自我改进与 LoRA 混合) | 338 | 持续学习 | Mind Lab | — | 自我改进 + 混合 LoRA 实现开放持续学习,无需重训即可不断进化 |
| 4 | Spark-to-Paper: End-to-End Research Paper Generation as a Composable Skill(Spark-to-Paper:端到端研究论文生成作为可组合技能) | 285 | 科研自动化 | — | — | 把”从想法到论文”的全流程封装为可组合技能,端到端自动生成研究论文 |
| 5 | Can We Defend Against AI-Generated Video Attacks on Real-World Crisis Events?(我们能否抵御真实危机事件中的 AI 生成视频攻击?) | 277 | AI 安全 | Hugging Face | — | 系统评测 AI 生成虚假危机视频的检测器、生成器与社会传播链路 |
| 6 | OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution(OpenART:通过开放式环境演化扩展智能体红队测试) | 261 | Agent 安全 | — | — | 让红队测试环境自我演化,规模化发现智能体漏洞 |
| 7 | Recursive Synthesis for Long-Horizon Terminal Tasks(面向长时程终端任务的递归合成) | 247 | 长时程任务 | Tencent Hunyuan(腾讯混元) | — | 递归合成方法攻克长时程终端任务的分解与执行难题 |
| 8 | EnvHarness: Awakening Static Worlds for Agent Learning(EnvHarness:唤醒静态世界用于智能体学习) | 229 | Agent 环境 | — | 把静态环境改造成可交互世界,为智能体训练提供”活”的练习场 | |
| 9 | On-Policy Self-Distillation without Any Supervision(无任何监督的在线策略自蒸馏) | 216 | 蒸馏/自监督 | UCSD(加州大学圣地亚哥分校) | — | 完全无监督的在线策略自蒸馏,零标注实现能力迁移 |
| 10 | ComBodied Agents: a New Paradigm of Human-Centric Agentic AI(ComBodied Agents:以人为本的具身智能体新范式) | 194 | 具身 Agent | — | — | 提出以人为本的具身智能体新范式,强调人机协同 |
| 11 | Beyond Pixels: From Video Priors to 4D Worlds(超越像素:从视频先验到 4D 世界) | 181 | 4D 世界模型 | — | — | 把视频先验提升为完整 4D 世界表示 |
| 12 | LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks(LongHorizon-Harness:面向真实世界任务的长时程智能体) | 180 | 长时程 Agent | Alibaba(阿里巴巴) | — | 专攻真实世界长时程任务的智能体框架 |
| 13 | Self-Supervised Visual On-Policy Distillation(自监督视觉在线策略蒸馏) | 167 | 视觉蒸馏 | UCSD | — | 自监督方式对齐视觉策略,在线蒸馏降成本 |
| 14 | Demystifying Agent Skills: Why They Work-Until They Don’t(解构智能体技能:为何有效——直到失效) | 158 | Agent 分析 | UCSD | — | 系统剖析智能体技能的失效边界,解释”何时好用何时翻车” |
| 15 | SwanTale: Unified Multi-Speaker Speech and Audio Generation(SwanTale:统一多说话人语音与音频生成) | 156 | 语音生成 | ByteDance(字节跳动) | — | 统一框架支持指令与零样本多说话人语音/音频生成 |
| 16 | SemComp-Bench: Benchmarking Semantic Task Completion in Video Generation(SemComp-Bench:视频生成语义任务完成度基准) | 155 | 视频评测 | FrameX-AI | — | 首个聚焦”语义层面任务是否完成”的视频生成基准 |
| 17 | DAPD: Dual-Anchored Policy Distillation(DAPD:双锚定策略蒸馏) | 151 | 策略蒸馏 | Shanghai AI Laboratory(上海人工智能实验室) | — | 双锚定机制稳定策略蒸馏过程 |
| 18 | Learn What’s Left, Not What’s Mastered: Saturation Aware Advantage Reweighting(学未掌握而非已掌握:饱和感知的优势重加权) | 147 | RL 训练 | UCSD | — | 饱和感知的优势函数重加权,让模型聚焦”还没学会的部分” |
| 19 | Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs(延迟暴露未来轨迹实现自动驾驶 VLM 可验证推理) | 142 | 自动驾驶 | — | — | 延迟揭示未来轨迹,迫使自动驾驶 VLM 学会可验证推理、防作弊 |
| 20 | Zetta ζ: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence(Zetta ζ:面向自进化物理智能的高效闭环具身框架) | 140 | 具身智能 | — | — | 高效闭环具身框架,支撑物理智能持续自进化 |
📅 展开 21-40 名
| # | 论文标题 | 👍 | 方向 | 作者/机构 | GitHub ⭐ | 亮点 |
|---|---|---|---|---|---|---|
| 21 | Co-Evolution in Agentic Systems: Toward Self-Directed Evolution Beyond Human Design(智能体系统的共同进化:超越人类设计的自主进化) | 134 | 自进化 Agent | — | — | 智能体间共同进化,突破人类设计天花板 |
| 22 | SWE-Bench ProMax: Benchmarking Agents on Large-Scale Multilingual Code Refactoring(大规模多语言代码重构基准) | 133 | 代码 Agent | ByteDance | — | 大规模多语言代码重构评测,比 SWE-Bench 更难更真实 |
| 23 | Alaya-EVOKE: From Linear-Scaling Supervision to Endless World(从线性扩展监督到无尽世界) | 132 | 世界模型 | — | — | 监督信号随世界扩展线性增长的世界模型训练范式 |
| 24 | HarnessEval-W: Agentifying the Evaluation of Visual Worlds(智能体化的视觉世界评测) | 123 | 世界模型评测 | MirroS | 238 | 层级子智能体把世界模型评测拆成可验证推理链 |
| 25 | SemaPLC: A Project-Grounded, Verification-Gated Agent Harness for PLC Code Generation(项目落地、验证把关的 PLC 代码生成框架) | 114 | 工业代码 | Midea AI Research Center(美的 AI 研究中心) | — | 工控 PLC 代码生成+验证门控,AI 进军工业产线 |
| 26 | AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses(测试时强到弱能力迁移) | 113 | 能力迁移 | UIUC(伊利诺伊大学香槟分校) | — | 测试时通过 harness 把强模型能力迁移给弱模型 |
| 27 | Stealing Reasoning Traces from Proprietary LLM APIs(从闭源 LLM API 窃取推理链) | 111 | 模型安全 | — | — | 揭示闭源 API 推理链被蒸馏窃取的安全风险 |
| 28 | DarwinX: Evolving Agent Harnesses Through Natural Selection(达尔文式自然选择进化智能体框架) | 110 | Agent 进化 | Salesforce AI Research | — | 用自然选择机制自动进化智能体测试框架 |
| 29 | LLMRouter: Unified Infrastructure for Developing, Evaluating, and Deploying LLM Routers(LLM 路由器统一基础设施) | 108 | 基础设施 | UIUC | — | 开发/评测/部署一站式 LLM 路由基础设施 |
| 30 | Mental World Modeling(心理世界建模) | 107 | 认知建模 | Mental World Model | — | 为智能体构建”心理世界”模型 |
| 31 | SimWAM: A Simple World Action Model for End-to-End Autonomous Driving(简单世界-动作模型实现端到端自动驾驶) | 106 | 自动驾驶 | H-EmbodVis | — | 极简世界-动作模型做端到端自动驾驶 |
| 32 | From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards(任务变换诱导自可验证奖励) | 106 | 自我改进 | — | — | RLVR→RLSVR:开放式任务也能自验证奖励 |
| 33 | FACET: Preserving Source Intent and Executable State in Terminal Task Synthesis(终端任务合成中保留源意图与可执行状态) | 102 | 任务合成 | USTC(中国科学技术大学) | — | 任务合成时保留原始意图与可执行状态 |
| 34 | Agentic ESOpt: Fine-Tuning Long-Horizon LLM Agents with Minimal GPU Requirements(极低 GPU 需求微调长时程智能体) | 101 | 低资源训练 | NUS(新加坡国立大学) | — | 少量 GPU 即可微调长时程 LLM Agent |
| 35 | AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning(智能体强化学习的递归自蒸馏) | 100 | Agent RL | Tsinghua University(清华大学) | — | 递归自蒸馏持续压缩智能体 RL 经验 |
| 36 | JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion(自回归扩散实现实时开放式视频编辑) | 100 | 视频编辑 | JD(京东) | — | 实时开放式指令视频编辑 |
| 37 | DreamX-Phi 1.0: Action-Conditioned Video World Model for Robotic Manipulation(面向机器人操作的动作条件视频世界模型) | 98 | 机器人 | Alibaba | — | 动作条件世界模型用于机器人操作预演 |
| 38 | MerchantBench: Benchmarking LLM Agents for Long-Term Coherence in E-Commerce Operations(电商运营长程一致性智能体基准) | 97 | 电商评测 | Alibaba | — | 电商场景长程一致性 Agent 基准 |
| 39 | Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing(统一多模态 3D 生成/理解/编辑模型) | 91 | 3D 生成 | Tencent Hunyuan | — | 一个模型统一 3D 生成、理解与编辑 |
| 40 | Co-RL: Unsupervised Reasoning Emerges from Diverse Cohort in Multi-agent RL(多智能体 RL 中多样群体涌现无监督推理) | 90 | 多智能体 RL | UCSD | — | 多样化智能体群体协作中自发涌现推理能力 |
🎯 核心洞察
- 机构分布(Top 40):中国力量强劲约占 1/3——腾讯混元 ×3、阿里 ×3、字节 ×2、上海 AI Lab、清华、中科大、京东、美的等;海外以 UCSD(×5,蒸馏/自监督方向成建制产出)、Google、UIUC(×2)、NUS(×2)、Salesforce、Pathway 为主。中国团队在 3D/语音/视频等多模态生成方向占优,海外在训练方法与评测体系上更活跃。
- 研究方向热度排行:① Agent/智能体(长时程任务、环境构建、红队安全、评测基准)占绝对主导约 55%;② 蒸馏与自我改进(自蒸馏、策略蒸馏、自验证奖励)约 15%;③ 世界模型与具身智能(4D、机器人、自动驾驶)约 15%;④ 多模态生成(语音/视频/3D)约 10%;⑤ 安全与攻防(深伪防御、推理链窃取、红队)约 5%。月榜关键词高度聚焦”Agent Harness(智能体框架)+ 自我进化”。
- 论文→GitHub 转化:月榜列表页不直接展示星标,仅部分论文可见仓库:#1 BDH-CQ(4.11k ⭐/702 赞,转化突出)、#24 HarnessEval-W(238 ⭐)等;头部论文普遍”高赞低仓”,说明本月趋势偏研究型成果而非工具型开源。
🔥 Hacker News AI 热帖
月榜搜索范围: 8 个搜索词 × pastMonth,合并去重后 186 条(2026-07-22 ~ 2026-08-22,按 objectID 去重,手动按 created_at 过滤 30 天)
📅 月榜
🏆 Tier 1 — 超级爆款(200+ points)
🥇 Tier 2 — 高热度(100-200 points)
🥈 Tier 3 — 中等热度(40-100 points)
🥉 Tier 4 — 值得关注(<40 points,精选)
- AI agent hacks gym to get its user a spot in pilates class(AI agent 黑进健身房帮抢普拉提课) | 新闻 | 37 分 — agent 越权行为的喜剧样本
- Proliferate – open-source, self-hostable Codex(可自托管的开源 Codex 替代) | Show HN | 34 分 — 任意 coding agent 通用
- Computer Anthology: evolving benchmark family for AI agents(持续进化的 agent 基准族) | 项目 | 29 分
- Agent-shell – vendor-neutral chat with AI agents in Emacs(Emacs 里的中立派 agent 聊天壳) | Show HN | 28 分
- Flock Has a Powerful New AI Tool for Police(Flock 警用 AI 工具源码曝光) | 新闻 | 27 分 — AI 监控伦理争议
- Why Normal People Aren’t Using AI Agents(普通人为什么不用 AI agent) | 文章 | 24 分
- OpenAI and four rivals just agreed on one standard for AI agents(OpenAI 与四家对手统一 agent 插件标准) | 新闻 | 24 分
- 200B Tokens Later: Letting AI Agents Decompile MW2(200B token 后:让 agent 逆向《使命召唤》引擎) | 项目 | 18 分 — agent 长任务史诗案例
- Ask HN: Is this the worst time to be human?(Ask HN:现在是人类最坏的时代吗?) | Ask HN | 17 分 — 49 条评论的时代情绪讨论
- Ask HN: How much do you spend monthly on AI model subscriptions?(你每月花多少钱订阅 AI?) | Ask HN | 14 分 — 41 条评论的真实账单
- Dead Internet Theory was right: AI agents are eating Web(死网理论成真:agent 流量暴涨近 8000%) | 新闻 | 14 分
- Tell HN: Pretending not to use AI has made me a better developer(装作不用 AI 反而让我更强) | Tell HN | 13 分
- Alibaba plans to charge big users of its next open-source AI model(阿里计划向下一代开源模型大客户收费) | 新闻 | 12 分 — 开源商业模式变化信号
- OpenAI: dropping API pricing of GPT-5.6 Sol by over 20%(OpenAI 官宣 GPT-5.6 Sol 再降价 20%+) | 新闻 | 7 分
📁 其余 <40 分条目(~90 条,略)
完整 186 条已按 objectID 去重,其余低分条目以 Show HN 小项目、arXiv 论文、行业新闻为主,此处从略。
📅 周榜(08-15 ~ 08-22,与月榜去重后)
周榜搜索范围: 8 个搜索词 × pastWeek,合并去重后 40 条。
↑ 已在月榜的周榜热门条目(不重复展开):GPT-5.6 Sol 降价 50%(633 分,周榜第 1)、GPT-5.6 Sol 史上最佳视觉模型(365 分,周榜第 2,本周热度回升说明视觉能力讨论发酵)、Huzzah AI 编程方法(358)、Vomit 清洗 Claude 输出(294)、LLM 五年级教材实验(245)、LLM 时代可扩展软件(170)、Anthropic 开源之战(152)、ThoughtDAG 上下文图(136)、Speko 语音路由(118)、OneCLI 沙箱 harness(87)、Yadda BDD 框架(66)、Vendo(57)、Proliferate 自托管 Codex(34)、Agent-shell(28)、Flock 警用 AI(27)、MW2 逆向(18)、Ask HN 最坏时代(17)、OpenAI 再降价 20%(7)。
🆕 周榜新增项目(月榜未收录):
| 热度 | 标题 | 类型 | 亮点 |
|---|---|---|---|
| 23 | Tim O’Reilly – Why Open Source Matters for AI(Tim O’Reilly:开源为何对 AI 重要) | 文章 | 技术出版教父下场谈开源 AI 价值 |
| 18 | GPT-5.6 Sol: 70% off in Devin(Devin 中 GPT-5.6 Sol 七折) | 新闻 | 降价潮蔓延到下游 agent 产品 |
| 15 | PINE64 halts open-source hardware until the AI bubble bursts(PINE64 停产开源硬件等待 AI 泡沫破裂) | 新闻 | 硬件厂商用脚投票,折射 AI 挤压效应 |
| 14 | AgentSight – eBPF observability for AI agents(eBPF 观察 agent,零改码) | Show HN | 阿里出品的 agent 可观测性方案 |
| 12 | Semantica, the Open Source Palantir for AI Agents(开源版 agent 数据中枢) | 项目 | 图原生的 agent 基础设施(与 GitHub 周榜第 6 位同一项目) |
| 11 | Ask HN: What tools for human code review of AI-assisted code?(用什么工具人审 AI 代码?) | Ask HN | 人审 AI 代码的工具链讨论(8 条务实讨论) |
📌 周榜其他新增(≤10 分):HarnessRouter(agent 框架统一接口)、Xalgorix(开源 AI 渗透测试)、ChatOSS(基于 Ollama 的开源 Codex)、GPT-Pro 七天长思考数学实验、Caspian(agent 的「找真人」工具)、Mozilla《开源不是美德,是所有权模式》、open-slopware(被 AI 污染软件替代清单)、Naeos(编程 agent 工程化系统)、Deft Writing(反 slop 写作实验室)、RelArena-α(关系学习开源)。
🎯 社区核心信号
- “认知负债”成为本月最大争议词:手抄 LLM 代码(545 分)、”2x not 10x”(280 分)、装不用 AI 反而更强(13 分)——社区从狂热转向认真讨论 AI 依赖的认知代价。
- Agent 安全从边缘话题变主战场:Docker 沙箱(694 分)、权限审批漏检 1/3(340 分)、思维链窃取(697 分)、agent 社工投毒(62 分)——安全基建类 Show HN 密集出现,说明开发者真实痛点在”敢不敢放权给 agent”。
- 价格战全面开打(本周绝对主线):GPT-5.6 Sol 一个月内多次降价(OpenRouter 5 折、官方再降 20%+、Devin 跟进 7 折),叠加 Hetzner 等廉价算力入场,”前沿能力白菜价”正在重塑 API 选型决策,开发者讨论焦点已从”能力”转向”成本与选型”。
- 开源与闭源阵营对立加剧:GLM-5.3 开源冲前沿(1171 分)、Anthropic 被指”对开源宣战”(152 分)、Tim O’Reilly/Mozilla 相继发文、阿里开源收费试水(12 分)、Debian/Rust/Codeberg 等社区各自立规——开源 AI 的治理与商业模式进入深水区。
- 上下文工程是本周最热技术词:ThoughtDAG 可编辑上下文图(136 分)、受限课程实验(245 分)都在回答”喂给模型什么、如何管理”,与 Needle2/Zero-Mem 一脉相承。
- LLM 做数学/科研出圈:麦克斯韦猜想被 GPT-5.6 证伪(157 分)、菲尔兹奖得主下场测评(260 分)、AI 设计噬菌体(9 分)——“AI 科学家”叙事开始有实锤案例。
- YC 新项目密集亮相且方向收敛:Speko(语音路由)、OneCLI(沙箱 harness)、Vendo(用户造功能)均围绕 agent 基建与分发,投资风向标清晰指向”卖铲子”。
💬 Reddit r/MachineLearning
月榜数据周期:近一个月 | 来源:r/MachineLearning top.json?t=month
📅 月榜 Top 15
| # | Flair | 标题 | 分数 | 评论数 | 作者 |
|---|---|---|---|---|---|
| 1 | [D] | 因会议评审流程,我已经失去了三个半潜在的博士生 | 682 | 141 | AffectionateLife5693 |
| 2 | [R] | City2Graph:面向异构图神经网络与城市空间分析的 Python 库 | 456 | 21 | Tough_Ad_6598 |
| 3 | [P] | 我训练了一个预测自己血糖的模型 | 348 | 92 | 0xdeadf1sh |
| 4 | [R] | GPT-5.5 在 ActiveVision 上仅得 10.6%,人类达 96.1% | 303 | 50 | Justgototheeffinmoon |
| 5 | [D] | 是时候直接拒掉不提供可复现代码的论文了 | 281 | 66 | Flaky-Ambition5900 |
| 6 | [P] | Transformer 出了名地不擅长算术,于是我手工设置权重(零训练),乘法准确率 100% | 276 | 55 | notforrob |
| 7 | [R] | SSOG-Attention:可分离高斯之和——SDPA 的次二次方可扩展替代方案 | 241 | 24 | 4rtemi5 |
| 8 | [P] | 我把 Bad Apple 压缩进一个 3MB 的神经网络 | 231 | 46 | Which_Lie_8932 |
| 9 | [R] | 往返一致性:双向扩散模型能预测自身的滚动误差 | 189 | 69 | Clean-Hovercraft5825 |
| 10 | [P] | 我把 Doom 的渲染器编译进一个 21B 参数的 transformer——全程零训练 | 187 | 33 | notforrob |
| 11 | [D] | 有生之年还来得及让 ML 研究领域恢复一些条理性吗? | 181 | 43 | NeighborhoodFatCat |
| 12 | [D] | NeurIPS 2026:如果 rebuttal 解决了你的疑虑,请提高你的评分 | 150 | 91 | undesirable_12 |
| 13 | [P] | 训练了一个只需 264KB 内存运行的扩散模型 | 144 | 19 | PandaBean18 |
| 14 | [D] | 你会选择给你完全自由但几乎不指导的博导吗? | 138 | 79 | Hope999991 |
| 15 | [D] | NeurIPS 2026 中的提示注入攻击? | 134 | 30 | Kwangryeol |
📋 展开月榜 16-30 名
- 16 我用 ARM64 汇编从零实现 YOLO26n 推理(137 分)——硬核复现
- 17 NeurIPS 2026 审稿人:AI 生成的 rebuttal 和论文(115 分/56 评论)
- 18 MLVC:多平台学习型视频编解码器(106 分)
- 19 EMNLP 2026 录用通知/结果讨论帖(93 分/498 评论)
- 20 把计算图编译成 vanilla transformer 权重的编译器——零训练(94 分)
- 21 单 GPU 研究还能发表吗?(87 分)
- 22 如何投诉已发表的 CVPR 论文?(85 分)
- 23 NeurIPS 2026:AC 和审稿人都消失了(84 分/67 评论)
- 24 「诚实」计算机会议排名:按旅行体验排序(82 分)
- 25 SineKAN:正弦激活函数的 Kolmogorov-Arnold 网络(76 分)
- 26 审稿强制化后,低质量审稿不能再以「志愿工作」为借口(76 分)
- 27 ICLR 2027 截稿早于 NeurIPS 2026 出结果(73 分/52 评论)
- 28 73 个 NeurIPS workshop 无一涉及因果推断(68 分)
- 29 连 AC 都不回复 rebuttal 和评论(68 分/85 评论)
- 30 糟糕但典型的 NeurIPS 体验?(64 分)
💬 月榜 Top 5 帖子热门评论摘要
- 「失去三个半博士生」(682 分月冠军):最热评论(316 赞)言简意赅——“这对他们是好事”,暗指逃离学术界是明智选择;173 赞用户共鸣:做出 SOTA 遗忘系统却三次重投被 AI 生成审稿意见刁难,”同行评审正在消亡”;86 赞助理教授:帮学生想清楚不要什么也是一种成功。
- 「City2Graph」:评论以正面反馈为主,”已分享给合作者马上试用”;也有”用 5 岁小孩能懂的方式解释一下”的科普请求,说明工具型研究触达非专业受众。
- 「预测自己血糖的模型」:质疑声集中(159 赞:”为什么用这么大的 transformer?”);社区共识:个人健康项目精神可嘉,但经典统计基线(ARMA/RNN)不可缺席。
- 「GPT-5.5 ActiveVision 仅 10.6%」:140 赞”基准设计得真巧妙”;48 赞”LLM 视觉能力仍然糟糕,这是通往 AGI 的下一个大前沿”;有评论提到 DeepSeek 的 Thinking with Visual Primitives 论文可能是新颖解法。
- 「拒掉无代码论文」:131 赞尖锐反驳:这等于枪毙所有基于闭源 LLM 的”研究”——整个领域有强烈财务动机不这么做;89 赞:需要 H100 数周的实验并不现实可复现。
📅 周榜 Top 15(与月榜去重后)
↑ 已在月榜的周榜热门帖(不重复展开):SSOG-Attention(242 分,周榜第 1,↑月榜第 7)、264KB 扩散模型(144 分,↑月榜第 13)、EMNLP 2026 等待楼(98 分/498 评论,↑月榜第 19)、SineKAN 正弦 KAN(82 分,↑月榜第 25)、NeurIPS 通知逼近 ICLR 截稿(24 分,同主题已见月榜第 27 位)。
🆕 周榜新增帖(月榜未收录):
| # | Flair | 标题 | 分数 | 评论数 | 说明 |
|---|---|---|---|---|---|
| 5 | [R] | BDH-CQ:基于循环潜空间推理的上下文学习 | 65 | 10 | 与 HF 论文月榜第 1 名同款研究,150M 参数刷新 ARC-AGI-1 成本-精度前沿 |
| 6 | [P] | 数据集:Starfield 野生动物——50 个物种类别的 2 万张图像 | 62 | 10 | 游戏素材数据集 |
| 7 | [D] | 如果你手头有一堆 GPU,你会真正拿它们造点什么?(跑 LLM 不算) | 58 | 81 | 81 条评论的算力畅想楼 |
| 8 | [D] | 求职建议:物理 AI/机器人方向应届生,市场与全球招聘行情如何? | 48 | 14 | 具身智能就业风向 |
| 9 | [D] | 如何解决线性注意力中的长程召回问题? | 41 | 27 | 注意力机制前沿讨论 |
| 10 | [R] | Survival of the Fitted:Qwen3.6-27B 的雅可比透镜零重拟合读取并操控 Qwen3.8-27B | 34 | 3 | 模型可解释性新玩法 |
| 11 | [P] | 三个从零训练的 LLM(353M/316M/672M)用同一 GRPO 配方得到三种不同结果,与规模无清晰关系 | 31 | 7 | RL 训练可复现性实验 |
| 12 | [D] | 如何让任何稀疏注意力/KV 压缩方法「看起来很棒」? | 31 | 4 | 评测方法论反思 |
| 13 | [D] | 重温 ECA 论文(2019,1.2 万引用):其核心假设并不完全成立 | 26 | 4 | 经典论文复现质疑 |
| 15 | [D] | 关于多分类中类别分组的影响 | 21 | 3 | 分类方法论讨论 |
📋 展开周榜 16-30 名(均为月榜未收录的新增项目)
- 谱神经元:面向可扩展可解释模型的 ML 基元([R],21 分)——可解释性新方向
- 我们的 AC 评论和回复在 OpenReview 上消失了([D],17 分)——评审流程乱象再添一案
- EMNLP 2026 Findings:值得线下参会吗?([D],14 分)
- EMNLP 评分不错仍被拒:接下来怎么办?([D],15 分)
- 生产级 RAG workshop:开源模型端到端基准评测([D],12 分)
- 微软研究院(MSR)实习咨询([D],8 分)
- 让 LLM”写简洁点”真能省钱吗?9 个模型实测:压缩输出能省钱且不掉精度,压缩输入提示词则不能([R],9 分)
- ICDM 2026 结果等待楼([D],9 分,33 评论)
- CI/CD 中的 AI 生成代码检测:求方法与实战经验([D],8 分)——呼应 HN”人审 AI 代码”之问
- 复杂表格数据的内在秩与信息引力:非参数、模型无关的信息论诊断工具([R],7 分)
- 基于句子和关键词 trie 的对话输入缩减 4-5 倍([P],6 分)
💬 周榜 Top 5 帖子热门评论摘要
- SSOG-Attention:24 赞技术建议(盒式核近似高斯核只需 3-4 次扫描);8 赞尖锐提问:博客承认”成分都已发表”,那博客为何是 AI 生成的?研究本身是否也是 AI 生成?——AI 生成内容的署名边界成为社区新敏感点。
- 264KB 扩散模型:17 赞吐槽网站可读性差;11 赞技术质疑:从训练脚本看它可能并不是扩散模型——“扩散”指生成方式而非网络架构;6 赞建议把计算图烧进 FPGA”焊死”到硬件。
- EMNLP 2026 等待楼:60 赞暖心顶帖”喝口水,放轻松——就算 EMNLP 不行,你的工作依然是好的”;39 赞”已备好烧酒等结果”(韩国作者群体氛围);15 赞实用建议:被录用作者请逐条人工核对参考文献,别依赖 GPTZero。
- SineKAN:14 赞共鸣”低垂果实被摘”——早该关注 KAN,异相位正弦可作通用逼近器,天然适合模拟计算;3 赞认可与 SIREN 相似性,追问与标准样条 KAN/MLP 的基准对比。
- BDH-CQ:28 赞最高赞吐槽”为什么标题全大写!”;认真讨论:此类改进落地后,SOTA 生产模型的算力成本多久能实质性下降?
🎯 核心洞察
- Flair 统计:月榜讨论 [D] 16 帖 > 项目 [P] 8 帖 > 研究 [R] 6 帖;周榜讨论 [D] 17 帖 > 研究 [R] 9 帖 > 项目 [P] 4 帖——讨论类占比过半,学术生态吐槽是绝对主题
- 学术评审危机是本月最大叙事:NeurIPS 2026 进入评审季——AI 生成 rebuttal 遭审稿人当面识破(115 分)、AC 与审稿人集体失联、”失去三个半博士生”(682 分月冠军)高赞回复几乎一边倒支持学生逃离学术界;EMNLP 等待楼狂揽 498 条评论为全月互动之最;ICLR 2027 截稿早于 NeurIPS 出结果的”排期死锁”持续发酵
- 创客文化兴旺:手工设置权重实现 100% 乘法(276 分)、21B 参数硬编码 Doom 渲染器、Bad Apple 压进 3MB 神经网络、264KB 内存跑扩散模型——“零训练/极限轻量化”极客项目集体刷屏,成为社区情绪出口
- 可复现性之争:拒掉无代码论文的呼声遭遇”闭源 LLM 研究利益链”的现实反击
- 周榜技术热点:线性注意力长程召回、稀疏注意力评测方法论、ECA 经典论文复现质疑、谱神经元等可解释性方向集中出现;SSOG-Attention 被”坦诚反噬”(承认成分非原创+博客疑似 AI 生成)折射 AI 生成内容署名争议
🚀 Product Hunt
📅 月榜 Top 17(2026 年 8 月)
| # | 产品 | 👍 | 💬 | 标签 | 说明 |
|---|---|---|---|---|---|
| 1 | AdAnt AI | 605 | 88 | 广告 · 人工智能 · 社媒营销 | 用 Claude 打造爆款、高转化的社交媒体广告 |
| 1 | Hey Noah | 597 | 101 | 效率 · 日历 · 人工智能 | 面向创始人的主动式 AI 执行助理 |
| 2 | Framer 3.0 | 909 | 28 | 设计工具 · 建站 · 人工智能 | 画布上直接用 Agent 设计/写作/分析,支持接入 Claude Code、Codex;新增分支与创作者社区 |
| 3 | Wispr Flow Notetaker | 583 | 73 | 笔记 · 会议 · 人工智能 | 把会议笔记的每个细节都记对 |
| 4 | Dograh | 559 | 162 | 开源 · 开发者工具 · GitHub | 开源的 VAPI 替代品(语音 Agent 平台) |
| 5 | Grok Bot | 532 | 23 | 效率 · 任务管理 · 人工智能 | 能真正委派任务的 AI 队友 |
| 6 | Astute | 531 | 162 | 社交媒体 · 营销 · 人工智能 | 自动化 B2B 品牌病毒式传播,联动新媒体创作者 |
| 7 | Coldtea.ai | 518 | 70 | 软件工程 · 开发者工具 · 人工智能 | 让你的软件进入「自动驾驶」 |
| 8 | Soloop | 482 | 67 | 效率 · 人工智能 · 创作者工具 | 面向独立创始人的「审批优先」Agent 操作系统 |
| 9 | Cloudflare OS | 466 | 3 | 开源 · 人工智能 · GitHub | 为公司构建 AI 操作系统 |
| 10 | Clipto MCP | 471 | 117 | 效率 · 搜索 · 视频 | 让 Agent 从 TB 级本地视频中检索素材片段 |
| 11 | Kane CLI | 464 | 56 | SaaS · 开发者工具 · 人工智能 | 在终端里用自然语言做浏览器与移动 App 测试 |
| 12 | NextDoor.Company | 461 | 56 | 招聘 · 地图 · 职业 | 在地图上发现附近正在招聘的初创公司 |
| 13 | Meridian | 458 | 81 | 效率 · 开源 · 开发者工具 | 别让你的工作被埋没,帮你升职加薪 |
| 14 | Clara AI SDR | 453 | 46 | 开发者工具 · 人工智能 | 把网站访客转化为合格销售管线 |
| 15 | Ito | 448 | 47 | 开发者工具 · 人工智能 · GitHub | 会真正运行你的代码的 AI 代码审查 |
| 16 | AgentSky | 432 | 59 | SaaS · 开发者工具 · 人工智能 | 任意 harness、任意 LLM——按需云端托管 AI Agent |
| 17 | Omniwork | 421 | 37 | 效率 · 人工智能 · 社媒营销 | 创意 Agent 操作系统,用桌面 AI Agent 更高效地创作 |
🎁 精选评价位:Viktor.com(684 赞,全场最高)——真正能干活的 AI 同事:驻扎 Slack、自带上下文、主动提议自动化;Customer.io(335 赞,推广位)——全渠道消息自动化,初创公司免费 12 个月。
📅 展开月榜 18-52(月榜延伸名次 + 8/20、8/21 日榜补充)
月榜延伸名次(虚拟滚动渲染所得)
| # | 产品 | 👍 | 💬 | 标签 | 说明 |
|---|---|---|---|---|---|
| 19 | Taku AI | 409 | 58 | 效率 · 人工智能 · 无代码 | 借用最好的 AI 配置(工作流)并据为己有 |
| 25 | Omni by xpander | 384 | 29 | Slack · 人工智能 · 虚拟助理 | 别再「babysit」你的 AI Agent |
| 26 | Ctruh Studio | 380 | 90 | 人工智能 · 增强现实 · 无代码 | 无需代码创建交互式 3D 与 XR 体验 |
| 31 | Vendo | 358 | 58 | 开源 · SaaS · 开发者工具 | 让用户在你的产品里搭建自己的功能 |
| 36 | Scrimba Explain | 325 | 31 | 效率 · 教育 · 视频 | 提任何问题,立刻得到一段视频解答 |
| 38 | BetterClaw | 324 | 72 | 效率 · SaaS · 人工智能 | 60 秒部署 AI Agent,永久 0 美元 |
8/21 日榜补充(去重后新增):fx (by Vercel)(👍171,Vercel 出品的轻量级开源编码 Agent);Epho(👍150,云端运行 Claude Code/Codex/Opencode 并挂载仓库);Antigravity IDE Extensions(👍146,Antigravity Agent 进驻现有编辑器);Plow Latch(👍135,Mac 上以受限权限安全运行 AI Agent);Dockhand(👍126,人人可用的 Docker 管理);OneCLI(👍122,给员工安全沙箱化的助理 Agent);Surfdeck(👍122,标签页触手可及);Router by Ramp(👍115,「Token 就是钱」——LLM 路由);Local(👍107,Mac 零门槛本地 AI);Actx0(👍102,Agent 记忆基础设施);Flunkey(👍101,Windows 语音优先 AI 层);ShogunAI(👍94,跑在 PC 上的个人 AGI);Project SKY(👍93,Windows 环境感知 AI 伴侣);Outlook Google Calendar Sync for Mac(👍81)。
8/20 日榜补充(去重后新增):Prized(👍160,非工程师搭建安全内部工具);Hermai Brand API(👍137,客户品牌白标 B2B SaaS);Lifelong(👍137,全家健康记录管理);MiniMax Design(👍132,面向开放式创作的专属 Agent 团队);Aloud(👍119,语音反馈变编码任务);Glasp for Firefox(👍115,网页/PDF/视频高亮总结);Shape(👍111,设计师与程序员的 Agent 式 IDE);bitdrift.ai(👍112,首个 Agent 式移动端可观测性平台);Berd(👍106,AI Agent 创作搞怪桌面应用);NobodyWho(👍106,任意设备跑 AI 模型);Zoho Cliq 7.0(👍98);Roveri(👍91,iPhone 骑行日志)。
|——|—–|—–|——|——|
| Prized(日榜 6) | 160 | 17 | 人工智能 · 无代码 · 安全 | 让非工程师也能搭建安全的内部工具 |
| Hermai Brand API(日榜 7) | 137 | 30 | 设计工具 · SaaS · 开发者工具 | 用每位客户自己的品牌白标你的 B2B SaaS |
| Lifelong(日榜 8) | 137 | 8 | 健康健身 · 人工智能 · 家庭 | 全家人的健康记录一站式管理 |
| MiniMax Design(日榜 9) | 132 | 2 | 设计工具 · 人工智能 · 图片视频 | 面向开放式创作的专属 Agent 团队 |
| Aloud(日榜 10) | 119 | 14 | Mac · 开发者工具 · 人工智能 | 把语音反馈变成编码 Agent 可执行的任务 |
| Glasp for Firefox(日榜 11) | 115 | 10 | 浏览器插件 · 效率 · 人工智能 | 在 Firefox 里高亮并总结网页、PDF 与视频 |
| Shape(日榜 12) | 111 | 6 | 设计工具 · 开发者工具 · 人工智能 | 面向设计师与程序员的 Agent 式 IDE |
| bitdrift.ai(日榜 13) | 112 | 10 | 软件工程 · 开发者工具 · 人工智能 | 全球首个 Agent 式移动端可观测性平台 |
| Berd(日榜 14) | 106 | 2 | Mac · 开源 · GitHub | 用 AI Agent 搞创作的搞怪桌面应用 |
| NobodyWho(日榜 15) | 106 | 19 | 安卓 · 开源 · 开发者工具 | 在任意设备上运行 AI 模型 |
| Zoho Cliq 7.0(日榜 16) | 98 | 1 | 效率 · 人工智能 · 科技 | 不间断的工作(大版本更新) |
| Roveri(日榜 17) | 91 | 8 | iOS · 旅行 · 地图 | iPhone 骑行日志,每次骑行都绘制在地图上 |
📅 周榜 Top 17(2026 年第 34 周,与月榜去重后)
↑ 已在月榜的周榜热门产品(不重复展开):Astute(周榜第 1,531 赞)、Clipto MCP(第 2,472 赞)、Meridian(第 3,458 赞)、Clara AI SDR(第 4,453 赞)、Taku AI(第 5,409 赞)、Omni by xpander(第 6,384 赞)、Vendo(第 9,358 赞,HN 周榜亦有 Launch)、Viktor.com(精选位)。8/20、8/21 日榜补充产品(fx、Epho、Plow Latch、OneCLI、Router by Ramp 等)与月榜章节完全重合,已在上文展开。
🆕 周榜新增产品(月榜未收录):
| # | 产品 | 👍 | 💬 | 标签 | 说明 |
|---|---|---|---|---|---|
| 7 | Clears | 372 | 35 | 开发者工具 · 人工智能 | 从 AI 编码迈向 Agent 式软件交付 |
| 8 | HyNote for Mac | 371 | 59 | 会议 · 菜单栏应用 · 苹果 | 100% 本地、完全私密的免费 Mac 转录工具 |
| 10 | Origin by Cursor | 343 | 10 | 开发者工具 · 人工智能 | Cursor 出品:为编码 Agent 时代打造的 Git 代码托管平台,直接对标 GitHub |
| 11 | Grok 4.6 | 298 | 9 | 安卓 · SaaS · 开发者工具 | xAI 发布:面向长时间运行 Agent 的前沿智能 |
| 12 | Wizstar | 269 | 29 | 效率 · 营销 · 人工智能 | 像专业演员一样会动会演的数字人 |
| 13 | Superflow AI | 263 | 27 | 设计工具 · 人工智能 · 营销自动化 | 上线前帮你 QA 网站的 AI Agent |
| 14 | Claude Watermark Remover | 263 | 14 | 写作 · 隐私 · 人工智能 | 找出并清除文本中 AI 留下的所有痕迹(与 GitHub 月榜 humanizer 同赛道) |
| 15 | Supernova | 260 | 35 | 数据分析 · 人工智能 · 数据 | 把你的所有数据接入 Claude 和 Codex |
| 16 | Checksum AI | 234 | 40 | API · 开发者工具 · 人工智能 | 你的编码 Agent 的「测试搭子」 |
| 17 | The New Calendly | 210 | 6 | 安卓 · 浏览器插件 · 笔记 | 处理会议前、中、后的全部工作 |
🎁 周榜精选位新增:Wispr Flow Dictation——停止打字开始说话,快 4 倍;Tines——Agent、应用与自动化的统一安全环境。
📌 周榜延伸名次新增:Mindcase(192 赞)——几分钟内从网页任意位置提取数据;MeetStream AI(179 赞)——面向 AI 会议 Agent 的统一 API 与基础设施。
🎯 核心洞察
- AI 渗透率极高:月榜 Top 17 中 15 个产品带「人工智能」标签,几乎全是 AI Agent / AI 工作流方向
- AI 同事/Agent OS 赛道最热:Hey Noah(AI 执行助理)、Grok Bot(AI 队友)、Soloop(Agent OS)、Omniwork(创意 Agent OS)、Viktor(AI 同事,684 赞全场最高)
- 开源替代是大主题:Dograh(开源 VAPI 替代)、Cloudflare OS、Meridian、Vendo、fx(Vercel 开源编码 Agent)、OneCLI、Berd、NobodyWho
- 营销增长类 AI 集中爆发:AdAnt AI(AI 广告)、Astute(B2B 病毒营销)、Clara AI SDR(AI 销售)
- 大厂动向:Cursor 推 Git 托管平台「Origin」直接对标 GitHub;xAI 发布 Grok 4.6(主打长时间运行 Agent);Vercel 开源轻量编码 Agent「fx」;Ramp 推 LLM 路由「Router」;MiniMax 发布 Design;Framer 3.0 画布 Agent(909 赞);Zoho Cliq 升级 7.0
- Agent 基建「水电煤」成形:Actx0(Agent 记忆)、Router by Ramp(LLM 路由)、bitdrift.ai(Agent 可观测性)、Plow Latch(Agent 权限沙箱)、OneCLI(企业沙箱助理)——Agent 生态配套集中上新
- 去 AI 痕迹成新需求:Claude Watermark Remover(263 赞)与 GitHub 月榜 humanizer、HN「反 slop」情绪互相印证
📰 Techmeme AI 行业新闻
过去 7 天 AI 相关行业新闻精选(来源:TechCrunch / The Verge / Bloomberg / Reuters 等)
📅 本周 AI 新闻 Top 15
| # | 标题 | 来源 | 说明 |
|---|---|---|---|
| 1 | Sources: Anthropic expects to match or beat the size of SpaceX’s record-setting IPO(消息人士:Anthropic IPO 规模有望追平甚至超越 SpaceX 创纪录 IPO) | Bloomberg(彭博社) | Anthropic 或 8 月底公开递交 IPO 文件,规模瞄准 SpaceX 级别 |
| 2 | Sources: Anthropic’s revenue run rate reached $65B by the end of July(Anthropic 7 月底年化收入达 650 亿美元) | Bloomberg | 从 5 月 470 亿飙升至 650 亿,IPO 前增长迅猛 |
| 3 | Sources: OpenAI’s Q2 sales grew 18% QoQ to $6.7B as loss jumped 32% to $12.3B(OpenAI 二季度营收环比增 18% 至 67 亿美元,亏损扩至 123 亿) | WSJ(华尔街日报) | 同期 Anthropic 销售额翻倍至 116 亿并实现小额经营利润,形成对比 |
| 4 | Sam Altman says OpenAI decided to slow the development of some AI models(Altman 称 OpenAI 决定放缓部分模型研发) | Time(时代周刊) | 因研究发现模型存在”不同程度失准”,主动降速 |
| 5 | Stripe agrees to acquire OpenRouter; source: $7.5B(Stripe 以 75 亿美元收购 AI 模型路由平台 OpenRouter) | NYT(纽约时报)/ WSJ | Stripe 史上最大收购,押注”AI 模型+token 支付”未来 |
| 6 | Filing: Nvidia agrees to spend up to $105B supporting SB Energy’s Ohio data center campus OpenAI will lease(英伟达将斥资最高 1050 亿美元支持 OpenAI 俄亥俄数据中心) | Bloomberg | OpenAI 签 20 年 10GW 租约,Nvidia 出资 15 亿投资 SB Energy 并兜底 |
| 7 | Sources: Poolside struck a non-exclusive $6B licensing deal with Nvidia, plus a $1B investment(Poolside 与英伟达达成 60 亿美元授权+10 亿美元投资) | Newcomer(科技通讯) | 估值 120 亿美元,109 名员工获 Nvidia 职位邀约 |
| 8 | Meta launches a Mac app for Meta AI, with Instagram/Facebook and Workspace integration(Meta AI 推出 Mac 应用,打通社媒账号与谷歌办公套件) | The Verge | Meta AI 桌面端扩张,直连广告投放与 Workspace |
| 9 | Google DeepMind: Gemma open models surpass 1B downloads(谷歌 Gemma 开源模型下载量突破 10 亿次) | Google 官方博客 | 两年内开发者发布超 10 万个 Gemma 模型变体 |
| 10 | OpenAI debuts ChatGPT for Teens(OpenAI 推出青少年版 ChatGPT) | NYT | 限制自残/饮食障碍等高风险对话,配备学习工具与护栏 |
| 11 | Etched raised $700M at a $21B valuation led by Jane Street(AI 推理芯片公司 Etched 融 7 亿美元,估值 210 亿) | WSJ | 估值三个月翻倍,客户 Jane Street 领投 |
| 12 | Sources: AI chip startup Fractile in talks to raise ~$600M at $6.5B valuation(AI 芯片初创 Fractile 洽谈融资 6 亿美元,估值 65 亿) | Bloomberg | 已与 Anthropic 达成约 2.5 亿美元初始订单 |
| 13 | Amazon makes AI-powered Alexa+ free on all Fire TV devices(亚马逊 Alexa+ 在 Fire TV 上全面免费开放) | TechCrunch(科技媒体) | 无需 Prime 订阅,自动升级全部美国用户 |
| 14 | China’s Hangzhou deploys autonomous traffic-control robots(杭州部署自主交通管理机器人) | Reuters(路透社) | 摄像头+雷达全天候指挥交通、识别违章 |
| 15 | Groq raised $350M at a $3.5B valuation, down from $6.9B(Groq 融资 3.5 亿美元,估值从 69 亿腰斩至 35 亿) | Bloomberg | Nvidia 授权交易挖走大量人才后被迫降估值融资 |
📋 更多新闻(16-32)
| # | 标题 | 来源 | 说明 |
|---|---|---|---|
| 16 | OpenAI CFO: OpenAI “will be a public company in 2027”(OpenAI CFO 称 2027 年上市) | CNBC | 全员会上表示业务向好可能提前 |
| 17 | OpenAI expands ad pilot to 31 European markets(OpenAI 广告试点扩至 31 个欧洲市场) | Adweek(广告周刊) | 覆盖德法西意,商业化加速 |
| 18 | Sources: OpenAI changed safety practices, paused RL training for two weeks(OpenAI 因 Hugging Face 入侵事件暂停强化学习训练两周) | Axios | Astra 疑似触及网络攻击关键阈值后启动准备框架响应 |
| 19 | OpenAI testing Private Safety Processing(OpenAI 测试”私有安全处理”零留存安全技术) | Axios | 与 Anthropic 要求 30 天数据留存的新政策形成对比 |
| 20 | Anthropic plans safety system with 30-day on-premise data retention(Anthropic 拟推企业自有云端 30 天留存方案) | Bloomberg | 隐私与安全监管间寻求平衡 |
| 21 | Z.ai’s GLM-5.3 scores 60 on Artificial Analysis index(GLM-5.3 智能指数 60 分,超 GLM-5.2 七分) | Artificial Analysis | 与 Kimi K3 持平,仍低于 Opus 5 的 63 分 |
| 22 | Z.ai prices GLM-5.3 API at $1.40/$4.40 per 1M tokens(GLM-5.3 API 定价与 5.2 持平) | VentureBeat | 输入 $1.40/百万 token,Kimi K3 为 $3/$15 |
| 23 | Cerebras unveils CS-3-based Nexus rack with 50% fewer components(Cerebras 发布 CS-4 服务器机架) | Reuters | 三颗 WSE-3 Turbo 芯片,Q3 交付 |
| 24 | Sources: ByteDance and Tencent got ~10K Nvidia H200 chips each(字节与腾讯各获约 1 万颗 H200 芯片) | FT(金融时报) | 美国许可下 H200 获准进入中国大陆 |
| 25 | Sources: Nvidia plans LPU tailored for China by end of 2026(英伟达年底前小批量交付中国定制 LPU) | The Information | 合规美国出口管制,重返中国市场 |
| 26 | Meta spending hundreds of millions/year on Azure AI tokens(Meta 每年花数亿美元经 Azure 用数万亿 AI token) | Bloomberg | 悄然成为微软最大 AI 客户之一 |
| 27 | Alibaba Qwen3.8-27B open model passes 1M+ downloads(阿里开源多模态模型 Qwen3.8-27B 下载破百万) | The Information | 发布数日内成为其增长最快模型之一 |
| 28 | Kuaishou Kling AI sales up 200% YoY(快手可灵 AI 收入同比增 200%) | Bloomberg | Q2 净利大跌 36%,AI 投入拖累利润 |
| 29 | Sources: SpaceX approached Cognition about acquisition(SpaceX 曾洽购 AI 编程公司 Cognition) | Bloomberg | CEO Scott Wu 回应”不出售” |
| 30 | Sources: Nvidia discusses Mercor investment at $20B valuation(英伟达洽投 AI 数据公司 Mercor,估值 200 亿) | The Information | 上季向 Mercor 支付数千万美元 |
| 31 | Slack launches Slack Code with AI coding agents(Slack 推出代码频道,AI 编程代理”如队友”协作) | The Verge | 全套餐开放项目级代码协作频道 |
| 32 | Binance launches Agent OS for AI trading agents(币安发布 Agent OS,AI 代理可代用户交易) | TechCrunch | 限制代理权限主要靠用户自行设置 |
🎯 行业核心动态
大公司动向(产品/收购/融资)
- Anthropic 成本周绝对焦点:年化收入 650 亿美元、IPO 或月底递交、联合创始人拟获超级投票权、100 亿美元级信贷额度超募;Situational Awareness 基金却折价甩卖其股权额度暴露流动性危机
- OpenAI 双线推进:俄亥俄 20 年 10GW 数据中心(Nvidia 最高 1050 亿美元支持)、2027 上市计划、广告扩欧;但因安全事件暂停 RL 训练、主动放缓模型研发
- 英伟达资本布局凶猛:Poolside 60 亿授权、Mercor 200 亿估值投资、Etched/Fractile 等芯片生态卡位;季自由现金流三年涨 18 倍至 485 亿美元,从”芯片护城河”转向”资本护城河”
- 算力融资与定制芯片:Cerebras CS-4、Waymo 自研 ASIC、Etched 210 亿估值、Marvell 获谷歌 122 亿美元认股权证
政策法规(监管/诉讼/数据)
- 美国司法部调查 a16z 近一年:合伙人兼任竞争性 AI 公司董事是否违规
- 29 州总检察长诉 Meta 青少年成瘾案开审,前工程师指证扎克伯格重增长轻安全
- FTC 要求企业披露个性化定价;GOP 备忘录警告数据中心民意反弹或致俄亥俄参议院席位失守
- Pew 调查:52% 美国人对 AI 担忧超过兴奋(2021 年为 37%)
商业化进展
- Stripe 75 亿美元收购 OpenRouter,致股东信称”奇点已始”,H1 收入同比增 41%
- Meta AI Mac 版落地、OpenAI 广告 31 国扩张、Alexa+ 免费开放、币安/支付宝布局 AI 代理交易与商户自动化
- 中国阵营:GLM-5.3 与 Kimi K3 发布并进入 API 竞价、Qwen3.8 开源爆发、杭州机器人交警上路
📈 Trendshift — GitHub 项目社交热度
数据来源:trendshift.io 日榜(社交提及 + 星标增长综合热度,2026-08-21 期)
📅 日榜 Top 12(今日爆发)
| # | 项目 | 📈 今日增长 | 热度分/提及 | 主题 | 说明 |
|---|---|---|---|---|---|
| 1 | openai/codex | +4,090 ⭐ | 34,263 · HN/Reddit/X | AI 智能体、AI 编程助手 | OpenAI 官方轻量级终端编程智能体,Rust 编写,在终端里直接跑 |
| 2 | deepseek-ai/deepseek-harness | +6,795 ⭐ | 9,965 · HN/Reddit/X | AI 智能体 | DeepSeek 官方 Agent Harness 运行时,上线一周星标破 18 万,今日增长全场第一 |
| 3 | ripienaar/free-for-dev | +814 ⭐ | 6,646 · HN/Reddit/X | 精选清单 | 面向 DevOps 与基础设施开发者的免费层 SaaS/PaaS/IaaS 大全 |
| 4 | mattpocock/skills | +2,921 ⭐ | — | AI 技能 | TypeScript 名师 Matt Pocock 的 .agents 目录实战技能集 |
| 5 | modular/modular | +769 ⭐ | — | AI 基础设施 | 模块化 AI 平台(含 MAX 与 Mojo 语言) |
| 6 | Wei-Shaw/sub2api | +700 ⭐ | — | 自托管 | 一站式开源中转服务,统一接入 Claude/OpenAI/Gemini/Grok 订阅,支持拼车共享 |
| 7 | mahlernim/google-timeline-visualizer | +663 ⭐ | — | 数据可视化 | 用 Google 位置历史(时间线)数据可视化你的年度旅行足迹 |
| 8 | AprilNEA/OpenLogi | +998 ⭐ | — | 自托管 | Rust 原生本地优先的罗技 Options+ 替代品,HID++ 重映射按键/DPI,无账号无遥测 |
| 9 | santifer/career-ops | +768 ⭐ | — | AI 智能体、爬虫、简历 | 开源 AI 求职工具:扫描招聘网站、A-F 评分卡打分、定制简历、跟踪投递,本地跑在编程 CLI 里 |
| 10 | makeplane/plane | +500 ⭐ | — | 自托管 | 开源版 Jira/Linear/Monday/ClickUp,现代项目管理平台 |
| 11 | canopy-network/canopy | +487 ⭐ | — | 区块链协议 | Canopy 网络协议官方 Go 实现 |
| 12 | JuliusBrussee/caveman | +534 ⭐ | — | AI 技能 | 🔥 “原始人说话” Claude Code 技能,砍掉 65% token 消耗 |
🎯 核心洞察
- Trendshift 独家发现(GitHub Trending 难见到):santifer/career-ops(AI 求职)、JuliusBrussee/caveman(省 token 技能)、mahlernim/google-timeline-visualizer 等小而美项目靠社交提及冲上日榜
- 社交传播最快:openai/codex(热度分 34,263 断层第一,HN/Reddit/X 三平台刷屏)、deepseek-ai/deepseek-harness(单日 +6,795 星)
- AI 技能生态爆发:mattpocock/skills、caveman、ui-ux-pro-max-skill 等 “Agent Skills” 类项目密集上榜,Claude Code / Codex 技能正成为新增长点
数据来源:trendshift.io 周榜(社交提及 + 星标增长综合热度)
📅 周榜 Top 12(持续热度)
| # | 项目 | 📈 本周增长 | 总星标 | 主题 | 说明 |
|---|---|---|---|---|---|
| 1 | deepseek-ai/deepseek-harness | +49,891 ⭐ | 180,903 | AI 智能体 | DeepSeek 官方开源 Agent Harness(智能体运行时框架),将 LLM 变成可工作的智能体,上架仅一周即登顶周榜,单周涨近 5 万星,是本周开源圈最大事件;围绕它的插件/桌面端/路由生态已迅速成型 |
| 2 | harry0703/MoneyPrinterTurbo | +9,183 ⭐ | 113,784 | AI 视频生成 | 利用 AI 大模型和自动化工作流,输入主题或关键词一键生成高清短视频(文案、素材、字幕、配乐全自动),国内开发者最爱的短视频自动化工厂 |
| 3 | mattpocock/skills | +9,985 ⭐ | 229,085 | AI 技能 | TypeScript 教育名师 Matt Pocock 从自己 .agents 目录整理出的”给真工程师的技能集”,周增近万星,是 Agent Skills 浪潮的标杆项目 |
| 4 | openai/codex | +4,937 ⭐ | 111,162 | AI 智能体、AI 编程助手 | OpenAI 官方 Rust 编写的终端轻量编程智能体,Claude Code 最直接的竞品,周热度分稳定前列 |
| 5 | anywhere-labs/deepseek-harness-desktop | +8,674 ⭐ | 17,530 | 本地大模型 | 基于官方 DeepSeek Harness 打造的 Electron 桌面端,支持 macOS 和 Windows,免配置、下载即用,蹭上母项目东风一周 +8.6k 星 |
| 6 | AprilNEA/OpenLogi | +4,284 ⭐ | 12,758 | 自托管 | Rust 原生、本地优先的罗技 Options+ 替代品:重映射按键、DPI、SmartShift 走 HID++,无账号无遥测,外设社区的口碑之选 |
| 7 | awesome-dsh-plugin/awesome-dsh-plugin | +6,064 ⭐ | 11,132 | 精选清单 | DeepSeek Harness (dsh) 插件精选列表,母项目爆火后生态配套迅速跟进的典型样本 |
| 8 | santifer/career-ops | +3,284 ⭐ | 67,337 | AI 智能体、爬虫、简历 | 开源 AI 求职全家桶:扫描招聘门户、A-F 结构化评分(1.0-5.0 分)、按 JD 定制简历、追踪投递进度,本地运行于 Claude Code/Codex 等编程 CLI |
| 9 | yjh051108/dsh-routing-suite | +3,753 ⭐ | 6,555 | AI 智能体 | DeepSeek Harness 的注入器 + 任务感知推理模式路由套件(实测 P1-P23),让 dsh 按任务自动切换深浅思考 |
| 10 | public-apis/public-apis | +6,248 ⭐ | 467,911 | 精选清单 | 免费公共 API 大合集,46 万星常青树,每周仍稳定吸星数千 |
| 11 | volcengine/OpenViking | +2,957 ⭐ | 31,584 | AI 智能体、AI 记忆、RAG | 字节跳动(火山引擎)出品的自进化上下文数据库,统一智能体记忆、知识 RAG 与技能,是国内大厂少见的 Agent 基础设施开源 |
| 12 | mukul975/Anthropic-Cybersecurity-Skills | +2,525 ⭐ | 30,509 | AI 智能体、AI 技能 | 817 条结构化网络安全技能,映射 MITRE ATT&CK、NIST CSF 2.0 等 6 大框架,兼容 Claude Code/Codex/Cursor 等 20+ 平台 |
| 13 | s1dashu/ip-as-logo-skill | +3,466 ⭐ | 3,470 | AI 图像生成、AI 技能 | 紧凑的 Codex 技能:生成高度简化、圆角、微妙新拟物风格的 IP 吉祥物 Logo,一周星标翻倍,设计师社区自来水传播 |
| 14 | yetone/cumora | +2,773 ⭐ | 2,857 | AI 智能体、聊天机器人 | AI 智能体的”团队群聊”:跨平台群聊应用,把 AI Agent 当一等公民队友,云端或自带 Claude Code/Codex 大脑均可 |
🎯 核心洞察
- Trendshift 独家发现:deepseek-harness 生态三连(本体 +49.9k、桌面端 +8.7k、插件清单 +6.1k、路由套件 +3.8k)——这种”母项目带飞全家桶”的生态爆发是 GitHub Trending 单榜看不到的
- 社交传播最快:deepseek-harness 周增 49,891 星为全场之最;MoneyPrinterTurbo(AI 短视频)在中文社区持续病毒式传播
- AI 求职与 Agent 技能是本周两大新兴赛道:career-ops 双榜齐上(日榜 + 周榜),Anthropic-Cybersecurity-Skills、mattpocock/skills、ip-as-logo-skill 显示 “Skills 经济”正从玩具走向工程化
- 周榜背景:本期数据基于 Trendshift 综合热度算法(社交提及 × 星标增长加权),榜单覆盖 25 个项目,以上为 AI 相关精选 Top 14
🌐 九源交叉分析
本期 OSSInsight 官方临时下线 star 榜单(GitHub 事件流故障),实际参与交叉分析的数据源为 八源:GitHub Trending、Hugging Face Models、Hugging Face Papers、Hacker News、Reddit r/ML、Product Hunt、Techmeme、Trendshift。
1. 🔥 跨源热门项目验证
综合评级标准:🔥🔥🔥 = 4+ 源验证 | 🔥🔥 = 3 源验证 | 🔥 = 2 源验证
| 项目/主题 | 出现的数据源 | 评级 | 说明 |
|---|---|---|---|
| Agent Skills 生态(mattpocock/skills、google/skills、diagram-design、Anthropic-Cybersecurity-Skills、cangjie-skill 等) | GitHub(月榜 #1/#2/#12 + 周榜 #2)· Trendshift(周榜 #3/#12/#13)· HN(Vomit、caveman 等 Skills 周边热议)· PH(Claude Watermark Remover 同赛道「去 AI 痕迹」)· Reddit(SSOG 帖延伸的 AI 生成内容争议) | 🔥🔥🔥 | 连续 3 周多源统治,Skills 已成第三种 Agent 能力分发格式;本周 Google 官方入场标志着从社区玩法升级为平台级品类 |
| Qwen3.8 系列 | HF Models(29 席中约 20 席围绕 27B 衍生)· Techmeme(下载破百万、增长最快模型之一)· Reddit(雅可比透镜零重拟合操控 Qwen3.8-27B)· GitHub(unsloth 周榜 #8) | 🔥🔥🔥 | 27B「生态母体」效应确立:量化厂牌以小时级跟进,无审查/abliterated 衍生占榜 1/3,国产开源继续领跑 |
| Stripe × OpenRouter 与模型网关叙事 | Techmeme(75 亿美元收购确认)· HN(GPT-5.6 Sol 降价 50% 成周榜第一,448 条评论)· GitHub(OmniRoute 月榜 #2,+31k) | 🔥🔥 | 收购落地+前沿模型跳水,网关/路由中间层的资本与用户双重验证;NVIDIA Switchyard、Router by Ramp 同周上新印证赛道拥挤 |
| 去 AI 痕迹/反 slop 赛道 | GitHub(humanizer 月榜 #21)· PH(Claude Watermark Remover 周榜 #14,263 赞)· HN(Deft Writing、open-slopware 替代清单、Humanising Is Dumb) | 🔥🔥 | 「AI 味」去除从灰色需求变成产品品类,与欧盟水印新规、学术 AI 生成内容争议同频共振 |
| DeepSeek Harness 生态(dsh 本体 + 桌面端 + 插件清单 + 路由套件) | Trendshift(周榜 #1/#5/#7/#9 四席 + 日榜双席)· HF Models(V4-Pro #14 / V4-Flash #27) | 🔥 | 社交热度依旧断层,但工程榜与 HN 均退潮,源数从上周 6 源回落至 2 源——生态爆发进入收敛期 |
| Needle2(cactus-compute/needle) | GitHub(月榜 #28 + 周榜 #9)· HN(月榜 535 分) | 🔥 | 连续 3 周,14MB 端侧模型与 ESP32 跑 LLM(HN 289 分)共同坐实「微型化」路线 |
| GLM-5.3 | HN(月榜 1171 分)· Techmeme(智能指数 60 分 + API 定价 $1.40/$4.40) | 🔥 | 前沿编码+安全能力涌现持续发酵,价格仅为 Kimi K3 的三分之一 |
| GPT-5.6 系列 | HN(多帖:降价/视觉登顶/Cyber/麦克斯韦猜想)· Techmeme(OpenAI 放缓研发、广告扩欧、青少年版) | 🔥 | 连续 4 周:能力叙事让位于价格叙事,本周「降价三连」成绝对主线 |
| MoneyPrinterTurbo | GitHub(周榜 #3,+9.7k)· Trendshift(周榜 #2,+9.2k) | 🔥 | 中文背景 AI 短视频工厂双源验证,在中文社区病毒式传播 |
其他双源验证:OpenLogi(GitHub 周榜 #11 + Trendshift 周榜 #6,Rust 本地优先替代罗技外设驱动);LTX-2(HF Models LTX-2.5 #7 + GitHub 官方推理包,开源视频生成放量);Kimi K3(HF #18 + Techmeme 提及,连续 6 周但热度趋弱)。
| Vendo | PH(周榜 #9 + 月榜延伸)· HN(Launch HN 57 分) | 🔥 | 「让用户在产品上造功能」的双源验证,YC 新方向样本 |
| OneCLI | PH(8/21 日榜 #9)· HN(月榜 110+87 分双帖) | 🔥 | 凭证网关→沙箱 harness 组合拳,Agent 安全基建新秀 |
2. 📊 连续上榜追踪(对比上期 W33 跨源验证表)
| 项目 | 首次上榜 | 连续周数 | W34 趋势 | 说明 |
|---|---|---|---|---|
| usestrix/strix | W27 | 8 周 | → 持平 | GitHub 月榜 #11 + 周榜 #4,AI 渗透测试常驻赛道 |
| earendil-works/pi | W29 | 6 周 | → 持平 | GitHub 月榜 #7 + 周榜 #22(+5k/周),Agent 工具包长青 |
| diegosouzapw/OmniRoute | W29 | 6 周 | → 持平 | GitHub 月榜 #2(+31k),网关叙事获 Stripe 收购背书 |
| Kimi K3 | W29 | 6 周 | ↓ 下降 | HF #18 + Techmeme 提及,热度趋弱 |
| virgiliojr94/book-to-skill | W30 | 5 周 | → 持平 | GitHub 月榜 #8(+14.6k) |
| block/buzz | W30 | 5 周 | ↑ 回稳 | GitHub 月榜 #3(+28.7k),但单源验证 |
| TencentCloud/TencentDB-Agent-Memory | W31 | 4 周 | → 持平 | GitHub 月榜 #9,腾讯 Agent 记忆中枢 |
| zhaoxuya520/reverse-skill | W31 | 4 周 | → 持平 | GitHub 月榜 #4(+18.7k) |
| GPT-5.6 系列 | W31 | 4 周 | ↑ 上升 | 本周「降价三连」登顶 HN 周榜,价格战全面开打 |
| DeepSeek V4 / DSH 生态 | W31 | 4 周 | ↓ 收敛 | 源数从 6 回落至 2,社交榜依旧霸屏但工程榜退潮 |
| MiniMax 家族 | W32 | 3 周 | → 持平 | HF 双席(H3 #11 / Music3 #6)+ PH MiniMax Design 上新 |
| Agent Skills 生态 | W32 | 3 周 | ↑ 上升 | 持续多源统治,Google 官方入场 |
| Qwen3.8 系列 | W33 | 2 周 | → 持平 | 4 源验证,衍生生态爆发期 |
| Muse Glimmer | W33 | 2 周 | ↓ 下降 | 仅 HF #22 单源,从 4 源明显回落 |
| diagram-design | W33 | 2 周 | → 持平 | GitHub 周榜 #2(+11.3k),技能单品天花板 |
| stablyai/orca | W27 | 🏁 退出 | 🏁 | 连续 7 周后退出本期各榜 |
| watermarks-remover(原项目) | W33 | 🏁 退出 | 🏁 | 原仓库退榜,但主题由 PH Claude Watermark Remover 与 GitHub humanizer 接棒延续 |
| deepseek-harness 本体 | W33(生态) | 🆕 单独登顶 | 🆕 | Trendshift 周榜 #1(+49.9k),18 万星里程碑 |
| holaOS / Soup / OpenLogi 等短线爆发 | W34 | 🆕 新入榜 | 🆕 | 本周 GitHub 周榜新面孔,聚焦企业级 Agent 工作区与本地化训练 |
趋势标注:🆕 本周新入榜 | ↑ 上升 | → 持平 | ↓ 下降 | 🏁 已退出
3. 各源独家发现
| 数据源 | 本期独家亮点 |
|---|---|
| GitHub Trending | 腾讯 AI-Infra-Guard(AI 红队全栈平台)与 Soup(一个 YAML 微调,4GB 显卡训 8B)等国产新锐;NVIDIA Switchyard 跨模型流量路由入场 |
| Hugging Face Models | unsloth GGUF 下载 580 万反超官方原版;无审查/abliterated 衍生文化占榜约 1/3;MiniMax-Music3(2B)与 LTX-2.5 预示音频/视频生成赛道接力 |
| Hugging Face Papers | Harness Scaling 路线登顶(StateM $15 达成 Terminal-Bench 95.3%);UCSD 蒸馏系 5 篇成建制产出;中国机构占 Top 40 的 1/3,3D/语音/视频多模态占优 |
| Hacker News | 「认知负债」成月度最大争议词(手抄 LLM 代码 545 分);SQLite 严重 CVE 疑为 LLM 幻觉产物(727 分)——AI slop 冲击安全与研究公信力 |
| Reddit r/ML | 学术评审危机全面发酵(EMNLP 等待楼 498 条评论、「失去三个半博士生」682 分月冠军);「零训练」极客美学刷屏(21B 硬编码 Doom、264KB 扩散模型) |
| Product Hunt | Cursor 推 Origin 直接对标 GitHub(编码 Agent 时代代码托管);Grok 4.6 主打长时间运行 Agent;Agent 基建「水电煤」(记忆/路由/可观测性/权限沙箱)集中上新 |
| Techmeme | Anthropic 年化收入 650 亿美元、IPO 或月底递交;Stripe 75 亿美元收购 OpenRouter;英伟达 1050 亿美元兜底 OpenAI 数据中心——资本层面「Agent 经济」全面定价 |
| Trendshift | dsh 生态「母项目带飞全家桶」四连霸(本体+桌面端+插件+路由);career-ops(AI 求职)与 caveman(省 65% token 技能)等小而美项目靠社交提及出圈 |
4. 🎯 本期 AI 趋势一句话总结
2026 年 W34 的关键词是 「Skills 工程化 + 价格战 + 微型化下沉」:Agent Skills 在 Google 官方入场后从社区玩法升级为平台级品类(GitHub 月榜 1/3 与之相关);GPT-5.6 Sol 一个月内「降价三连」叠加 Stripe 75 亿美元收购 OpenRouter,把竞争焦点从能力转向成本;Qwen3.8-27B 以一己之力养活 HF 榜 2/3 衍生生态,而 14MB 的 Needle2、264KB 扩散模型与 ESP32 跑 LLM 则把「本地全天候 Agent」推向极限——与此同时,学术圈的评审危机与「认知负债」之争提醒所有人:工具越强,人的判断力越贵。