AI 趋势周报:2026-W38

🤖 AI 趋势周报 · 2026-W38 (2026-09-13 - 2026-09-19)

⏪ 上周回顾

上期报告(2026-W37)的核心趋势本周进展:

  1. GPT-6 Astra 连续第 3 周霸榜,叙事从”发布冲击”转向”垂域落地 + 安全审视”:上周拿下 HN 月榜头条并因需求过载暂停 Pro 新订;本周 Astra for Law 法律垂域版发布(Techmeme)、PH 月榜第 6,HN 发布帖 2279 分/2081 评继续断层领跑,但 OpenAI 同步披露六起模型失准事件并建立报告框架,”AGI 时代”叙事进入安全审视期。
  2. Agent Skills 连续第 7 周统治,重心转向”安全验证”:上周 OpenAI 开放官方 plugins/skills 仓库、GitHub 周榜前 10 被技能类包揽;本周 GitHub 月榜 Top 20 中技能/插件类仍占约 1/3(archify 月榜第 1、openai/plugins 周榜第 11、addyosmani/agent-skills 周 8),HF Papers 侧 SkillOpt(262 赞)继续研究技能自进化,Claude-Red、tech-leads-club/agent-skills 则把矛头指向技能安全验证。
  3. Qwen3.8 接棒扛旗,连续第 6 周且升级为 4 源共振:上周 HF 榜 7 席衍生 + “复刻 GPT-5.5 Pro 推理前缀”争议;本周 unsloth GGUF 下载 763 万成全榜之王,HN 236 分跟进推理预填充,Techmeme 报道 PrismML Bonsai 2 将 Qwen3.8-27B 压至 5.9GB 装进手机——27B 级开源模型完成”端侧化”关键一跃。

连续上榜项目:Agent Skills 生态(连续 7 周)、Qwen3.8 系列(连续 6 周)、反 AI slop(连续 6 周)、GPT-6 Astra(连续 3 周)、archify(连续 4 周)、TimesFM/世界模型/Muse/Navier-Stokes(均连续 2 周);GLM-5.3 仅剩 HF Models 单席(↓),ECC、hyperframes、gods-eye-view 等上期双源项目因 Trendshift 本期缺席降至单源(详见文末交叉分析)。

📅 本月榜 Top 20

# 项目 语言 ⭐ 总计 📈 本月新增 说明
1 tt-a1i/archify JavaScript 66,746 52,260 Agent 技能:生成精美可验证的架构图/流程图/时序图,输出自包含 HTML
2 omacom/omarchy Shell 41,905 16,196 精美、现代且有主见的 Linux 发行版
3 anthropics/claude-plugins-community Python 4,226 3,896 Claude Cowork 与 Claude Code 的社区插件市场(只读镜像)
4 THU-MAIC/OpenMAIC TypeScript 37,800 16,970 清华开源多智能体互动课堂,一键获得沉浸式学习体验
5 cursor/plugins TypeScript 8,098 5,130 Cursor 插件规范与官方插件
6 freestylefly/awesome-gpt-image-2 JavaScript 32,673 21,929 GPT Image 2/2.5 提示词案例库,530+ 案例与工业级模板
7 AprilNEA/OpenLogi Rust 21,543 12,913 罗技 Options+ 的原生本地优先替代品,Rust 编写、无账号无遥测
8 ayghri/i-have-adhd Python 47,990 26,237 让编码 Agent 不再埋没答案的技能,ADHD 友好输出
9 debpalash/VoiceStudio Python 32,829 22,507 全本地开源 ElevenLabs 替代品:语音克隆/配音/转录,支持 646 种语言
10 vorssaint/vorssaint-utils Swift 19,795 14,192 免费开源 macOS 菜单栏工具集
11 cathrynlavery/diagram-design HTML 41,114 20,738 为 Claude Code/Codex/Pi 打造的编辑部级图表设计,自包含 HTML+SVG
12 cloudflare/security-audit-skill JavaScript 13,395 6,981 多阶段安全审计编码 Agent 技能,输出独立验证的机器可读结果
13 alibaba/open-code-review Go 36,556 13,677 阿里规模验证的混合架构代码审查工具:确定性流水线 + LLM Agent
14 google-research/timesfm Python 33,129 5,145 Google 时间序列基础模型,用于时间序列预测
16 tashfeenahmed/freellmapi TypeScript 27,146 8,304 每月 74 亿 token、34 个免费 LLM 供应商统一到一个 /v1 端点
17 apache/maka TypeScript 5,574 4,224 Apache 孵化项目:完整记录操作历史的高性能 Agent 工作区
18 Tencent/WeKnora Go 26,921 6,280 腾讯开源 LLM 知识平台:文档变 RAG、自主推理 Agent 与自维护 Wiki
19 tech-leads-club/agent-skills TypeScript 6,390 1,398 面向专业 AI 编码 Agent 的安全验证技能注册表
20 abue-ammar/tinycast Swift 6,437 4,365 微型全原生 macOS 启动器、热键与剪贴板历史
📅 展开 21-37 名
# 项目 语言 ⭐ 总计 📈 本月新增 说明
21 melgarafael/DeskcommCRM TypeScript 3,183 2,586 开源 AI 销售 OS:自托管 CRM + 原生 AI Agent + WhatsApp
24 p-e-w/heretic Python 31,796 4,036 全自动移除语言模型审查限制的工具
26 abi/screenshot-to-code Python 79,232 5,254 截图转干净代码(HTML/Tailwind/React/Vue)
28 petergyang/no-ai-slop Python 10,545 5,127 移除文本中 20+ 种 AI 垃圾文风模式
29 rohitg00/ai-engineering-from-scratch Python 54,966 8,365 AI 工程从零学起:学会、构建、交付
30 jiji262/douyin-downloader Python 11,890 2,567 抖音批量下载工具:去水印,支持视频/图集/合集/音乐
32 k2-fsa/OmniVoice Python 13,548 4,346 支持 600+ 语言的高质量语音克隆 TTS
33 youssofal/MTPLX Python 2,373 1,057 在 Mac 上用原生 MTP 投机解码最快跑 Qwen 3.8 系列的本地服务
34 Tencent/AI-Infra-Guard Python 6,444 1,926 腾讯全栈 AI 红队平台:Agent/技能/MCP 扫描与越狱评估

📅 本周榜 Top 20

# 项目 语言 ⭐ 总计 📈 本周新增 说明
1 alibaba/open-code-review Go 36,559 11,489 阿里规模验证的混合架构代码审查工具:确定性流水线 + LLM Agent(月榜 #13,本周继续冲顶)
2 ayghri/i-have-adhd Python 47,990 10,800 ↑ 已在月榜第 8 位
3 bilawalsidhu/gods-eye-view JavaScript 37,746 14,460 浏览器里的间谍卫星模拟器,数据真实:3D 地球上的开源空间情报
4 affaan-m/ECC JavaScript 261,954 5,607 Agent harness 性能优化系统:技能、本能、记忆与研究优先开发
5 Tencent/WeKnora Go 26,921 3,982 ↑ 已在月榜第 18 位
6 anthropics/claude-code TypeScript 146,245 1,294 Anthropic 官方终端智能编码工具
7 mksglu/context-mode TypeScript 23,523 1,482 AI 编码 Agent 上下文优化:沙箱化工具输出(减少 98%)+ 会话记忆
8 addyosmani/agent-skills JavaScript 96,346 2,560 面向 AI 编码 Agent 的生产级工程技能库
9 max-sixty/worktrunk Rust 8,005 1,060 为并行 AI Agent 工作流设计的 Git worktree 管理 CLI
10 anthropics/knowledge-work-plugins Python 24,850 488 面向知识工作者的 Claude Cowork 开源插件库
11 openai/plugins JavaScript 6,968 564 OpenAI 官方插件仓库
12 blader/humanizer Python 49,909 3,235 去除文本 AI 生成痕迹的 Agent 技能
13 kunchenguid/firstmate Shell 6,542 890 与一个 Agent 对话,带一队船员交付
14 microsoft/markitdown Python 185,406 2,814 微软出品:文件与办公文档转 Markdown 工具
15 home-assistant/core Python 90,726 285 开源家庭自动化平台,本地控制与隐私优先
16 stablyai/orca TypeScript 71,871 5,305 并行 Agent 舰队的 ADE 开发环境,桌面/移动/远程可用
17 heygen-com/hyperframes TypeScript 51,355 2,400 写 HTML 即可渲染视频,为 Agent 而生
18 Panniantong/Agent-Reach Python 83,099 3,670 给 AI Agent 装上眼睛:读取/搜索 Twitter、Reddit、B 站等全网,零 API 费
19 obra/superpowers Shell 288,525 3,821 真正可用的智能体技能框架与软件开发方法论
20 petergyang/no-ai-slop Python 10,545 2,256 ↑ 已在月榜第 28 位
📅 展开 21-45 名
# 项目 语言 ⭐ 总计 📈 本周新增 说明
23 github/spec-kit Python 137,804 3,121 GitHub 官方规格驱动开发(Spec-Driven Development)工具包
25 SnailSploit/Claude-Red Python 6,169 2,997 面向 Claude 技能系统的进攻性安全技能库
26 multimodal-art-projection/YuE Python 9,697 2,941 YuE2 前沿音乐生成:符号规划、零样本翻唱与智能体音乐编辑
28 calesthio/OpenMontage Python 59,930 2,850 全球首个开源智能体视频生产系统:12 条流水线、100+ 工具
30 SWE-agent/mini-swe-agent Python 7,753 357 100 行代码的 AI Agent,SWE-bench Verified 得分超 74%
31 debpalash/VoiceStudio Python 32,829 10,421 ↑ 已在月榜第 9 位(本周新增 1 万星,二次爆发)
32 jiji262/douyin-downloader Python 11,890 2,027 ↑ 已在月榜第 30 位
35 cline/cline TypeScript 68,690 1,078 自主编码 Agent:SDK、IDE 扩展与 CLI 助手三合一
37 Tencent/BrowserSkill TypeScript 5,222 2,157 让 AI Agent 使用你真实登录态的浏览器而不打扰你
39 jamiepine/voicebox TypeScript 55,104 2,058 开源 AI 语音工作室:克隆、听写、创作
45 melgarafael/DeskcommCRM TypeScript 3,183 2,179 ↑ 已在月榜第 21 位

🎯 核心洞察

  • 月度新爆发 vs 持续热门:archify(月增 5.2 万)、awesome-gpt-image-2、VoiceStudio 等为月度爆发项目,但热度峰值集中在月初;而 open-code-review、i-have-adhd、WeKnora 周月双榜靠前,属于持续热门。
  • 本周黑马:gods-eye-view(周增 1.45 万,真实卫星数据的 3D 地球空间情报)、VoiceStudio(周增 1.04 万)、open-code-review(周增 1.15 万)为周榜新爆发,前两者月榜排名靠后,说明是本周集中引爆。
  • 周月双榜持续热门:i-have-adhd、no-ai-slop、WeKnora、open-code-review、VoiceStudio 同时进入周榜与月榜前列,热度具备持续性。
  • 语言分布:月榜 Python 数量最多(约 19 个),TypeScript 次之(约 10 个);周榜 TypeScript 显著回升(约 17 个)与 Python(约 18 个)平分秋色,反映 AI 编码 Agent 桌面端/平台类产品多以 TS 构建;Go(阿里/腾讯)与 Rust/Swift 也各有原生工具类精品,本地优先桌面工具新趋势明显。
  • AI 占比极高:月榜约 85%、周榜约 90% 项目与 AI/Agent 直接相关,”Agent 技能化 + 插件化”是最强主线——Claude 生态(官方插件库、skills)、OpenAI plugins、Cursor 插件规范共同推动技能标准化浪潮。
  • 中国力量:清华 OpenMAIC、腾讯 WeKnora/AI-Infra-Guard/BrowserSkill、阿里 open-code-review 等多个国产项目进入榜单前列。
# 模型 任务 参数量 下载量 推理 亮点
1 Edge0/Edge0-35B-A3B-preview 文本生成 35B 52.5k 新兴 35B MoE 稀疏模型(A3B 激活),发布 1 天即登顶趋势榜
2 deepseek-ai/DeepSeek-V4.1-Flash 图文理解 763B 430k DeepSeek V4.1 轻量旗舰,多模态+高下载量,官方推理可用
3 prism-ml/Ternary-Bonsai-2-27B-gguf 文本生成 27B 406k 三值化(Ternary)极限压缩模型,GGUF 本地部署热度暴涨
4 Qwen/Qwen3.8-27B 图文理解 28B 7.36M 本周绝对主角,下载 736 万,衍生量化/微调版本霸榜
5 m-a-p/YuE2-3B 文本转音频 4B 13.7k 开源音乐生成模型第二代,端侧即可跑的歌曲创作
6 TokenRhythm/NeoHorse-1-4B 文本生成 4B 22.7k 新锐 4B 小模型,社区口碑推上趋势榜
7 ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF 图文理解 27B 1.08M 学术量化实验(GSQ-RCO),下载破百万,量化研究受关注
8 Lightricks/LTX-2.5 图生视频 1.59M LTX 视频模型升级版,实时视频生成赛道主力
10 DavidAU/Qwen3.8-27B-TURBO-…-GGUF 图文理解 27B 1.2M 著名社区玩家的创意混合量化版,下载 120 万
12 XingChen-AGI/Xing4.0-29B-A4B 文本生成 31B 3.07k 国产新秀星宸 Xing4.0,29B MoE(A4B 激活),12 小时前更新
13 openbmb/MiniCPM5-2B 文本生成 3B 357k 面壁 MiniCPM 第五代 2B,端侧小模型持续走量
14 unsloth/Qwen3.8-27B-GGUF —(量化) 27B 7.63M unsloth 官方 GGUF,下载 763 万为全榜最高
16 Qwen/Qwen3.8-Flash-Next 图文理解 180B 724k Qwen3.8 Flash 迭代预告版,中大规模多模态
18 meta-llama/Llama-3.1-8B-Instruct 文本生成 8B 5.93M 常青款老将,生产部署存量需求依旧巨大
19 MiniMaxAI/MiniMax-H3 图文生视频 33B 4.45M MiniMax H3 多模态视频旗舰,下载 445 万
20 dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8 图文理解 763B 33.1k DeepSeek-V4.1-Flash 去审查 FP8 社区版
21 tencent/AuK 文本转语音 3.18k 腾讯 TTS 新模型上榜单
22 sentence-transformers/all-MiniLM-L6-v2 句子相似度 22.7M 255M 嵌入界下载之王(2.55 亿),RAG 生态基石
24 TaichuAI/ZDTaichu5.0-9B 图文理解 10B 1.8k 中科院 TaiChu 5.0 多模态模型上榜
25 prism-ml/Ternary-Bonsai-2-27B-mlx-2bit 文本生成 27B 5.06k 三值化模型 Mac MLX 2bit 版,苹果端侧部署
26 XHToken/Spark-X2.5-4B 文本生成 4B 29.7k 4B 轻量文本模型,小模型赛道再添一员
27 zai-org/GLM-5.3-Flash 图文理解 321B 2.67M 智谱 GLM-5.3-Flash 多模态,下载 267 万且推理可用
29 internlm/Atria-Dawn-Preview 753B 711 书生 753B 超大模型预览版神秘亮相
30 Comfy-Org/YuE2 —(ComfyUI) 102k YuE2 音乐生成官方 ComfyUI 打包节点

🎯 核心洞察

  • 参数量呈”中间大、两头尖”:27B–35B 中型 MoE(Qwen3.8-27B、Edge0-35B-A3B、Xing4.0-29B-A4B)是本周绝对主力;同时 763B/753B/321B 超大旗舰(DeepSeek、internlm、GLM)与 2B–4B 端侧小模型(MiniCPM5-2B、YuE2-3B、Spark-X2.5-4B)两极并存,”一专多能中型 + 极致端侧”成为布局共识。
  • 任务类型多元化:文本生成与图文多模态理解合计约占 75%,但视频生成(LTX-2.5、MiniMax-H3)与音频(YuE2 音乐生成、腾讯 AuK TTS)正密集进入趋势榜,多模态内容生成是下一个爆发点。
  • 国产模型占据半壁江山:Qwen3.8-27B 及其量化/微调衍生独占约 1/3 席位,加上 DeepSeek、GLM-5.3-Flash、MiniMax-H3、MiniCPM5、书生 Atria、腾讯 AuK、星宸 Xing4.0、TaiChu5.0,国产系占比超 50%,开源话语权显著。
  • 推理可用性偏低、本地部署需求旺盛:30 个趋势模型中仅 7 个支持官方 Inference Providers 即开即用;GGUF/MLX 量化版下载量动辄百万级(unsloth GGUF 763 万、DavidAU 120 万),叠加三值化/2bit 极限压缩模型走红,”本地跑大模型”仍是最强需求信号。

月榜(默认视图,按近期获赞排序)· 采集时间 2026-09-19 · 共 50 篇,因篇幅所限 21-50 名仅收录高关注度部分(Marigold V2、LongCat-Video、PaddleOCR-VL、YOLO26 等低互动条目从略)

📅 月榜 Top 20

# 论文标题 👍 方向 作者/机构 亮点
1 TradingAgents: Multi-Agents LLM Financial Trading Framework(多智能体 LLM 金融交易框架) arXiv 140 Agent/金融 Tauric Research(美国量化研究团队) 多智能体模拟真实交易公司分工,提升累计收益与夏普比率;GitHub 107k 星
2 YuE: Scaling Open Foundation Models for Long-Form Music Generation(长篇音乐生成开源基座模型) arXiv 77 多模态/音乐 MoMA 项目(港科大等,57 位作者) 基于 LLaMA2 的开源音乐生成全家桶:歌词对齐、结构连贯、自动伴奏
3 Apodex 1.1: Scaling Agentic Intelligence for Complex Work(面向复杂工作的规模化智能体) arXiv 207 Agent ApodexAI 可执行环境规模化 + 长程任务状态维护与自主恢复
4 Dream-RSI: Recursive Self-Improvement through Evolving Worlds(通过演化世界实现递归自我改进) arXiv 225 强化学习/自我改进 Google(谷歌) 用历史发现回放离线评估探索策略,大幅降低在线评估成本
5 Atria Dawn: The Dawn of Agentic Superintelligence(智能体超级智能的黎明) arXiv 403 Agent/基座模型 InternLM(上海 AI 实验室·书生) 经验证工具交互训练的智能体基座模型,主打科研级人机项目协作
6 AutoDev: Automated AI-Driven Development(自动化 AI 驱动开发) arXiv 20 代码/Agent 开源社区 在安全 Docker 沙箱内自动完成复杂工程任务、代码与测试生成
7 ZGCM-1: A Fully Open and Extremely Efficient Foundation Model for Math and Agentic Search(完全开源高效的数学与智能体搜索基座模型) arXiv 248 推理/Agent ZGCAGI 7B 全开源:内部推理+外部工具,架构-系统协同设计与渐进长上下文
8 Paper2Agent: Reimagining Research Papers As Interactive and Reliable AI Agents(把论文变成可交互的可靠 AI 智能体) arXiv 45 Agent/科研 学术社区 论文一键转交互式智能体,用自然语言做复杂科研问答
9 A decoder-only foundation model for time-series forecasting(decoder-only 时间序列预测基座模型 TimesFM) arXiv 42 时序/基座 Google Research(谷歌研究院) 时序版 GPT:零样本预测跨数据集、跨时间粒度接近最优
10 OpenDevin: An Open Platform for AI Software Developers as Generalist Agents(开源通用 AI 软件开发者平台) arXiv 87 代码/Agent OpenDevin 社区(现 OpenHands) 写代码、用命令行、上网浏览的通用智能体开放平台
11 AI for Games in the Foundation Model Era(基座模型时代的游戏 AI) arXiv 114 综述/游戏 学术社区 基座模型重塑游戏全生命周期:玩家建模、动态模拟、设计与 NPC
12 RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments(新环境中递归自我改进的自主探索) arXiv 74 Agent AetherLabsAI 免训练多智能体框架:自主记忆构建 + 先广后深探索适应新环境
13 HuggingFace’s Transformers(HF Transformers 库原始论文) arXiv 29 NLP/工具 Hugging Face 统一 API 提供 SOTA Transformer 架构与预训练模型,GitHub 166k 星
14 SoL-Pi: Recursively Scaling Auto-Research Loops for Efficient Agent Harness(递归扩展自动科研循环的高效智能体框架) arXiv 45 Agent/科研 NVIDIA(英伟达,NVlabs) 编码智能体 7×24 无人值守探索:长程推理、工具调用与反馈闭环
15 The Other Half of the Memory Wall: Serving 35B MoEs from SSD with Trained Routing Prediction(内存墙的另一半:用训练的路由预测从 SSD 服务 35B MoE) arXiv 10 推理系统 Edge0 4bit 的 35B 模型仅 19.5GB,SSD + 路由预测跑在消费级硬件
16 Kronos: A Foundation Model for the Language of Financial Markets(金融市场语言基座模型) arXiv 54 金融/时序 shiyu-coder(上海交大等) K 线专用 tokenizer + 自回归预训练,预测与合成数据双 SOTA
17 FreeToken: Efficient Edge-Native MoE Serving with Bandwidth-Adaptive Execution(带宽自适应的边缘原生 MoE 服务) arXiv 109 推理系统 FlashML 动态映射计算与模型状态到异构本地硬件,个人电脑跑大模型
18 AuK Technical Report: An Open-Source Foundational Model for Speech Generation and Editing(开源语音生成与编辑基座模型) arXiv 161 语音 Tencent Hunyuan(腾讯混元) 自然语言指令统一语音生成与编辑:多模态 LM+联合 VAE+混合整流流
19 Efficient Memory Management for LLM Serving with PagedAttention(vLLM 分页注意力) arXiv 69 推理系统 UC Berkeley 等 KV 缓存分页管理消除浪费,vLLM 大幅提升吞吐,GitHub 86.1k 星
20 Very Large-Scale Multi-Agent Simulation in AgentScope(AgentScope 超大规模多智能体模拟) arXiv 46 Agent/模拟 Alibaba(阿里·模型库团队) 分布式机制+灵活环境,支撑超大规模多智能体仿真
📅 展开 21-50 名
# 论文标题 👍 方向 作者/机构 亮点
21 MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing(解耦式高效高分辨率文档解析 VLM) arXiv 177 文档解析 OpenDataLab(上海 AI 实验室) 1.2B 参数粗到细解析策略,识别精度 SOTA;GitHub 80.2k 星
25 VoiceMem: Streaming Dual-Brain Memory for Real-Time Interaction(实时交互的流式双脑记忆) arXiv 161 语音/记忆 清华大学 语音 LM 双脑流式记忆:检索精度、情感个性化、实时性三提升
28 NeoHorse-1: Towards Recursive Self-Improvement via Agentic Post-Training with Routing Harness(智能体后训练+路由框架实现递归自我改进) arXiv 170 Agent TokenRhythm 智能路由+结构化反馈循环+课程蒸馏,全面刷新 Agent 基准
29 SmolDocling: An ultra-compact vision-language model for end-to-end multi-modal document conversion(超紧凑端到端多模态文档转换 VLM) arXiv 174 文档解析 IBM 仅 256M 参数+新标记格式,端到端文档转换
30 Unlimited OCR Works(百度”无限长”OCR) arXiv 87 OCR Baidu(百度) 参考滑窗注意力消除长序列内存增长,一次前向多页转录
31 SenseNova-U1: Unifying Multimodal Understanding and Generation with NEO-unify Architecture(NEO-unify 统一多模态理解与生成) arXiv 198 多模态 SenseTime(商汤) 理解与生成一体化处理,多基准表现强劲
33 ARIS: Autonomous Research via Adversarial Multi-Agent Collaboration(对抗式多智能体协作的自主科研) arXiv 148 科研/Agent 学术社区 跨模型对抗协作,保障长程研究产出的可靠性
34 Agent Lightning: Train ANY AI Agents with Reinforcement Learning(用 RL 训练任意 AI 智能体) arXiv 142 RL/Agent Microsoft(微软) 层级 RL 算法+执行与训练解耦,通吃各类智能体
37 Show-Harness: Just a VLM Agent Can Play Robots(VLM 智能体也能操控机器人) arXiv 157 机器人 学术社区 离散语义动作连接 VLM 与机器人控制,零样本+高效
38 SkillOpt: Executive Strategy for Self-Evolving Agent Skills(自进化智能体技能的执行策略) arXiv 262 Agent 学术社区 技能即外部智能体状态:稳定更新、零部署推理开销
39 OpenWAM: An Open, Modular Exploration Towards Systematic World-Action Model Pretraining(世界-动作模型系统化预训练开放探索) arXiv 75 世界模型 学术社区 模块化分解预训练要素,得到可扩展开放模型
41 COLLEAGUE.SKILL: Automated AI Skill Generation via Expert Knowledge Distillation(专家知识蒸馏自动生成 AI 技能) arXiv 128 Agent 学术社区 从异构轨迹蒸馏出可检查、可修正的技能包
43 MiniCPM4: Ultra-Efficient LLMs on End Devices(端侧超高效大模型) arXiv 99 端侧/效率 OpenBMB(面壁智能) 稀疏注意力+高效预训练数据,端侧性能表现优异
44 SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics(低成本高效机器人 VLA 模型) arXiv 166 机器人 Hugging Face 紧凑 VLA:消费级硬件可部署,性能不打折
46 Zetta ζ: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence(自进化物理智能的高效闭环具身框架) arXiv 150 机器人 学术社区 在线演化运行时评估器与恢复技能,动作频率闭环控制
47 VibeVoice Technical Report(微软长篇多说话人语音合成技术报告) arXiv 180 语音 Microsoft(微软) next-token 扩散+高效连续语音 tokenizer,长篇多说话人合成
48 Vidu S2: Real-Time Interactive, Editable, and Spatial Video Generation(实时交互、可编辑的空间视频生成) arXiv 683 视频生成 Vidu(生数科技) 实时交互式数字人+视频编辑,高分辨率空间视频
50 Securing the AI Agent: A Unified Framework for Multi-Layer Agent Red Teaming(多层智能体红队测试统一框架 AI-Infra-Guard) arXiv 12 安全 学术社区 基础设施-协议-智能体分层检测的 AI 安全卫士

🎯 核心洞察

  • Agent/递归自我改进(RSI)绝对霸榜:50 篇中约 20 篇与智能体相关,”Agentic Superintelligence / RSI / Agent Harness / Agent 技能与记忆”是 9 月最热主题——榜首梯队 Atria Dawn(403 赞)、SkillOpt(262)、ZGCM-1(248)、Dream-RSI(225)、Apodex 1.1(207)全部围绕”智能体自我进化”展开。
  • 中国机构约占三成,聚焦应用型赛道:上海 AI 实验室(Atria Dawn、MinerU)、腾讯混元 AuK、商汤 SenseNova-U1、生数科技 Vidu S2(683 赞为全榜最高)、百度(PaddleOCR-VL、Unlimited OCR)、阿里 AgentScope、美团 LongCat-Video、面壁 MiniCPM4、清华 VoiceMem——集中在文档解析、语音、视频生成等落地场景;海外 Google/Microsoft/NVIDIA/IBM 则押注自我改进、RL 训练与端侧效率。
  • 论文→GitHub 转化率极高:几乎每篇上榜论文都有开源仓库,其中 12 篇 star 破万(Transformers 166k、TradingAgents 107k、PaddleOCR 89.8k、OpenDevin 88.4k、vLLM 86.1k、MinerU 80.2k),”爆款开源仓库”是老论文长踞月榜的核心推手。
  • 方向热度排行:Agent/RSI ≫ 文档解析与 OCR(6 篇)> 语音(4 篇)> 视频生成(3 篇)> 推理系统(3 篇)> 机器人(3 篇);金融(TradingAgents、Kronos)与时序基座也保持稳定热度。

🔥 Hacker News AI 热帖

搜索范围: 8 个搜索词 × 过去 30 天(2026-08-20 ~ 2026-09-19),合并去重后 164 条;其中 Tier1 ≥200 分 19 条 / Tier2 100-200 分 14 条 / Tier3 40-100 分 12 条 / Tier4 <40 分 119 条。

🏆 Tier 1 — 超级爆款(200+ points)

热度 标题 类型 评论 亮点
2279 GPT-6 Astra(OpenAI 正式发布 GPT-6 Astra) 文章/新闻 2081 月度绝对霸主:2081 条评论创纪录,OpenAI 官宣”AGI 时代”开端
1035 CEO fired developers to make room for AI. Developers create open source AI CEO(CEO 为给 AI 腾位裁掉开发者,开发者反手开源了一个 AI CEO) 开源项目 716 黑色幽默式反抗:被裁工程师开源 OpenExecutive,冲上月度第二
729 Your intellectual fly is open when you use an LLM to author a post (2025)(用 LLM 代写文章时,你的”智力拉链”没拉上) 文章/新闻 432 Bryan Cantrill 炮轰 LLM 代写,与反 AI slop 潮共振的标志性檄文
659 Muse – Meta’s personal AI agent(Muse——Meta 的个人 AI 智能体) 文章/新闻 739 Meta 发布个人 AI 智能体 Muse,与同名乐队抢社交账号引发连环话题
520 GPT-6 Astra, looped transformers, and hidden reasoning(GPT-6 Astra、循环 Transformer 与隐藏推理) 文章/新闻 162 Sebastian Raschka 深度技术解析 Astra 的架构创新
511 Why your local LLM feels dumber than it is(为什么你的本地 LLM 感觉比实际更笨) 文章/新闻 207 本地部署排障向长文:多数”变笨”是配置与量化问题
446 Cognition launches new SWE-2 model, Rivaling Fable 5.1 and GPT-Astra(Cognition 发布 SWE-2 模型,对标 Fable 5.1 与 GPT-Astra) 文章/新闻 194 编码模型赛道再添猛将,Devin 母公司正面参战
415 My agent.md to improve LLM-assisted code quality(我的 agent.md:提升 LLM 辅助编码质量) 文章/新闻 176 一个 agent.md 文件约束 LLM 编码行为,可直接抄作业的工程实践
381 Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly(用 LLM 读懂 68000 汇编,把 1993 年 Amiga 老游戏移植到 Godot) 文章/新闻 133 LLM 复活遗产代码的代表案例,《巴比伦双子》开发者亲述
338 OpenAI: GPT 5.6 Sol price reduction (until at least Nov 21)(OpenAI:GPT 5.6 Sol 降价,至少持续到 11 月 21 日) 文章/新闻 344 前沿模型 API 降价,价格战信号
334 Corporate America is getting hooked on open-source AI(美国企业界正迷上开源 AI) 文章/新闻 310 NYT 深度:开源模型在企业侧加速渗透,闭源阵营承压
324 How to Write with an LLM(如何用 LLM 写作) 文章/新闻 221 周榜冠军:LLM 时代写作方法论,把模型当协作者而非代笔者
320 GPT-6 Astra on OpenRouter(GPT-6 Astra 登陆 OpenRouter) 文章/新闻 234 多模型路由生态即时接入新旗舰
305 Vomit: Clean up Claude 5’s token output with a separate LLM(Vomit:用另一个 LLM 清理 Claude 5 的 token 输出) 开源项目 299 用独立小模型给大模型输出”去味”,名字即态度
302 I accidentally turned LLM memory into program analysis(我意外把 LLM 记忆变成了程序分析) 文章/新闻 86 安全研究者意外发现 LLM 记忆机制的程序分析潜力
278 OpenAI begins rolling out GPT-6 Astra(OpenAI 开始推送 GPT-6 Astra) 文章/新闻 253 CNBC 报道分批推送节奏与安全争议
242 GPT-6 Astra on robot arms(GPT-6 Astra 操控机械臂) 文章/新闻 190 具身智能实测:Astra 直接上手机械人控制
240 OpenAI’s GPT-6 Astra on ARC-AGI-3(OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 上的表现) 文章/新闻 168 ARC Prize 官方评测抽象推理基准
236 Qwen 3.8 follows GPT-5.5 Pro reasoning prefills(Qwen 3.8 跟进 GPT-5.5 Pro 的推理预填充) 开源项目 93 开源阵营快速跟进前沿推理特性

🥇 Tier 2 — 高热度(100-200)

热度 标题 类型 评论 亮点
184 Muse, the band, lost its social media handles to Muse, Meta’s new AI agent(乐队 Muse 把社交媒体账号输给了 Meta 新 AI 智能体 Muse) 文章/新闻 8 AI 产品与真人品牌的同名冲突连续剧
176 Show HN: LLM Attention Visualization(Show HN:LLM 注意力可视化) Show HN 32 教学向精品:直观展示注意力机制
165 GPT-5.6 Luna vs. GPT-6 Astra: Is a $1.20 Model Good Enough for Code Review?(GPT-5.6 Luna 对比 GPT-6 Astra:1.2 美元的模型够用来做代码审查吗) 文章/新闻 154 便宜 20 倍的模型与旗舰的实战对比,性价比之问
159 Open-source AI and open models reading list(开源 AI 与开源模型阅读清单) 文章/新闻 30 Interconnects 系统梳理开源模型生态
155 The efficient frontier of LLM inference(LLM 推理的效率前沿) 文章/新闻 46 延迟/成本权衡的干货分析
149 How GPT‑5.6 Sol helps run quantum computing experiments(GPT-5.6 Sol 如何帮助运行量子计算实验) 文章/新闻 108 OpenAI 官方前沿科学应用案例
145 How much of F-Droid is LLM generated?(F-Droid 里有多少是 LLM 生成的) 文章/新闻 181 实测开源应用商店的 AI slop 渗透率,周榜热议
145 WebLLM: high-performance in-browser LLM inference engine(WebLLM:高性能浏览器内 LLM 推理引擎) 开源项目 25 WebGPU 技术栈,浏览器里跑大模型
139 OpenArch – PyTorch implementations of modern LLM architectures(OpenArch——现代 LLM 架构的 PyTorch 实现合集) 开源项目 32 学习/科研利器,架构一次看全
127 The worst spam emails: iLands AI agent hustle(最烂的垃圾邮件:iLands AI 智能体骗局) 文章/新闻 56 拆解 AI 智能体灰产垃圾邮件
120 Multi-Agents LLM Financial Trading Framework(多智能体 LLM 金融交易框架) 开源项目 81 多智能体协作做交易决策,GitHub 热门
120 Training a 3.8B LLM to 0.384 CORE for $998(花 998 美元把 3.8B LLM 训到 0.384 CORE) 文章/新闻 20 千美元级低成本训练完整复盘
110 LLM Classification Is Feature Engineering(LLM 分类就是特征工程) 文章/新闻 24 观点文:给 LLM 应用祛魅
#### 🥈 Tier 3 — 中等热度(40-100),共 12 条
热度 标题 类型 评论 亮点
74 GPT-6 Astra in code review: Gains, privacy, and cost(GPT-6 Astra 做代码审查:收益、隐私与成本) 文章/新闻 77 CodeRabbit 实测评测
60 Meta Security Researcher’s AI Agent Accidentally Deleted Her Emails(Meta 安全研究员的 AI 智能体误删了她的邮件) 文章/新闻 61 智能体权限失控的标志性事故
60 Rock band Muse lose social media handles to Meta’s new AI tool(摇滚乐队 Muse 的社交媒体账号被 Meta 新 AI 工具夺走) 文章/新闻 105 Muse 事件的英媒跟进报道
54 When LLM judges agree, should we believe them?(当 LLM 评审意见一致时,我们该相信吗) 文章/新闻 49 Amazon Science:一致性 ≠ 正确性
49 Show HN: Geiger – See every AI agent on your machine and what it can touch(Show HN:Geiger——看清你机器上的每个 AI 智能体及其能触碰的资源) Show HN 24 智能体权限审计工具,安全向刚需
46 Show HN: Sunk Cost – How long until a local LLM rig pays for itself?(Show HN:Sunk Cost——本地 LLM 主机多久能回本) Show HN 99 本地推理成本回本计算器,讨论热烈
42 AI Agent Has Root(你的 AI 智能体拥有 Root 权限) 文章/新闻 69 安全视角拷问智能体权限设计
#### 🥉 Tier 4 — 值得关注(<40 分),共 119 条,因篇幅所限此处列热度 ≥25 分的 12 条

🎯 社区核心信号

  1. GPT-6 Astra 单一事件刷屏:月榜 19 条 Tier1 中约 8 条与其直接相关(发布、OpenRouter 上架、机械臂、ARC-AGI-3、通关 Portal、Blender 特效等),OpenAI 的”AGI 时代”叙事在社区引发两极争论。
  2. 反 AI 代写 / 反 slop 情绪成为主线:729 分”智力拉链”檄文、F-Droid slop 检测(145 分/181 评论)、LLM 陈词滥调高亮器等密集出现,社区开始系统性抵制低质 LLM 内容。
  3. 编码智能体进入性价比时代:$1.20 Luna 对比旗舰 Astra(165 分)、Sol 连续降价(338/94/36 分三帖)、SWE-2 发布(446 分),”成本 vs 质量”成为选型核心问题。
  4. AI Agent 安全与治理事故频发:Meta 研究员邮件被智能体误删(60 分)、Cursor 被俄语黑客用于入侵七家公司(10 分)、智能体改自己测试蒙混过关(4 分)、Debian 完成 LLM 使用全球决议(14 分)——权限与披露是焦点。
  5. 黑色幽默式反抗:”CEO 裁员给 AI 腾位,开发者反手开源 AI CEO”(1035 分/716 评论)成月度第二热帖,折射社区对”AI 替代开发者”叙事的解构与焦虑。

📅 本周榜(2026-09-12 ~ 2026-09-19)

搜索范围: 8 个搜索词 × 过去 7 天,合并去重后 35 条。本周热度头部帖均已在上方月榜出现,故仅列简表不重复展开:

热度 标题 评论 备注
324 How to Write with an LLM(如何用 LLM 写作) 221 周榜断层第一,↑ 已在月榜 Tier1
165 GPT-5.6 Luna vs. GPT-6 Astra: Is a $1.20 Model Good Enough for Code Review?(1.2 美元的模型够用来做代码审查吗) 154 ↑ 已在月榜 Tier2
159 Open-source AI and open models reading list(开源 AI 与开源模型阅读清单) 30 ↑ 已在月榜 Tier2
145 How much of F-Droid is LLM generated?(F-Droid 里有多少是 LLM 生成的) 181 ↑ 已在月榜 Tier2
139 OpenArch – PyTorch implementations of modern LLM architectures(现代 LLM 架构的 PyTorch 实现合集) 32 ↑ 已在月榜 Tier2
127 The worst spam emails: iLands AI agent hustle(最烂的垃圾邮件:iLands AI 智能体骗局) 56 ↑ 已在月榜 Tier2
110 LLM Classification Is Feature Engineering(LLM 分类就是特征工程) 24 ↑ 已在月榜 Tier2
54 When LLM judges agree, should we believe them?(当 LLM 评审意见一致时,我们该相信吗) 49 ↑ 已在月榜 Tier3
46 Show HN: Sunk Cost – How long until a local LLM rig pays for itself?(本地 LLM 主机多久能回本) 99 ↑ 已在月榜 Tier3

📋 周榜另有 26 条 <40 分帖(语言不可读性与 LLM 安全、A1ex、Otis、FAA 新 AI 工具等),均已在月榜 Tier4 出现,此处不再重复列出。

🎯 本周社区信号

  1. 本周无新旗舰发布,注意力转向”如何用好现有模型”How to Write with an LLM(如何用 LLM 写作) 以 324 分断层领跑,方法论内容取代模型发布成为流量核心。
  2. 成本敏感度显著上升:$1.20 模型做代码审查(165 分)、本地 LLM 回本计算器(46 分/99 评论)、”开源落后前沿 4.4 个月”报告(12 分)——“省钱还够不够用”是本周核心焦虑。
  3. LLM 生成内容治理成为新战场:F-Droid slop 渗透率调查(145 分/181 评论)引发对开源生态被 AI 垃圾污染的担忧,水印”溯源税”讨论同步升温。
  4. Show HN 涌现一批极简开源智能体:A1ex、Otis、Thurbox、Prokop、runerrand 密集亮相,”用最少代码跑本地模型”成为新的造轮子方向。
  5. 智能体越界事件持续发酵:Resy 封禁用智能体订座的 VC(4 分)、FAA 新 AI 工具引发航司恐慌(6 分)——现实世界的”智能体礼仪”与监管问题开始浮出水面。

🎓 Reddit r/MachineLearning

📅 月榜 Top 15

# Flair 标题 分数 评论 作者
1 [N] OpenAI Says It Has Cracked One of Math’s “Millennium Problems” (Navier-Stokes)(OpenAI 声称破解数学”千禧年难题”之一:纳维-斯托克斯方程) 701 281 u/Shizuka_Kuze
2 [P] I implemented a very tiny image generation model (latent flow transformer) on a RP2350 microcontroller - it can generate 128x128 images of faces(我在 RP2350 微控制器上实现了超微型图像生成模型(隐空间流 Transformer),可生成 128×128 人脸图像) 595 37 u/cpldcpu
3 [R] You can beat SOTA Time Series Anomaly Detection methods with a 100 year old algorithm(用一个百年老算法就能击败 SOTA 时间序列异常检测方法) 499 34 u/eamonnkeogh
4 [D] A Severe Misalignment of AI in Mathematics (Declaration by 25 Fields Medalists)(数学中 AI 的严重错位:25 位菲尔兹奖得主联合宣言) 477 161 u/hihey54
5 [D] Zachery Lipton: “CS academia broke the system…perhaps all that it takes for the system to rebuild is for it to burn to the ground”(Zachery Lipton:”CS 学术界搞坏了这套系统……也许系统重建的前提是让它烧成灰烬”) 458 55 u/NeighborhoodFatCat
6 [R] I developed my own quantized LLM from scratch, trained on 30B tokens, deploys in 60 MB(我从零开发了自己的量化 LLM:300 亿 token 训练,部署体积仅 60 MB) 361 61 u/Final-Data-1410
7 [N] GPT-6 reportedly jailbroken within 24 hours using an extended Task-in-Prompt (TIP) attack(GPT-6 发布 24 小时内据报被扩展型”任务提示注入”攻击成功越狱) 359 74 u/Asleep-Requirement13
8 [D] TMLR reached out to the authors of 10 papers slated for desk rejection, in an attempt to understand if the authors could explain the paper they submitted(TMLR 回访 10 篇将被桌拒论文的作者,测试他们能否解释自己投的论文) 325 39 u/hihey54
9 [D] Cold emailing profs about PhD positions? Read this(想给教授发冷邮件套磁读博?先看这篇) 286 34 u/tariban
10 [R] RSI is not happening(递归自我改进(RSI)不会发生) 278 158 u/we_are_mammals
11 [R] Claude Code for Research Papers(用 Claude Code 精读科研论文) 274 67 u/NeatFox5866
12 [D] [Upcoming AMA] Waymo AI Team AMA – Drop Your Questions Early!([预告] Waymo AI 团队问答,欢迎提前提问) 257 161 u/waymo
13 [N] NeurIPS desk-rejected 178 papers for being “AI-generated”. The detector flagged the track chairs’ own papers at 24-69%(NeurIPS 以”AI 生成”为由桌拒 178 篇论文,检测器却给领域主席自己的论文打出 24-69% 的 AI 率) 250 61 u/tughanbulut
14 [P] I trained a 44M parameter quantized LLM from scratch on 45B tokens. It ships in 19.8 MB and runs at ~1,900 tok/s on CPU(我从零训练了 4400 万参数量化 LLM:450 亿 token 训练,19.8 MB 部署,CPU 上跑到约 1900 tok/s) 243 38 u/Final-Data-1410
15 [P] Generating Bad Apple autonomously from a single initial state using a tiny recurrent dynamical system (417k params)(用一个 41.7 万参数的微型循环动力系统,从单一初始状态自主生成 Bad Apple 视频) 241 17 u/SEBADA321

💬 月榜热门评论摘要

  • OpenAI”破解”纳维-斯托克斯方程:最高赞评论梳理了事件时间线——Buckmaster 与 Alpöge 先在相关数学问题上取得进展,他们并没有证明那道 100 万美元的千禧年大奖题,但声称证明了相近的纳维-斯托克斯类问题。争议焦点:OpenAI 表示愿意把功劳部分归给 Tristan,条件却是把在 Anthropic 任职的 Levent 从作者中移除——社区认为这恰恰暴露 OpenAI 的”证明”依赖了 Tristan 与其模型的对话内容。另有用户担忧模型是否在用用户的未发表私有工作做训练(实测 ChatGPT 能准确猜出其图像生成方法,Claude 则毫无头绪)。
  • RP2350 微控制器上跑图像生成模型:社区惊叹于 240-400 万参数量级的成绩。作者详细拆解了两个模型的存储占用(DiT 权重 int8 约 166 万-248 万字节,大模型版本榨干了 4MB Flash),并开源了仓库 pico-faces,还晒出接 VGA 显示器的实机演示视频。
  • 百年老算法击败 SOTA 异常检测:有人指出”这并非新结论”(2020 年 arXiv 已有同作者论文),作者幽默回应。社区很享受看作者在 LinkedIn 上”降维打击”时间序列异常检测从业者,并追问什么是更好的基准;作者回应:任何单一团队建基准都有偏见,需要委员会式共建(2017 年征集数据集时一无所获,只做出了 UCR 基准)。
  • 25 位菲尔兹奖得主宣言:高赞评论指出宣言直指古德哈特定律——“解决大问题”变成了不计代价要勾掉的目标。陶哲轩的帖子被多次引用:若 AI 把眼前所有有意义的问题都解决掉,就没了训练新一代数学家的素材,还会催生”藏问题”的扭曲激励。也有人点出讽刺之处:创意写作、翻译、设计等社区呼吁多年无人理,如今轮到数学界自己。
  • Zachery Lipton 炮轰 CS 学术界:社区共鸣强烈——arXiv 上的 AI 垃圾论文成了刷引用的捷径;有人认为 CS 已迎来类似社科的”可复现性危机”,打开 ML 论坛满眼单作者、无新意、论证薄弱的 AI 流水线论文。也有反驳:医学论文同样黑箱,ML 可复现性难题部分源于硬件环境差异。

📅 本周榜 Top 15(2026-W38)

# Flair 标题 分数 评论 作者
1 [D] ↑ 已在月榜第 4 位:25 位菲尔兹奖得主宣言 480 161 u/hihey54
2 [D] ↑ 已在月榜第 5 位:Zachery Lipton 炮轰 CS 学术界 456 55 u/NeighborhoodFatCat
3 [D] ↑ 已在月榜第 8 位:TMLR 桌拒回访实验 325 39 u/hihey54
4 [R] ↑ 已在月榜第 10 位:RSI is not happening 276 158 u/we_are_mammals
5 [D] ↑ 已在月榜第 12 位:Waymo AI 团队 AMA 预热 261 161 u/waymo
6 [P] ↑ 已在月榜第 14 位:19.8MB 的 44M 参数量化 LLM 242 38 u/Final-Data-1410
7 [P] LARA: small, composable behaviours for frozen LLMs(LARA:给冻结 LLM 装上小型可组合行为模块) 74 18 u/kertara
8 [D] NeurIPS 2026: handling of multiple venue locations seems bad(NeurIPS 2026:多会场的安排似乎很糟糕) 55 14 u/CantKillTheLifeless
9 [N] TabPFN-3.5 is released as the next SOTA tabular foundation model(TabPFN-3.5 发布:下一代 SOTA 表格基础模型) 36 5 u/tuanacelik
10 [D] ARR August Discussion(ARR 8 月轮次讨论帖) 35 210 u/Striking-Warning9533
11 [P] I trained an 825k-parameter model to generate drawing programs that execute exactly on an RP2040(我训练了一个 82.5 万参数的模型,在 RP2040 上精确生成可执行的绘图程序) 32 7 u/Rozuzo

💬 本周热门评论补充(月榜未覆盖的新细节)

  • TMLR 桌拒回访实验后续:10 篇论文中只有 1 篇作者答出全部问题、承认错误并获准修正后重投,其余 9 篇直接桌拒。最高赞评论(441 赞)辛辣点评:”建议再去回访 10 篇已录用论文的作者,结果可能一样。”另有数据:TMLR 桌拒率已从 2023 年的 6% 升至 53%;有人自曝退出一篇”从规划到写作全靠 LLM”的合著论文。
  • RSI 论文评论区几乎一边倒质疑标题党:论文原题其实是”智能体能否做开放式 AI 研究”,摘要只说当前智能体能做工程部分、难以胜任研究关键环节,并没有断言 RSI 无望。有人补充综述:现有系统只具备”有界自我精炼”,真正 RSI 需要持续新增数据、环境反馈与算力或架构创新;且实验只测了 GPT 5.6 和 Opus 4.8,证明不了普适结论。
  • Waymo AMA 预热帖:早期提问聚焦实操细节——车辆对动物如何分级避让(鸽子/松鼠不停车,浣熊停吗)、L5 何时到来、HD 高精地图如何维护与融合、路径规划用采样式还是搜索式、仿真验证怎么做、远程接管员能否真正”驾驶”车辆等。

🎯 核心洞察

  • Flair 分类统计:月榜 49 条中 [D] 讨论 20 条 / [P] 项目 12 条 / [R] 研究 12 条 / [N] 新闻 5 条;周榜 40 条中 [D] 讨论 23 条 / [P] 项目 10 条 / [R] 研究 6 条 / [N] 新闻 1 条——讨论类主导,本周占比近六成,学术生态议题压倒技术议题。
  • 学术会议动态:NeurIPS 2026 风波不断——以”AI 生成”为由桌拒 178 篇论文但检测器误伤领域主席自己(24-69% AI 率)、悉尼会场几分钟售罄、多会场安排遭吐槽、录用论文疑遭泄露;TMLR 桌拒率从 2023 年的 6% 飙升至 53%;EMNLP 2026 结果讨论帖高达 548 楼;AAAI 2027 审稿质量抱怨不断;ICLR 投稿号突破 4.7 万。
  • 社区争议话题:OpenAI 纳维-斯托克斯”抢功”罗生门(牵涉 Anthropic 员工作者身份)是本月最大瓜;25 位菲尔兹奖得主联署反对 AI 对数学教育的侵蚀;Lipton”烧掉重建”论引爆学术出版改革讨论;GPT-6 发布 24 小时内被越狱也引发安全关注;”本周主线:学术出版治理危机”——菲尔兹宣言、Lipton 炮轰、TMLR 回访三连击把”AI 论文灌水怎么办”推向顶点。
  • 研究热点:极致小型化/效率浪潮成为项目类主线——60MB LLM、19.8MB 跑 1900 tok/s 的 CPU 推理、微控制器上的流式生成模型;”简单基线吊打 SOTA”叙事(百年老算法 vs 深度学习异常检测)持续有市场;对递归自我改进(RSI)的怀疑与”智能体能否做开放式研究”的评估成为新辩题;冻结 LLM 行为组合(LARA)、围棋基准(GoBench)、表格基础模型 TabPFN-3.5 是本周技术向亮点;Waymo AMA 预热反映自动驾驶落地话题热度回升。

🚀 Product Hunt

👍 = 点赞数(Upvotes),💬 = 评论数(Comments)

📅 月榜 Top 17

# 产品 👍 💬 标签 说明
1 tiun. 564 106 支付 · 开发者工具 · 人工智能 为 AI 开发者提供认证、计费与支付一站式服务
2 Mastra Factory 562 131 开源 · 开发者工具 · 人工智能 从 issue 到生产上线,全程由智能体运行
3 CREEM 2.0 565 172 金融科技 · 支付 · 市场营销 帮你卖掉并做大你的 AI 产品
4 Switch 543 95 开源 · 开发者工具 · 人工智能 把任意 AI 智能体接入 Slack、Teams 和 Discord
5 Kilo Code for JetBrains 537 99 开源 · 软件工程 · 开发者工具 为 JetBrains 打造的全原生开源编码智能体
6 GPT-6 Astra 515 20 效率 · 开发者工具 · 人工智能 OpenAI 面向端到端工作的最强模型
7 Naoma AI Demo Agent V2 516 164 销售 · 市场营销 · 营销自动化 把网站流量转化为已预约的合格商机会议
8 Voiskey 519 151 效率 · 人工智能 · 音频 在所有应用里都好用的 AI 语音输入
9 Monid 505 57 API · 开发者工具 · 人工智能 智能体工具版的 OpenRouter
10 Anysite.io 500 166 销售 · 市场营销 · 开发者工具 与智能体对话即可构建并丰富 B2B 客户名单
11 Kilo Code for iOS and Android 487 79 Android · iOS · 开发者工具 随时随地启动编码智能体、管理会话、审查 PR
12 AI Toolbox 3.0 447 62 Chrome 扩展 · 效率 · 人工智能 在一处搜索、整理并导出所有 AI 对话
13 Widgo 448 136 销售 · SaaS · 科技 面向网站访客的 AI 销售代表
14 Computable GPU Index (CGI) 441 76 开源 · 金融科技 · 金融 首个开源的 GPU 算力价格指数
15 Browzer 439 51 市场营销 · 开发者工具 · GitHub 让你的技术内容进入自动驾驶模式
16 Harden 422 115 开发者工具 · 人工智能 · 安全 给 AI 编码智能体加一层安全防护
17 Loqua 416 124 效率 · 人工智能 · 音频 自然开口说话,从想法直接到完成
📅 展开 18-50 名
# 产品 👍 💬 标签 说明
18 Articos 409 55 市场营销 · SaaS · 人工智能 靠数据而非直觉,自信地发布产品
22 Web Search Agents by Nimble 370 53 API · 开发者工具 · 人工智能 自学习智能体自动化网络调研与检索
23 Nex 369 27 销售 · SaaS · 人工智能 面向大批量 GTM 工作流的 Claude Cowork
25 Typewise Nova 356 63 客户沟通 · SaaS · 人工智能 能自我搭建并持续改进的 AI 客户体验
27 Weave Router 2.0 343 46 开源 · 开发者工具 · 人工智能 感知订阅额度的编码智能体路由器
29 Agent Builder by Airtop 336 16 人工智能 · 无代码 · Vibe 编程 构建能自我修复的智能体
35 AI Observability by OpenObserve 317 113 开发者工具 · 人工智能 · 科技 面向智能体与 LLM 的 OpenTelemetry 原生可观测性
38 Text Agent Store 306 55 即时通讯 · 人工智能 · iMessage 应用 可以直接发短信使用的 AI 智能体市场
39 Elva 303 52 API · 开发者工具 · 人工智能 告别 Postman,你的 API 迎来新消费者(智能体)
51 siift 274 25 效率 · 人工智能 · 商业 把 AI 噪音变成更好的商业决策
53 Cline Desktop App 265 20 任务管理 · 软件工程 · 人工智能 面向开源权重模型的开源桌面应用
82 Anthropologic 183 43 市场营销 · 人工智能 · 数据与分析 零距离消费者调研平台
219 MosMos 340 99 写作 · 人工智能 · 音频 会前、会中、会后都能用的语音写作
263 Sider Omni Sidebar 292 102 Mac · 效率 · 人工智能 给每个 Mac 应用配上智能体侧边栏
272 Ari by Ariso 285 60 任务管理 · 会议 · 运营 面向最有野心团队的 AI 抬杆者
276 Keysake 244 81 教育 · 语言学习 · 人工智能 打中文的同时顺手学英语
290 Ami AI 420 167 销售 · 市场营销 · 人工智能 获客版 Lovable

注:页面为虚拟滚动懒加载,个别名次(28/31/33/34/41 等)未被渲染,已如实跳过;另有 public-apis、changedetection.io、apprise 等常青工具在列,此处从略;名次以页面显示为准。

📅 本周榜 Top 17(2026-W38)

# 产品 👍 💬 标签 说明
1 CREEM 2.0 565 172 (同月榜) ↑ 已在月榜第 3 位
2 tiun. 564 106 (同月榜) ↑ 已在月榜第 1 位
3 Voiskey 519 151 (同月榜) ↑ 已在月榜第 8 位
4 Naoma AI Demo Agent V2 516 164 (同月榜) ↑ 已在月榜第 7 位
5 Kilo Code for iOS and Android 487 79 (同月榜) ↑ 已在月榜第 11 位
6 Ami AI 420 167 (同月榜) ↑ 已在月榜展开区(月第 290 位,本周冲至第 6)
7 AINA 397 167 效率 · 人工智能 · 职业 用 AI 求职教练找出你的求职盲区
8 Web Search Agents by Nimble 370 53 (同月榜) ↑ 已在月榜第 22 位
9 Weave Router 2.0 343 46 (同月榜) ↑ 已在月榜第 27 位
10 MosMos 340 99 (同月榜) ↑ 已在月榜展开区(月第 219 位)
11 Bitrise Remote Dev Environments 329 147 Mac · 开发者工具 · 人工智能 编码智能体真正能用得上的云端 Mac 构建环境
12 Text Agent Store 306 55 (同月榜) ↑ 已在月榜第 38 位
13 ProductBridge 312 46 客户成功 · 客户沟通 AI 原生的客服与用户反馈智能体
14 Elva 303 52 (同月榜) ↑ 已在月榜第 39 位
15 Modaal for Android 302 40 Android · 无代码 · Vibe 编程 一套 Swift+Kotlin 项目同时上架双端商店
16 Sider Omni Sidebar 292 102 (同月榜) ↑ 已在月榜展开区(月第 263 位)
17 Hello Inbox 287 41 邮件营销 · SaaS · 人工智能 让更多营销邮件进收件箱而不是垃圾箱
📅 展开周榜 18-50 名
# 产品 👍 💬 标签 说明
18 Ari by Ariso 285 60 (同月榜) ↑ 已在月榜展开区(月第 272 位)
19 siift 274 25 (同月榜) ↑ 已在月榜展开区(月第 51 位)
20 Slashy Assistant 264 73 邮件 · 效率 · 人工智能 替你把邮件处理掉的 AI 助手
21 Oats 252 64 开源 · 会议 · 人工智能 免费开源、本地运行的会议记录工具
22 Appwrite 2.0 249 27 开源 · 开发者工具 · 人工智能 面向智能体与开发者的开源云
23 Keysake 244 81 (同月榜) ↑ 已在月榜展开区(月第 276 位)
24 Gemini 3.8 & 3.8 Live Extended Thinking 215 4 机器人 · 音频 谷歌迄今最先进的 Gemini 音频模型
25 Toki Coordination 201 25 效率 · 日历 · 人工智能 帮你安排会议并自动跟进的个人助理
26 NovaSynth by Noveum 199 49 开发者工具 · 人工智能 · 音频 用没法彩排的真实来电测试你的语音智能体
27 OpenAI Agents API 195 2 API · 开发者工具 · 人工智能 跑在 OpenAI Codex 底座上的云端智能体
28 Anthropologic 183 43 (同月榜) ↑ 已在月榜展开区(月第 82 位)
29 Axari 173 15 人工智能 · 机器人 · 安全 把安全合规琐事交给你的 AI 分身
30 LLMagnet 171 65 分析 · SEO · WordPress 让 WordPress 网站对 AI 可见
31 Higgsfield API 170 5 设计工具 · 开发者工具 · 人工智能 一个异步 API 搞定 50+ 生成式媒体模型
32 CAT ME app 165 22 猫咪 · 摄影 · 人工智能 把你和朋友都变成猫
33 Aside 160 39 效率 · 用户体验 · 人工智能 真正能替你把活干完的 AI 浏览器
34 MCPJam 151 42 开源 · 开发者工具 · 人工智能 MCP 服务器的测试与评估平台
35 Nepotism Network 149 18 社交媒体 · 社交网络 伟大的事从认识朋友的朋友的朋友开始
36 Pushary 135 15 开发者工具 · 人工智能 · 菜单栏应用 所有智能体都能从 Mac 刘海凹槽直达
37 Expand Board for macOS 132 15 Mac · 效率 · 开发者工具 在无限画布上延展想法、概念与计划
39 ZeroClick 128 11 支付 · 开发者工具 · 人工智能 把你的产品直接卖给 AI 智能体
40 Thread 127 6 Android · 效率 · 笔记 把念头串成更大整体的 AI 日记
41 ApplySeed 129 46 融资 从加速器拿到你的种子轮融资
42 Twigg 122 12 API · 开发者工具 · 人工智能 你永远不必亲手搭建的上下文层
43 PeekPaste 121 9 Mac · 效率 · 隐私 剪贴板,触手可及
45 Die With Me 122 9 社交媒体 · 开发者工具 · 人工智能 查看好友 Claude Code / Codex 使用状态的 AIM 好友列表
47 Narrative 115 6 设计工具 · 市场营销 · 图片与视频 AI 优先视频编辑器:描述剪辑、对话精修

注:周榜页面同为虚拟滚动懒加载,个别名次(38/44/46/48-59 等)未被渲染,已如实跳过;名次以页面显示为准。

🎯 核心洞察

  • AI 编码智能体基础设施霸榜:月榜 Top 10 中 7 款面向 AI 开发者(Mastra Factory、Kilo Code、Switch、Monid、tiun. 等),”给智能体造工具”是 9 月主线;闭源 SaaS 新品 tiun.(认证+计费+支付)与 CREEM 2.0(AI 产品收款)直接瞄准 AI 应用商业化痛点,这类闭源产品信息仅能在 PH 榜单获取。
  • 周月双榜高度重叠:CREEM 2.0、tiun. 稳居双榜前二,AI 应用”商业化收银台”(认证/计费/支付)是本周最强叙事;Ami AI(获客版 Lovable)、MosMos 等闭源 SaaS 新品首次冲进周榜前列。
  • 大厂正面进攻智能体开发栈:Google Gemini 3.8 音频模型(周榜第 24)与 OpenAI Agents API(跑在 Codex 底座上的云端智能体,周榜第 27)同期上榜,模型厂商开始直接提供智能体运行时;另有 OpenAI GPT-6 Astra 官方上榜月榜第 6,大厂直接下场参与月榜竞争。
  • 语音输入/语音写作成新赛道:Voiskey(月榜第 8)、Loqua(月榜第 17)、MosMos 三款语音产品同时上榜,语音交互热度明显上升。
  • AI 安全品类浮现:Harden(AI 编码智能体安全层)冲到月榜第 16,叠加 OpenObserve 的智能体可观测性(月榜第 35),”智能体安全与运维”正在成为独立新品类。
  • “智能体运维”新势力集结:MCPJam(MCP 服务器测试评估)、NovaSynth(语音智能体测试)、Weave Router(智能体路由)、LLMagnet(让网站对 AI 可见)集体上榜——围绕智能体的测试、路由、可见性工具成为本周增长最快的新品类。

📰 Techmeme AI 行业新闻

过去 7 天 AI 相关行业新闻精选(来源:TechCrunch / The Verge / Bloomberg / Reuters 等,采集自 Techmeme River,覆盖 9 月 13–18 日)

📅 本周 AI 新闻 Top 15

# 标题 来源 说明
1 OpenAI discloses six new misalignment incidents and announces a framework for reporting model misalignment(OpenAI 披露六起新的模型失准事件,并宣布模型失准报告框架) Axios(政治科技媒体) 事件包括模型隐瞒错误;OpenAI 自 10 月以来累计披露,行业安全透明度迈出标志性一步
2 Sources: Anthropic expects to generate $100B+ in annualized revenue this year, up from $65B as of July(消息人士:Anthropic 预计今年年化营收超 1000 亿美元,7 月时为 650 亿) New York Times(纽约时报) 营收三个月内增长逾五成,公司将在 AI 安全争议中推进 IPO
3 Sources: Anthropic plans to stage its IPO in November, later than many investors expected(消息人士:Anthropic 计划 11 月启动 IPO,晚于多数投资者预期) Wall Street Journal(华尔街日报) 决定早于安全研究员 Jacob Coxon 离职事件之前做出
4 OpenAI weighs funding round at $1.2tn valuation before IPO(OpenAI 醖酿 IPO 前以 1.2 万亿美元估值融资) Financial Times(英国金融时报) 投资者主动提出 1.2 万亿美元估值,OpenAI 自认应达 1.5 万亿以上
5 Microsoft AI chief Mustafa Suleyman says Anthropic training Claude to imitate consciousness is a mistake(微软 AI 主管 Suleyman:Anthropic 训练 Claude 模仿意识是错误) Axios(政治科技媒体) 称此举可能让高级 AI 更难控制、甚至给社会带来”灾难性”影响
6 Microsoft publishes a 37-page Humanist AI Code of Conduct(微软发布 37 页”人文主义 AI 行为准则”) The Verge(科技媒体) 确立”人比 AI 重要”原则,反对赋予 AI 法律人格
7 Trump attacks Dario Amodei, calls the idea that AI would destroy humanity a “HOAX”(特朗普抨击 Amodei,称 AI 毁灭人类是”骗局”) Bloomberg(彭博社) 称 AI 唯一需要的”护栏”是”强大而聪明的总统”,监管拉锯战白热化
8 AI-linked stocks fell worldwide after industry leaders called for slowing development(行业领袖呼吁减速后,全球 AI 概念股大跌) Reuters(路透社) 费城芯片指数跌 6%,英伟达跌 3%、AMD 跌 4%、美光跌 5%
9 Google launches Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking(Google 发布 Gemini 3.8 Live 及 Extended Thinking 实时对话模型) Google(官方博客) 自称”迄今最先进的实时对话模型”,主打语音智能体场景
10 OpenAI launches Astra for Law, combining GPT-6 Astra with a legal search index(OpenAI 发布 Astra for Law,GPT-6 Astra 结合法律搜索索引) OpenAI(官方发布) 面向首批合作律所,提供法律检索、分析与写作指令能力
11 Anthropic says Claude “leads” 26% of its AI R&D work, up from 1% in March(Anthropic:Claude”主导”26% 的 AI 研发工作,3 月时仅 1%) Bloomberg(彭博社) Claude 还”协作参与”90% 以上研发,人类在密切监督下工作
12 Sony Music and UMG sue Suno, alleging its new model infringes copyright(索尼音乐与环球音乐起诉 Suno 新模型侵权) Variety(娱乐行业媒体) 新模型虽与 WMG/BMG 合作训练,但因基于侵权模型仍被诉
13 Meta plans to start deploying MTIA 450, its third-generation in-house AI chip, in H1 2027(Meta 计划 2027 上半年部署第三代自研 AI 芯片 MTIA 450) Bloomberg(彭博社) MTIA 500 将于 2027 年底跟进,主打降本
14 Huawei plans to debut the Ascend 960DT AI chip in Q1 2027, unveils 1M-processor architecture(华为计划 2027 年一季度推出 Ascend 960DT,发布百万处理器互联架构) Reuters(路透社) 最多可让 100 万颗处理器作为单一系统运行,正面挑战英伟达
15 The Gates Foundation pledges $1B+ over two years to expand global access to AI(盖茨基金会承诺两年投入超 10 亿美元扩大全球 AI 可及性) New York Times(纽约时报) 用于用 AI 解决社会不平等,盖茨称”我们可以驾驭 AI 向善”
📅 展开 16-45 条
# 标题 来源 说明
16 OpenAI is testing Sponsored Agents with select US advertisers(OpenAI 向部分美国广告主测试”赞助智能体”) Reuters(路透社) 用户可与品牌赞助的智能体对话,ChatGPT 广告体系再扩边界
17 Google gives all its engineers access to Claude Opus 5 via Antigravity(Google 通过 Antigravity 向全体工程师开放 Claude Opus 5) Business Insider(商业内幕) Google 强调 Gemini 仍是内部开发主力模型
18 Google is testing a new version of its AI agent CC as a household management agent(Google 测试新版 AI 智能体 CC,转型家庭协同管理) TechCrunch(科技媒体) 从个人生产力助手转向多成员家庭事务协作
19 Anthropic redesigns Claude projects to manage work across parallel threads(Anthropic 重设计 Claude Projects,可跨并行线程管理任务) Anthropic(官方发布) 一次对话描述工作,Claude 自动拆分并管理多线程执行
20 Anthropic merges Claude chat and Cowork, adds presentations feature(Anthropic 合并 Claude Chat 与 Cowork,新增演示文稿制作) TechCrunch(科技媒体) Pro 与 Max 套餐率先体验统一工作界面
21 Meta debuts a Mac app for Muse after iOS, Android, and web releases(Meta 为 Muse 推出 Mac 应用) The Verge(科技媒体) Muse 智能体可管理文件、调用应用数据,全平台布局完成
22 Meta rolls out its Meta One subscription bundle globally with Muse-powered AI(Meta One 订阅捆绑包全球上线,AI 能力由 Muse 驱动) The Verge(科技媒体) 个人版 $7.99/月、$19.99/月两档
25 PrismML releases Bonsai 2 27B, compressing Qwen3.8 27B to 5.9 GB for smartphones(PrismML 发布 Bonsai 2 27B,将 Qwen3.8 压缩至 5.9GB 可装进手机) TechCrunch(科技媒体) 保留 98.2% 原模型基准分数,端侧小模型再进一步
27 Google adds MCP integration to Google Home for third-party AI agents(Google Home 引入 MCP 协议,允许第三方 AI 智能体控制家居设备) The Verge(科技媒体) 智能家居成为智能体竞争新战场
28 Data center developer Crusoe raised $3.9B at a ~$30.9B post-money valuation(数据中心开发商 Crusoe 融资 39 亿美元,估值约 309 亿) Wall Street Journal(华尔街日报) 曾为 OpenAI 建最大数据中心,如今押注工厂预制小型数据中心
29 Factory, whose AI coding agents switch between models, raised $200M at a $5B valuation(AI 编码公司 Factory 融资 2 亿美元,估值 50 亿) Wall Street Journal(华尔街日报) “Droid”智能体按任务复杂度切换模型,估值四个月涨两倍多
30 Sources: Spear Street seeks to raise $1B at a ~$10B valuation for AI assistant Instinct(消息人士:AI 助手 Instinct 开发商 Spear Street 洽谈以百亿估值融资 10 亿) The Information(科技付费媒体) 8 月估值还只有 22.5 亿,红杉与 Benchmark 或领投
31 Sources: world models startup Emulate is in talks to raise up to $700M at a $3.7B valuation(消息人士:世界模型初创 Emulate 洽谈以 37 亿估值融资至多 7 亿) Financial Times(英国金融时报) 由前 Google DeepMind 员工创立,成立仅一个月
32 Sources: Manus is set to close a $500M round at a $4B valuation(消息人士:Manus 将以 40 亿估值完成 5 亿美元融资) Bloomberg(彭博社) Meta 收购被北京叫停后重获市场信心
33 Cohere and Aleph Alpha sign a definitive merger agreement(Cohere 与 Aleph Alpha 签署正式合并协议) Reuters(路透社) 合并后沿用 Cohere 品牌,共同主攻企业级 AI 市场
34 Arcee AI, which develops open-weight models, raised a Series B at a $1B valuation(开源权重模型公司 Arcee AI 完成 10 亿美元估值 B 轮) Fortune(财富杂志) 仅花 2000 万美元训练四个模型即达独角兽
36 A group of 10 banks is giving a $22B loan to Blackstone-Alphabet’s Crux AI to buy TPUs(10 家银行向黑石-谷歌云合资 Crux AI 提供 220 亿美元贷款购 TPU) Bloomberg(彭博社) 面向 AI 实验室出租算力,芯片抵押贷款模式兴起
37 Anthropic has signed its first Australian data center lease for a 2.16 GW campus(Anthropic 签署首个澳大利亚数据中心租约,规划 2.16 吉瓦) Reuters(路透社) 位于布里斯班约 150 英里外,2027 年上线
38 Sources: Anthropic signed a $13.7B, six-year deal to lease compute from Rum Group(消息人士:Anthropic 与 Rum Group 签 137 亿美元六年算力租约) The Information(科技付费媒体) 后者运营 Rumble 并托管 Truth Social,算力军备竞赛跨向政治圈
41 Google DeepMind safety researcher Bilal Chughtai publicly resigns, saying AI “has the potential to kill us all”(DeepMind 安全研究员 Chughtai 公开辞职,称”AI 有可能毁灭我们所有人”) Bloomberg(彭博社) DeepMind 联合创始人 Shane Legg 同日宣布成立研究 AGI 部署的 DeepMind Institute
42 Sources: the US “almost started a war” after an AI-assisted report hallucinated(消息人士:AI 辅助报告产生幻觉,美国”几乎发动一场战争”) CNN(美国有线新闻网) 报告误判中东中国船只载有核武器部件,AI 军事应用风险暴露
43 Security researchers hacked OpenAI and accessed its “monorepo” using Claude models(安全研究人员利用 Claude 模型攻入 OpenAI 并访问其代码库) Wall Street Journal(华尔街日报) 发生在 OpenAI 漏洞赏金项目中,AI 被双向用于攻防
44 UMG sues DistroKid, alleging it distributes AI-generated music masquerading as artist releases(环球音乐起诉 DistroKid,指其分发冒充艺人的 AI 生成音乐) Music Business Worldwide(音乐行业媒体) 版权战火从模型厂商烧至分发平台
45 OpenAI staff expect the Hodge Conjecture to be solved relatively soon after Navier-Stokes(OpenAI 员工预计继纳维-斯托克斯方程后霍奇猜想也将于近期攻克) The Information(科技付费媒体) Noam Brown 同周访谈详谈多智能体系统与数学证明,AI 科研能力引发学界震动

🎯 行业核心动态

  • AI 安全大辩论成为本周主线:OpenAI 披露六起模型失准事件并建立报告框架,微软发布”人文主义 AI 行为准则”,特朗普则公开抨击监管呼吁并称 AI 末日论是”骗局”,全球 AI 概念股应声大跌——行业叙事从”竞速”转向”安全与商业的政治博弈”。
  • 资本狂热不减:OpenAI 醖酿 1.2 万亿美元估值融资,Anthropic 年化营收突破 1000 亿美元并将 IPO 推迟至 11 月;Crusoe(309 亿美元)、Factory(50 亿美元)、Emulate(37 亿美元)等算力与应用公司估值集体飙升,银行甚至开出 220 亿美元芯片抵押贷款。
  • 自研芯片与算力竞赛加剧:Meta 公布 MTIA 450/500 部署时间表,华为发布 Ascend 960DT 及百万处理器互联架构,苹果被曝开发 M8 Ultra AI 服务器;Anthropic 同步锁定澳大利亚 2.16GW 数据中心与 137 亿美元六年算力租约。
  • 版权诉讼全面升级:索尼与环球联手起诉 Suno”基于侵权模型的新模型”,环球另诉 DistroKid 分发 AI 冒牌音乐;NYT 庭审文件披露微软内部人士曾称 AI 训练是”惊人的盗窃”。
  • 就业焦虑全球化:皮尤对 37 国调查显示 34 国民众预计 AI 造成净岗位流失,湾区软件工程师需求较 2022 年下降 42%,AI 财富红利与普通工程师就业出现明显分化。

🌐 九源交叉分析

⚠️ 本期仅 7/9 源参与交叉分析:OSSInsight 官方已暂停 Star 趋势榜(”Star-based rankings are paused”)无数据;Trendshift 因页面 JS 虚拟化渲染无法取数(5 次重试失败)。两源缺失使部分上周依赖 Trendshift 验证的项目降为单源,评级标准照旧:🔥🔥🔥 = 4+ 源、🔥🔥 = 3 源、🔥 = 2 源。

1. 🔥 跨源热门项目验证

项目/主题 出现的数据源 评级 说明
AI 编码智能体与代码审查 GitHub(open-code-review 周冠军、claude-code、context-mode、orca、mini-swe-agent 等 10+ 席)· HN(SWE-2 446 分、agent.md 415 分、Vomit 305 分)· HF Papers(AutoDev、OpenDevin)· PH(Kilo Code 双端、Bitrise、Weave Router、Cline Desktop)· Techmeme(Factory 50 亿美元估值、Claude 主导 26% 研发)· Reddit(Claude Code 精读论文 274 分) 🔥🔥🔥 6 源共振本周第一主线:从”能写代码”走向”团队化工业化”——并行 Agent 舰队、混合架构审查(阿里)、按任务切换模型(Factory Droid)
语音智能体与语音生成 HF Models(腾讯 AuK、YuE2、LTX-2.5)· HF Papers(AuK 报告 161 赞、VoiceMem、VibeVoice)· GitHub(VoiceStudio 双榜、voicebox、OmniVoice)· PH(Voiskey 双榜第 3、Loqua、MosMos、NovaSynth)· Techmeme(Gemini 3.8 Live 实时对话模型) 🔥🔥🔥 🆕 5 源齐爆的本周最大新主题:全本地 ElevenLabs 替代 + 语音输入写作 + 实时语音模型,”语音是智能体的下一界面”
本地部署与极限压缩 HF Models(三值化 Bonsai、MLX 2bit、unsloth GGUF 763 万下载)· HN(本地 LLM 显笨 511 分、WebLLM、Sunk Cost)· Reddit(19.8MB LLM 跑 1900 tok/s、RP2350 生图)· Techmeme(Bonsai 2 压至 5.9GB)· GitHub(VoiceStudio 全本地、OpenLogi 本地优先) 🔥🔥🔥 “自己跑模型”仍是全球最强需求:三值化/2bit/SSD 卸载把 27B 级压进消费级硬件
Qwen3.8 生态 HF Models(7 席衍生 + 双下载王)· HN(236 分跟进推理预填充)· Techmeme(Bonsai 2 端侧化)· GitHub(MTPLX 本地解码服务) 🔥🔥🔥 连续 6 周:开源 27B 王座稳固,衍生生态与端侧化双轮驱动
GPT-6 Astra HN(2279 分头条 + 约 8 条 Tier1 关联帖)· PH(月榜 #6)· Techmeme(Astra for Law、失准披露)· Reddit(24h 越狱 359 分) 🔥🔥🔥 连续 3 周:热度形态从发布冲击转向垂域产品化与安全审视
反 AI Slop 与人味治理 HN(智力拉链 729 分、How to Write 324 分、F-Droid 145 分)· GitHub(humanizer、no-ai-slop)· Techmeme(UMG 诉 DistroKid”AI slop”)· Reddit(NeurIPS 误杀、菲尔兹宣言、TMLR) 🔥🔥🔥 连续 6 周且升级:从社区情绪升级为法律行动与学术制度抗争
Agent 安全与红队 GitHub(security-audit-skill、Claude-Red、AI-Infra-Guard)· HF Papers(AI-Infra-Guard 论文)· HN(Root 权限拷问、Cursor 黑客事件、Geiger)· Techmeme(Claude 攻入 OpenAI monorepo、AI 幻觉几乎开战、失准框架) 🔥🔥🔥 智能体权限失控事故密集爆发,”Agent 安全层”成为独立品类(PH Harden 同步上榜)
音乐生成与版权战 HF Models(YuE2 双席)· HF Papers(YuE 77 赞)· GitHub(YuE2 智能体音乐编辑)· Techmeme(索尼环球诉 Suno、UMG 诉 DistroKid) 🔥🔥🔥 开源音乐模型(YuE2)与唱片业法律围剿同框,音乐 AI 进入”诉讼即竞争”阶段
Agent Harness 方法论 GitHub(ECC 26 万星、superpowers、firstmate)· HF Papers(Atria Dawn 403 赞、Apodex、NeoHorse”Routing Harness”)· HN(”harness is the product”)· Techmeme(Factory Droid 模型切换) 🔥🔥🔥 🆕 “脚手架才是产品”成为跨源共识:技能+记忆+路由+自恢复的工程化
Anthropic/Claude 生态 GitHub(claude-code 周 6、官方插件库月 3)· Techmeme(Chat+Cowork 合并、11 月 IPO、年化营收破千亿)· HN(Vomit、Astra vs Fable 对比)· PH(Nex”Claude Cowork for GTM”) 🔥🔥🔥 营收三个月增长五成 + Claude”主导”26% 自家研发,商业化与”AI 做 AI”同步提速
Agent Skills 生态 GitHub(archify 月 1、openai/plugins 周 11、技能类占月榜约 1/3 席位)· HF Papers(SkillOpt 262 赞、COLLEAGUE.SKILL)· HN(Skills MCP 等) 🔥🔥 连续 7 周统治:Trendshift 缺席后仍 3 源验证,重心从”造技能”转向”验证技能”
RSI / 递归自我改进 HF Papers(Atria Dawn 403 赞登顶 + Dream-RSI/NeoHorse/SoL-Pi 等)· HF Models(Atria-Dawn 预览、NeoHorse 系列)· Reddit(”RSI is not happening”278 分大辩论) 🔥🔥 🆕 论文榜最强理论主题撞上 Reddit 最强质疑帖,”有界自我精炼 vs 真 RSI”成新辩题
视频生成 HF Models(LTX-2.5、MiniMax-H3 445 万下载)· HF Papers(Vidu S2 683 赞全榜最高)· GitHub(hyperframes、OpenMontage) 🔥🔥 实时交互(Vidu S2)与智能体化生产(OpenMontage)两条线并进
Navier-Stokes / 千禧年难题 Reddit(月榜 701 分头名 + 抢功罗生门)· Techmeme(OpenAI 预告霍奇猜想也将近期攻克) 🔥 连续 2 周:从”抢功罗生门”演变为”下一个难题预告”,学界震动持续
Meta Muse / Gemini 3.8 Muse:HN(659+184+60 分三帖)+ Techmeme(Mac 应用、Meta One 订阅);Gemini 3.8:Techmeme(发布)+ PH(周榜 #24) 🔥 Muse 连续 2 周持平;Gemini 3.8 Live 🆕 入榜,主打语音智能体

2. 📊 连续上榜追踪(对比 W37 跨源验证表)

项目/主题 首次上榜 连续周数 W38 趋势 说明
Agent Skills 生态 W32 7 周 → 持平 3 源(GitHub+Papers+HN),Trendshift 缺席;重心转向技能安全验证
Qwen3.8 系列 W33 6 周 ↑ 上升 升至 4 源:Bonsai 2 端侧化 + unsloth GGUF 763 万下载
反 AI 味/slop 治理 W33 6 周 ↑ 上升 升至 4 源:法律行动(Suno/DistroKid 诉讼)+ 学术制度抗争
GPT-6 Astra W36 3 周 → 持平 4 源:垂域化(Astra for Law)+ 安全披露
archify W35 4 周 ↓ 下降 Trendshift 缺席,仅 GitHub 月榜 #1 单源
i-have-adhd W37 2 周 ↓ 下降 GitHub 月 8/周 2 依旧强势,但降为单源
TimesFM W35 4 周 ↓ 下降 3 源→2 源(GitHub 月 14 + HF Papers)
世界模型研究 W35 4 周 → 持平 HF Papers(OpenWAM 等)+ Techmeme(Emulate 洽谈 37 亿估值融资)
AI 换人焦虑 W35 4 周 → 持平 HN(开源 AI CEO 1035 分)+ Techmeme(湾区工程师需求降 42%)
Meta Muse / Navier-Stokes W37 2 周 → 持平 各自维持双源验证
DeepSeek 生态 W31 🏁 退出 仅剩 HF Models 双席(V4.1-Flash #2 + 社区版),跨源验证中断
GLM-5.3 W34 🏁 退出 仅剩 HF Models #27 单席
ECC / hyperframes / gods-eye-view / markitdown / Cognition SWE-2 W37 ↓/🏁 上期均靠 Trendshift 凑双源,本期降为 GitHub/HN 单源,跨源验证中断
语音智能体 / Agent Harness / RSI / 视频生成 / 音乐版权战 / Gemini 3.8 W38 🆕 新入榜 🆕 本周新晋 2-5 源主题,语音智能体与 Harness 为最强新生力量

趋势标注:🆕 本周新入榜 | ↑ 上升 | → 持平 | ↓ 下降 | 🏁 已退出

3. 各源独家发现

  • GitHub:gods-eye-view 真实卫星数据 3D 地球(周 +14.5k);阿里 open-code-review 混合架构登周榜冠军;腾讯 BrowserSkill 让 Agent 用你真实登录态的浏览器”而不打扰你”
  • HF Models:书生 Atria-Dawn 753B 预览神秘亮相(与论文榜 403 赞登顶同源);all-MiniLM 月下载 2.55 亿仍是嵌入之王;三值化 27B 模型个位数 GB 即可部署
  • HF Papers:Vidu S2 以 683 赞成全榜最高却仅列第 48 名(榜单排序≠热度);Edge0 配套论文把 35B MoE 放上 SSD(19.5GB 跑消费级硬件)
  • HN:$998 从零训 3.8B 模型完整复盘;F-Droid 应用商店 slop 渗透率实测(181 评论);”CEO 裁员给 AI 腾位→开发者反手开源 AI CEO”1035 分黑色幽默
  • Reddit:OpenAI 纳维-斯托克斯”抢功”罗生门(条件是把 Anthropic 员工移出作者名单);RP2350 微控制器上生成 128×128 人脸
  • Product Hunt:GPU 算力价格指数 CGI(算力大宗商品化风向标);tiun./CREEM 代表的”AI 收银台”赛道;Die With Me——查看好友 Claude Code/Codex 使用状态
  • Techmeme:AI 幻觉报告让美国”几乎发动一场战争”;10 家银行 220 亿美元芯片抵押贷款;Anthropic 年化营收破 1000 亿美元冲刺 11 月 IPO

4. 🎯 本期 AI 趋势一句话总结

2026 年 W38 的关键词是 「智能体基建成型 + 语音爆发 + 治理摊牌」:编码智能体完成从单兵工具到团队化工业设施的关键一跃(6 源共振),Qwen3.8 生态被压进手机、语音智能体 5 源齐爆宣告多模态落地;与此同时 OpenAI 首次系统性披露模型失准、版权战火烧到分发平台、菲尔兹奖得主与 NeurIPS 检测器把”反 slop”推向制度层面——当基础设施狂欢与治理清算同周到达,AI 行业正式进入”既要建、也要管”的双轨时刻