给 digest 那张技术报告索引补一行之前,总要先回答同一个问题:这条消息的一手出处是哪一页。2026 年这件事变难了。同一家机构的中文稿、英文博客、模型卡、arXiv 报告分散在三四个域名上,时间还能差好几天——GLM-5.2 是 06.13 先推给 Coding Plan 用户、06.16 才出博客,Qwen3.8-Max-Preview 到今天只有一份阿里云产品文档能证明它存在。等二手转述通常晚半天到两天,而且丢掉的恰好是架构那一段。

这一页记的不是模型,是渠道:每家把第一手信息放在哪、哪些能订阅、哪些注定只能手动刷。所有链接都在 2026-07-30 实际请求过一遍,跳转和失效的情况写在最后一节。

本页尝试回答几个问题:

  • 每家的「第一落点」是哪个页面
  • 哪些渠道能进 RSS reader,哪些是看着像 feed 的假 feed
  • 中文渠道和英文渠道发的是不是同一份东西

第一落点总表

机构 第一落点 几乎同刻的第二落点 一手材料形态
OpenAI openai.com/news X @OpenAI 博客 + system card PDF
Anthropic anthropic.com/news platform.claude.com release notes 博客 + model card PDF
Google DeepMind blog.google AI 板块 deepmind.google/blog 博客 + model card
Meta ai.meta.com/blog HF meta-llama 博客 + 模型卡
Mistral mistral.ai/news HF mistralai 博客 + 模型卡
xAI x.ai/news docs.x.ai 博客 + system card
DeepSeek HF deepseek-ai GitHub 同名仓库 模型卡 + 仓库里的 PDF
字节 Seed seed.bytedance.com/zh/blog 火山引擎上架 博客 + 模型卡
阿里 Qwen HF QwenModelScope qwen.ai/blog 模型卡为主
月之暗面 moonshot.cn/research arXiv、HF moonshotai 研究页 + arXiv
智谱 Z.ai z.ai/blog/<模型> GitHub zai-org 仓库 README 博客 + 技术报告
MiniMax minimax.io/blog HF MiniMaxAI 博客 + 模型卡
蚂蚁百灵 HF inclusionAI ant-ling.com 动态 模型卡 + arXiv
美团 LongCat longcat.chat/blog GitHub meituan-longcat 博客,报告看心情
阶跃星辰 微信公众号 static.stepfun.com/blog/<模型> 模型页 + 仓库
小红书 dots HF dots-studio GitHub dots-studio 模型卡

这张表的实际用法是:出现一条「某某发了新模型」的传闻时,直接打开对应机构的第一落点,能查到就是真的,查不到就再等等。

四种发布形态

盯渠道之前先分清这四类,决定了你该守着哪种页面。

blog-first:博客上线即发布,权重(如果开)几分钟内跟上。OpenAI、Anthropic、Google、MiniMax、Z.ai、LongCat 属于这一类,博客本身就是主文档,模型卡只是它的摘要。

weights-first:Hugging Face 上出现 repo 就是发布,博客可能永远不来。DeepSeek 是极端案例——到今天没有博客,技术报告是仓库里的一个 PDF,唯一的「发布公告」是 X 上一条链接。Qwen 开源档、Ling、dots 也走这条路。

paper-first:arXiv 先于产品。Moonshot 的 Attention Residuals(03.16)、Z.ai 与清华的 IndexCache(03.12)都是先挂论文,三四个月后才在旗舰模型里看到落地。这类最容易漏,因为发布当天没有任何产品新闻,只有一条 arXiv 记录。

doc-only:闭源档只在 API 文档或价格页留痕。Qwen3.8-Max-Preview 至今没有模型卡、没有 benchmark、没有博客,只有阿里云的 token 套餐说明里写着它。这类必须靠 OpenRouter 一类的第三方接入面板反查。

海外

OpenAI

开源权重只在 gpt-oss 那条线上,主线模型全部只有 system card。开发者侧的东西已经从 platform.openai.com 整体迁到 developers.openai.com,旧链接会跳转,但写脚本时最好直接用新域名。新版本先在 changelog 里出现、博客随后补上的情况不少见。

Anthropic

公司侧留在 anthropic.com,产品侧搬到了 claude.com(产品博客在这边),文档统一收在 platform.claude.com,docs.anthropic.com 和 docs.claude.com 都会跳过去。没有 RSS——anthropic.com/rss.xml 是 404,只能靠 release notes 页面或第三方镜像。engineering 那栏值得单独订,harness 和上下文管理的实践文章都发在那里。

Google DeepMind

三条博客线各管一摊:blog.google 是产品发布,deepmind.google 是研究和模型,research.google 是 Google Research 的论文。blog.google 今年改过路径,老的 /technology/google-deepmind/ 会跳到 /innovation-and-ai/...。DeepMind 那条 RSS 是本页实测里最好用的一个,抓下来第一屏就有 Gemini 3.6 Flash 和 3.5 Flash Cyber——技术报告索引里 Google 那行只写到 3.5 Flash,该补了。

Meta

Llama 4 之后再没出过完整技术报告,Llama 5 也只有模型卡。今年博客上的重头戏是 Muse 系列(07.09 的 Muse Spark 1.1、07.07 的 Muse Image / Video),语言模型反而不是主角。这个站对脚本 UA 直接返回 400,见最后一节。

Mistral

发布节奏稳定,博客一篇讲清楚一个模型,URL 形如 mistral.ai/news/mistral-small-4/,权重同步上 HF。最近在往具身方向走(Robostral Navigate),语言模型那条线的更新可以只盯 HF。

xAI

02.02 被 SpaceX 收购,站点署名已经改成 SpaceXAI,但域名和渠道没动。发布密度极高且绝大多数是产品集成(Grok for Word/Excel 之类),模型本体的公告混在里面,翻的时候要有耐心。

外围但要挂着

机构 渠道 为什么值得看
NVIDIA Nemotron 实验室 · 技术博客 RSS · HF nvidia 海外大厂里少数还在出完整技术报告的,Nemotron 3 的 PDF 直接挂在实验室页
Microsoft Research 博客 · HF microsoft 小模型(Phi 线)和推理系统论文
AI2 allenai.org/blog · HF allenai 全开源(数据 + 配方 + 权重)的对照组
Cohere cohere.com/blog · HF CohereLabs 企业向和多语种方向的参照

国内

国内这批有个共同特征:中文首发在微信公众号,英文博客和模型卡晚几小时到一天,而且两边内容不一样——公众号偏发布会叙事,模型卡才有参数和 benchmark。阶跃 Step 3.7 Flash 那次,所有中文报道注明的来源都是「官方公众号」,英文侧则只有 GitHub 仓库和模型页。公众号没有 RSS,这是国内渠道最大的缺口,只能靠 HF/GitHub 的机器可读接口兜底。

DeepSeek

没有博客,没有发布会,模型卡就是全部。技术报告作为 PDF 放在 GitHub 仓库里,arXiv 版本往往晚一到两个月(V4 的模型 04.24 发、arXiv 06 月才挂)。盯 HF 组织页比盯任何新闻源都快。

字节跳动 Seed

team.doubao.com 已经并到 seed.bytedance.com。中英文博客是同一批文章的两个版本,slug 有时用中文转义、有时用英文,两边都要试。旗舰权重不开源,模型卡加 cookbook 仓库(如 ByteDance-Seed/Seed2.0)是能拿到的最详细材料;API 什么时候上架看火山引擎,那边的上线时间偶尔早于博客。

阿里 Qwen

渠道最散的一家。开源档在 HF 和 ModelScope 同刻发布;英文长文有时发在 Alibaba Cloud 博客(Qwen3.5 那篇就在那儿);闭源的 Max 档只在阿里云模型文档里留痕。旧的 qwenlm.github.io 还活着、RSS 也还能抓,但最后一批文章停在 2025 年的 Qwen3Guard 和 Qwen-Image,别再订它。

月之暗面 Kimi

研究页是主入口,模型页走 moonshotai.github.io/Kimi-K2/ 这种独立站形式。这家是国内少数认真投 arXiv 的(Kimi K3 技术报告全文 的报告 07.27 上 arXiv,模型 07.16 就发了),架构类单篇论文也走 arXiv 加 GitHub 双发。

智谱 Z.ai

组织名从 THUDM 改成了 zai-org,两边的旧链接都还在跳转。博客没有可用的索引页——z.ai/blog 直接 404,只有具体文章的直链能打开,所以入口其实是 GitHub 上 zai-org/GLM-5 的 README,那里汇总了各版本的博客、报告、HF 和 ModelScope 链接。发布顺序经常是先给订阅用户灰度、几天后才发博客。

MiniMax

今年把文章路径从 /news/<slug> 换成了 /blog/<slug>,两个索引页都还在,老文章留在 news 下(M2.5 在 /news/minimax-m25,M3 在 /blog/minimax-m3),做归档时两边都要爬。属于少数愿意为单个技术点单独出报告的(MiniMax Sparse Attention 全文翻译)。

蚂蚁百灵

对外品牌是 Ling / Ring / Ming 三条线,开源组织名却叫 inclusionAI,两个名字都要搜。开发者文档里那张版本演进表比任何新闻稿都好用——Ling 3.0(2026.07,原生混合线性架构、引入 KDA)在那张表里能直接读到,技术报告索引里还没收。发布当天通常同步 HF、ModelScope 和 OpenRouter 免费额度。

美团 LongCat

两个域名都在用,写引用时统一用 longcat.chat。有时出 arXiv 报告(LongCat-Flash-Thinking、LongCat-Next),有时只有博客(LongCat-2.0),后者的博客就是唯一官方材料,值得整篇存档。

阶跃星辰 StepFun

官网 stepfun.com 只有产品页,没有 news 路径,模型页挂在 static 子域上,一般从 GitHub 仓库 README 的 ModelPage 链接进去。英文侧最活跃的其实是 Discord。今年 VL 和 Flash 两条线都投了 arXiv,透明度在国内属于偏高的。

小红书 dots

hi lab 时期的 rednote-hilab 已经改名 dots-studio,旧地址 301 跳转,收藏夹和脚本里的常量要换。产品线从 dots.llm1(143B)扩到了 dots.vlm、dots.ocr / mocr、dots.tts,OCR 那条线的下载量比语言模型高一个量级。没有博客,模型卡就是全部。

其余挂着的

机构 渠道
腾讯混元 hunyuan.tencent.com · GitHub · HF tencent
百度 ernie.baidu.com · HF baidu · GitHub PaddlePaddle/ERNIE
小米 MiMo HF XiaomiMiMo · GitHub
上海 AI Lab GitHub InternLM · HF internlm
面壁 MiniCPM GitHub OpenBMB · HF openbmb
昆仑万维 HF Skywork · GitHub
百川 HF baichuan-inc · baichuan-ai.com
快手 HF Kwai-Klear
零一万物 HF 01-ai

能订阅的和不能订阅的

真正能进 RSS reader 的没几个,实测结果:

渠道 地址 状态
OpenAI News openai.com/news/rss.xml 可用,全文输出
Google DeepMind deepmind.google/blog/rss.xml 可用,更新最快
Google Research research.google/blog/rss/ 可用
blog.google 全站 blog.google/rss/ 可用,噪音大
NVIDIA 技术博客 developer.nvidia.com/blog/feed/ 可用(Atom)
arXiv cs.CL rss.arxiv.org/rss/cs.CL 可用,量大需要过滤
Anthropic anthropic.com/rss.xml 404,没有官方 feed
DeepSeek api-docs.deepseek.com/news/rss.xml 假 feed,返回 200 但内容是 Docusaurus 兜底 HTML
MiniMax minimax.io/news/rss.xml 404
Qwen 旧站 qwenlm.github.io/blog/index.xml 能抓但已停更,停在 2025 年

没有 feed 的那些,用机器可读接口代替:

1
2
3
4
5
# HF 组织最近发布的模型,按创建时间倒序
curl -s "https://huggingface.co/api/models?author=deepseek-ai&sort=createdAt&direction=-1&limit=20"

# GitHub 仓库的 release,标准 Atom
curl -s "https://github.com/zai-org/GLM-5/releases.atom"

author= 换成 QwenmoonshotaiMiniMaxAIinclusionAImeituan-longcatstepfun-aidots-studiozai-org 就覆盖了国内主力。这个接口不需要 token,返回里带 createdAtlastModified,写个定时任务比刷网页可靠得多——毕竟 weights-first 的那几家,HF 上 repo 出现的时刻就是发布时刻。

抓取时会踩的坑

这一节是给 fetch_article.py 那类脚本准备的,2026-07-30 实测:

  • 对脚本直接拒绝openai.comx.aiallenai.org 返回 403,ai.meta.com 返回 400。浏览器打开完全正常,是 UA 和指纹层面的拦截。这几家要么走 RSS,要么手动存页面。
  • 正文靠 JS 渲染qwen.ai/blogwww.stepfun.commoonshotai.github.io 首页 curl 下来是空壳,抓图脚本会报「没有找到插图」。
  • 看着像 feed 的不是 feed:DeepSeek 那条 news/rss.xml 是 Docusaurus 的 catch-all,返回码 200 但内容是 HTML 文档页。判断标准是看首字节是不是 <?xml
  • 没有索引页z.ai/blog 404,文章直链却是 200。这种站只能从 GitHub README 或模型卡进。
  • 改过名和搬过家rednote-hilabdots-studioplatform.openai.comdevelopers.openai.comdocs.anthropic.comdocs.claude.complatform.claude.comblog.google/technology/...blog.google/innovation-and-ai/...lmarena.aiarena.ai;MiniMax 从 /news/ 换到 /blog/。旧链接目前都还跳转,但引用时应该写新地址。

横向面板

一手渠道之外,这几个用来交叉验证和捡漏:

中文二手源(机器之心、量子位一类)只当索引用:它们的时效性不错,但摘要里的架构数字经常和模型卡对不上,写笔记前必须回到一手。

参考资料