Digest
读完外部材料(论文 / 技术博客 / 代码仓库)之后,用自己的话重写一遍的产物。 不是摘要,是「我确认自己读懂了」的记录。
模型与算法
- reasoning-effort —— 推理努力度是怎么训出来的:low/medium/high 这个旋钮在推理侧只是一句 system prompt,在训练侧是三条可叠加的路线;硬性 token 预算是另一件事
系统与 Infra
工程实践
Author houmin
Publish July 25, 2026
LastMod July 27, 2026
License 本作品采用 CC BY-NC-ND 4.0 许可协议进行许可,转载时请注明原文链接
如果你在浏览博客的过程中发现了任何问题,欢迎在对应文章下评论。如果你有其他事情想要咨询,可以通过邮件联系我。
Linked Mentions
-
No backlinks found.