English version →

这里会不定期记录我在大模型训练和智能体构建工作中的一些思考——比如面向推理与代码的强化学习、harness 设计、auto research,偶尔也会有一些 AI 科学计算方向的笔记。

文章会比较短、偏实用:我遇到的问题、有效(或无效)的想法,以及一些想留存下来的粗略直觉。更多内容陆续更新。