自序 · 大模型
在变化里理解不变的结构
大模型领域几乎每天都有新名字。越是更新迅速,我越想保留一个能慢下来思考的地方:一个方法究竟解决了什么问题,它与已有方法有什么联系,又把成本转移到了哪里。
我想写下什么
这个专栏沿着架构、训练、微调、对齐、推理与应用展开。我的写作目标,是把论文里的机制与工程里的限制放在同一张图里,帮助读者形成可解释的判断,而不是追逐一份不断加长的模型清单。
怎样读这个专栏
建议先建立完整流程,再选择一个环节深入。读一个改进时,写下基线、改动和收益成立的条件;做实验时,记录数据、配置和结果。一次能够复现的小实验,往往比记住许多结论更有帮助。
与读者的约定
这是一份会继续修订的学习内容。我会保留所引用资料的来源,区分已有结论、个人理解与尚需验证的问题。如果你发现错误,或有一种更清楚的解释,欢迎告诉我。维护内容的意义,不是让每一页看起来永远正确,而是让理解能够不断接近事实。
这篇序言公开,帮助你判断内容是否适合自己的目标。目录中的其他正文按专栏或全站阅读权益开放;选择之前,请先了解内容范围与服务约定。
愿我们每次回到这里,都能带着比上一次更具体的问题离开。
学习基地作者
2026 年 10 月