合集
关于
大语言模型从零到一
从互联网数据、Token与Transformer讲起,逐步拆解预训练、SFT、强化学习、幻觉、推理模型与Agent。用通俗案例和流程图,带你真正理解大模型如何工作、如何训练,以及如何可靠使用。
01
一句话讲清 LLM:为什么预测下一个 Token 也能产生智能?
→
02
大模型吃进去的是什么?从互联网数据到 Token
→
03
Transformer 到底在算什么?一文看懂 Attention
→