先回答一个最底层的问题:大模型输出的到底是什么? 大模型是"打字机",不是"数据库" 大模型的本质是逐 token 预测:根据已有文本,按概率预测下一个 token,拼成完整回复。token 解码出来