0x0002026-04-30推理范式Reflexion 反思式自我纠错Reflexion 的核心是把失败信号转成一段自然语言经验,写进记忆,再喂给下一次尝试。它用「语言反馈」代替了「梯度更新」——模型权重不动,靠上下文里多出来的那段教训变强。2,050 字