2026-04-16
额外训练步骤如何释放AI的推理能力
IBM一项涵盖500多组对照实验的研究揭示,"中间训练"(mid-training)是提升大语言模型推理能力的关键环节。研究发现,中间训练可将不同规模和架构模型的整体推理能力提升3至4倍,而跳过这一步骤、仅依赖强化学习的...
IBM一项涵盖500多组对照实验的研究揭示,"中间训练"(mid-training)是提升大语言模型推理能力的关键环节。研究发现,中间训练可将不同规模和架构模型的整体推理能力提升3至4倍,而跳过这一步骤、仅依赖强化学习的...