本文探讨了一种简单的自我蒸馏方法(SSD),通过利用大型语言模型(LLM)自身的输出来改进代码生成。SSD在LiveCodeBench v6上将Qwen3-30B-Instruct的通过率从42.4%提升至55.3%。该方法通过调整温度和截断配置,优化了模型的输出,尤其在解决复杂问题时表现更佳。SSD为LLM代码生成提供了一种有效的后训练改进方向。
完成下面两步后,将自动完成登录并继续当前操作。