分享 Qwen AI 模型移植经验

💡 原文中文,约600字,阅读约需2分钟。
📝

内容提要

作者分享Qwen模型移植经验:DeepSeek V4 Flash和Qwen 3.8 27B未审查版移植正常,但Qwen 3.8 Flash Next未审查版在输出超过5K时出现中英韩混合乱码,归因于训练不严谨。通过设置温度0.3、top_p 0.95、top_k 20,并统一模型ID为qwen3.8-flash-next-uncensored可解决。作者已更新算力舱内多个模型,后续将继续优化。

🏷️

标签

➡️

继续阅读