突破万字长文输出瓶颈!清华大学开源 LongWriter-6k 数据集;7 个 CCF A 类顶会即将截稿
原文中文,约3600字,阅读约需9分钟。
📝
内容提要
清华大学的研究团队构建了LongWriter-6k数据集,扩展了大模型的最大输出窗口大小至10,000+字。该数据集可用于小说创作和学术研究,生成精彩小说和详尽的研究报告。hyper.ai官网上线了LongWriter-6k数据集,并提供在线使用。
❓
Q&A
LongWriter-6k数据集的主要功能是什么?
LongWriter-6k数据集可以扩展大模型的最大输出窗口至10,000+字,支持小说创作和学术研究。
如何在线使用LongWriter-6k数据集?
用户可以访问hyper.ai官网,直接使用LongWriter-6k数据集。
LongWriter-6k数据集包含多少篇数据?
LongWriter-6k数据集包含6,000篇SFT数据。
LongWriter-6k数据集适合哪些应用场景?
该数据集适合用于小说创作和生成详尽的研究报告。
hyper.ai官网还提供哪些其他公共数据集?
hyper.ai官网还提供EVOBC甲骨文文字演化数据集、HUST-OBS甲骨文识别数据集等公共数据集。
LongWriter-6k数据集的输出长度范围是多少?
LongWriter-6k数据集的输出长度范围为2,000到32,000字。
🏷️