小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

本文综述了大型语言模型(LLMs)的架构、训练策略、数据集及评估,重点分析芬兰语和低资源语言的应用。研究表明,LLMs在自然语言处理领域表现优异,但仍需解决效率和可靠性问题。

关于欧洲语言的大型语言模型调查

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-08-27T00:00:00Z

该研究探讨了芬兰语大型语言模型的创建与评估,分析了多语言建模中的屈折变化对模型质量的影响。通过分层潜在变量和词元标记策略,提升了机器翻译的精度和资源利用率,并提出在低资源环境中使用双层Transformer架构和数据增强技术以提高翻译性能。

LLM 对复杂的 FST 生成的芬兰语词汇的形态分析

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-07-11T00:00:00Z

本文介绍了两种三语BERT模型的训练,分别适用于芬兰语、爱沙尼亚语和英语,以及克罗地亚语、斯洛文尼亚语和英语。这些模型在多个下游任务中表现优异,特别是在命名实体识别和依存句法分析方面。研究还探讨了如何在有限计算预算下有效转移英文预训练模型到其他语言,以及多语言数据对低资源语言模型性能的影响。

语言模型的减肥计划:通过额外预训练进行相关语言编码器的成本高效开发

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-04-08T00:00:00Z

本文探讨了预训练深度学习语言模型在自然语言处理中的应用,特别是针对芬兰语的研究。研究比较了多语言模型微调与芬兰语数据单独训练的模型,结果显示后者在词性标注、命名实体识别和依存分析任务中表现更佳。此外,研究还展示了多语言预训练模型的有效性及其在多种语言任务中的应用潜力。

多语能力的祝福:Poro 34B

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-04-02T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码