小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

本研究探讨了视觉-语言模型(VLMs)在文本编码器中获取语法知识的局限性,结果显示单模态语言模型(ULMs)在语法信息获取方面明显优于VLM,而VLM的语法学习受到预训练目标的显著影响。

看见语法:揭示视觉-语言模型中的语法学习限制

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-12-11T00:00:00Z

本研究提出了多种新颖的评判方法,以解决语言模型在语法知识评估中的不足。实验结果表明,概率读出法和基于提示的方法在性能上优于传统方法,展示了大语言模型在语法知识利用方面的优势。建议采用多样化的评估方法来全面评估大语言模型。

如何最大化利用大语言模型的语法知识进行可接受性判断

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-08-19T00:00:00Z

本文探讨神经语言模型与语言学理论的关系,特别是其对负极性项的处理能力。研究发现,模型在许可环境中对负极性项有一定理解,但不同实验方法的效果差异显著。通过多种方法评估模型的语法知识,有助于深化语言模型与心理语言学的联系。

预训练语言模型中否定结构的约束研究

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-08-06T00:00:00Z

本文探讨了神经语言模型在多任务学习中的表现,发现语法知识在训练初期迅速获得,而语义和推理能力则在后期提升。研究表明,语言模型能够有效学习语言的分布式表示,尤其在翻译语料库中。通过分析不同学习目标下的信息流动,揭示了模型可解释性和多任务学习的重要性。

表示形式作为语言:一个信息论解释的框架

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-06-04T00:00:00Z

该研究使用信息论探测套件,分析了9项任务,发现语法知识在全面训练的0.5%后迅速获得,持续性能改善主要来自对开放域知识的获取,而语义和推理任务则受益于后期对长距离语境化和更高专业化的提升。跨任务相似性的测量揭示了语言相关任务在训练期间共享信息,这对模型可解释性、多任务学习和有限数据学习具有重要意义。

子空间编年史:语言信息在语言模型训练中的产生、转变和交互

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-10-25T00:00:00Z

国际母语日,汉语查询领域有新华字典、现代汉语规范词典、快快查汉语字典和汉典、萌典、汉字屋等,可以帮助我们更好地了解汉字的源流和演变,以及笔顺、词语辨析等,要注意鉴别信息来源,以及自主查询,结合词语的源流、语境及语法结构等做出综合判断。

汉语查询指南

少数派 少数派 · 2023-02-21T03:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码