小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
即使是生成式人工智能也使用维基百科作为来源

Ryan与Wikimedia Deutschland的AI项目负责人Philippe Saade讨论了Wikidata嵌入项目,团队将3000万条Wikidata条目向量化以支持语义搜索,重点在于减轻抓取负担、维护数据完整性及用户反馈的重要性。

即使是生成式人工智能也使用维基百科作为来源

Stack Overflow Blog Stack Overflow Blog · 2026-02-20T08:40:00Z
维基媒体希望让您和人工智能开发者更容易地搜索其数据

Wikidata将推出新的AI友好数据库,旨在帮助小型科技公司提升AI系统对小众主题的理解。通过添加向量,AI将更好地理解信息的上下文。

维基媒体希望让您和人工智能开发者更容易地搜索其数据

The Verge The Verge · 2025-10-01T08:30:00Z

本研究探讨了维基数据知识表示中的社会偏见,特别是在链接预测任务中对少数群体的影响。提出的AuditLP框架利用公平性指标识别性别和年龄偏见,发现偏见结果与全球北方和南方的社会经济文化分区相关。

Social Biases in Knowledge Representations of Wikidata Separate Global North from Global South

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-05-05T00:00:00Z
大型语言模型在对称性测试中失败:新训练方法提升关系推理能力

研究表明,大型语言模型(LLMs)在理解对称和反对称关系方面表现不佳。为此,提出了一种新的对称感知训练方法,并基于Wikidata创建了数据集。结果显示,标准LLMs在该基准上的表现与随机猜测相当。通过对编码器进行对比学习重训练,模型在少量样本下实现了更好的知识保留和学习效率,验证了对称感知训练的有效性。

大型语言模型在对称性测试中失败:新训练方法提升关系推理能力

DEV Community DEV Community · 2025-04-30T09:19:01Z

本研究旨在提高维基数据中学术数据的可获取性,填补会议数据的不足。通过大型语言模型自动提取会议元数据并进行人工验证,提出了一种新方法,扩展了维基数据中的学术实体,增强了其作为学术资源的实用性。

Scholarly Wikidata: Population and Exploration of Conference Data in Wikidata using Large Language Models

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-11-13T00:00:00Z

本研究探讨了Wikidata中的常识知识,发现其与其他常识源重叠较小,并提出了改进建议。同时,研究提出利用大型语言模型和图挖掘技术自动清理Wikidata分类法,评估结果显示其在实体识别任务中有效。

Wikidata中的不相交性违反

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-10-17T00:00:00Z

本研究解决了Wikidata分类法中实例与类之间的歧义、分类路径不准确、循环存在及类别冗余等问题。作者提出了一种名为WiKC的新版本分类法,通过结合大型语言模型和图挖掘技术,实现了自动化清理。评估结果显示,WiKC在实体类型识别任务中具有实用价值。

利用大型语言模型优化Wikidata分类法

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-09-06T00:00:00Z

本文探讨了大型语言模型(LLMs)在推理能力上的差异,特别是归纳推理与演绎推理的区别。研究提出了新框架SolverLearner,发现LLMs在归纳推理方面表现优异,但在演绎推理,尤其是“反事实”推理任务中相对不足。这为理解LLMs的推理能力提供了新视角。

项目SHADOW:基于LM探测的Wikidata符号高阶关联推理

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-08-27T00:00:00Z

本文探讨如何利用Wikidata中的结构化数据生成贫穷语言的开放领域概要,提出了一种神经网络结构,并评估其在阿拉伯语和世界语上的有效性。研究还涉及多语言BERT嵌入和Transformer模型在翻译及序列标记任务中的应用,以提高翻译能力和模型性能。

利用变压器翻译维基百科分类名称

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-08-12T00:00:00Z

本文探讨了自然语言处理(NLP)领域的研究,包括利用维基百科和Wikidata进行文化和地理分析、提高数据预测的成本效益,以及通过新方法提取人物生命轨迹。这些研究旨在改善数据的可用性和准确性,推动社会科学研究和政策决策。

映射过去:通过 Wikidata 地理链接 20 世纪早期的瑞典百科全书

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-06-25T00:00:00Z

ParaNames 是一个多语言个人名库,涵盖 400 种语言和 1.18 亿个人名,支持命名实体识别和机器翻译。经过七年的新闻分析和维基百科挖掘,该库包含 20 万个名字及其变体,旨在改善名称搜索和机器学习。

ParaNames 1.0: 利用 Wikidata 创建一个包含 400 多种语言的实体名称语料库

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-05-15T00:00:00Z

本文介绍了一个新的数据集,用于在知识图谱上进行口头回答的对话式问答。通过扩展现有的多轮对话式问答数据集,提供了新的贡献,并使用五个序列到序列模型进行了实验,同时保持语法的正确性。进行了误差分析,详细说明了模型在指定类别中的误差率。提议将答案口头化的数据集公开,并详细说明其使用,以便广泛使用。

KGConv, 一个基于 Wikidata 的对话语料库

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-08-29T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码