小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Humanoid-GPT——采用因果注意力机制的类GPT追踪器:通过扩展“数据规模、模型结构、训练多样性”,最终实现零样本动作追踪

Humanoid-GPT是一种新型的GPT风格Transformer模型,专为人形机器人的零样本运动跟踪设计。研究者利用20亿帧的动作数据进行训练,克服了以往模型在灵活性和泛化能力上的不足。该模型采用因果注意力机制,在未见过的动作和控制任务中表现出色,推动了人形智能体的通用AGI发展。

Humanoid-GPT——采用因果注意力机制的类GPT追踪器:通过扩展“数据规模、模型结构、训练多样性”,最终实现零样本动作追踪

结构之法 算法之道 结构之法 算法之道 · 2026-06-21T09:24:38Z
视频生成推理加速实践:基于全局时间索引的序列并行 3D 位置编码优化

本文探讨了哔哩哔哩在视频生成模型优化方面的实践,重点介绍了分块自回归模型的计算与通信优化。通过引入因果注意力和KV缓存机制,Self-Forcing模型实现了更高效的视频生成,降低了延迟,并支持长视频生成和实时推理。

视频生成推理加速实践:基于全局时间索引的序列并行 3D 位置编码优化

实时互动网 实时互动网 · 2026-02-13T06:39:19Z

本研究提出MAGNET方法,旨在增强解码器的双向建模能力。通过自监督训练和结合双向与因果注意力,MAGNET提升了生成文本和填补缺失文本的能力。

MAGNET: Enhancing Generative Decoders with Representation Learning and Infilling Capabilities

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-01-15T00:00:00Z

本研究发现,基于因果变换的语言模型(如GPT-3)在没有显式位置编码的情况下仍然具有竞争力。实验结果显示,这种模型通过网络获取隐含的绝对位置概念,从而弥补了缺失的信息。因果注意力使模型能够推断每个令牌可以关注的前任数,从而近似其绝对位置。因此,因果语言模型除了显式的定位机制外,还可以从因果掩码的影响中推导出位置意识。

CausalLM 不适用于上下文学习

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2023-08-14T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码