小红花·文摘

$Humanoid-GPT——采用因果注意力机制的类GPT追踪器：通过扩展“数据规模、模型结构、训练多样性”，最终实现零样本动作追踪$

Humanoid-GPT——采用因果注意力机制的类GPT追踪器：通过扩展“数据规模、模型结构、训练多样性”，最终实现零样本动作追踪

结构之法算法之道 ·

视频生成推理加速实践：基于全局时间索引的序列并行 3D 位置编码优化

实时互动网 ·

本研究提出MAGNET方法，旨在增强解码器的双向建模能力。通过自监督训练和结合双向与因果注意力，MAGNET提升了生成文本和填补缺失文本的能力。

MAGNET: Enhancing Generative Decoders with Representation Learning and Infilling Capabilities

BriefGPT - AI 论文速递 ·

本研究发现，基于因果变换的语言模型（如GPT-3）在没有显式位置编码的情况下仍然具有竞争力。实验结果显示，这种模型通过网络获取隐含的绝对位置概念，从而弥补了缺失的信息。因果注意力使模型能够推断每个令牌可以关注的前任数，从而近似其绝对位置。因此，因果语言模型除了显式的定位机制外，还可以从因果掩码的影响中推导出位置意识。

CausalLM 不适用于上下文学习

BriefGPT - AI 论文速递 ·