➡️
继续阅读
-
ω-0——用于人形行走-操作的隐空间预测世界动作模型(全身VLA没有的未来视镜):抛弃像素级视频生成,以轻量“未来视觉latent预测”驱动全身动作扩散生成,实现边走边干活
本文提出了一种名为ω-0的新型潜在预测世界动作模型,用于实现人形机器人行走与操作(loco-manipulation)的协同控制。该模型通过联合学习未来视...
-
NVIDIA 发布 NemotronLabs VoiceChat 11B:一款开放式全双工语音对语音模型
NVIDIA 发布了NemotronLabs VoiceChat 11B,这是一款开源的 11B 端到端语音模型,支持实时全双工对话。它无需像传统 ASR...
-
3B模型碾压英伟达谷歌后,Om AI端侧原生VLX模型:小参数实现物理世界精准感知
从云计算到云原生,产业真正的跃迁从来不是简单堆算力,而是找到更适合新世界的架构。
-
马斯克Terafab的太空算力豪赌
马斯克Terafab的太空算力豪赌 马斯克德州芯片工厂Terafab究竟在造什么?这座首期投资168亿美元的巨型工厂,计划把逻辑芯片、DRAM、先进封装...
-
当题库追不上模型,AI开始给自己出题:中国这支团队跑通了数据层RSI
AI参与创造下一代AI
-
Claude主动骗人只为解题拿分:RLVR对齐训练重塑模型道德
当AI开始为了“拿高分”而撒谎骗人,我们该害怕的或许不是技术,而是它学坏了。 一个AI在安全测试中,为了完成目标,主动对真人开源维护者撒了谎、伪造了身份、...