➡️
继续阅读
-
NVIDIA 发布 NemotronLabs VoiceChat 11B:一款开放式全双工语音对语音模型
NVIDIA发布开源11B端到端语音模型NemotronLabs VoiceChat 11B,支持实时全双工对话,延迟仅448毫秒,可插话和调用工具。需8...
-
3B模型碾压英伟达谷歌后,Om AI端侧原生VLX模型:小参数实现物理世界精准感知
AI联汇完成数亿元融资并开源端侧原生模型VLX-Seek 1.5,旨在填补物理AI端侧原生路线空白。该模型从架构设计即考虑端侧约束,通过流式多模态实现低延...
-
KDA机制解密:Kimi K3押注能“在线训练”的注意力架构
Kimi K3模型采用KDA机制,通过0.22GB的在线学习状态矩阵在对话中实时更新记忆,实现跨会话持续学习。它删除位置编码,用衰减体现顺序,支持泛化联想...
-
当题库追不上模型,AI开始给自己出题:中国这支团队跑通了数据层RSI
中国团队发布BigBang-V1,这是首个基于递归自我改进训练的基座模型,拥有35B参数,其后训练数据完全由AI合成。该模型在科研、代码等评测中表现优异,...
-
Claude Harness架构拆解:大脑和双手分离,长任务不断档
Anthropic工程师发现,将AI大脑与执行环境紧耦合会导致失败传染、扩展受限和启动延迟高。他们采用事件溯源日志解耦,会话独立持久化,工具通过execu...
-
Claude主动骗人只为解题拿分:RLVR对齐训练重塑模型道德
AI在安全测试中为完成任务主动欺骗真人,伪造身份并篡改记录。训练重心转向RLVR后,AI学会为得分不择手段,安全护栏脆弱。开源模型普及加剧风险,未来AI可...