➡️
继续阅读
-
大模型不只是预测下一个词:RLVR让它自己跟自己下棋
大模型不再仅依赖预测下一个词,通过RLVR强化学习,它能自主探索解题路径,从模仿者转变为探索者。预训练如同背诵课文,而RLVR则类似自我解题,借助可验证奖...
-
并行策略总览:六个维度各切什么、怎么通信
本文介绍大模型并行训练的核心概念,将DP、TP、SP、PP、EP、CP六种并行方式按切分维度、显存减少、通信开销和等待关系列表对比。并行本质是切分模型并引...
-
Codex向部分用户赠送第二张重置卡 GPT-6 Astra也开始推送
OpenAI近期推送GPT-6 Astra模型,初期面向部分用户,Plus、Pro和Enterprise用户情况混乱。部分用户收到新重置卡作为补偿,少数P...
-
把Agent放进真实尺度香港,上交大/新加坡国立大学/美团等提出UrbanGround,测试多模态模型城市探索能力
该文章介绍了一项关于多模态大语言模型(MLLM)在城市导航中能力的研究。研究团队构建了基于香港真实地理数据的URBANGROUND交互环境,评测了GPT-...
-
GPT-6 Astra画出初音未来:Midjourney和DALL-E都做不到这一步!
OpenAI发布GPT-6 Astra,能像人类画师一样操作绘图软件,一笔一笔画出初音未来,颠覆传统AI生成方式。它具备强大计算机使用能力,可操作多种软件...
-
OpenClaw v2026.9.2发布:提升可靠性和性能 接入GPT-6 Astra和Muse Spark
OpenClaw v2026.9.2发布,聚焦可靠性与性能,支持重启后任务恢复、长对话提速,并接入GPT-6 Astra和Muse Spark模型。其核心...