➡️
继续阅读
-
大模型不只是预测下一个词:RLVR让它自己跟自己下棋
大模型不再仅依赖预测下一个词,通过RLVR强化学习,它能自主探索解题路径,从模仿者转变为探索者。预训练如同背诵课文,而RLVR则类似自我解题,借助可验证奖...
-
并行策略总览:六个维度各切什么、怎么通信
本文介绍大模型并行训练的核心概念,将DP、TP、SP、PP、EP、CP六种并行方式按切分维度、显存减少、通信开销和等待关系列表对比。并行本质是切分模型并引...
-
AI 范式雷达:《外壳走上台前:Agent 的竞争从换模型转向换 Harness》
FrontierHarness Eval评测显示,同一模型下不同执行外壳的任务通过率差异达16.7%,成本相差17倍,竞争焦点从模型转向外壳基准化。厂商如...
-
从AI代码到可信软件:工程约束的实践
文章探讨了“工程约束”如何通过仓库强制执行标准,确保AI生成代码的质量与问责。它强调权限、质量门、证据和可观测性,并描述了从辅助到自主的成熟度阶段。核心是...
-
AI时代重审欧陆哲学:卡尔纳普语言手术刀再杀海德格
卡尔纳普的逻辑实证主义虽被视为失败,但其方法论已深入分析哲学。他反对“第一哲学”,主张以逻辑分析语言,影响深远。当代形而上学复兴实为技术化分支,非传统宏大...
-
看 NocoBase 的分支更新:AI 无代码平台进生产前,先把风险边界想清楚
NocoBase开源AI无代码平台更新,维护main、next、develop三分支,生产环境应用稳定版。文章强调AI无代码平台非黑盒,需关注配置导出、迁...