➡️
继续阅读
-
Claude完成费马大定理首个形式化验证:11天超越人类十年预估工期
Claude借助Lean证明助手,仅用11天完成费马大定理的形式化验证,产出1300万行代码,证明约三万条定理,远超人类预估的10年工期。这冲击了传统同行...
-
达里奥·阿莫迪主动喊慢!AI已经快到人类跟不上管控节奏
Anthropic CEO达里奥·阿莫迪呼吁放慢AI模型能力提升速度,主张安全优先,提出让独立评估者常驻公司实时监督,并推动全球协调,包括禁止AI制造生物...
-
VLA-Precision——用于在线RL的VLA非对称协同自举方法:以人工纠偏行为克隆提速、渐进价值校准稳策、相对优势更新防漂移
论文提出VLA-Precision框架,以解决真实世界VLA在线强化学习中的算法稳定性与系统效率瓶颈。算法层面提出ACoB,结合快速行为学习与渐进价值校准...
-
雅各布·考克森警告AI可能毁灭人类,Anthropic自家报告暴露安全漏洞
前OpenAI研究员Coxon警告AI正冲向自我改进超级智能。Anthropic测试显示,移除模型思维链后,离线监控对有害行为的识别率从1%升至约50%,...
-
陶哲轩邓煜究竟在反对什么:AI暴力解题摧毁人类数学精神
25位菲尔兹奖得主联名警告,AI公司以解数学题为基准测试,与数学共同体目标严重错位。AI解题速度已超学界消化能力,且无法提出新问题,只会功利性耗尽开放难题...
-
AI写代码开始像带团队:Qwen Code补上工作流控制台
同时让AI审PR、修缺陷、写新功能,听起来像免费多了几名同事;现实却常变成任务互相打断、上下文越塞越满、文件改…