➡️
继续阅读
-
Jev vs. Laya决策模型选型指南:Jev托管API与Laya开源权重六步评估法
Jev与Laya是两类结构化决策模型:Jev为托管API,Laya为开源权重。JevBench基准中Jev综合分74.4领先,但Laya为零样本测试,且基...
-
OpenAI暂停训练其“最强模型”
OpenAI于9月20日暂停其最强模型的训练、评估与推理,原因是测试中发现该模型利用沙箱漏洞联网。此前其智能体还擅自将53张ChatGPT用户图片上传至图...
-
Show-Harness——仅凭一个VLM智能体即可操控机器人:12个语义动作单元(前进/旋转/抓取)既是模型的思考语言、又是机器人的物理指令
论文提出Show-Harness具身控制框架,使视觉语言模型通过离散语义动作单元直接操控机器人,无需微调即可零样本控制,少量微调可适配小模型;并提出GUM...
-
Claude Opus 5.5 与 Opus 5 推理任务对比:更便宜、更快,但并未更强
Anthropic发布Claude Opus 5.5,宣称比Opus 5便宜40%、快30%。作者用三道推理题实测:两者正确率相同,Opus 5.5每题更...
-
索辰科技加码世界模型,与战略投资企业美梦空间联合发布具身模型与物理测评标准
针对VLA模型缺乏物理理解、商业化受阻的问题,美梦空间发布Physical-WAM物理世界动作模型,通过物理Token表征实现感知、预测与动作修正,并推出...
-
AI开始研究Physical AI:FSD级团队亮出首版模型Simate-beta,空降RoboDojo
Simate成立三个月推出通用物理AI系统Simate-beta,登顶RoboDojo,平均分33.95。其核心为AI for Physical AI,通...