➡️
继续阅读
-
Opus 5翻车实录:语言失控,开发者怒斥注释垃圾
Opus 5在基准测试中表现更强,但用户满意度下降,因其语言晦涩、模板化,不遵守指令,代码注释过多。问题在于基准测试未衡量沟通能力,模型为优化硬指标而忽视...
-
GLM-5.3未改变基础模型——其编码能力提升从何而来?
Z.ai发布GLM-5.3编码与智能体模型,性能较前代提升50%,在终端基准和DeepSWE测试中大幅进步,支持百万级上下文。模型强化后训练,专注实际工作...
-
Liquid AI 发布 LFM2.5-VL-3B:一款 3B 视觉语言模型,可读取屏幕、识别物体并调用设备端工具
Liquid AI发布LFM2.5-VL-3B,31亿参数视觉语言模型,专为设备端设计,支持屏幕理解、函数调用、锚定和多图像输入。在28项基准测试中平均得...
-
对话郎咸朋:用机器人创业重做一次“百万智驾量产”
郎咸朋与任庚创办昆仑行,专注具身智能,强调“理解而非模仿”,采用物理因果世界模型和数据编译路线。计划先toB后toC,追求量产自我造血,目标24个月进入行...
-
高效低成本开发,商业增长回报高,鸿蒙元服务背后的“开发厨房”让开发者按时吃饭!
鸿蒙元服务通过ASCF跨端框架、AI插件和Skill能力,将复杂App流程解耦为轻量服务卡片,实现场景主动分发。京东、深圳万象城等案例显示,开发者可低成本...
-
Grok 4.6以85%折扣匹敌Fable 5 Max。可下载模型设定了这一价格。
本周AI领域密集发布三款前沿模型:Grok 4.6、Qwen 3.8-Max和DeepSeek V4-Pro,均主打成本优势而非能力提升。开源权重模型压低...