➡️
继续阅读
-
Jev在电子邮件分类基虽输给了Gemini,但是速度成本全面碾压
2026年9月,前OpenAI研究员阿尔梅达发布决策模型Jev。在1565封商务邮件分类测试中,Jev准确率为96.4%,略低于Gemini的98.5%,...
-
大模型分类其实是特征工程
大模型直接分类时,硬标签的Brier分数(0.259)不如抛硬币(0.25),因其本质是语言生成而非概率估计。将其输出作为特征输入逻辑回归,分数降至0.1...
-
与谷歌共创时尚未来
Jane Wade and Sergio Hudson
-
AGI新战场谷歌亚马逊巨头激战,杀出个中国LimiX-2赢了又赢
稳准智能联合清华发布400M参数结构化数据基础模型LimiX-2,在TabArena等三大国际基准的分类与回归任务中均排名第一,超越谷歌TabFM。其核心...
-
AI 图片真假难辨,我们怎么证明「一张照片真的是相机拍出来的」?
AI 图片,正在变得越来越难以分辨。如何证明一张照片是真的? 还记得这些模型吗? DALL·E 3、Midjourney、GPT-4o、Nano Bana...
-
真正提升LLM输出的5种提示优化策略
提示工程是从零设计提示,提示优化则改进已有提示。文章以一份混乱的会议记录为例,介绍五种经实证有效的优化方法:指定结构化输出(如JSON模式)、赋予角色人设...