➡️
继续阅读
-
OpenAI拟按结果付费,但有个问题
OpenAI正试验按结果付费模式,企业客户仅在AI成功完成任务时付费,而非按token计费。此模式面临挑战:需明确任务成功标准,复杂任务如编码或长流程代理...
-
在真实世界数据集上微调SOTA目标检测模型
本文介绍了在PyCharm中微调YOLO12、YOLO26和RF-DETR等SOTA目标检测模型的方法。作者先在COCO数据集上验证基线性能,再测试零样本...
-
DeepSeek首款视觉模型对比Gemini 3.7 Flash:成本与速度的权衡
DeepSeek发布V4 Flash Vision Exp,支持图像输入,价格低于Gemini 3.7 Flash。测试显示两者在图表、发票和日志分析中准...
-
从排行榜到模型画像:面向智能体编码的大语言模型深度评估
JetBrains研究团队提出一种超越“解决率”的编码智能体评估方法,从结果、效率、补丁质量和过程四个维度分析模型轨迹。对比Claude Opus 4.7...
-
索尼音乐与华纳联合起诉Anthropic 指控其未经授权盗用大量歌词训练AI模型
索尼音乐与华纳起诉AI公司Anthropic,指控其未经授权使用版权歌词训练Claude模型,要求每首侵权歌曲赔偿15万美元。此前Anthropic已因盗...
-
AQuA:让量化研究 Agent 持续进化,也让回测结果经得起检验
AQuA系统由普林斯顿、蚂蚁和斯坦福团队开发,用于自主量化交易研究。它通过分离数据路径与评价规则,防止数据泄漏和过拟合,使Agent能可靠积累证据。实验显...