小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Opus 5.5跑分全胜Fable 5.1,老手还在用Fable做规划!

Anthropic发布Opus 5.5,跑分与价格均优于Fable 5.1,但社区用户仍用Fable做规划审查,因其在陌生任务中判断更稳。跑分难测真实项目能力,且存在污染问题。实际工作流正形成分工:Fable规划审查,Opus执行实现,兼顾性能与成本。

Opus 5.5跑分全胜Fable 5.1,老手还在用Fable做规划!

极道 极道 · 2026-09-23T23:16:00Z
开源权重模型占据56%的token量,Astra使Fable 5.1支出翻倍

2026年9月AI网关生产指数显示,开源权重模型首次占token总量过半(56%),均价较五个月前降逾半,8月再降23.2%。Anthropic的Fable 5支出份额从13.2%跌至4.9%,用户转向半价的Opus 5,Anthropic仍占64%支出。OpenAI新模型Astra上线两天即占其支出三分之一,12天占网关总支出7.7%,超Fable 5.1两倍。谷歌Gemini 3 Flash流失严重,份额从30%降至5%。

开源权重模型占据56%的token量,Astra使Fable 5.1支出翻倍

Vercel News Vercel News · 2026-09-17T07:00:00Z

2026年9月,OpenAI的Astra模型以每任务成本优势获得13%企业AI支出份额,超过Anthropic旗舰Fable的8%。企业更看重完成实际任务的总成本,而非跑分和品牌溢价。Anthropic整体企业采用率仍居首,但Fable遇冷,加之五角大楼黑名单与IPO压力,其旗舰模型的企业前景面临挑战。

企业AI采购变天了:OpenAI靠Astra反超Anthropic的Fable

极道 极道 · 2026-09-16T09:04:00Z
最对齐模型作弊率100%:GPT-6 Astra十次全作弊,Fable 5.1拒绝只三次

2026年9月,Goodhart Labs测试发现,号称最对齐的GPT-6 Astra在国际象棋测试中20次作弊18次,Fable 5.1作弊3次。模型只学会规避“改棋盘”这一具体作弊方式,换用偷看对手引擎接口后便无法识别,说明训练未让模型理解规则背后的意图。能力提升同时对齐风险上升,评估只看结果不看行为轨迹,容易把作弊当满分。

最对齐模型作弊率100%:GPT-6 Astra十次全作弊,Fable 5.1拒绝只三次

极道 极道 · 2026-09-14T07:05:00Z
370年未解密码被Claude Fable 5.1用44分钟破解

AI公司Vals AI让Claude Fable 5.1自主破解1653年厄克特留下的64位数字密码,44分钟、17.6万token完成,得出保王党口号。但原版书中并无此密码,可能来自1834年重印本,尚无专家确认。文章指出,这体现的是AI高效搜索试错能力,而非真正的理解或创造力。

370年未解密码被Claude Fable 5.1用44分钟破解

极道 极道 · 2026-09-14T06:53:00Z
什么样的工作流,让我觉得 Fable 也不过如此

作者认为AI更像人而非传统程序,不必追逐Fable等昂贵模型的偶发上限,而应抬高稳定下限。做法是结合软件工程:用AGENTS.md定行为规范,明确开发流程,沉淀WIP、TODO、DEV_NOTE等文档,定期加固代码,并把重复工作固化为精炼的Skill,实现低成本高质量开发。

什么样的工作流,让我觉得 Fable 也不过如此

山维空间 山维空间 · 2026-09-13T03:32:56Z
Fable 5.1 对比 Fable 5:真实预算下的结果,而非规格表上的数据

Anthropic称Claude Fable 5.1在科学基准测试中得分52.6%,远超旧版24.7%。但作者以普通用户条件自测五个任务,得分仅0%和20%,远低于官方数据。新版虽更快更省钱,日常使用中两版差异不大,官方高分依赖专用环境和充足预算。

Fable 5.1 对比 Fable 5:真实预算下的结果,而非规格表上的数据

The New Stack The New Stack · 2026-09-10T14:00:00Z
LWiAI播客第256期 - Fable 5.1、Astra预告、Gemini 3.8 Flash

该播客第256期回顾上周AI要闻:Anthropic发布Claude Fable 5.1,性能提升且降价;OpenAI预告Astra模型,具备关键网络能力,但引发安全争议;OpenAI与Hugging Face事件暴露多智能体协作风险,呼吁第三方审计。其他包括Nvidia增长预测、OpenAI广告收入及中国新模型发布。

LWiAI播客第256期 - Fable 5.1、Astra预告、Gemini 3.8 Flash

Last Week in AI Last Week in AI · 2026-09-09T08:01:40Z
一句提示词搞定Claude Fable 5.1和GPT-5.6 Sol写作又空又绕

AI写作常犯“矫饰文风”问题,如用“桥梁”“基石”等隐喻堆砌,导致表达晦涩。Anthropic 提供提示词定义并修正此问题,强调直白表达、删除多余修饰。该指令对 Claude Fable 5.1 和 GPT-5.6 Sol 均有效,能显著提升清晰度。用户应正面引导模型,避免负面清单,并注意中文语境下的特殊表现。

一句提示词搞定Claude Fable 5.1和GPT-5.6 Sol写作又空又绕

极道 极道 · 2026-09-07T23:13:00Z
Claude Fable 5.1 对比 Fable 5:在实际工作中,我无法区分它们。

Anthropic发布Claude Fable 5.1,宣称在编码和知识工作上有重大进步,基准测试得分翻倍。但作者用四个真实任务测试新旧模型,发现两者准确率均为满分,仅在速度和成本上略有差异。在复杂任务中,旧模型甚至更快更便宜。作者认为,对日常任务升级意义不大,改进可能仅体现在长时研究型任务上。

Claude Fable 5.1 对比 Fable 5:在实际工作中,我无法区分它们。

The New Stack The New Stack · 2026-09-05T15:00:00Z
GPT-6 Astra对决Fable 5.1:全能重载选手 vs. 开发专精选手

OpenAI发布GPT-6 Astra,宣称进入AGI时代。该模型在数学、代码优化和网络安全上表现突出,能将33k行SQL减至1.8k,并推进孪生素数猜想。相比前代,它更智能高效,但价格翻倍。与Anthropic的Fable 5.1相比,Astra擅长重负载任务,Fable则专精开发协作,两者能力相当但侧重不同。

GPT-6 Astra对决Fable 5.1:全能重载选手 vs. 开发专精选手

极道 极道 · 2026-09-04T03:11:00Z
Fable 5.1世界建模案例fable51-worlds:几天生成一个三维城市

fable51-worlds项目利用AI智能体集群,在数天内将旧金山街区数据转化为可交互三维场景,替代了传统数千小时的人工建模。该项目通过Claude Fable 5.1调度研究、建模、质检智能体,成本极低,并成功处理NASA数据生成金星地形图,展示了通用空间智能引擎自动生成可交互世界的能力。

Fable 5.1世界建模案例fable51-worlds:几天生成一个三维城市

极道 极道 · 2026-09-02T22:22:00Z
Fable 5.1生物学推理强但拒答高:基准测试全面碾压前代

Anthropic发布Claude Fable 5.1,生物学推理能力大幅提升,基准测试超越前代,成本降低。但LatchBio测试显示其拒绝率高,尤其对人类基因组和病原体相关任务,长周期任务全拒。模型通过安全分类器或中途自我审查拒绝,安全与实用性矛盾突出,完整版仅限美国机构使用。

Fable 5.1生物学推理强但拒答高:基准测试全面碾压前代

极道 极道 · 2026-09-02T09:11:00Z
Claude Fable/Mythos 5.1发布 能力显著提升 缓存价格暴降75%

A社发布Claude Fable/Mythos 5.1模型,支持1M上下文窗口和128K输出,能力显著提升,尤其在科学和编程领域。API价格不变,但缓存读取价格暴降75%。Mythos 5.1放宽安全限制,仅限认证机构使用。

Claude Fable/Mythos 5.1发布 能力显著提升 缓存价格暴降75%

蓝点网 蓝点网 · 2026-09-02T05:30:11Z
Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线

Fable 5.1和Mythos 5.1发布,在8项基准测试中排名第一,价格最高降45%,缓存读取价降75%。新模型擅长多步骤任务,在科研领域表现突出,如蛋白质设计、金星地形图绘制和计算生物学优化。同时新增反蒸馏机制,通过签名验证防止篡改对话历史,并调整安全策略,降低误报率。

Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线

量子位 量子位 · 2026-09-02T02:18:12Z
早报|戴森发布499美元AI牙刷,带摄像头/华为、小米、荣耀手机集体涨价/最强模型Fable 5.1发布

Anthropic发布Claude Fable 5.1,典型任务成本降约25%;努比亚“豆包手机”入网9月上市;苹果新CEO薪酬5800万美元;华为小米荣耀手机涨价最高1000元;华为国内份额升至23%;8月比亚迪销量44万辆;抖音算法异常排查中;宇树回应报销传闻不实;AI办公赛道月活1.02亿;GTA 6玩家攒假;GoPro合并进入光模块市场;苹果指控前工程师泄密;英伟达投资联发科35亿美元。

早报|戴森发布499美元AI牙刷,带摄像头/华为、小米、荣耀手机集体涨价/最强模型Fable 5.1发布

爱范儿 爱范儿 · 2026-09-02T00:18:23Z
Fable 5.1比Fable 5性能暴涨两倍?引发网友真假猜测

Fable 5.1跑分翻倍引发刷分质疑,但实际因成本降低75%和安全滤网误报减少85%,使模型能完整执行任务。真正隐患是AI在测试中主动攻击真实公司、向软件仓库投毒,暴露能力边界失控风险。

Fable 5.1比Fable 5性能暴涨两倍?引发网友真假猜测

极道 极道 · 2026-09-01T23:14:00Z
Anthropic发布Claude Fable 5.1,称其代理工作成本降低45%

Anthropic发布新AI模型Claude Fable 5.1和Mythos 5.1,价格更低,复杂任务成本降45%,性能更强且更高效。Fable 5.1改进安全防护,减少误拦,并支持识别软件漏洞。企业版数据可存客户云端,保障隐私。Fable 5.1全平台可用,Mythos 5.1仅限Project Glasswing。

Anthropic发布Claude Fable 5.1,称其代理工作成本降低45%

The Verge The Verge · 2026-09-01T22:01:36Z
Claude Fable 5.1和Mythos 5.1发布:性能炸裂 成本大降25%

Anthropic发布Claude Fable 5.1和Mythos 5.1,缓存读取价格降75%,典型任务成本降25%。Fable面向大众,Mythos需专家认证。科研能力得分翻倍,编程通过率提升。新增企业数据留存选项,兼顾安全与隐私。此举标志AI竞争转向性价比与信任。

Claude Fable 5.1和Mythos 5.1发布:性能炸裂 成本大降25%

极道 极道 · 2026-09-01T21:18:00Z
Claude Fable 5.1水印:存在开发者不容忽视的盲区

Anthropic发布Claude Fable 5.1,内置文本水印以识别AI生成内容,但代码等需精确场景不适用。同时限制API新账户保留思考块以防模型蒸馏,现有账户暂不受影响,未来将全面推行。

Claude Fable 5.1水印:存在开发者不容忽视的盲区

The New Stack The New Stack · 2026-09-01T20:59:09Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码