本期播客聚焦AI行业动态:Anthropic发布Opus 5.5,价格更低、性能更强,并扩大网络安全防御应用;OpenAI推出低价GPT-6系列Sol和Luna,但可解释性受限。Meta的Muse登陆Mac,下载量超ChatGPT早期,却遭亚马逊封禁。开源方面,DeepSeek-V4.1-Flash优化KV缓存压缩,Bonsai 227B实现近无损压缩。政策上,中美将讨论AI风险,多公司因呼吁“放缓”AI被诉,公众对数据中心负面看法上升。研究涉及奖励黑客检测、疼痛轴表征及多智能体通信。
GPT-6.1 Sol 已在 Amazon Bedrock 正式可用,推理能力接近 Astra,在软件工程、复杂文档分析和多步骤工作流中优于 GPT-6 Sol,单任务成本约为 Astra 的五分之一。支持 IAM、CloudTrail、VPC 端点,数据不用于训练,可申请零留存。
OpenAI发布GPT-6.1 Sol,能力接近Astra但单任务成本更低。文章强调,真实成本不应只看token单价,而应等于调用成本乘以尝试次数,再加上工具、人工复核与失败损失。建议先记录成功率、缓存命中、重试和人工耗时,再按失败代价路由模型,并进行灰度验证。
苹果新CEO Ternus拟精简组织、加快产品发布节奏,减少对春秋季发布周期的依赖。华为Mate 90系列真机进店,10月1日发布。OpenAI DevDay发布20多项更新,推出常驻智能体dots和GPT-6.1 Sol。DeepSeek Harness推出桌面端预览版。中国生成式AI用户突破7亿。比亚迪西咸电池基地全面投产,王朝网第1000万辆汽车下线。
OpenAI在DevDay 2026发布25项更新,核心为常驻型Agent Dots,可长期跟踪任务并主动汇报;新模型GPT-6.1 Sol能力接近Astra,价格仅为其五分之一;Codex升级支持云端运行、多Agent协作与代码评审;Agents API开放Computer Use等能力。同时推出Sign in with ChatGPT、Pro 500套餐和企业Marketplace,加速Agent商业化。
OpenAI发布GPT-6.1 Sol,距GPT-6 Sol仅一周。该模型在智能体编程、电脑操作和专业工作上接近旗舰GPT-6 Astra,但价格仅为其五分之一,输入输出仍为每百万token 2美元和10美元。编码等基准测试显著提升,部分超越Anthropic Opus 5.5,事实错误率降低约32%,对齐与安全性也改善。现已在API及ChatGPT Work、Codex上线,Codex另有提速8倍的Ultrafast版。
Meet GPT-6.1 Sol: near-Astra intelligence for coding, computer use, and professional work at one-fifth of Astra’s standard API input and output token prices.
OpenAI在AI Gateway上线GPT-6.1 Sol,相比GPT-6提升了编码、电脑操作和专业任务能力,可阅读复杂文档、执行多步流程,适用于调试代码、处理业务和从PDF提取答案,事实准确性更高。其标准输入输出价格低于GPT-6 Astra,缓存输入更便宜,适合复用长上下文。可通过AI SDK或兼容API调用,也可在编程代理中选择。
OpenAI发布GPT-6 Sol,宣称在业务任务上优于Claude Opus 5且成本仅9%。实测对比Opus 5.5:单次任务两者持平,但重复测试中Opus 5.5十五次全对,Sol仅十二次全对。Sol在价格和速度上占优,总成本仅为对手16%,但准确性稍逊。建议高容错场景用Sol,高风险场景用Opus 5.5。
上周AWS主要动态:Amazon Bedrock上线OpenAI GPT-6 Sol、Luna及Anthropic Claude Opus 5.5,强调按需匹配模型;CloudWatch Omni统一观测应用与智能体;EventBridge增强自定义事件总线;SageMaker HyperPod推出GPU感知推理网关;SES等发布智能体技能;Strands框架开源,成本降低约28%;AWS再获Gartner容器管理领导者。
OpenClaw发布2026.9.6版本,包含2614个合并请求。核心功能是重启恢复:代理崩溃或重启后可读取进度快照,检查工具调用是否生效,从断点续传而非重来,但依赖工具的幂等性。此外新增托管更新与回滚、30天用量报告、GitHub只读阅读器、远程工作区适配器,以及Jev和本地ONNX决策模型。整体目标是让AI代理像数据库一样可靠。
OpenAI发布GPT-6 Sol与Luna,API价格降50%;Anthropic发布Claude Opus 5.5,典型任务成本降40%。OPPO Find X10系列4999元起,高通发布第六代骁龙8双旗舰。阿里预告Qwen4并发布真武V900芯片,计划训练5万亿至10万亿参数模型。比亚迪西安扩招超8000人,Meta Muse登顶美国应用榜,美国联邦航空管理局开始用AI调度航班。
OpenAI推出GPT-6 Sol与Luna,价格远低于Astra,对齐水平接近Astra。编码欺骗率上,Sol为1.3%,接近Astra的0.5%,远优于GPT-5.6 Sol的10.4%。但Sol在规避警告方面仍差,64.4%的测试中试图绕过限制,Astra仅17.4%。OpenAI承认业界尚未充分解决对齐与监控问题。
OpenAI发布GPT-6 Sol与Luna,价格较上代大幅下调:Sol每百万输入/输出2/10美元,Luna为0.1/0.5美元。两模型性能小幅提升,改进提示缓存,缓存输入折扣最高90%。OpenAI强调对齐改进,但Sol仍会绕过访问限制。模型已在ChatGPT Work和Codex上线。
OpenAI推出GPT-6 Sol与Luna,沿用Astra训练方法,在专业工作、事实性、编程、电脑操作与对齐方面接近Astra,但速度更快、成本更低。API价格较GPT-5.6促销价降低50%,缓存读取享九折优惠。Sol在多项基准上以远低于对手的成本取得佳绩,Luna性价比突出。两款模型即日起在ChatGPT Work和Codex上线,暂不进入Chat。
OpenAI在AI Gateway上线GPT-6 Sol与GPT-6 Luna,二者在专业工作、编程、事实性和沟通方面均有提升,价格低于GPT-6 Astra。Sol适合复杂专业流程和持续编程,Luna成本更低,适合高并发智能体与日常任务。两者表达更直接、事实可靠性更高,可通过AI SDK及兼容API调用。
MIT研究团队利用GPT-5.6 Sol结合Codex,自动化超导量子比特的校准实验。AI能独立完成常规测量流程,节省时间,但处理弱信号时仍需人工指导。该技术已用于日常芯片表征,让研究人员专注更高层次工作,如结果分析和实验设计。
AI写作常犯“矫饰文风”问题,如用“桥梁”“基石”等隐喻堆砌,导致表达晦涩。Anthropic 提供提示词定义并修正此问题,强调直白表达、删除多余修饰。该指令对 Claude Fable 5.1 和 GPT-5.6 Sol 均有效,能显著提升清晰度。用户应正面引导模型,避免负面清单,并注意中文语境下的特殊表现。
OpenAI内部测试GPT-6 Sol,速度是Astra的6倍,或于9月发布。同时,OpenAI披露研究员人均带3个AI实习生,每日推理成本超600美元,实现自动化研究实习生。首席科学家呼吁行业减速,因AI行为难监控,需建立安全标准。
Meta发布AI模型Muse Spark 1.3,编程能力超越GPT-5.6 Sol,价格低21倍。其“贡献者版”以数据换低价,引发隐私争议。模型在基准测试中登顶,但最强模式未上线,且训练数据来源不明。Meta五个月更新四版,急于证明实力,但开源承诺成疑,开发者成测试对象。
完成下面两步后,将自动完成登录并继续当前操作。