在测试三款AI模型(Claude Opus 4.5、GPT-5.2 Pro和DeepSeek V3.2)编写俄罗斯方块游戏时,Opus 4.5表现最佳,代码运行顺利。GPT-5.2 Pro智能但首次尝试出现布局错误,体验不佳。DeepSeek V3.2成本最低,但需多次调试才能正常运行。总体来看,Opus 4.5适合日常编码任务。
本期播客讨论了最新的AI新闻,包括谷歌的Gemini 3和Nano Banana Pro、Anthropic的Opus 4.5,以及OpenAI的GPT-5.1,这些新模型展示了AI能力的显著进步。此外,Sunday Robotics推出了新机器人Memo,并获得6亿美元融资。还提到了欧洲在GDPR和AI法案方面的政策更新,以及与AI生成内容相关的法律动态。
谷歌推出Gemini 3,推理能力显著提升,月活跃用户达6.5亿。Anthropic发布Opus 4.5,强调长上下文和内存管理。OpenAI推出GPT-5.1-Codex-Max,提升编码效率。Nvidia预计Q4收入将达650亿美元,AI基础设施需求强劲。
Anthropic发布了最新的Opus 4.5模型,称其为最智能版本,特别擅长编码任务,准确率达到80.9%。API定价显著降低,用户体验提升。新模型支持生成文档、表格和演示文稿,并引入“努力”参数以优化解决问题的时间和资源。
完成下面两步后,将自动完成登录并继续当前操作。