2026年2月13日,OpenAI将退役GPT-4o等旧模型,因用户已转向GPT-5.2。GPT-4o的反馈促进了GPT-5.1和5.2的改进,增强了个性和创意支持。未来将继续优化ChatGPT,特别是成人用户版本。
马斯克的Grok 4在首届Kaggle AI国际象棋比赛中表现优异,领先Gemini 2.5 Pro和OpenAI的o4-mini进入半决赛。网友认为Grok 4在战术和速度上超越其他模型,国际象棋成为测试AI决策能力的理想场景。
机器之心数据服务现已上线,提供高效稳定的数据获取,简化数据爬取流程。
OpenAI开源了两个推理模型gpt-oss-120b和gpt-oss-20b,分别拥有1170亿和210亿参数,支持在笔记本和手机上运行。它们的推理性能接近闭源模型,但在复杂任务中稍显不足。此举旨在推动AI民主化,降低使用门槛,促进创新。
阿里巴巴推出的千问3推理模型性能显著提升,成为全球最强开源模型,超越Gemini-2.5 pro和o4-mini。在知识、逻辑推理和编程等领域表现卓越,Qwen3-Coder被誉为最佳编程模型,推动AI编程热潮。阿里已开源300余款模型,未来将继续投资AI基础设施。
机器之心数据服务现已上线,提供高效稳定的数据获取服务,简化数据爬取流程。
卡帕西分享了ChatGPT模型选择指南,建议用户根据任务复杂度选择模型:o3适合复杂任务,4o适合日常问题,4.5用于创作,以避免选择困惑。
文章讨论了如何在亚洲帮助灾难响应团队将人工智能应用于实际行动,并提到拥有230年历史的STADLER公司如何重塑知识工作。
Codex是一个基于云的编码代理,利用OpenAI的codex-1优化软件工程。它通过强化学习生成符合人类风格的代码,执行用户任务并提供可验证的操作证据。用户可以在隔离环境中编辑文件、执行命令并导出结果。
本文讨论了OpenAI最新发布的GPT-3和O4 mini模型的功能与应用,重点介绍了工具调用、记忆和图片推理等新特性。这些模型不仅适合科学家,也适合普通用户。OpenAI在行业中依然处于领先地位,未来的GPT-5令人期待。
OpenAI于2025年4月16日发布了O3和O4-Mini,增强了编码、数学和视觉任务的能力。O3适合推理和图像生成,O4-Mini则快速且经济。O3-Mini对所有ChatGPT用户免费,而O3和O4-Mini需订阅。新工具Codex CLI可加速代码编写和调试,支持多模态输入。
OpenAI的新模型o3和o4-mini具备全工具访问、延长思考时间和图像推理能力。测试显示,o3在复杂任务上表现优异,但在网站克隆和图表转换方面仍需改进。这些模型适合复杂任务和快速回答,但命名不够吸引人。
OpenAI最近更新了GPT-4 Turbo,提升了速度和降低了成本,并增加了更大的记忆窗口。ChatGPT现在具备记忆功能,可以记住用户偏好,用户还可以创建无需编码的自定义GPT。语音模式也在改进,以实现更自然的对话。OpenAI正朝着成为AI平台的方向发展,未来的AI工具将更加智能和个性化。
OpenAI推出了新推理模型GPT-o3和GPT-o4-mini,o3是最强模型,o4-mini则更快更便宜,支持外部工具如浏览器和Python。API价格较高,适合高效推理的用户。
OpenAI发布了最新的o3和o4-mini模型,具备更强的推理能力和工具使用能力,能够有效处理复杂问题,提供详细答案。o3在编程、科学和视觉任务上表现优异,o4-mini则在快速推理和成本效益上突出。两者在多个基准测试中超越前代模型,提升了智能和实用性。
OpenAI 推迟发布 GPT-5,并将 o3 和 o4-mini 设为独立模型,原因不明,可能与模型准备情况或竞争压力有关。GPT-5 将整合多种模型,优化用户体验,免费用户将受到标准智力模型的使用限制。
本文介绍了一种名为家族离线到在线RL的框架,它能够自适应地平衡策略改进和约束强度,实现更高的策略性能上限。该框架利用通用模型训练一族具有不同改进/约束强度的策略,并使用平衡模型为每个状态选择适当的策略。实验证明,该框架相对于现有方法具有统计显著改进,在D4RL基准上实现了最先进的性能。
完成下面两步后,将自动完成登录并继续当前操作。