小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ

文章探讨了从“推理思维”向“智能体思维”的转变,强调模型评估和期望的变化。智能体思维注重通过行动进行推理,强调环境设计和系统解耦的重要性。未来的智能将依赖于多个智能体的协作,推动从训练模型到训练智能体的演变。

[译] 大模型训练的中场叙事:从 Reasoning Thinking 转向 Agentic Thinking (2026)

ARTHURCHIAO'S BLOG ARTHURCHIAO'S BLOG · 2026-07-05T00:00:00Z
微软在Build大会发布七款MAI新模型:顶尖MAI-Thinking-1深度拆解

微软在Build大会上发布了七款新AI模型,特别是MAI-Thinking-1,展示了其完整的AI产业链。通过自研MAIA芯片和大量人类数据训练,微软实现了高效的模型训练和持续进化,降低了成本,增强了竞争优势,目标是超越其他AI公司。

微软在Build大会发布七款MAI新模型:顶尖MAI-Thinking-1深度拆解

极道 极道 · 2026-06-05T00:40:00Z
OpenAI推出GPT-5.4 Thinking和Pro版本

OpenAI推出了GPT-5.4模型,具备更强智能和更少错误,支持文档和表格功能。新模型定价较高,但使用效率提升,适合处理复杂任务。GPT-5.4 Thinking和Pro版本已上线,面向不同用户群体。

OpenAI推出GPT-5.4 Thinking和Pro版本

The New Stack The New Stack · 2026-03-05T18:00:26Z
即刻体验国内最强推理模型Qwen3-Max-Thinking,千问PC和网页端已接入

抱歉,您提供的文本内容过于简短,无法进行有效总结。请提供更详细的文章内容。

即刻体验国内最强推理模型Qwen3-Max-Thinking,千问PC和网页端已接入

机器之心 机器之心 · 2026-01-27T05:34:43Z
美团 LongCat-Flash-Thinking-2601 发布,工具调用能力登顶开源 SOTA!

美团LongCat团队发布了LongCat-Flash-Thinking-2601模型,具备卓越的智能体搜索和工具调用能力,支持重思考模式,提升决策质量。该模型在编程和数学推理等评测中表现优异,已开源并可在线体验,旨在降低开发者使用门槛。

美团 LongCat-Flash-Thinking-2601 发布,工具调用能力登顶开源 SOTA!

美团技术团队 美团技术团队 · 2026-01-20T00:00:00Z

英伟达收购SchedMD,旨在增强其在高性能计算和AI领域的竞争力。SchedMD的Slurm系统被全球超过一半的TOP500超级计算机及多家科技公司使用,提供高效的算力调度。收购后,英伟达将整合技术,提升生态系统影响力,并承诺保持Slurm的开源属性,但外界对其持续开发能力表示担忧。

英伟达护城河又宽了!低调收购开源算力调度王牌工具,全球过半顶级超算在用,Thinking Machines也离不开它

量子位 量子位 · 2025-12-17T04:21:22Z
GPT-5系统卡更新:GPT-5.2

GPT-5.2是最新的GPT-5系列模型,其安全缓解方法与GPT-5和GPT-5.1相似。文中提到GPT-5.2 Instant和GPT-5.2 Thinking的不同名称。

GPT-5系统卡更新:GPT-5.2

OpenAI OpenAI · 2025-12-11T00:00:00Z
GPT 5.1模型现已在Vercel AI Gateway中上线

OpenAI推出了GPT-5.1 Instant和GPT-5.1 Thinking模型,用户可通过Vercel的AI Gateway访问。Instant模型增强了指令执行和对话能力,Thinking模型则优化了性能以适应不同任务。

GPT 5.1模型现已在Vercel AI Gateway中上线

Vercel News Vercel News · 2025-11-13T13:00:00Z

OpenAI发布了GPT-5.1,包含Instant和Thinking两个子模型。Instant适合日常对话,反应迅速;Thinking用于复杂推理,回答更清晰。新模型支持个性化设置,用户可选择不同的AI风格,提升互动体验。

OpenAI新模型GPT-5.1发布,不跑分不刷榜,主打一个说人话

量子位 量子位 · 2025-11-13T04:21:02Z
GPT-5.1 Instant 和 GPT-5.1 Thinking 系统卡附录

GPT-5.1系列模型包括对话性更强的GPT-5.1 Instant和能精确调整思考时间的GPT-5.1 Thinking。GPT-5.1 Auto可自动选择最佳模型,安全措施与之前相似,并新增心理健康和情感依赖评估功能。

GPT-5.1 Instant 和 GPT-5.1 Thinking 系统卡附录

OpenAI OpenAI · 2025-11-12T00:00:00Z
仅3B激活参数,更强的多模态理解与推理能力,ERNIE-4.5-VL-28B-A3B-Thinking正式开源!

百度于11月11日开源ERNIE-4.5-VL-28B-A3B-Thinking模型,具备3B激活参数,性能媲美顶级大模型。该模型在视觉语言理解、文档解析和跨模态推理方面表现优异,支持“图像思考”等创新功能,已在多个平台发布,适合商业使用。

仅3B激活参数,更强的多模态理解与推理能力,ERNIE-4.5-VL-28B-A3B-Thinking正式开源!

百度大脑 百度大脑 · 2025-11-11T04:52:58Z
DeepSeek-R1之后,Kimi K2 Thinking又给OpenAI们亿点点震撼

中国初创公司月之暗面推出的开源AI模型Kimi K2 Thinking在多项基准测试中超越GPT-5,训练成本仅为460万美元,显示出开源模型在性能与成本上的优势,可能改变全球AI竞争格局。

DeepSeek-R1之后,Kimi K2 Thinking又给OpenAI们亿点点震撼

TechWeb 全站精华 TechWeb 全站精华 · 2025-11-10T02:15:51Z

智谱AI与清华大学推出GLM-4.1V-Thinking模型,旨在提升多模态理解与推理能力。该模型采用课程采样强化学习策略,性能超越现有大型视觉语言模型,具备主动思考能力,能够解决推理难题。

推理能力跃迁!GLM-4.1V-Thinking推动认知智能演进;500万个分步思维数据示例!MathX-5M解锁数学推理新境界

HyperAI超神经 HyperAI超神经 · 2025-07-14T07:27:51Z

该研究提出了一种自给自足框架,通过强化学习提取结构化信息,显著提升大型语言模型在复杂科学问题上的联想思维能力。在生物医学问答任务中,模型性能提高了71.4%。此方法为结构化检索与推理的整合提供了新思路。

Self-Sufficiency: Enhancing Large Language Model Reasoning Abilities through Associative Thinking Based on Limited Structured Knowledge

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-05-21T00:00:00Z
Be a domain specialist in 60 seconds; AWS taught 6 high concepts of Executive Leadership, Capital Raising, and Business Thinking

后疫情时代,AI取代传统岗位,成功依赖信息差与高效盈利。AWS ExecLeaders强调建立信任、快速学习和高效人脉,帮助高管在60秒内成为领域专家,提升商业价值。优秀高管通过敏捷思维与高维视角,快速决策、优化流程,实现盈利。

Be a domain specialist in 60 seconds; AWS taught 6 high concepts of Executive Leadership, Capital Raising, and Business Thinking

DEV Community DEV Community · 2025-05-18T08:11:48Z

本研究提出J1方法,通过强化学习提升大型语言模型的判断能力,解决人工智能评估质量不足的问题。研究结果显示,该模型在多个基准测试中表现优于其他模型,验证了新颖奖励策略的有效性。

J1: Incentivizing the Thinking Ability of Large Language Models as Judges via Reinforcement Learning

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-05-15T00:00:00Z

本文介绍了DeepPsy-Agent,一种结合心理学三阶段帮助理论与深度学习技术的创新心理支持系统。该系统通过动态对话管理和深度推理,有效应对AI心理支持中的挑战,提升心理干预的效果与质量。

Deep Psychological Agent: An Emotion Support Agent System with Stage Awareness and Deep Thinking

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-03-20T00:00:00Z

LeapVAD方法通过认知感知和双重思维,提升了自动驾驶在复杂场景下的推理能力,优化了环境表现和决策过程。实验结果显示,该方法在有限训练数据下优于传统摄像头方法,具备卓越的持续学习和领域适应能力。

LeapVAD: A Leap in Autonomous Driving through Cognitive Perception and Dual-Process Thinking

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2025-01-14T00:00:00Z
推理最强也最快,谷歌发布Gemini 2.0 Flash Thinking,全面超越o1-preview

谷歌推出的Gemini 2.0 Flash Thinking模型具备推理能力,尤其在数学和编程任务上表现优异,速度快、质量高,解决了如三赌徒问题等复杂问题。尽管偶尔出错,但整体性能令人瞩目。

推理最强也最快,谷歌发布Gemini 2.0 Flash Thinking,全面超越o1-preview

机器之心 机器之心 · 2024-12-20T05:41:27Z

本研究提出了一种基于知识图谱的离线思维链评估框架OCEAN,旨在提升大型语言模型的评估能力。该框架通过优化推理路径,提高思维链的对齐度,同时保持模型在下游任务中的通用性。

OCEAN: Offline Evaluation and Alignment of Thinking Chains in Large Language Models

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-10-31T00:00:00Z
  • <<
  • <
  • 1 (current)
  • 2
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码