Anthropic发布了Claude Haiku 4.5,定位为小型快速模型,性能与Claude Sonnet 4相当,但成本仅为其三分之一,速度超过两倍。该模型具备混合推理能力,支持快速回答和扩展思考,用户可查看推理过程。经过多种数据清洗和过滤训练,确保安全性和准确性,开发者可通过多个平台访问该模型。
Nous Research发布的Hermes 4是一个开放权重模型系列,采用后训练技术,具备混合推理能力。核心组件DataForge通过有向无环图生成合成数据,显著提升推理样本质量。Hermes 4在多个基准测试中表现优异,展现了开源AI的潜力与中立性。
Anthropic推出Claude 4系列,包括适合复杂任务的Claude Opus 4和经济实惠的Claude Sonnet 4。两者支持混合推理和改进的记忆能力,提升用户体验。
亚马逊云科技推出了Anthropic的Claude Opus 4和Claude Sonnet 4模型,具备快速响应与深度思考的混合推理能力。Claude Opus 4适合复杂任务和编码,Claude Sonnet 4在性能与成本上取得平衡,适用于高吞吐量业务,支持多任务处理。两者均具备“扩展思考”功能。
阿里巴巴Qwen团队于2025年4月29日发布了最新的大型语言模型Qwen 3,拥有2350亿参数,支持多种应用场景,具备混合推理能力,能够在复杂任务与快速对话间灵活切换。Qwen 3在多个基准测试中表现优异,提供高效的多语言支持,推动了AI的可及性与创新。
阿里推出的Qwen 3模型在通义APP中表现优异,超越其他开源模型,具备混合推理能力,能够快速准确解答复杂问题,支持编程生成代码,展现出强大的逻辑性与创造力。
阿里发布了开源模型Qwen3,具备混合推理能力,支持119种语言,训练数据量达到36万亿token。旗舰模型Qwen3-235B-A22B在核心测试中表现优异,开源六款Dense和两款MoE模型,适合不同设备部署。Qwen3通过动态切换机制和多模态协作协议,推动AI模型从生成答案向完成任务转变。
Amazon Bedrock上线了Anthropic的Claude 3.7 Sonnet模型,具备混合推理能力,支持标准和深度思考模式,特别在编码和复杂问题解决方面表现优异,最大支持128K令牌,帮助企业提升客户互动和工作效率。
亚马逊云科技推出Anthropic的Claude 3.7 Sonnet模型,支持在标准与深度思维模式间切换,生成最长128K token的响应,适合复杂代码生成与内容创作,用户可控制推理预算,实现速度与成本的平衡。
本研究提出Jakiro方法,通过专家组合生成多样化预测,解决模型容量有限导致的准确性不足问题。引入混合推理策略,结合自回归与并行解码,提高了预测的准确性和速度,推动了推测解码研究的进展。
本文提出了一种系统化的分类方法,分析了大型语言模型(LLMs)的技术及应用前景,强调提高模型效率的必要性,并介绍了多语言模型框架、工具增强和混合推理方法等创新,以推动LLMs的发展和应用。
完成下面两步后,将自动完成登录并继续当前操作。