小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
为什么Qwen能自我改进推理,Llama却不行?斯坦福找到了原理

研究表明,不同语言模型在自我改进能力上存在显著差异。Qwen-2.5-3B在强化学习中优于Llama-3.2-3B,因其具备关键的认知行为,如验证和回溯。通过引导Llama学习这些行为,模型性能显著提升,表明认知行为对有效利用计算资源至关重要。

为什么Qwen能自我改进推理,Llama却不行?斯坦福找到了原理

机器之心 机器之心 · 2025-03-05T06:54:54Z

本文探讨大型语言模型(LLMs)在心理学研究中的应用,强调其在认知和行为领域的潜力,同时指出数据隐私和偏见等技术与伦理挑战。呼吁负责任地使用LLMs,以充分发挥其优势并应对相关风险。

利用大型语言模型模拟实地实验

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-08-19T00:00:00Z

本文探讨机器心理学作为新兴研究领域,评估大型语言模型(LLMs)的行为与能力。研究提出BOLT框架,分析LLMs在治疗师角色中的表现,并使用CogBench工具评估35个模型的认知行为。结果显示,LLMs在模拟人格特质和学习行为方面具有潜力,但与人类行为的一致性仍需改进,强调了进一步研究的必要性。

MacBehaviour: 用于大型语言模型行为实验的 R 匠

BriefGPT - AI 论文速递 BriefGPT - AI 论文速递 · 2024-05-13T00:00:00Z
  • <<
  • <
  • 1 (current)
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码