➡️
继续阅读
-
DeepSeek V4 Pro 0813涨价3倍!智能体反倒省钱了?
DeepSeek V4 Pro 0813虽涨价三倍,但在智能体任务中可能更省钱,因其模型能力提升减少了工具调用和Token消耗,且1M上下文和缓存优化降低...
-
ICLR 2026 | 面向序列决策的贝叶斯集成方法
本文提出Bayesian Ensemble(BE)框架,在现有集成方法上增加轻量级贝叶斯层,动态更新成员选择分布而非固定均匀采样。基于此提出BEB(ban...
-
利用参数化查询模板降低Text2SQL延迟
本文介绍通过参数化查询模板缓存降低Text2SQL延迟的方法。系统将SQL查询泛化为模板,用语义搜索匹配用户问题,命中时跳过LLM生成,直接执行查询。生产...
-
开源Qwen3.8 2.4T发布:本地跑不动,量化救不了贫穷
通义千问发布2.4万亿参数开源模型Qwen3.8-2.4T,权重达4.9TB,普通硬件无法运行。量化压缩至FP8仍超消费级显卡极限,且无QAT优化,性能受...
-
Anthropic赋予智能体做梦的能力,开发者们随之觉醒。
Anthropic在AI DevCon上提出“梦境”机制,通过异步批处理整合和更新AI代理的记忆,清理过时信息并优化学习。专家认为这有助于管理记忆,但担忧...
-
智能体AI系统中的检索与记忆
本文探讨了智能体AI系统中检索与记忆的区别及结合方法。检索从外部语料库获取知识,记忆则保存智能体自身交互历史。两者在信息来源、范围、更新机制和失败模式上不...