➡️
继续阅读
-
世界纪录,Qwen 3.8 27B 单台 125 token
懒猫AI算力仓单台运行Qwen 3.8 27B模型,创下性能纪录:prefill速度3754 TPS,长代码解码125 TPS,八会话解码231 TPS,...
-
工业Agent不是“套壳”大模型!西门子百年经验灌进工业AI
西门子Xcelerator是开放式数字商业平台,旨在推动工业AI规模化落地。它通过Eigen工程智能体等自研产品、开发套件和Marketplace生态,解...
-
别看名字选 AI:一张表分清聊天、Agent 和工作流 - 努力的小雨
聊天、Agent和工作流三种AI工具各有适用场景:聊天适合一次性问答,Agent能读取文件并交付成品,工作流则用于固定步骤的重复执行。选择时应先明确交付物...
-
读完一本书,先让 Agent 整理这 10 条笔记 - 努力的小雨
本文介绍如何用AI整理读书笔记:手动复制10条笔记,加“原文”或“我的想法”标签,用提示词让AI去重、分类、补行动建议,最后检查数量、身份和出处。强调先小...
-
换个窗口就失忆?先给 Agent 留张交接卡 - 努力的小雨
AI产品保存信息方式不同,大模型受上下文限制易丢信息。测试显示,使用六栏交接卡(任务、限制、已完成、下一步、禁区、验收)可显著提升找回率,从2项增至6项。...
-
Ollama首次尝试受阻后,Claude Desktop现可轻松运行Qwen、DeepSeek和Kimi模型
Ollama重新推出与Claude Desktop的集成,允许用户通过Ollama连接本地或云端模型(如Qwen、DeepSeek等),在Claude界面...