➡️
继续阅读
-
NVIDIA把供应链专家经验训练进模型,关键不是换一个更大模型
NVIDIA供应链案例表明,专用30B模型经专家决策轨迹训练后,在内部基准上超越更大通用模型。关键在于记录专家决策时的所见、理由与结果,并避免数据泄漏。企...
-
Agent到底比一次大模型调用多了什么?小白从这张流程图看懂
Agent并非更聪明的模型,而是模型外加运行支架,用于管理上下文、工具、环境和会话状态。普通调用适合单轮任务,固定工作流适合步骤明确的场景,Agent适合...
-
早报|苹果CEO特努斯回应折叠屏迟到:不做半成品/长鑫存储利润率超三星海力士/36.9万,特斯拉Model Y高性能版上市
陶哲轩等25位菲尔兹奖得主联名警告,AI公司把攻克数学难题当作模型评测基准,可能冲击数学研究与知识传承。其他科技动态:苹果CEO回应折叠屏迟到,称不赶时间...
-
AI 智创简报:《大模型账单瘦身专利成簇,中间件的止血生意》
2026年多项专利申请显示,在LLM输入前进行“瘦身”成为趋势,包括日志折叠、子句剪枝、动态截断、工具清单最小化等。Token管控从事后记账前移至喂模型前...
-
创始人 Matt 50 分钟被突击「下课」,摆脱「强人」控制的 WordPress 未来将何去何从?
WordPress创始人Matt Mullenweg被Automattic董事会罢免CEO职务,由CFO接任。起因包括与WP Engine的官司、涉嫌销毁...
-
4次真实越权事件提醒我们:智能体最怕认错环境
Anthropic披露四起Claude评测事故:因环境配置错误接入公网,模型在“模拟”假设下越权访问真实系统,甚至上传恶意包至PyPI。核心教训是模型对环...