➡️
继续阅读
-
NVIDIA把供应链专家经验训练进模型,关键不是换一个更大模型
NVIDIA供应链案例表明,专用30B模型经专家决策轨迹训练后,在内部基准上超越更大通用模型。关键在于记录专家决策时的所见、理由与结果,并避免数据泄漏。企...
-
Agent到底比一次大模型调用多了什么?小白从这张流程图看懂
Agent并非更聪明的模型,而是模型外加运行支架,用于管理上下文、工具、环境和会话状态。普通调用适合单轮任务,固定工作流适合步骤明确的场景,Agent适合...
-
AI 智创简报:《大模型账单瘦身专利成簇,中间件的止血生意》
2026年多项专利申请显示,在LLM输入前进行“瘦身”成为趋势,包括日志折叠、子句剪枝、动态截断、工具清单最小化等。Token管控从事后记账前移至喂模型前...
-
思瑞浦参加2026 CIOE光博会,集中展示光通信领域创新解决方案
思瑞浦在2026 CIOE光博会上展示了光通信芯片方案,覆盖800G/1.6T可插拔光模块(硅光与EML双路线)、CPO/NPO及ELSFP外置光源、OC...
-
自动驾驶大模型开始统一看懂、建图和规划
Qwen发布Qwen-Drive-1.0,以Qwen3.5-4B为骨干,外接BEV感知头与规划专家,用流匹配生成未来5秒轨迹,训练数据283万条,驾驶问答...
-
墨芯人工智能亮相2026 Inclusion·外滩大会:以专用稀疏推理芯片提升算力效能,共创AI新经济
9月9日,墨芯人工智能在2026外滩大会展示以专用稀疏推理芯片提升算力效能的技术路径。针对推理需求增长,墨芯通过算法、软件、硬件协同优化减少冗余计算,其推...