➡️
继续阅读
-
源神启动!一张消费级显卡跑“Opus级”Agent,Qwen3.8-27B多项榜单反超Claude
Qwen3.8-27B开源,拥有270亿参数,支持原生多模态和262K上下文,可扩展至100万Token。在SWE-bench Pro和QwenSWEBe...
-
刚刚,Qwen3.8-27B 开源了!家用显卡也能跑
Qwen3.8系列模型正式开源,所有开发者、科研机构和企业可免费下载、部署及商用。其中27B参数模型支持原生多模态和262K上下文,编程和办公性能大幅提升...
-
128K长上下文+智能体强化训练!LFM2.5-2.6B解锁端侧大模型高效部署;DETR用Transformer斩断NMS与Anchor,重塑目标检测
LFM2.5-2.6B是面向端侧部署的轻量级AI推理模型,支持128K长上下文和智能体工具调用,性能可与大4倍参数模型竞争。在Apple M5 Max上推...
-
至知研究院提出大模型可解释性新路线:拆权重,数据成本不到1%
该文介绍了一种新方法“稀疏权重分解”(SWD),用于直接分解预训练大模型的权重矩阵,无需训练替代网络。SWD将稠密权重分解为两个稀疏矩阵,形成可独立干预的...
-
为什么你的可穿戴设备需要数周数据才能变得有用
智能戒指或手表刚佩戴时,评分不准确是正常的,因为设备需要时间建立个人基线。首周数据基于人群平均值,而非个人历史,因此看似随机。设备通过加权移动平均算法,逐...
-
连续聚合刷新揭秘:失效、回看与延迟数据
本文介绍TimescaleDB的连续聚合功能,这是一种高性能PostgreSQL物化视图,用于提升时间序列数据的实时分析性能。文章还提及相关社区解决方案,...