➡️
继续阅读
-
源神启动!一张消费级显卡跑“Opus级”Agent,Qwen3.8-27B多项榜单反超Claude
Qwen3.8-27B开源,拥有270亿参数,支持原生多模态和262K上下文,可扩展至100万Token。在SWE-bench Pro和QwenSWEBe...
-
刚刚,Qwen3.8-27B 开源了!家用显卡也能跑
Qwen3.8系列模型正式开源,所有开发者、科研机构和企业可免费下载、部署及商用。其中27B参数模型支持原生多模态和262K上下文,编程和办公性能大幅提升...
-
128K长上下文+智能体强化训练!LFM2.5-2.6B解锁端侧大模型高效部署;DETR用Transformer斩断NMS与Anchor,重塑目标检测
该数据集包含 95,036 张按小时采集的 Himawari-8/9 卫星红外图像帧,并与气象数据配对,涵盖海洋性大陆西部区域(东南亚及马六甲海峡区域,覆...
-
诺兰的《奥德赛》采取了什么样的改编策略?
笔者刚刚从电影院回到家,趁着记忆还很清晰来写影评。离开影院之前我记下了几个印象深刻的点,接下来我会逐个分析这些情节、人物、背景乃至主题层面的增删改究竟和原...
-
有毒职场正在炼成:OKR 变成 KPI,敏捷开发变成切碎的瀑布
Matrix首页推荐Matrix是少数派的写作社区,我们主张分享真实的产品体验,有实用价值的经验与思考。我们会不定期挑选Matrix最优质的文章,展示来自...
-
至知研究院提出大模型可解释性新路线:拆权重,数据成本不到1%
该文介绍了一种新方法“稀疏权重分解”(SWD),用于直接分解预训练大模型的权重矩阵,无需训练替代网络。SWD将稠密权重分解为两个稀疏矩阵,形成可独立干预的...