阿里巴巴发布Qwen3.8-27B模型,采用Apache 2.0许可,可在MacBook Pro等本地设备运行。其性能接近Anthropic Opus 4.6,在编码和知识任务上超越旧旗舰,并具备视觉能力。尽管存在过度思考、量化质量损失等局限,但整体表现亮眼,优于Meta的Glimmer-30B。社区已提供MLX转换,4位版本约16GB,适合32GB内存Mac运行。
本文介绍GitHub Copilot应用的使用指南,涵盖编写首个提示词、选择上下文与模型,以及Java企业开发中通过SDK驱动Copilot,并讲解斜杠命令以规划、协作、自动化和定制开发工作流。
Qwen3.8系列模型正式开源,所有开发者、科研机构和企业可免费下载、部署及商用。其中27B参数模型支持原生多模态和262K上下文,编程和办公性能大幅提升,新增推理控制功能。模型以Apache2.0协议开放,累计开源460余个模型,全球下载超30亿次。
Z.ai发布GLM-5.3编码与智能体模型,性能较前代提升50%,在终端基准和DeepSWE测试中大幅进步,支持百万级上下文。模型强化后训练,专注实际工作环境,但API定价未公布,旧版本调用自动重定向至新模型,影响对比测试。网络安全能力增强,但漏洞利用仍逊于竞品,权重两周后开放。
本文介绍机器学习中潜在空间(latent space)的三种核心作用:描述性(如PCA压缩高维数据)、生成性(通过插值创造新数据点)和预测性(如推荐系统、RAG中计算相似度)。潜在空间将复杂数据转化为结构化数值表示,是压缩、生成和连接数据的关键基础概念。
大赛聚焦国产AI算力生态,设六组别,其中“AI+加速卡模型适配赛道”由太初元碁承办,要求参赛者在其自研加速卡上优化适配模型,提供免费云资源和智能工具。报名截止2026年10月15日,决赛颁奖于11月12日,优胜者获官方证书,旨在以赛促学培养AI人才。
苹果与阿里巴巴合作,为中国市场定制开发AI大模型,用于苹果设备上的生成式AI服务,预计未来几个月内随iOS更新推出。此举使苹果成为首家在中国获批提供自研AI模型的美国公司,有助于应对中国严格的监管环境。
Ceph的ECBackend实现中,整条带写无需读旧数据,而部分写需读改写(RMW),增加延迟。EC修复从k个存活分片重建缺失分片,网络效率优于副本池。EC池空间效率高(4+2为1.5倍),但随机小写延迟高,适合顺序大写场景如RGW。allow_ec_overwrites支持覆盖写,但RMW代价仍在。编码插件有Jerasure、ISA-L等,LRC可降低重建读取。
谷歌发布Gemini 3.7 Flash,专为编码代理和自动化工作流设计,性能优于3.6 Flash,代码得分提升,且不易卡住。API初始价格减半,但2027年将翻倍。支持低中高思考级别,需注意迁移调整。虽改进显著,但测试可靠性仍待验证,3.5 Pro仍未发布。
Google DeepMind推出Gemini Omni模型,首个版本Omni Flash支持通过对话生成和编辑视频,简化创作流程。团队访谈强调其多功能性,未来将不断改进,潜力无限。
Voyage AI发布新一代代码嵌入模型voyage-code-4,专为编码代理优化,提升检索性能并降低成本。在代理代码检索基准上,其性能平均超越Cohere Embed v4和Gemini Embedding 2达28.25%和31.03%,在传统代码检索上也显著领先。该模型支持多种维度嵌入和量化,价格比前代低三分之一,现可通过Voyage API等获取。
BanyanCode是开源终端AI编程助手,基于OpenCode构建,通过代理网格、代码图谱、跨会话记忆和免费搜索,使DeepSeek V4 Flash性能提升9.66%,成本低至0.037美元。文章强调Harness(工具层)比模型本身更重要,能显著影响编码效率与成本。
SSI正探索基于TTT的小型推理引擎,模型通过专门数据学习“如何学习”,并在推理中更新权重,规模虽小但性能强大。爆料称当前版本8月可能发布,下一代规模将扩大10倍。Ilya此前强调持续学习,英伟达投资SSI并提升算力,TTT路线或成其秘密武器,但真实性待确认。
深度求索发布DeepSeek-V4-Pro-0813版,从预览版正式进入GA阶段,模型ID不变,API定价暂未调整。该模型支持1M上下文窗口,提供Responses和Anthropic API,价格未变但已预告将涨价。目前未开源,基准测试数据待完善,内部数据显示多项测试较预览版大幅提升,编码、数学等核心任务保持开源领先,接近前沿闭源模型水平。
SpaceXAI发布Grok 4.6模型,专注长时程任务和可视化交互,经补充训练提升软件工程、编程等能力,并增强自我测试。基准测试表现持平或略逊于竞品。定价为输入2美元、输出6美元、缓存0.5美元每百万,超200K部分翻倍,快速模式加倍。现已在Cursor和Grok Build提供。
微信团队推出自研AI模型WeLM系列,包括80B和617B版本,后者采用混合专家架构,仍在开发中。该系列已内置到微信AI助手小微,支持对话、搜索及调用微信功能。设计注重资源效率而非参数规模,旨在支撑十亿级用户高频使用,未来将加速小程序智能化。
本文介绍SPDK事件框架核心概念:Reactor为每核事件循环线程,Event用于跨核消息投递,Poller在同线程反复轮询。强调消息传递优于锁,状态由单线程拥有。阻塞reactor回调会导致同核I/O停滞,排障时应先检查哪核循环停止。spdk_thread可独立嵌入其他循环,io_device/io_channel模式实现全局慢状态与每线程快路径分离。
ModelPack项目旨在解决AI模型管理工具与格式耦合的问题,通过制定开放标准并利用OCI工件来标准化模型打包和分发。项目与Docker合作,使Docker Model Runner支持ModelPack格式(通过`--format=cncf`选项),提升模型互操作性。合作强化了规范,扩大了项目可见性,体现了开源协作的价值。
一位广告从业者花费440美元购买Mac Mini部署OpenClaw,初期成功实现图片自动处理,但Sonnet权限被收回后,改用Haiku、MiniMax、Kimi均失败,Codex后台烧光预算,更新后出现六个致命Bug。最终因维护成本过高,半年后主动终止项目,揭示了AI代理部署的隐性成本与信任崩塌。
SK海力士重启大连NAND二厂建设,并投资380亿美元扩产;索尼与台积电拟合资建图像传感器厂;英特尔扩大股票发行至200亿美元;字节跳动预训练10万亿参数AI模型;扎克伯格主张允许模型蒸馏;苹果支付负责人退休。
完成下面两步后,将自动完成登录并继续当前操作。