小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
阿里巴巴新模型承诺在笔记本电脑上实现Opus 4.6级性能

阿里巴巴发布Qwen3.8-27B模型,采用Apache 2.0许可,可在MacBook Pro等本地设备运行。其性能接近Anthropic Opus 4.6,在编码和知识任务上超越旧旗舰,并具备视觉能力。尽管存在过度思考、量化质量损失等局限,但整体表现亮眼,优于Meta的Glimmer-30B。社区已提供MLX转换,4位版本约16GB,适合32GB内存Mac运行。

阿里巴巴新模型承诺在笔记本电脑上实现Opus 4.6级性能

The New Stack The New Stack · 2026-08-14T18:10:58Z
如何通过代理应用将软件交付工作流引入GitHub

本文介绍GitHub Copilot应用的使用指南,涵盖编写首个提示词、选择上下文与模型,以及Java企业开发中通过SDK驱动Copilot,并讲解斜杠命令以规划、协作、自动化和定制开发工作流。

如何通过代理应用将软件交付工作流引入GitHub

The GitHub Blog The GitHub Blog · 2026-08-14T16:00:00Z
刚刚,Qwen3.8-27B 开源了!家用显卡也能跑

Qwen3.8系列模型正式开源,所有开发者、科研机构和企业可免费下载、部署及商用。其中27B参数模型支持原生多模态和262K上下文,编程和办公性能大幅提升,新增推理控制功能。模型以Apache2.0协议开放,累计开源460余个模型,全球下载超30亿次。

刚刚,Qwen3.8-27B 开源了!家用显卡也能跑

量子位 量子位 · 2026-08-14T15:41:12Z
GLM-5.3未改变基础模型——其编码能力提升从何而来?

Z.ai发布GLM-5.3编码与智能体模型,性能较前代提升50%,在终端基准和DeepSWE测试中大幅进步,支持百万级上下文。模型强化后训练,专注实际工作环境,但API定价未公布,旧版本调用自动重定向至新模型,影响对比测试。网络安全能力增强,但漏洞利用仍逊于竞品,权重两周后开放。

GLM-5.3未改变基础模型——其编码能力提升从何而来?

The New Stack The New Stack · 2026-08-14T15:20:24Z
理解机器学习模型中潜在空间的作用

本文介绍机器学习中潜在空间(latent space)的三种核心作用:描述性(如PCA压缩高维数据)、生成性(通过插值创造新数据点)和预测性(如推荐系统、RAG中计算相似度)。潜在空间将复杂数据转化为结构化数值表示,是压缩、生成和连接数据的关键基础概念。

理解机器学习模型中潜在空间的作用

MachineLearningMastery.com MachineLearningMastery.com · 2026-08-14T12:00:23Z
太初元碁助力国家级“AI+教育”大赛 “AI+加速卡模型适配赛道”开启招募

大赛聚焦国产AI算力生态,设六组别,其中“AI+加速卡模型适配赛道”由太初元碁承办,要求参赛者在其自研加速卡上优化适配模型,提供免费云资源和智能工具。报名截止2026年10月15日,决赛颁奖于11月12日,优胜者获官方证书,旨在以赛促学培养AI人才。

太初元碁助力国家级“AI+教育”大赛 “AI+加速卡模型适配赛道”开启招募

量子位 量子位 · 2026-08-14T10:25:36Z
苹果与阿里巴巴合作,为中国市场定制训练AI模型

苹果与阿里巴巴合作,为中国市场定制开发AI大模型,用于苹果设备上的生成式AI服务,预计未来几个月内随iOS更新推出。此举使苹果成为首家在中国获批提供自研AI模型的美国公司,有助于应对中国严格的监管环境。

苹果与阿里巴巴合作,为中国市场定制训练AI模型

The Verge The Verge · 2026-08-14T09:21:17Z

Ceph的ECBackend实现中,整条带写无需读旧数据,而部分写需读改写(RMW),增加延迟。EC修复从k个存活分片重建缺失分片,网络效率优于副本池。EC池空间效率高(4+2为1.5倍),但随机小写延迟高,适合顺序大写场景如RGW。allow_ec_overwrites支持覆盖写,但RMW代价仍在。编码插件有Jerasure、ISA-L等,LRC可降低重建读取。

【Ceph RADOS】EC 路径:ECBackend、整条带写与 RMW 的代价模型

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-08-14T00:00:00Z
刚刚在DeepSWE上拿下65%的AI模型,并非谷歌承诺的那款。

谷歌发布Gemini 3.7 Flash,专为编码代理和自动化工作流设计,性能优于3.6 Flash,代码得分提升,且不易卡住。API初始价格减半,但2027年将翻倍。支持低中高思考级别,需注意迁移调整。虽改进显著,但测试可靠性仍待验证,3.5 Pro仍未发布。

刚刚在DeepSWE上拿下65%的AI模型,并非谷歌承诺的那款。

The New Stack The New Stack · 2026-08-13T19:59:34Z

Google DeepMind推出Gemini Omni模型,首个版本Omni Flash支持通过对话生成和编辑视频,简化创作流程。团队访谈强调其多功能性,未来将不断改进,潜力无限。

Omni专家分享他们对这一模型最兴奋之处。

The Keyword The Keyword · 2026-08-13T13:30:00Z
voyage-code-4:为编码代理构建的代码检索模型

Voyage AI发布新一代代码嵌入模型voyage-code-4,专为编码代理优化,提升检索性能并降低成本。在代理代码检索基准上,其性能平均超越Cohere Embed v4和Gemini Embedding 2达28.25%和31.03%,在传统代码检索上也显著领先。该模型支持多种维度嵌入和量化,价格比前代低三分之一,现可通过Voyage API等获取。

voyage-code-4:为编码代理构建的代码检索模型

Voyage AI Voyage AI · 2026-08-13T13:00:00Z
Harness比模型更重要!BanyanCode让DeepSeek性能飙升 9.66%

BanyanCode是开源终端AI编程助手,基于OpenCode构建,通过代理网格、代码图谱、跨会话记忆和免费搜索,使DeepSeek V4 Flash性能提升9.66%,成本低至0.037美元。文章强调Harness(工具层)比模型本身更重要,能显著影响编码效率与成本。

Harness比模型更重要!BanyanCode让DeepSeek性能飙升 9.66%

极道 极道 · 2026-08-13T12:40:00Z
刚刚!Ilya首个模型曝光了

SSI正探索基于TTT的小型推理引擎,模型通过专门数据学习“如何学习”,并在推理中更新权重,规模虽小但性能强大。爆料称当前版本8月可能发布,下一代规模将扩大10倍。Ilya此前强调持续学习,英伟达投资SSI并提升算力,TTT路线或成其秘密武器,但真实性待确认。

刚刚!Ilya首个模型曝光了

量子位 量子位 · 2026-08-13T08:36:53Z
深度求索发布DeepSeek-V4-Pro-0813 该模型从预览版正式进入GA阶段

深度求索发布DeepSeek-V4-Pro-0813版,从预览版正式进入GA阶段,模型ID不变,API定价暂未调整。该模型支持1M上下文窗口,提供Responses和Anthropic API,价格未变但已预告将涨价。目前未开源,基准测试数据待完善,内部数据显示多项测试较预览版大幅提升,编码、数学等核心任务保持开源领先,接近前沿闭源模型水平。

深度求索发布DeepSeek-V4-Pro-0813 该模型从预览版正式进入GA阶段

蓝点网 蓝点网 · 2026-08-13T05:30:30Z
SpaceXAI推出Grok 4.6系列模型 专注于长时程任务和处理交互式可视化工作

SpaceXAI发布Grok 4.6模型,专注长时程任务和可视化交互,经补充训练提升软件工程、编程等能力,并增强自我测试。基准测试表现持平或略逊于竞品。定价为输入2美元、输出6美元、缓存0.5美元每百万,超200K部分翻倍,快速模式加倍。现已在Cursor和Grok Build提供。

SpaceXAI推出Grok 4.6系列模型 专注于长时程任务和处理交互式可视化工作

蓝点网 蓝点网 · 2026-08-13T03:00:16Z
微信宣布推出WeLM模型 参数规模为617B 目前已经内置到微信原生AI助手小微中

微信团队推出自研AI模型WeLM系列,包括80B和617B版本,后者采用混合专家架构,仍在开发中。该系列已内置到微信AI助手小微,支持对话、搜索及调用微信功能。设计注重资源效率而非参数规模,旨在支撑十亿级用户高频使用,未来将加速小程序智能化。

微信宣布推出WeLM模型 参数规模为617B 目前已经内置到微信原生AI助手小微中

蓝点网 蓝点网 · 2026-08-13T02:30:18Z

本文介绍SPDK事件框架核心概念:Reactor为每核事件循环线程,Event用于跨核消息投递,Poller在同线程反复轮询。强调消息传递优于锁,状态由单线程拥有。阻塞reactor回调会导致同核I/O停滞,排障时应先检查哪核循环停止。spdk_thread可独立嵌入其他循环,io_device/io_channel模式实现全局慢状态与每线程快路径分离。

【SPDK 用户态存储】Reactor 与线程模型:Event、Poller 与 Message Passing

土法炼钢兴趣小组的博客 土法炼钢兴趣小组的博客 · 2026-08-13T00:00:00Z
利用Docker和ModelPack推进AI模型互操作性

ModelPack项目旨在解决AI模型管理工具与格式耦合的问题,通过制定开放标准并利用OCI工件来标准化模型打包和分发。项目与Docker合作,使Docker Model Runner支持ModelPack格式(通过`--format=cncf`选项),提升模型互操作性。合作强化了规范,扩大了项目可见性,体现了开源协作的价值。

利用Docker和ModelPack推进AI模型互操作性

Cloud Native Computing Foundation Cloud Native Computing Foundation · 2026-08-12T11:00:00Z
OpenClaw半年关停:三次换模型失败后按下终止键

一位广告从业者花费440美元购买Mac Mini部署OpenClaw,初期成功实现图片自动处理,但Sonnet权限被收回后,改用Haiku、MiniMax、Kimi均失败,Codex后台烧光预算,更新后出现六个致命Bug。最终因维护成本过高,半年后主动终止项目,揭示了AI代理部署的隐性成本与信任崩塌。

OpenClaw半年关停:三次换模型失败后按下终止键

极道 极道 · 2026-08-12T08:27:00Z

SK海力士重启大连NAND二厂建设,并投资380亿美元扩产;索尼与台积电拟合资建图像传感器厂;英特尔扩大股票发行至200亿美元;字节跳动预训练10万亿参数AI模型;扎克伯格主张允许模型蒸馏;苹果支付负责人退休。

SK海力士拟重启大连NAND二厂建设;扎克伯格主张允许模型“蒸馏”;字节跳动预训练10万亿参数AI模型

全球TMT-美通国际 全球TMT-美通国际 · 2026-08-12T06:01:54Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 1tok 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator 模力方舟 Gitee AI

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码