小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
GPT-5.6-sol入榜DRACO:OpenSquilla集成方案仍在Brave组质量、成本双领先

在DRACO公开评测中,OpenSquilla 0.5.0的多模型集成方案以平均得分64.09和低至$0.12的任务成本领先,超越了GPT-5.6-sol。该方案结合了四个国产模型,强调了模型组织能力在复杂任务中的重要性。

GPT-5.6-sol入榜DRACO:OpenSquilla集成方案仍在Brave组质量、成本双领先

量子位
量子位 · 2026-07-14T05:13:56Z
OpenSquilla发布0.5.0 Preview:多模型集成登顶DRACO双榜,对比名单中出现最新旗舰Fable 5

OpenSquilla发布了0.5.0 Preview 1版本,核心更新为多模型集成协作,通过四个国产模型的协作提升性能。研究表明,该方案在成本和分数上均优于单一模型,显示出国产模型在合理组织下的高效性。OpenSquilla致力于降低成本并提升智能,已完成首轮融资,估值达1亿美元。

OpenSquilla发布0.5.0 Preview:多模型集成登顶DRACO双榜,对比名单中出现最新旗舰Fable 5

量子位
量子位 · 2026-07-06T09:28:52Z
OpenSquilla发布0.5.0 Preview:多模型集成登顶DRACO双榜,对比名单中出现最新旗舰Fable 5

OpenSquilla发布了0.5.0 Preview 1版本,核心更新为多模型集成协作,通过四个国产模型的协作提升性能。研究表明,该方案在成本和分数上均优于单一模型,展示了国产模型的潜力。OpenSquilla致力于降低成本并实现智能交付,已完成首轮融资,估值达1亿美元。

OpenSquilla发布0.5.0 Preview:多模型集成登顶DRACO双榜,对比名单中出现最新旗舰Fable 5

量子位
量子位 · 2026-07-06T04:14:08Z

文章讨论了作者从使用昂贵的AI大模型转向国产大模型的体验,虽然效率有所下降,但整体花费显著降低,每天不到4元。作者认为流程和规则比模型本身更重要,国产模型在性价比上表现良好,期待未来的提升。

从月花1k刀到每天不到4块,我换上了DeepSeek V4 Pro

远飞闲记
远飞闲记 · 2026-07-03T00:00:00Z
刚刚,豆包2.1发布!Agent自己跑18个小时搞定芯片设计代码

字节推出了新版本的国产模型Seed 2.1系列,包括Doubao-Seed-2.1-Pro和Doubao-Seed-2.1-Turbo。该模型在芯片设计等复杂任务中表现出色,能够生成高质量代码,并在多个基准测试中超越国外同类产品。Seed 2.1 Pro的价格仅为国外产品的四分之一,具备较强的市场竞争力,能够有效支持开发和办公任务,成为生产级的助手。

刚刚,豆包2.1发布!Agent自己跑18个小时搞定芯片设计代码

量子位
量子位 · 2026-06-23T13:37:17Z

Claude Code在使用国产模型DeepSeek V4 Pro时效果不佳,代码逻辑混乱且速度慢。相比之下,OpenCode对国产模型的兼容性更好,能快速完成需求并输出高质量代码。文章强调工具适配模型的重要性,建议保留老工具以备不时之需,并指出国产模型并非不可用,关键在于如何调用。

Claude Code换回OpenCode——国产模型编程的正确打开方式

远飞闲记
远飞闲记 · 2026-06-23T00:00:00Z
Artificial Analysis放榜:千问3.7问鼎国产模型冠军,全球前五

阿里云新发布的Qwen3.7-Max大模型在全球大模型榜单中得分56.6,位列全球第五、国产第一,超越多款国产模型。该模型在编程、智能体和推理等方面有显著突破,能够独立完成复杂任务,并在指令跟踪和长文本生成等领域表现优异。

Artificial Analysis放榜:千问3.7问鼎国产模型冠军,全球前五

量子位
量子位 · 2026-05-21T09:16:12Z
Qwen最新3.7 Max预览版空降!两代超大杯并行迭代,林俊旸走了但还在加速

阿里巴巴的Qwen3.7预览版在文本和视觉领域表现优异,分别排名第13和第16,成为国产模型的佼佼者。Qwen团队加快了模型迭代速度,未来将持续推出新版本,体现快速实验和高频交付的趋势。

Qwen最新3.7 Max预览版空降!两代超大杯并行迭代,林俊旸走了但还在加速

量子位
量子位 · 2026-05-19T02:46:06Z
Token需求狂飙千倍,22亿热钱涌向这家AGI Infra头号玩家

无问芯穹在AI基础设施领域迅速崛起,近期获得超7亿元融资,日均Token调用量增长20倍,成为国内顶尖大模型的合作伙伴。随着Agent时代的到来,Token需求激增,推动行业高速发展。无问芯穹通过中立的MaaS平台,优化多种国产模型,提升Token生产效率,助力中国AI产业化进程。

Token需求狂飙千倍,22亿热钱涌向这家AGI Infra头号玩家

量子位
量子位 · 2026-05-07T02:46:50Z

DeepSeek 正在测试其识图功能,允许用户通过图片与 AI 互动,提升了多模态能力。这一进展增强了 DeepSeek 在国产开源模型中的竞争力,尤其在性价比方面。尽管识图能力不及 GPT-4V,但已足够满足日常使用。国产模型在多模态领域的进步使用户能够以更低成本享受 AI 服务,推动行业竞争和技术普及。

DeepSeek 开始测试识图模式,国产模型又近了一步

dotNET跨平台
dotNET跨平台 · 2026-05-02T00:01:24Z
国内环境下的Claude Code安装与使用教程

随着AI技术的发展,Claude Code成为开发者的编程协作工具。文章介绍了如何在国内环境中安装Claude Code,并使用CC Switch配置国产模型。用户可以通过自然语言与Claude Code互动,轻松生成代码,最后演示了创建一个简单的HTML页面的过程,展示了其编程能力。

国内环境下的Claude Code安装与使用教程

程序新视界
程序新视界 · 2026-04-21T12:16:03Z
Claude Opus 4.6 一天之内被超越两次,这次来自国产模型

智谱的GLM-5.1模型在SWE-bench Pro上得分58.4%,超越Claude Opus 4.6和GPT-5.4,能够独立完成复杂任务如构建Linux系统,且成本显著降低。GLM-5.1开源,支持多种推理框架,标志着国产模型的进步。

Claude Opus 4.6 一天之内被超越两次,这次来自国产模型

爱范儿
爱范儿 · 2026-04-08T09:16:23Z
套壳中国大模型撑起500亿美元估值?扒一扒 Cursor 的"套壳"疑云

本周末,AI工具Cursor推出Composer 2,疑似使用中国模型Kimi K2.5。尽管Cursor否认侵权,称已获得Fireworks AI授权,但此事件引发广泛关注,Kimi的曝光度提升,国产模型技术逐渐被认可。

套壳中国大模型撑起500亿美元估值?扒一扒 Cursor 的"套壳"疑云

阮一峰的网络日志
阮一峰的网络日志 · 2026-03-21T10:19:11Z
养虾人狂吃国产模型!4.19万亿Token调用量激增34.9%超越美国

中国大模型的调用量达到4.19万亿Token,超越美国,成为全球第一。国产模型在养虾领域表现优异,MiniMax M2.5、Kimi K2.5和Step 3.5 Flash位列前三。尽管在速度和价格上仍需改进,但市场份额持续增长,展现出强劲竞争力。

养虾人狂吃国产模型!4.19万亿Token调用量激增34.9%超越美国

量子位
量子位 · 2026-03-11T08:41:27Z
本地Qwen+云模型:OpenClaw真实体验

OpenClaw近期受到关注,吸引用户尝试,但功能被认为有限。作者分享了两个实用场景:自动化博客发布和定时数据抓取工具。国产模型在复杂任务上与Claude存在差距,但在简单任务中表现稳定。本地部署适合轻量任务,满足隐私需求。

本地Qwen+云模型:OpenClaw真实体验

远飞闲记
远飞闲记 · 2026-03-09T00:00:00Z
春节AI模型大战,谁是最大赢家?

2026年初,AI大模型领域集中发布了多款国产模型,如智谱GLM-5和字节Seedance 2.0,展现出实用性和任务处理能力。春节期间的发布利用了用户的注意力,推动了技术与需求的结合。北京海淀区成为创新中心,形成完整产业链,促进大模型的快速迭代与商业化。

春节AI模型大战,谁是最大赢家?

TechWeb 全站精华
TechWeb 全站精华 · 2026-02-20T02:45:08Z
在claude code中体验下GLM最新模型

文章回顾了国产大语言模型ChatGLM的体验,特别是GLM4.6的进步。最初效果一般,但随着版本更新,GLM4.6在任务完成度和风格上有显著提升,体现了国产模型的进步。

在claude code中体验下GLM最新模型

Nicksxs's Blog
Nicksxs's Blog · 2025-10-18T14:33:49Z

中国开源大模型已进入全球前五,国产模型从追赶者转为引领者。阿里、智谱等公司在多个领域表现突出,推动创新,重塑全球格局。

开源模型TOP5,被中国厂商包圆了

量子位
量子位 · 2025-10-15T08:37:33Z
国产推理大模型决战2025考研数学,看看谁第一个上岸?

2025年考研数学真题测试了大语言模型的推理能力,OpenAI的GPT-o1模型表现最佳,平均分超过140分,智谱的GLM-Zero-Preview紧随其后。深度推理模型在数学问题上展现出强大能力,国产模型逐渐缩小与国际领先者的差距。

国产推理大模型决战2025考研数学,看看谁第一个上岸?

机器之心
机器之心 · 2025-01-14T06:29:50Z

AGI-Eval团队评测AI视频生成模型,Sora在视频-文本一致性和视频质量上略逊于国内领先模型,但运动质量表现较好。整体来看,国产模型在动态场景和细节表现上仍占优势。

AGI-Eval团队:AI视频生成模型年度横评,Sora大饼落地,但国产模型仍然领先!

量子位
量子位 · 2025-01-06T00:48:26Z
  • <<
  • <
  • 1 (current)
  • 2
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
友情链接: MOGE.AI 九胧科技 模力方舟 Gitee AI 菜鸟教程 Remio.AI DeekSeek连连 53AI 神龙海外代理IP IPIPGO全球代理IP 东波哥的博客 匡优考试在线考试系统 开源服务指南 蓝莺IM Solo 独立开发者社区 AI酷站导航 极客Fun 我爱水煮鱼 周报生成器 He3.app 简单简历 白鲸出海 T沙龙 职友集 TechParty 蟒周刊 Best AI Music Generator

小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码