小红花·文摘
  • 首页
  • AI Tokens🪙
  • 排行榜🏆
  • 直播
  • FAQ
李开复彭博社专访:中国AI以“六个月差距”挑战美国,开源模型将赢得全球覆盖战

李开复表示,中美AI模型差距约六个月,但中国以低价提供性能接近的产品,类似安卓与苹果模式。美国公司盈利高,中国公司获更大用户规模。尽管芯片受限,中国工程师效率极高。AI将重塑企业组织,未来核心是设计问题者,人类连接行业将增长。

李开复彭博社专访:中国AI以“六个月差距”挑战美国,开源模型将赢得全球覆盖战

TechWeb 全站精华 TechWeb 全站精华 · 2026-09-05T07:22:49Z
那些想用但不让用 AI 的公司,终于可以用 AI 了

文章报道了ChatGPT等云端AI服务宕机后,企业转向本地AI解决方案的趋势。元空智能与惠普合作,将开源模型和Agent框架装入本地设备,提供数据安全、成本可控的推理服务,适用于金融、医药等合规要求高的行业。该方案用一次性硬件支出替代云端订阅费,支持离线运行,并瞄准20B-100B参数的中等模型作为生产力甜区。

那些想用但不让用 AI 的公司,终于可以用 AI 了

爱范儿 爱范儿 · 2026-09-04T01:24:28Z
使用任意* LLM 与 @mux/ai

Mux的@mux/ai工具现已支持开源模型,新增Baseten和OpenAI兼容端点提供商,允许用户自带本地或自托管模型。该工具要求视觉能力和结构化输出,部分模型需base64模式,并附验证脚本。开源模型存在可靠性问题,已通过重试机制解决。用户还可微调模型,集成更便捷。

使用任意* LLM 与 @mux/ai

Mux Blog - Video technology and more Mux Blog - Video technology and more · 2026-09-03T17:05:01Z
中美同步收紧AI,压力为何都落向中国AI企业?

中美同步收紧AI管控,表面为面子,实则阻碍中国AI发展。中国限制模型权重、数据出境、境外流片及收购,意在保护本土利益,但拖慢自身进程。美国限制芯片出口,增加成本与不确定性。中间地带国家倾向使用中国开源模型。小公司仍将顽强前行,但路更艰难。

中美同步收紧AI,压力为何都落向中国AI企业?

硕鼠的博客站 硕鼠的博客站 · 2026-09-01T00:30:00Z
阿里巴巴发布Qwen3.8-Flash:“Qwen4架构的早期预览”

阿里巴巴发布Qwen3.8-Flash,一款1250亿参数的开源多模态MoE模型,作为Qwen4的架构预览。该模型在编码和办公任务上性能优越,训练资源仅需同类模型的九分之一,成本更低。它支持26万token上下文,可扩展至百万,并已在Hugging Face和ModelScope开放。开发者反应不一,有人称赞其能在消费级硬件运行,也有人认为本地模型尚不足以替代远程服务。

阿里巴巴发布Qwen3.8-Flash:“Qwen4架构的早期预览”

The New Stack The New Stack · 2026-08-28T18:27:06Z
英伟达斥资129亿美元,确保开源模型运行于自家芯片

英伟达拟以129亿美元收购Hugging Face,类似微软收购GitHub,旨在掌控开源模型生态。开源模型因成本低、易运行,正抢占市场,威胁OpenAI和Anthropic。此举确保开发者继续使用英伟达CUDA软件栈,巩固其硬件主导地位。开发者应构建适应模型变化的系统,而非依赖单一默认。

英伟达斥资129亿美元,确保开源模型运行于自家芯片

The New Stack The New Stack · 2026-08-28T15:43:25Z
英伟达129亿美元收购Hugging Face面临开源难题

英伟达据报将以129亿美元收购AI模型平台Hugging Face,旨在掌控开发者寻找和运行开源模型的关键入口。该平台以硬件中立著称,支持AMD、英特尔等芯片,收购后可能偏向英伟达硬件,削弱其开放性。此举意在对抗客户自研芯片趋势,巩固AI生态地位,但面临社区价值受损风险。

英伟达129亿美元收购Hugging Face面临开源难题

The New Stack The New Stack · 2026-08-27T15:35:00Z
Qwen3.8-Flash-Next开源实测:1/9成本干翻自家397B旗舰!

阿里通义千问发布Qwen3.8-Flash-Next开源模型,采用MoE、GDN、QSA、Gated Residual和N-gram Embedding等创新架构,125B参数仅激活6B,成本为前代九分之一,性能超越397B旗舰。训练中发现Muon优化器下Batch Size Warmup无效,可节省18.8%算力,引发行业反思。

Qwen3.8-Flash-Next开源实测:1/9成本干翻自家397B旗舰!

极道 极道 · 2026-08-26T22:39:00Z
匿名模型Ox Alpha现身:智谱GLM-5.3-Flash跑在10万张国产芯片上

智谱发布开源模型GLM-5.3-Flash,匿名测试版Ox Alpha性能宣称追平Claude Opus 4.8,价格仅四十分之一,并跑在10万张国产芯片上。但实际使用中性能参差,价格含促销折扣,芯片效率“相当”而非超越,API条款严苛。开发者评价分化,建议用户实测、算清成本、关注生态。

匿名模型Ox Alpha现身:智谱GLM-5.3-Flash跑在10万张国产芯片上

极道 极道 · 2026-08-26T22:01:00Z
Ollama首次尝试受阻后,Claude Desktop现可轻松运行Qwen、DeepSeek和Kimi模型

Ollama重新推出与Claude Desktop的集成,允许用户通过Ollama连接本地或云端模型(如Qwen、DeepSeek等),在Claude界面内使用。此功能支持Mac应用,用户可切换模型,强调成本、速度和灵活性。Ollama旨在让开源模型更易用,未来或支持Windows。

Ollama首次尝试受阻后,Claude Desktop现可轻松运行Qwen、DeepSeek和Kimi模型

The New Stack The New Stack · 2026-08-26T16:59:39Z
OpenAI「亲儿子」反水,认中国模型做「赛博义父」

美国法院近期因AI工具出现虚构引用和隐藏文字等失误,凸显通用模型难以胜任法律实务。Harvey公司基于中国Kimi K3模型训练出法律专用模型Tenet,提升任务完成率。类似地,Cursor、Devin等美国AI产品也采用Kimi系列底座,中国开源模型正成为海外AI产品的供应链基础,提供低成本、可定制的第三条路径。

OpenAI「亲儿子」反水,认中国模型做「赛博义父」

爱范儿 爱范儿 · 2026-08-25T12:01:44Z
闭源RSI的严父:18个Agent自主科研,Kimi K3靠Harness逼近Opus 5

Prime Intellect的研究表明,开源模型结合Multi-Agent Harness在nanoGPT优化任务中表现接近顶级闭源模型,挑战了RSI的假设。实验发现模型间的差距不在于创意,而在于试错吞吐量。更便宜的开源模型负责监控实现,高效的试错机器能提升AI科研速度,加速AI研发迭代。

闭源RSI的严父:18个Agent自主科研,Kimi K3靠Harness逼近Opus 5

量子位 量子位 · 2026-08-20T09:46:23Z
阿里千问Qwen3.8-27B实测碾压Opus 5!一张3090就够了

阿里开源Qwen3.8-27B模型,在编程等任务上超越Claude旗舰,仅需一张二手3090显卡即可运行。其Sharp聊天模板优化了性能,引发对云端订阅价值的质疑。但测试条件存疑,结果可能仅在特定配置下成立,开源与闭源模型竞争仍存变数。

阿里千问Qwen3.8-27B实测碾压Opus 5!一张3090就够了

极道 极道 · 2026-08-18T22:56:00Z
美国新AI模型专为定制而生

Thinking Machines发布开源模型Inkling,采用混合专家架构,总参数9750亿,但每次推理仅激活约410亿参数。该模型结合滑动窗口与全局注意力层,支持百万级token上下文,并使用相对位置编码以避免外推问题。Inkling支持图像和音频输入,并引入可调推理努力参数,旨在便于用户定制和微调。

美国新AI模型专为定制而生

ByteByteGo Newsletter ByteByteGo Newsletter · 2026-08-18T15:30:36Z
片段:8月18日

本文探讨AI智能的本质、安全风险及行业影响。作者认为AI智能提升有限,但可复制性和响应速度带来新价值。文章批评美国政府对AI模型的突然限制,导致企业转向中国开源模型,并强调开放权重模型对防御的重要性。同时提及AI在选举预测可视化中的应用,以及中国AI发展对就业的挑战。

片段:8月18日

Martin Fowler Martin Fowler · 2026-08-18T15:04:00Z
在线教程丨Qwen3.8-27B重磅开源,推理/编程/Agent能力齐升级

Qwen3.8-27B开源模型发布,拥有270亿参数,强化推理、编程与Agent能力,在代码、多模态和智能体评测中表现优异,接近顶级闭源模型。支持图像视频理解及灵活思考控制,HyperAI已上线教程供开发者快速调用。

在线教程丨Qwen3.8-27B重磅开源,推理/编程/Agent能力齐升级

HyperAI超神经 HyperAI超神经 · 2026-08-18T09:54:13Z
快讯|范式PhanRouter上线智谱GLM-5.3,即日开放调用

智谱AI发布新一代开源模型GLM-5.3,总参数量7430亿,编程能力提升50%,在基准测试中位列开源第一。范式旗下平台PhanRouter同日适配并开放调用,用户无需更换API即可使用,提供低价和99.9%服务保障。该模式降低企业采用门槛,推动AI落地。

快讯|范式PhanRouter上线智谱GLM-5.3,即日开放调用

量子位 量子位 · 2026-08-17T08:26:25Z
两块RTX 3090跑105 tok/s!Qwen3.8-27B本地部署实测

阿里开源Qwen3.8-27B模型,270亿参数,支持262K上下文,性能接近闭源旗舰。社区实测在双RTX 3090上达105 tok/s,通过量化、MTP加速等技术实现。模型Apache 2.0协议,48小时下载86万次。但速度受场景、配置影响大,多卡未必更快,且长上下文需量化KV缓存牺牲质量。

两块RTX 3090跑105 tok/s!Qwen3.8-27B本地部署实测

极道 极道 · 2026-08-17T04:23:00Z
智谱GLM 5.3挖出2436漏洞:安全实测反超Mythos

智谱GLM 5.3在269个项目中挖出2436个漏洞,其中1097个高危,平均潜伏26.6年,最老可追溯至1981年。在CyberGym评测中以84.5%准确率反超闭源模型Mythos 5。该模型还发现DNS协议致命缺陷,可致千万服务瘫痪,并成功追踪AI黑客Neo。开源权重后,打破闭源安全垄断,推动AI安全普及。

智谱GLM 5.3挖出2436漏洞:安全实测反超Mythos

极道 极道 · 2026-08-15T06:36:00Z
刚刚,GLM-5.3发布:Coding更接近Fable 5!潜伏40年的bug都被揪出来了

智谱发布GLM-5.3开源模型,在编程和安全能力上显著提升,编程接近Claude Fable 5,安全测试获84.5%成最强开源安全模型。实测中能自主完成复杂编程任务、修复漏洞并通过回归测试,强调生产级AI需兼顾代码交付与安全验证。

刚刚,GLM-5.3发布:Coding更接近Fable 5!潜伏40年的bug都被揪出来了

量子位 量子位 · 2026-08-14T08:47:51Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码