李开复表示,中美AI模型差距约六个月,但中国以低价提供性能接近的产品,类似安卓与苹果模式。美国公司盈利高,中国公司获更大用户规模。尽管芯片受限,中国工程师效率极高。AI将重塑企业组织,未来核心是设计问题者,人类连接行业将增长。
文章报道了ChatGPT等云端AI服务宕机后,企业转向本地AI解决方案的趋势。元空智能与惠普合作,将开源模型和Agent框架装入本地设备,提供数据安全、成本可控的推理服务,适用于金融、医药等合规要求高的行业。该方案用一次性硬件支出替代云端订阅费,支持离线运行,并瞄准20B-100B参数的中等模型作为生产力甜区。
Mux的@mux/ai工具现已支持开源模型,新增Baseten和OpenAI兼容端点提供商,允许用户自带本地或自托管模型。该工具要求视觉能力和结构化输出,部分模型需base64模式,并附验证脚本。开源模型存在可靠性问题,已通过重试机制解决。用户还可微调模型,集成更便捷。
中美同步收紧AI管控,表面为面子,实则阻碍中国AI发展。中国限制模型权重、数据出境、境外流片及收购,意在保护本土利益,但拖慢自身进程。美国限制芯片出口,增加成本与不确定性。中间地带国家倾向使用中国开源模型。小公司仍将顽强前行,但路更艰难。
阿里巴巴发布Qwen3.8-Flash,一款1250亿参数的开源多模态MoE模型,作为Qwen4的架构预览。该模型在编码和办公任务上性能优越,训练资源仅需同类模型的九分之一,成本更低。它支持26万token上下文,可扩展至百万,并已在Hugging Face和ModelScope开放。开发者反应不一,有人称赞其能在消费级硬件运行,也有人认为本地模型尚不足以替代远程服务。
英伟达拟以129亿美元收购Hugging Face,类似微软收购GitHub,旨在掌控开源模型生态。开源模型因成本低、易运行,正抢占市场,威胁OpenAI和Anthropic。此举确保开发者继续使用英伟达CUDA软件栈,巩固其硬件主导地位。开发者应构建适应模型变化的系统,而非依赖单一默认。
英伟达据报将以129亿美元收购AI模型平台Hugging Face,旨在掌控开发者寻找和运行开源模型的关键入口。该平台以硬件中立著称,支持AMD、英特尔等芯片,收购后可能偏向英伟达硬件,削弱其开放性。此举意在对抗客户自研芯片趋势,巩固AI生态地位,但面临社区价值受损风险。
阿里通义千问发布Qwen3.8-Flash-Next开源模型,采用MoE、GDN、QSA、Gated Residual和N-gram Embedding等创新架构,125B参数仅激活6B,成本为前代九分之一,性能超越397B旗舰。训练中发现Muon优化器下Batch Size Warmup无效,可节省18.8%算力,引发行业反思。
智谱发布开源模型GLM-5.3-Flash,匿名测试版Ox Alpha性能宣称追平Claude Opus 4.8,价格仅四十分之一,并跑在10万张国产芯片上。但实际使用中性能参差,价格含促销折扣,芯片效率“相当”而非超越,API条款严苛。开发者评价分化,建议用户实测、算清成本、关注生态。
Ollama重新推出与Claude Desktop的集成,允许用户通过Ollama连接本地或云端模型(如Qwen、DeepSeek等),在Claude界面内使用。此功能支持Mac应用,用户可切换模型,强调成本、速度和灵活性。Ollama旨在让开源模型更易用,未来或支持Windows。
美国法院近期因AI工具出现虚构引用和隐藏文字等失误,凸显通用模型难以胜任法律实务。Harvey公司基于中国Kimi K3模型训练出法律专用模型Tenet,提升任务完成率。类似地,Cursor、Devin等美国AI产品也采用Kimi系列底座,中国开源模型正成为海外AI产品的供应链基础,提供低成本、可定制的第三条路径。
Prime Intellect的研究表明,开源模型结合Multi-Agent Harness在nanoGPT优化任务中表现接近顶级闭源模型,挑战了RSI的假设。实验发现模型间的差距不在于创意,而在于试错吞吐量。更便宜的开源模型负责监控实现,高效的试错机器能提升AI科研速度,加速AI研发迭代。
阿里开源Qwen3.8-27B模型,在编程等任务上超越Claude旗舰,仅需一张二手3090显卡即可运行。其Sharp聊天模板优化了性能,引发对云端订阅价值的质疑。但测试条件存疑,结果可能仅在特定配置下成立,开源与闭源模型竞争仍存变数。
Thinking Machines发布开源模型Inkling,采用混合专家架构,总参数9750亿,但每次推理仅激活约410亿参数。该模型结合滑动窗口与全局注意力层,支持百万级token上下文,并使用相对位置编码以避免外推问题。Inkling支持图像和音频输入,并引入可调推理努力参数,旨在便于用户定制和微调。
本文探讨AI智能的本质、安全风险及行业影响。作者认为AI智能提升有限,但可复制性和响应速度带来新价值。文章批评美国政府对AI模型的突然限制,导致企业转向中国开源模型,并强调开放权重模型对防御的重要性。同时提及AI在选举预测可视化中的应用,以及中国AI发展对就业的挑战。
Qwen3.8-27B开源模型发布,拥有270亿参数,强化推理、编程与Agent能力,在代码、多模态和智能体评测中表现优异,接近顶级闭源模型。支持图像视频理解及灵活思考控制,HyperAI已上线教程供开发者快速调用。
智谱AI发布新一代开源模型GLM-5.3,总参数量7430亿,编程能力提升50%,在基准测试中位列开源第一。范式旗下平台PhanRouter同日适配并开放调用,用户无需更换API即可使用,提供低价和99.9%服务保障。该模式降低企业采用门槛,推动AI落地。
阿里开源Qwen3.8-27B模型,270亿参数,支持262K上下文,性能接近闭源旗舰。社区实测在双RTX 3090上达105 tok/s,通过量化、MTP加速等技术实现。模型Apache 2.0协议,48小时下载86万次。但速度受场景、配置影响大,多卡未必更快,且长上下文需量化KV缓存牺牲质量。
智谱GLM 5.3在269个项目中挖出2436个漏洞,其中1097个高危,平均潜伏26.6年,最老可追溯至1981年。在CyberGym评测中以84.5%准确率反超闭源模型Mythos 5。该模型还发现DNS协议致命缺陷,可致千万服务瘫痪,并成功追踪AI黑客Neo。开源权重后,打破闭源安全垄断,推动AI安全普及。
智谱发布GLM-5.3开源模型,在编程和安全能力上显著提升,编程接近Claude Fable 5,安全测试获84.5%成最强开源安全模型。实测中能自主完成复杂编程任务、修复漏洞并通过回归测试,强调生产级AI需兼顾代码交付与安全验证。
完成下面两步后,将自动完成登录并继续当前操作。