微调你的大模型?不,是让它自己卷死自己。 2026年微调大模型早已不是烧钱游戏,开源小模型通过强化学习直接干翻闭源巨无霸。GRPO算法、RULER自动评分、ART框架让AI在试错中进化,省去手动标注和奖励函数。关键是在监督微调的战略定力与强化学习的战术创新之间找到致命平衡,否则要么变书呆子要么变疯狗。 监督微调SFT给你基本盘但锁死天花板...
DeepSeek一年烧掉74亿美元估值,OpenRouter上中国模型流量碾压美国三倍——你猜谁在为这场免费午餐买单?...
Anthropic指控阿里巴巴大规模蒸馏其AI模型Claude,并利用假账号进行数据采集。阿里在高管离职后迅速转向闭源产品,可能对开源生态造成影响,此事件引发了对AI行业未来的担忧,尤其是全尺寸开源模型的消失。
Warp,一个基于Rust的开发环境,宣布其客户端开源,旨在通过社区合作加速产品开发。公司认为AI辅助开发将改变软件构建方式,强调开放性和可定制性,以应对市场竞争。
DeepSeek-V4正式上线,分为V4-Pro和V4-Flash两个版本,性能领先于同类产品。V4-Pro适合复杂任务,V4-Flash为经济版,适合简单任务。新模型支持1M上下文,采用创新的注意力机制,显著降低计算需求。API服务已更新,旧模型将在三个月后停用。
Cal.com因安全考虑将核心代码转为闭源,回应AI技术带来的漏洞风险。虽然仍提供去除商业功能的开源版本Cal.diy,但公司认为开放代码增加了被攻击的风险,客户更关注数据安全而非开源性。这一决定反映了开源项目面临的安全挑战,可能影响行业趋势。
Meta推出的新一代大模型Muse Spark强调闭源策略,未提供开源链接,显示其开源立场的转变。与Llama系列相比,Muse Spark在性能上处于第一梯队,但未来的开源计划尚不明确,开发者面临不确定性。
谷歌逐渐限制Android系统的侧载应用,背离了其曾经的开放性。尽管以“安全”为名,这一做法却导致用户信任度下降,Android的竞争优势受到削弱。
Claude CoWork与OpenClaw在AI智能体领域竞争。前者是闭源的“贵族私教”,仅支持苹果电脑,依赖截图操作;后者是开源的“街头霸王”,支持多平台,使用命令行。两者各有优势,未来可能共存,满足不同用户需求。
Anthropic 指责其他公司蒸馏 Claude 模型,但自己也使用开源模型进行训练,引发网友质疑其双标行为。尽管开源训练没有问题,但其闭源做法引发争议。
META决定放弃开源策略,转向闭源AI模型Avocado,预计明年春季发布。该模型将通过微调多个开源模型来提升性能,以实现盈利,标志着META在AI领域的战略转变。
2025年,中国人工智能迅速发展,开源与闭源技术竞争激烈,AI Agent实现质变,推动各行业变革。年度榜单揭晓,展示领航企业、潜力创业公司及杰出产品,体现AI生态的多样性与创新。
近期,闭源AI模型发布后,开源模型迅速跟进,形成了“开源双胞胎”的叙述。然而,这种叙述忽视了数据、计算和工程系统等关键因素,实际上开源生态处于被动状态。闭源巨头主导发展节奏,开源只能被动响应,导致能力差距。真正的挑战在于开源能否在生产中稳定运行,而不仅仅是模仿闭源模型。
Kimi K2 Thinking发布并开源,具备超越GPT-5的智能和推理能力。该模型支持边思考边使用工具,能够进行200-300次连续调用,刷新多个基准测试成绩。在编程、创意写作和学术研究等领域表现优异,采用INT4量化以提升性能,兼容性更强。
机器之心数据服务现已上线,提供高效稳定的数据获取,简化数据爬取流程。
Zilliz CEO 星爵讨论了开源与闭源商业模式,指出Databricks的双核心架构成功平衡了用户体验与商业化。他反思了创业理想的变化,强调思考的重要性,认为AI工具应当辅助思考,而非替代。
KubeSphere突然闭源,用户未获提前通知,导致无法访问文档和服务。这一决定可能源于盈利下滑,反映了国内开源商业模式的困境,损害了用户信任,未来合作前景堪忧。开源应平滑过渡,保留历史,以维护行业信任。
机器之心数据服务现已上线,提供高效稳定的数据获取服务,简化数据爬取流程。
开源模型Qwen在一周内推出三款新模型,刷新多项SOTA,成为全球最强开源模型。这些新模型在逻辑推理、数学和编程等任务上表现优异,超越多个闭源模型,展示了中国开源技术的快速发展与领先地位。
阿里通义团队开源的Qwen3-Coder刷新了AI编程的最新技术,超越了Claude Sonnet 4。该模型支持256K上下文,扩展至1M,具备强大的编程能力,用户可免费使用,推动开源编程发展。
完成下面两步后,将自动完成登录并继续当前操作。