➡️
继续阅读
-
大模型不只是预测下一个词:RLVR让它自己跟自己下棋
大模型不再仅依赖预测下一个词,通过RLVR强化学习,它能自主探索解题路径,从模仿者转变为探索者。预训练如同背诵课文,而RLVR则类似自我解题,借助可验证奖...
-
并行策略总览:六个维度各切什么、怎么通信
本文介绍大模型并行训练的核心概念,将DP、TP、SP、PP、EP、CP六种并行方式按切分维度、显存减少、通信开销和等待关系列表对比。并行本质是切分模型并引...
-
2026年可用的5个免费LLM API提供商
本文介绍了五个提供免费LLM API的服务商:GroqCloud(高速推理)、OpenRouter(多模型试用)、Cloudflare Workers A...
-
B站首届AI创造公开赛收官,超八成参赛者为一人团队
B站首届AI创造公开赛落幕,总奖金143万元,吸引超3万投稿。UP主W博士与AI猫娘凭《猫娘计划》获一等奖100万奖金。参赛者多为非专业开发者,超八成是一...
-
Linux Kernel 7.1已经结束生命周期不再提供更新 用户应尽快升级到7.2系列
Linux Kernel 7.1系列已结束支持,最终版7.1.13于9月2日发布,含76项修复。该非LTS版本生命周期短,官方建议用户升级至7.2系列或L...
-
用 ChatGPT 定时任务做一个 Hacker News 中文摘要网站
作者利用ChatGPT定时任务自动抓取Hacker News前30条,生成中文摘要并筛选兴趣内容,通过Eleventy构建静态网站hn-digest并发布...