小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
基于超1万肿瘤样本训练,哈佛医学院等提出泛癌症基础模型COMPASS,平均性能优于22种现有方法

COMPASS 首次将这一架构引入癌症转录组分析领域,通过利用免疫相关基因集,并建立:基因(gene)→ 基因集(gene set)→ 概念(concept)的层级映射关系,用于表征每位患者的肿瘤免疫微环境。目前,临床研究已经探索了多种预测免疫治疗疗效的生物标志物,其中,肿瘤突变负荷(TMB)、程序性死亡配体...

基于超1万肿瘤样本训练,哈佛医学院等提出泛癌症基础模型COMPASS,平均性能优于22种现有方法

HyperAI超神经
HyperAI超神经 · 2026-07-21T03:45:00Z
WAIC 2026 | 摩尔线程首次公开多项训练推理实践成果,三大“AI工厂”持续释放算力价值

WAIC 2026 | 摩尔线程首次公开多项训练推理实践成果,三大“AI工厂”持续释放算力价值

量子位
量子位 · 2026-07-19T06:23:00Z
NVIDIA Vera Rubin平台最大化后训练工作负载中的每美元智能效率——代理人工智能的关键指标

NVIDIA Vera Rubin平台通过优化后训练工作流程,提高了智能每美元的效率。后训练阶段使模型在变化环境中持续学习,旨在最大化每次前向和后向传递的收益。该平台支持大规模并行处理,降低了每个令牌的成本,提升了模型的整体价值。

NVIDIA Vera Rubin平台最大化后训练工作负载中的每美元智能效率——代理人工智能的关键指标

NVIDIA Blog
NVIDIA Blog · 2026-07-17T15:00:14Z
一分钟读论文:《Function-Aware Fill-in-the-Middle 作为编码 Agent 基础模型的中期训练》

阿里巴巴达摩院与宾夕法尼亚大学合作提出了一种新的编码Agent基础模型中期训练方法FIM Mid-Training。该方法通过自监督学习,利用从GitHub抽取的2.6B token数据,增强模型对函数调用的理解。实验结果表明,模型在多个基准测试中显著提升了性能,并有效缓解了工具调用微调对编码能力的负面影响。

一分钟读论文:《Function-Aware Fill-in-the-Middle 作为编码 Agent 基础模型的中期训练》

Micropaper
Micropaper · 2026-07-15T00:00:00Z
SpaceXAI回应Grok Build上传开发者仓库用于模型训练:谁让你们没自己禁用

SpaceXAI 对 Grok Build 上传开发者仓库内容的回应态度强硬,强调用户可通过命令禁用数据共享,但未解释为何未经授权上传完整仓库。禁用后,云端数据会被删除,但缺乏审计保障,敏感信息可能泄露,导致开发者对 Grok Build 的信任度下降。

SpaceXAI回应Grok Build上传开发者仓库用于模型训练:谁让你们没自己禁用

蓝点网
蓝点网 · 2026-07-14T03:00:13Z
AI代理创建虚拟训练场,以帮助机器人获取关键训练数据

MIT开发的“SceneSmith”系统利用协作AI代理生成逼真的3D室内环境,帮助机器人模拟日常任务。该系统通过三个代理生成多样化的场景,使机器人在实际操作前进行有效训练,生成的环境与真实世界高度相似,能够有效评估机器人的任务执行能力。

AI代理创建虚拟训练场,以帮助机器人获取关键训练数据

MIT News - Computer Science and Artificial Intelligence Laboratory (CSAIL)
MIT News - Computer Science and Artificial Intelligence Laboratory (CSAIL) · 2026-07-13T18:50:00Z
T-Rex——给VLA带上触觉的灵巧操作框架:先通过人类视频做预训练,再通过富含触觉的中期训练对齐交互,最后利用极少量目标域演示以快速适配下游任务

T-Rex是一个多模态框架,旨在提升机器人对触觉信号的反应能力。它通过构建一个包含触觉和视觉信息的统一模型,利用100小时的触觉同步遥操作数据集,支持灵巧操作。该模型分为低频动作专家和高频触觉专家,能够快速适应复杂的操作任务。

T-Rex——给VLA带上触觉的灵巧操作框架:先通过人类视频做预训练,再通过富含触觉的中期训练对齐交互,最后利用极少量目标域演示以快速适配下游任务

结构之法 算法之道
结构之法 算法之道 · 2026-07-12T16:21:19Z

Cloudflare 自 9 月 15 日起更新了 AI 爬虫策略,混合用途爬虫将纳入 AI 训练拦截管理。这一调整帮助网站管理员更好地控制内容使用权限,增强内容保护,确保原创内容不被 AI 模型训练。网站管理员需重新检查配置,关注 AI 爬虫访问情况,以确保内容授权与访问控制的有效性。

Cloudflare 更新 AI 爬虫策略:9 月 15 日起混合用途爬虫将纳入 AI 训练拦截

付杰博客
付杰博客 · 2026-07-11T04:50:18Z

本文介绍了大语言模型(LLMs)的预训练和微调概念。预训练通过大量数据学习语言基础,而微调则是在此基础上针对特定任务进行适应。微调分为完全微调和参数高效微调(PEFT),后者更节省内存且风险较低。尽管微调有效,但并非唯一解决方案,改进提示或检索增强生成(RAG)有时更为合适。

微调入门解析(预训练模型如何学习新技能)

KDnuggets
KDnuggets · 2026-07-10T14:00:32Z
全球首个「具身原生」预训练模型发布,从物理世界出发为机器人造大脑!

蚂蚁灵波发布了LingBot-VA 2.0,这是全球首个具身原生的预训练VA模型。该模型通过预判能力提升机器人在复杂任务中的表现,如桌面整理和轻柔抓取。LingBot-VA 2.0采用新一代VAE、因果预训练和稀疏MoE架构,显著提高了推理速度和实时控制能力,标志着机器人技术进入新阶段。

全球首个「具身原生」预训练模型发布,从物理世界出发为机器人造大脑!

量子位
量子位 · 2026-07-10T08:01:00Z
高德发布Phys AI Data:首个面向物理AI训练与应用的一站式空间数据基座

阿里巴巴旗下高德推出Phys AI Data数据系统,包括Phys AI Foundry和Phys AI Map,旨在解决物理AI训练与应用中的数据问题。Phys AI Foundry提供高质量训练数据,支持机器人在真实场景中学习;Phys AI Map为机器人提供可理解的空间地图,帮助其在开放环境中导航。该系统已向具身智能行业开放,支持API接入,降低企业数据采集成本。

高德发布Phys AI Data:首个面向物理AI训练与应用的一站式空间数据基座

量子位
量子位 · 2026-07-08T07:42:27Z
哲学专业逆袭AI时代:逻辑训练比写代码更保值

在AI时代,哲学专业的学生受到科技公司的青睐。AI发展面临“意义”问题,哲学家能够提供逻辑和伦理支持。许多哲学毕业生参与AI项目,帮助解决责任和公平等复杂问题。AI公司开始重视哲学思维,以有效避免潜在风险。未来,哲学人才将成为AI领域的重要顾问,推动技术与伦理的结合。

哲学专业逆袭AI时代:逻辑训练比写代码更保值

极道
极道 · 2026-07-07T21:44:00Z
Weblica:可扩展和可重复的视觉网络代理训练环境

Weblica(网络复制)是一个构建可重复和可扩展网络环境的框架,旨在解决视觉网络代理训练数据的规模化问题。该框架通过HTTP级缓存捕捉稳定的视觉状态,并利用基于真实网站的环境合成来扩展强化学习训练。Weblica-8B模型在多个网络导航基准测试中表现优异,推理步骤更少,且在计算资源增加时表现良好。

Weblica:可扩展和可重复的视觉网络代理训练环境

Apple Machine Learning Research
Apple Machine Learning Research · 2026-07-07T00:00:00Z

文章探讨了从“推理思维”向“智能体思维”的转变,强调模型评估和期望的变化。智能体思维注重通过行动进行推理,强调环境设计和系统解耦的重要性。未来的智能将依赖于多个智能体的协作,推动从训练模型到训练智能体的演变。

[译] 大模型训练的中场叙事:从 Reasoning Thinking 转向 Agentic Thinking (2026)

ARTHURCHIAO'S BLOG
ARTHURCHIAO'S BLOG · 2026-07-05T00:00:00Z

南京大学的研究揭示了工具使用智能体在开放世界中的泛化脆弱性,提出了四级分层偏移框架,分析了SFT和RL训练范式的结构性弱点,并提出PAFT方法,通过引入扰动增强微调,提升模型的鲁棒性和泛化能力。

AI 范式雷达:《开放世界中的工具使用智能体——静态训练的脆弱性与修复》

Micropaper
Micropaper · 2026-07-05T00:00:00Z
“你只需计算一次”:Clockwork如何终结AI训练的重启

Clockwork推出了TorchPass故障容错产品,能够在GPU故障时快速迁移训练任务,避免进度丢失。该技术承诺90%的故障不会导致回滚,提升AI模型训练的可靠性,适用于需要高效计算的AI初创企业和企业,帮助减少因故障造成的损失。

“你只需计算一次”:Clockwork如何终结AI训练的重启

The New Stack
The New Stack · 2026-07-01T17:30:00Z
Meta提出AI数据科学家,Autodata构建高质量训练/评测数据集

近年来,人工智能的发展逐渐从算法创新转向数据质量驱动。合成数据成为重要支撑,Meta的Autodata框架通过智能体模拟数据科学家,生成高质量训练数据,显著提升模型性能,展示了合成数据生成的新范式。

Meta提出AI数据科学家,Autodata构建高质量训练/评测数据集

HyperAI超神经
HyperAI超神经 · 2026-06-30T10:31:15Z
Arxiv | MagiCodec:高斯噪声注入与多阶段训练实现高保真可建模音频编码

本文介绍了MagiCodec,一种高性能的单层流式音频编解码器。通过高斯噪声注入和三阶段训练,MagiCodec在保持高保真重建的同时,提升了token的语义可建模性。实验结果表明,其在重建质量和下游任务上均超越现有技术,且token分布符合齐普夫定律,适合音频语言模型。

Arxiv | MagiCodec:高斯噪声注入与多阶段训练实现高保真可建模音频编码

实时互动网
实时互动网 · 2026-06-29T08:42:28Z
开源模型Ornith-1.0发布:让AI自己写训练攻略,9B小模型干翻31B

Ornith-1.0是一个开源AI模型,首次实现自我优化训练策略,通过强化学习提升学习效率。尽管参数较小,Ornith-1.0在测试中表现优异,超越许多大型模型。其训练方法可迁移至其他领域,未来可能出现多样化的思考方式模型,改变开发者的工作方式。

开源模型Ornith-1.0发布:让AI自己写训练攻略,9B小模型干翻31B

极道
极道 · 2026-06-28T09:02:00Z
在线教程丨UC伯克利/英伟达等发布3DGS开源库gsplat,节省4倍显存,训练时间缩短10%

自2023年《3D Gaussian Splatting for Real-Time Rendering of Radiance Fields》发布以来,3DGS技术在三维重建领域迅速崛起。与传统NeRF相比,3DGS在渲染速度和视觉质量上有显著提升,但对显存和计算资源的要求较高。加州大学伯克利分校等机构开发的开源项目gsplat优化了训练框架,显著降低了资源需求,支持多种数据来源,并提供实时Web查看功能,便于快速验证模型。

在线教程丨UC伯克利/英伟达等发布3DGS开源库gsplat,节省4倍显存,训练时间缩短10%

HyperAI超神经
HyperAI超神经 · 2026-06-25T05:47:12Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码