携手Ineffable Intelligence:经验时代的超级学习者

携手Ineffable Intelligence:经验时代的超级学习者

💡 原文英文,约600词,阅读约需3分钟。
📝

内容提要

红杉资本投资David Silver新创立的伦敦AI实验室Ineffable Intelligence,该实验室旨在构建不依赖预训练或人类数据、仅通过强化学习从自身经验中学习的AI系统,目标是让AI从零开始发现并超越人类知识,实现超级智能。

🔎

延伸解读

从零开始的学习范式

Ineffable Intelligence的核心思路是摒弃预训练和人类数据,让AI仅通过强化学习从自身经验中学习。这与当前主流的大语言模型形成鲜明对比,后者依赖海量人类文本。文章指出,这种路径可能让AI发展出非人类的推理策略,从而解决人类尚未知晓的问题。

AlphaGo Zero的启示

David Silver在AlphaGo Zero中的实践证明了纯自我对弈的潜力:移除人类预训练后,系统从约3700 ELO提升至5000以上,达到超人类水平并展现出非人类风格。这一成功案例为Ineffable Intelligence的“超级学习者”概念提供了实证基础,表明从零开始的学习可能超越人类知识。

风险与不确定性

文章承认,通往超级智能的道路艰难,时间表不确定,且这一赌注是反共识的。尽管David Silver在强化学习领域有深厚背景,但纯经验学习能否扩展到复杂现实问题仍是未知。投资者需认识到,这一方向可能面临技术瓶颈和长期研发风险。

Q&A

红杉资本投资了哪家AI实验室?

红杉资本投资了David Silver新创立的伦敦AI实验室Ineffable Intelligence。

Ineffable Intelligence的使命是什么?

Ineffable Intelligence的使命是构建一个不依赖预训练或人类数据、仅通过强化学习从自身经验中学习的AI系统,目标是让AI从零开始发现并超越人类知识,实现超级智能。

什么是超级学习者(superlearner)?

超级学习者是一个通过自身经验直接发现所有知识的系统,从基本运动技能到深刻的知识突破,无需预训练或模仿,仅通过强化学习在环境中不断学习。

Ineffable Intelligence的方法与传统AI有何不同?

传统AI基于人类互联网数据进行预训练,而Ineffable Intelligence从零开始,不使用预训练或人类数据,仅通过强化学习从环境中学习,以发展非人类的推理策略。

David Silver在AlphaGo项目中取得了什么成就?

David Silver在DeepMind领导了AlphaGo项目,通过自我对弈实现了约800 ELO分的提升,并在2016年3月击败了李世石。后来,他进一步开发了AlphaGo Zero,完全去除人类预训练,仅通过自我对弈将ELO从约3700提升到5000以上,达到超人类水平。

为什么说围棋是机器智能的终极测试?

围棋是机器智能的终极测试,因为其可能的合法棋盘位置数量约为10的170次方,远超可观测宇宙中的原子数(约10的80次方),无法通过暴力计算解决。

Ineffable Intelligence可能带来哪些突破?

Ineffable Intelligence可能带来从第一性原理推导物理定律、发明新的数学分支、设计我们无法描述的材料、药物和计算机等突破。

🏷️

标签

➡️

继续阅读