DeepMind强化学习掌门人David Silver离职创业！Alpha系列AI缔造者，哈萨比斯左膀右臂

核心人物动态 - 强化学习领域权威专家David Silver已从DeepMind离职，结束了在该公司长达15年的职业生涯 [1][2] - 其离职后创立了一家名为Ineffable Intelligence的新AI公司，该公司已于2025年11月注册成立，Silver于2026年1月16日正式出任公司董事 [2][3] - 新公司总部位于伦敦，目前正处于积极招募研究人才和寻求风险投资的阶段 [7] 人物背景与成就 - David Silver是DeepMind的元老级研究员，于2010年公司创立之初加入，与联合创始人Demis Hassabis是大学好友并曾共同创业 [12] - 作为强化学习团队负责人，他主导或深度参与了DeepMind几乎所有里程碑项目，是“Alpha系列”AI的核心缔造者 [12] - 其代表性成就包括：2016年领导开发击败围棋冠军李世石的AlphaGo [14]；开发出在不依赖人类棋谱情况下精通围棋、国际象棋和日本将棋的AlphaZero [14]；开发出无需知晓规则即可掌握多种游戏的MuZero [15]；开发出击败《星际争霸II》顶尖职业选手的AlphaStar [16]；近期参与了可解答国际数学奥林匹克竞赛题目的AlphaProof以及谷歌首个Gemini模型的研究 [17] - 其学术影响力巨大，是DeepMind发表论文最多的研究员之一，谷歌学术统计其论文总被引次数超过28万次，h-index高达104 [19] 创业动机与理念 - 创业动机是希望回归“解决AI领域最难题所带来的敬畏与奇迹”，并将实现超级智能视为当前最大的未解挑战 [20] - 其目标是构建一个能够自我发现所有知识基础、并能永无止境学习的超级智能 [21] - 他认为当前主流的大语言模型能力受限于人类已有知识，倡导AI进入“经验时代”，即通过强化学习从经验中自我学习，从而发现人类未知的新事物 [22][24] - 他强调实现真正的超级智能，AI必须摆脱对人类知识和直觉的依赖，从第一性原理出发进行学习，并以AlphaGo对战李世石时超出人类专家理解的第37手棋为例证 [24][25]