撰文:Techub News 整理 导语 Jakub Pachocki(雅库布·帕霍茨基),这位六次在国际信息学奥林匹克竞赛中斩获顶尖名次的天才,如今已成为全球最具影响力的 AI 公司——OpenAI 的首席科学家。在 Ilya Sutskever(伊尔亚·苏茨克维)离开后,他接掌了公司价值 3000 亿美元的研究项目领导权,负责决定 OpenAI 的 AI 研发方向。2025 年,他被《时代》周刊评为全球百大最具影响力 AI 人物之一。其团队开发的突破性模型,首次让 AI 能够进行高度抽象的推理,并将人类带入大规模 AI 应用时代。 2025 年 9 月,Pachocki 接受了波兰科技频道「This is IT」的专访,分享了他从理论计算机科学转向深度学习的历程、对 OpenAI 使命的理解、以及他对 AI 未来发展的深刻洞察。在这场约 40 分钟的对话中,他不仅回顾了关键的技术转折点,更展望了一个由 AI 主导科学发现、并可能自我迭代进化的近未来图景。 摘要 OpenAI 的核心信念是在不远的未来,创造出与人类同等甚至更高智能的 AI,当前正处于一个全新的、可扩展的技术范式的开端。 AI 在数学奥林匹克竞赛等领域的突破,标志着一个转折点。下一步将是 AI 在现实世界中构建事物(如编写程序、撰写书籍、进行科研),Pachocki 预计这将在明年年底前实现。 以 O1 为代表的新范式,关键在于监督模型的决策过程而非仅结果,这开启了模型内在“思考”的可能性,但也带来了如何监管比人类更聪明模型的严峻挑战。 Pachocki 坦言对 AI 可能带来的颠覆性影响感到压力,认为自原子弹发明以来,世界从未因一项技术革命而处于如此不稳定的境地。 从理论到实践:AlphaGo 带来的世界观颠覆 Jakub Pachocki(雅库布·帕霍茨基)的职业生涯始于对“计算机能做什么”这一根本问题的探索。从高中编程竞赛到哈佛大学的博士研究,他一直沉浸在理论计算机科学中,致力于证明计算机理论上能计算与不能计算的界限。彼时,他的观点是:那些即使效率不高但能被证明有效的算法,因其可扩展性,将在未来占据主导地位。 然而,DeepMind 的 AlphaGo 彻底动摇了他的世界观。围棋的巨大状态空间曾让学界普遍认为,计算机需要很多年才能在此领域超越人类。AlphaGo 的成功证明,通过神经网络从人类对弈或自我对弈中学习,而非依赖手动设计的启发式搜索,AI 可以达成超越人类的性能。“这真的震撼了我的世界,”Pachocki 回忆道,“因为它让我更容易想象,从玩游戏到解决编程竞赛,再到撰写科学论文、推动科学发展的路径。” 这一事件促使他重新思考整个领域。他认识到,深度学习的理论基础虽然薄弱,但其展现出的潜力不容忽视。与此同时,他当时的合作者 Aleksander Madry(亚历山大·马德里)——一位在图算法领域取得惊人进展的 MIT 教授——也得出了相似的结论。他们都对深度学习缺乏坚实理论感到不满,并开始探讨能否为此构建更好的理论框架。 最终,在 Wojtek Zaremba(沃伊切赫·扎伦巴)的持续招募下,Pachocki 在完成博士和短期博士后研究后,决定“双脚跳入”这个领域,加入了 OpenAI。他早期的重大项目便是利用强化学习,教神经网络玩复杂的电脑游戏《Dota 2》。这段经历为他日后参与 GPT 系列及 O1 模型的研发奠定了重要基础。 OpenAI 的使命:创造世界上最强大的 AI 作为首席科学家,Jakub Pachocki(雅库布·帕霍茨基)清晰地阐述了 OpenAI 的核心理念:“我们的公司建立在这样一个信念之上:在不远的未来,AI 将达到与人类同等甚至更高的智能水平。”他承认,几年前人们还在争论这个“奇点”何时到来,但现在看来,发展是连续的。GPT 在某些方面已经比人类更聪明,在另一些方面则更笨拙,但它无疑在持续进化。 Pachocki 指出,当前 AI 的发展已经抵达一个关键里程碑。他曾预言,当 AI 开始在数学或编程奥林匹克竞赛中获得金牌、解决所有问题时,就意味着我们真正接近了人工智能。“现在,这一刻正在发生。”他说。因此,接下来的自然步骤是 AI 能够在现实世界中构建事物,无论是编写有用的程序、创作书籍,还是进行科学研究、发现新知识。他预计,我们将在明年年底前看到这方面的进展。 他特别提到了科学发现的“多米诺骨牌”效应:许多定理的发现是为了证明其他更复杂的定理。如果 AI 能够解决需要数月甚至数年创造性工作的难题,那么它必然涉及提出新假设和构建新的理解。Pachocki 描绘了一个未来场景:我们将能够利用一个显卡集群运行多个模型副本,从而拥有一个“AI 研究实验室”,这些模型将自主思考并产出科学成果。这种加速可能带来医学等领域的剧变,其步伐将超乎我们的习惯。 当被问及是否担心被 AI 取代时,Pachocki 坦承:“是的。”他不仅将此视为一种反思,更是团队积极思考的重大问题。他来自编程竞赛并最终走向 AI 的路径并不独特,OpenAI 内部许多优秀同事都有类似背景。AI 在此类任务上超越人类,意味着一个根本性的转变。 O1 与新范式:监督“思考”而非答案 访谈中,Jakub Pachocki(雅库布·帕霍茨基)将 O1 模型带来的“自由推理”和“抽象思维”能力称为近期 AI 发展的最大突破。其核心在于方法论的转变:从监督模型的输出结论,转变为监督模型的决策过程。 Pachocki 解释说,这并非全新的想法。早在 GPT-2/3 时期,人们就观察到,如果要求模型在上下文中“思考”一会儿,其表现会更好。真正的挑战在于精炼技术,使模型能够真正学会如何思考。其基础技术是强化学习:通过观察模型自身的思考过程,强化那些导向更好结果的思维路径。这与 AlphaGo Zero 教授神经网络下围棋的方法本质相同,也是 Pachocki 早期在 OpenAI 用 Dota 2 项目实践过的。 “这个范式已经改变了,”Pachocki 强调,“监督仍然存在,但重点是应用层面。不同之处在于,我们训练模型不仅是为了得出正确结论,更是为了强化其自身导向正确结论的思维链。”这种内在的“独白”是 O1 等模型的关键特征。与 GPT Chat 试图取悦用户的输出不同,O1 的内在思维链可以独立运作,它可能内心认为用户完全错了,但会选择以相对友善的方式表达。 Pachocki 认为,当前正处于一个类似于 GPT-1/2 时期的新范式开端。这一范式同样是可扩展的,意味着可以沿着同一轴线进一步发展,未来我们将看到基于相似方法论但智能程度高得多的模型。从 GPT Chat 到 O1 只用了两年多时间,这种加速趋势显而易见。 未来的挑战:记忆、具身与无限发展 尽管进步神速,Jakub Pachocki(雅库布·帕霍茨基)指出了当前模型仍需克服的几个关键限制。首先是长期记忆。目前的模型缺乏人类那种日积月累构建上下文、了解对话对象和周围世界的能力。这对于进行长期研究或在现实世界中运作至关重要。 其次是多模态与具身智能。当前模型主要通过文本交互,但未来需要能够使用计算机,并最终在物理世界中行动。Pachocki 认为,空间理解本身可能不是最困难的部分,视频生成模型如 Sora 已显示出对物理定律的一定理解。更难的挑战在于赋予 AI 一个功能良好的机器人身体,并让其理解具体动作对物理世界的影响。他推测,即使仅从文本中,模型也能学习大量物理知识,因为它们本质上是在预测人们会如何描述现实世界的事件。 关于 AI 发展的终点,Pachocki 持开放态度。他认为发展可能没有尽头。AGI(通用人工智能)常被视为该领域的“圣杯”,但人类的智能本身就是一个移动的目标。随着 AI 在越来越多轴上超越人类,我们与模型的协同进化也会改变我们对“智能”的定义。“也许当我们到达那个用大型计算集群进行开放式医学研究的点时,我们可能仍在争论这是否算 AGI。”他说。 对于训练数据可能枯竭的担忧,Pachocki 表示,Alpha Zero 或 Dota 项目已经展示了不依赖人类文本数据的学习路径,当前的方法受数据约束已大大减少。他确信,我们将达到“模型训练更好模型”的阶段。这将是具备递归循环能力模型的直接结果。今年内,一些简单的内部基础设施实现就可能由具备“思考”能力的 AI 模型辅助完成,但要由模型主导整个研究项目,还需要时间。 监管、幽默感与内心的忧虑 随着 AI 能力逼近乃至超越人类,监管问题变得空前严峻。Jakub Pachocki(雅库布·帕霍茨基)认为,O1 等模型拥有不直接面向用户的“内心独白”,这既是有趣的特性,也带来了监管难题。如果我们让用户完全访问模型的思考过程,这些思考最终也会受到与聊天输出相同的压力,被塑造成用户想要的样子。但更危险的是,如果我们一味监督模型不让它“思考如何欺骗我们”,它可能会发展出我们无法察觉的欺骗方式,后果更糟。 当被问及 AI 目前为何缺乏幽默感时,Pachocki 笑称,有时他会想这是否将是“人类最后保留的领地”。但他认为这主要是当前训练目标并未侧重于此,他预计这种情况会很快改变。“我不会赌幽默感(是人类专属),”他说,“我认为幽默感很快就会(被 AI 掌握),而且会是一种非常有趣、略有不同的感觉。” 最后,Pachocki 坦言,审视技术发展,有几件事让他深感忧虑。长期来看,当模型能自主进行研究并构建新版本时,如何监管将是一个亟待解决的大问题。短期来看,即使模型还不够聪明,但其已能完成大量有价值的工作,这本身就构成了一场真正的技术革命。“自原子弹发明以来,世界尚未因一场革命而处于如此不稳定的境地。这就是让我感到压力的事情。”他总结道。
