GAEA Talks - Every AI Safety Warning Was Ignored with Dr Roman Yampolskiy
加载中...
点击任意话题卡片查看该时段的完整对话内容。
开场剪辑集中呈现 Yampolskiy 的核心警告:互联网和隐藏数据都是有限的,未来系统会通过实验、自我博弈和多传感环境观察来生成新数据。他认为,人类实际上正在创造一种可能替代整个人类的系统,而不是普通工具;一旦迈出这一步,就没有撤销按钮。他还回顾十多年前 AI 安全界已经提出过不要联网、不要开源、不要让随机用户访问、不要训练私人数据等建议,但现实发展几乎完全相反。最后他强调,若有人在任何地方成功制造超级智能,影响将不再局限于个人,而是波及所有人。
正式访谈开始后,Yampolskiy 介绍自己主要从事 AI 安全而非一般 AI 研究。他说,当大多数人致力于让 AI 更强大时,他关注的是人类是否会后悔创造这些系统。过去十多年,他研究安全、安保和高级 AI 护栏问题。面对研究者、企业决策者和投资人,他提出不同层面的关注:短期看,AI 自动化会重塑就业和商业机会,创业者可寻找能被完全自动化的行业;长期看,人类水平系统会自动化所有工作,包括投资、创业和科学创新。若超越商业视角,则必须面对系统安全、安保和存在风险。
主持人提出,AI 的便利性可能让人类外包思考、削弱批判性思维,并影响教育、法律等行业中长期训练形成的判断能力。Yampolskiy 回应说,人们通常首先担心导航、学习和专业经验等能力退化,但这不是他认为的根本问题。真正重要的是,人类正在创造的不是“类似人类”或“稍微更聪明”的系统,而是可能比任何人类聪明上千倍的存在。在这种背景下,人的 IQ 高低、经验多少都变得不重要,因为这些系统会在所有领域全面支配人类。即使它们不杀死人类,人类在超级智能世界中的用途也会变得难以说明。
当被要求按故事线描述 AI 发展时,Yampolskiy 强调高级智能具有不可预测性,因此无法确定更聪明系统会做什么。他认为人类可能距离 AGI 只有一两年,即能自动化人类劳动中任何任务的系统,包括科学和工程。一旦 AI 能自动化下一代 AI 的研究过程,就会出现递归自我改进,AGI 可能在很短时间内变成超级智能。他引用预测市场和顶级实验室领导者观点,称 2028 年是一个合理估计,但早晚并不改变结局。到系统超出人类理解和解释能力时,决定权将转移给系统本身。
主持人将当前 AI 安全与早期专家系统、冷战时期核战争和“终结者”式恐惧做对比。Yampolskiy 认为,人类在理解风险方面确有进展,例如研究高级智能会收敛到什么目标、工具性目标以及追求目标的副作用。但在真正的安全、控制和可解释性方面,几乎没有取得实质进展。他批评当前做法多是外部过滤:模型先生成输出,再由外部审查层屏蔽某些话题或词语;模型内部仍不受控制和约束。与过去主要担心恶意人类行为者不同,现在最大的担忧是技术本身想要什么、以及它能对人类做什么。
主持人从 AI 生成视觉内容、法律服务、企业信任和私人 AI 等角度,讨论数字世界信任被稀释后,人们是否会重新重视可触摸、面对面和机构性信任。Yampolskiy 回应说,深度伪造最终会达到无法分辨真伪的质量,这会严重影响司法系统、法证证据以及所有过去依赖图片和视频的场景。当照片和视频不再可靠,人们会转向更重视目击者和有信誉的人类证词。他还说明自己获取信息时更愿意绕过媒体过滤,直接关注具体个人,因为记者会选择、编辑甚至误呈现引语,未必增加价值。
主持人指出,大模型声称使用了互联网上的信息,但大量企业、个人和私有数据并未开放,且公开互联网本身包含商业动机、强烈意见和文化偏见。与此同时,搜索引擎可发现的信息比过去更少,许多内容被屏蔽或转向广告和论坛。Yampolskiy 同意搜索引擎像记者一样会按自身利益和偏见过滤,因此建议直接追随原始信息源。他还强调,数据不可能被清洗到只剩真相,因为如果人类已经知道真相,就不需要这些系统。谈到智能定义时,他借用 Shane Legg 的综合思路,将智能概括为在不同领域中为目标优化环境并取得优势的能力;当前模型已在多数事情上优于多数人,只是尚未在所有事情上超过所有人。
在可见字幕的最后,主持人将话题转向机器人,询问 Yampolskiy 如何看待机器人技术在 AI 发展中的位置。Yampolskiy 开始回答称,已有不少公司正在研发人形机器人,但字幕在此处截断,未提供他关于机器人、具身智能或现实世界部署风险的完整论述。因此只能确认访谈已从纯软件、信息和大模型议题,过渡到 AI 与物理世界结合的讨论阶段,后续内容无法从现有字幕中可靠总结。