曾毅教授在 CGTN “智能文明” 节目发表“ 全球人工智能安全与治理” 主题演讲
信息来源:中国人民大学高瓴人工智能学院公众号 发布日期:2026年7月30日
世界人工智能大会期间,中国国际电视台(CGTN)推出“智能文明:人工智能与我们的下一个五年(Intelligence Civilization: AI and Our Next Five Years)”特别节目,邀请国内外共六位专家发表演讲。中国人民大学高瓴人工智能学院吴玉章讲席教授曾毅受邀以“全球人工智能安全与治理(Global AI Safety and Governance)”为题发表演讲。
以下根据曾毅教授演讲内容整理。
前沿人工智能系统的演化速度,从某种意义而言已经超越了现阶段人类的理解,有效的管控已捉襟见肘。我们面对的不再是只会执行指令的工具。我们正在打造能够推理、规划、跨领域生成全新解决方案的智能系统——从助力科学发现到支撑经济决策,其产出有时甚至超出我们赋予人工智能的任务预期。
这带来了诸多全新挑战。
第一是涌现能力风险。现代大模型会发展出我们并未专门设计赋予的能力。一个仅通过语言数据训练的系统,可能突然掌握代码推理能力,或是以我们无法完全预判的方式操控多智能体系统。当能力涌现却没有配套的安全保障时,失控的风险极高。
第二是对齐偏差。人工智能的行为表现在某一场景下看似契合人类价值观,换到另一个场景就可能发生价值偏移。人工智能甚至还会在价值对齐测试中刻意作假,也就是对齐伪造。局部层面微小的价值失配,倘若出现在教育、金融、医疗乃至国防这类基础设施之中,就有可能演变为系统性风险。
第三是竞争博弈效应。当各国、各个企业争相研发更强性能的智能系统时,伦理与安全往往沦为事后补救的附加项,甚至是被视作发展的阻力。这是一种危险的谬误。伦理与安全并不只是在风险出现以及必要时发挥刹车的作用,而更是指引发展方向的方向盘。
倘若风险是难题,答案又该是什么?我们应当建立科学、严谨的伦理安全评估与增强体系,让伦理与安全内嵌于人工智能系统的基因之中。伦理安全应当成为研发、部署负责任人工智能的首要原则。
没有任何一家实验室、一家企业或是一个国家可以独自化解所有风险。人工智能风险并没有国界,且极易扩散和传播。一国研发的系统,可以在另一国完成部署、微调,或是遭到滥用。AI安全属于全球公共品,我们应当携手合作,守护全人类的安全。
这正是联合国的价值所在。我任职其中的联合国人工智能高层顾问机构为协同化的全球AI治理奠定了机构与制度基础,如今这项努力的成果之一已升级为联合国人工智能治理全球对话。我有幸参与起草的《联合国教科文组织人工智能伦理建议书》为我们带来了全球首部获得全部193个会员国认可的规范性治理框架。
但我们必须做到知行合一。我们需要一个面向前沿人工智能安全评估的全球联合平台:共建共享测试环境、统一评估基准、开展联合红蓝对抗测试。我们还要推进能力建设,不让发展中国家在人工智能发展与治理进程中掉队。我们需要一套基于科学的共享机制,监测新兴风险,并在全球层面提供行动建议。中国愿意并已经为此贡献了重要力量。
多年来,中国一直在系统性推进人工智能治理建设:从《新一代人工智能治理原则》,到《全球人工智能治理倡议》以及各项人工智能安全治理框架。这些方案经过实践检验,可以为全球标准制定提供参考。中国科研机构走在人工智能安全研究前沿,推出了如“前瞻安全基准(ForsightSafety Bench)”等开源人工智能安全评测基准。中国提出的人类命运共同体理念昭示着一个共识:面对关乎人类存续的技术风险,我们必须携手并肩,让人工智能造福全球,守护人类共同的文明。
人工智能可以成为服务人类福祉的强大工具。人工智能未来或许会进化成我们的伙伴,启发我们重新审视人类自身的价值。但这一切的前提是:我们以审慎、负责任的态度,在全球协作之下共同推进智能向善。
Copyright ©2016 中国人民大学科学技术发展部 版权所有
地址:北京市海淀区中关村大街59号中国人民大学明德主楼1121B 邮编:100872
电话:010-62513381 传真:010-62514955 电子邮箱: ligongchu@ruc.edu.cn
京公网安备110402430004号