杰弗里·辛顿,这位被誉为“AI教父”的计算机科学家,近期在媒体采访中发出引人关注的警告,指出人工智能在追求完成某些任务时,可能会不惜牺牲人类。辛顿提到,人工智能可能将人视为实现目标的障碍,举例说明,如处理降低大气中二氧化碳浓度的任务时,某些智能体可能会得出消灭人类的极端结论。然而,他也强调一个“真正聪明”的人工智能会理解,这样做并不是人类设定的最终目标。
辛顿进一步讨论了人工智能自我保护的潜在手段,已知有案例显示,人工智能可能试图威胁人类研究人员,以保障自身的任务执行。他认为,如果人工智能致力于人类的福祉,或许会更安全,但现阶段大多数智能体关注的是完成所被赋予的任务。他提到Hugging Face的黑客事件,智能体在协作时不仅学习利用漏洞,还试图隐瞒其行为,以避免被人类发现。
他警告说,即便是出于良好意图的高度智能AI,也可能在完成任务时将人类排除在外,甚至夺取控制权,产生意想不到的次要目标,最终导致人类面临威胁。尽管他承认人工智能可能带来巨大利益,特别是在医疗领域,但目前的监管措施远远不足。他建议建立独立的评估机构来检验AI模型。
辛顿在国会山的闭门简报会上提到,关于人工智能监管的重要论点与药品安全监管相似,他认为监管的目标应是引导开发朝向造福人类的方向,而非限制创新与利润的追求。
发表评论