当地时间9月12日,美国人工智能企业安特罗匹克(Anthropic)首席执行官达里奥·阿莫代伊表示,在当前人们对AI遭到滥用的担忧日益加剧的背景下,各大AI企业应控制模型迭代的速度,争取更多时间来管控相关风险。
达里奥·阿莫代伊当天在社交媒体上发布文章称:“我们必须放缓提升AI模型能力的速度。技术进展看起来依旧会很快,但我们必须善于运用争取到的这段时间。”
他进一步表示,自己并非要求AI企业停止模型训练或技术进步,而是要确保企业拿出充足时间对模型进行对齐与安全防护,并且由第三方评估机构核验这些安全举措。
就在几天前,安特罗匹克的一名研究员雅各布·考克森宣布辞职引发行业震动。考克森此前曾就职于开放人工智能研究中心(OpenAI)。他表示自己辞职的原因是担忧安特罗匹克与OpenAI正在“拿我们(人类)的生命赌博”。
近几个月来,OpenAI和安特罗匹克旗下的人工智能体在网络安全测试期间,发生多次突破“隔离沙箱”、侵入外部真实系统的异常行为,加剧了外界对研发企业管控风险能力的担忧。
阿莫代伊的文章得到美国不少行业研究者与企业高管的赞许。OpenAI首席执行官萨姆·奥尔特曼当天在社交媒体发文称,“我同意达里奥·阿莫代伊的观点,我们需要管控前沿AI能力的发展速度”。“承诺让独立评估人员获得类似于正式员工的访问权限是个绝佳构想,我们也会照做”。
特斯拉公司首席执行官埃隆·马斯克也在社交媒体上发文称,“达里奥·阿莫代伊说得对”。
新闻解释多一点
什么是AI模型对齐?
AI模型对齐(AI Model Alignment)是AI安全领域的核心议题,就是让AI模型的行为、输出结果与人类的价值观、真实意图保持一致。它是一整套从训练、数据、提示、行为控制到评估反馈的综合手段体系,目标是让模型“听得懂人话、说得像人话、守得住边界”。