哈萨比斯提议设立AI模型国际审查机构
人工智能竞赛正在进入一个新的阶段:比拼的不只是模型能力,还有谁能建立一套被行业和政府接受的安全规则。
7月17日,谷歌DeepMind首席执行官Demis Hassabis提出,希望成立一个国际独立机构,对最先进AI模型在公开发布前进行统一测试和安全审查。他计划于下周前往华盛顿,与美国政府讨论这一方案的可能性。
这一提议背后,是AI能力快速提升带来的监管压力。
近年来,前沿模型的能力增长速度明显加快。大模型已经从文本生成、图像处理,逐渐扩展到代码开发、自动化执行以及复杂任务规划等领域。与此同时,模型可能被滥用于网络攻击、信息操纵以及其他高风险场景的担忧也在增加。
哈萨比斯提到,Anthropic旗下Mythos模型展现出的先进网络攻击能力,再次凸显了建立更严格AI安全评估机制的必要性。
虽然目前行业对于AI风险的具体程度仍存在争议,但大型模型发布前进行安全测试,已经逐渐成为科技公司和监管机构共同关注的问题。
按照哈萨比斯提出的方案,新机构应保持独立性,由外部专家负责评估,而资金则可以由领先AI公司提供。前沿模型在正式发布前,最长可能接受30天测试。如果发现潜在风险,机构可以协调行业暂缓推进某些模型开发。
这实际上类似于航空、药品和金融行业中的风险评估机制。
高风险技术通常不会完全依靠企业自身判断。航空制造需要安全认证,新药上市需要临床测试,金融机构需要压力测试。AI行业此前更多依赖公司内部安全团队,但随着模型能力增强,外部审查机制正在被重新讨论。
不过,建立这样的国际机构并不容易。
AI产业竞争具有明显的商业属性。模型公司投入数十亿美元建设算力、训练模型,发布时间往往关系到市场竞争优势。如果审查机制过于严格,企业可能担心创新速度受到限制。
尤其是在美国、中国、欧洲等地区都在推动AI产业发展的背景下,如何协调不同国家的监管标准,将成为最大挑战之一。
目前,部分AI企业已经表达支持态度。
OpenAI首席执行官Sam Altman和特斯拉、xAI创始人埃隆·马斯克此前都公开支持加强前沿AI安全管理。虽然两家公司在商业竞争上存在明显关系,但在AI风险治理方面,行业巨头之间正在形成一定共识。
这也反映出AI企业面临的新现实。
过去,科技公司更多希望通过快速迭代建立市场优势。但随着模型能力接近更高阶段,企业自身也开始意识到,如果安全问题引发重大事件,整个行业都可能受到影响。
DeepMind长期专注人工智能安全研究,哈萨比斯此次提出国际审查机制,与其此前强调的“负责任AI发展”路线保持一致。
但真正的问题在于,谁来定义“前沿模型”,谁来决定哪些能力需要限制,以及审查结果是否具有约束力。
如果未来这一机构成立,它可能成为AI产业类似“安全认证体系”的存在。但在此之前,行业仍需要解决技术、商业和国际协调之间的平衡。
AI发展的速度不会因为监管讨论而停止。真正的竞争,可能正在从单纯追求更强模型,转向如何让更强模型在可控范围内进入社会。