据外媒报道,Anthropic、OpenAI和Google DeepMind近期围绕人工智能安全问题展开多轮讨论,三家全球领先AI公司正在探索如何建立更加系统的前沿模型安全评估机制,以应对人工智能能力快速提升带来的潜在风险。
据悉,相关讨论涉及内容包括模型风险评估、安全测试标准以及是否建立新的行业安全组织等方向。其中,Anthropic近期持续强调前沿人工智能发展的安全挑战。该公司CEO达里奥·阿莫迪此前提出,随着AI模型能力快速增强,行业需要进一步完善安全评估体系,并加强外部测试机制。
Google DeepMind此前已推出「前沿安全框架」,用于识别先进AI模型可能出现的高风险能力,并制定相应防护措施。
OpenAI方面也表示,AI安全已经成为行业共同关注的问题,公司正在与包括Anthropic、Google DeepMind在内的机构探讨相关合作方式,希望推动更加成熟的安全评估框架。
OpenAI全球政策负责人Chris Lehane透露,三家公司已经围绕AI安全问题进行了数周沟通,相关讨论旨在推动行业建立更加完善的安全评估体系。此次合作并非传统意义上的联合研发,而是聚焦于如何降低高级AI系统可能带来的风险。
目前,三家公司尚未公布正式协议,也未形成统一监管机构,但这一动向显示,全球头部AI企业正在加强在安全领域的协调合作。










