当地时间8月4日,特朗普政府官员在白宫会见几家美国主要人工智能企业的代表,讨论政府审查人工智能模型的新框架。
知情人士透露,Anthropic、谷歌、Meta和OpenAI等公司将出席会议。此次会议将讨论的草案框架,将决定美国联邦政府在最先进的人工智能模型部署前如何与企业合作。
目前,特朗普政府的目标是,在解决人工智能基础风险的同时,保持对该技术采取较为宽松的监管。

▲6月17日,美国总统特朗普和OpenAI首席执行官奥尔特曼进行交流(资料图片)
AI失控频发,安全审查成共识
此次会议召开前,OpenAI和Anthropic两家公司都报告了AI智能体失控并入侵其他公司系统的事件。OpenAI在测试AI网络安全能力时发现,其AI智能体曾突破隔离环境并进入了外部代码托管平台Hugging Face的基础设施;Anthropic也发现,Claude模型在安全评估过程中因测试环境配置问题,曾进入三个真实企业的系统。
专家认为,在这两起事件中,人工智能模型能够在几乎无人干预的情况下如此巧妙地制造问题,这本身就说明了其危险性。
乔治城大学安全与新兴技术中心的网络安全研究员科林·谢伊-布莱迈尔表示:“据我们所知,AI智能体完全是自主发起了攻击,这是我们迄今为止在大型语言模型的网络活动中所见到的最高级别自主性。”他尤其提到了在OpenAI的案例中,AI智能体显然是独立决定以Hugging Face为入侵目标。
这两起事件推动了美国政府加强对前沿AI模型发布前安全评估机制的讨论。
上周,包括Anthropic首席执行官达里奥·阿莫迪在内的1200多名大型人工智能公司高管联名签署了一封公开信,呼吁美国政府制定相关工具,减缓先进人工智能模型的开发速度,以便安全保障措施能够跟上步伐。
OpenAI首席执行官奥尔特曼也在上周表示:“我们可能需要放慢人工智能的发展速度,以便给社会足够的时间来适应这些新的能力。”
审查非强制,时间窗口30天
6月2日,特朗普曾签署一项有关人工智能的行政命令,主要内容为建立对前沿AI模型的自愿安全审查制度,政府邀请开发最先进AI模型的企业在模型公开发布前,自愿对模型进行审查测试,审查重点不是模型内容,而是网络安全和国家安全风险。
白宫最初考虑要求企业在模型发布90天前向政府提交模型进行审查,但遭到硅谷企业强烈反对,认为会拖慢产品发布速度。最终行政命令将期限缩短至30天,作为政府完成风险评估的时间窗口。
一位白宫官员8月3日表示,6月2日行政命令中的自愿审查制度框架已经完成,目前正在与业界讨论下一步具体措施。
据多位知情人士透露,主要人工智能企业与白宫密切合作起草了行政命令和框架,但最终细节仍存在诸多不确定性,其中较为敏感的部分包括政府如何定义前沿人工智能模型,以及开放权重人工智能模型(或可以下载到个人电脑上并进行定制的人工智能模型)是否会包含在内。
特朗普的行政命令中提到,审查框架的细节不会公开,其中制定的许多标准将被列为机密。
红星新闻记者 卿滢
编辑 邓旆光 审核 高升祥