特朗普政府推出的AI安全测试框架,本意是评估先进AI的潜在网络安全风险,但最新报道揭示其存在重大局限:开源模型被完全排除在外,且整个框架为自愿性质。这一做法在AI安全领域引发广泛讨论。
发生了什么
据Axios报道,特朗普政府的AI测试框架在制定时明确将开源模型排除在外。所谓开源模型,指那些权重公开、可供任何人下载和审查的AI系统,如Meta的Llama系列或Mistral的模型。框架文件甚至直接写明,该测试不适用于此类模型。此外,整个框架是自愿性的,意味着AI公司没有法律义务必须遵守。
这一框架旨在评估AI系统可能被用于网络攻击等恶意目的的风险,但它的覆盖范围和约束力都相当有限。
为什么重要
开源模型在AI生态中占据重要地位,它们推动了技术民主化,但也带来了独特的安全挑战。由于任何人都能下载和修改,开源模型可能被恶意微调,用于生成恶意代码或策划攻击。排除开源模型,意味着这一安全测试框架无法覆盖最容易被滥用的AI类型。
同时,自愿性质让框架的实际效果大打折扣。在缺乏强制力的情况下,企业可能出于成本或竞争考虑而选择不参与,导致框架形同虚设。这与欧盟《人工智能法案》等强制性监管形成鲜明对比,也反映出美国在AI监管上的路径分歧。
值得注意的是,特朗普政府此前曾签署行政命令,强调AI创新优先,而这一测试框架的宽松设计,可能正是为了减少对企业的束缚。但安全与创新的平衡,始终是AI治理的核心难题。
影响与看点
对开发者而言,开源模型被排除意味着他们可能面临更少的合规压力,但同时也失去了一个官方安全评估的参考。对用户来说,开源AI应用的安全性将更加依赖社区审查和第三方工具,而非政府背书。
值得关注的是,这一框架是否会随着舆论压力而调整。目前来看,其模糊性和自愿性可能难以有效应对AI的快速发展。一个独立判断是:在缺乏强制监管的情况下,AI安全测试的实效性存疑,行业自律或许能填补部分空白,但无法完全替代公共监管。



