简介:本文探讨了针对大型语言模型的安全评估技术,涵盖数据泄露、偏见和鲁棒性等关键问题,旨在提升模型安全性。
4月16日,在联合国日内瓦总部万国宫举行的第27届联合国科技大会AI边会上,世界数字技术院(WDTA)与云安全联盟大中华区(CSA GCR)联合主办了会议,并发布了两项具有重要意义的国际标准:“生成式人工智能应用安全测试标准”和“大语言模型安全测试方法”。这是国际组织首次在生成式AI应用安全及大模型安全领域发布国际标准,为业界提供了统一的测试框架。这些标准将对人工智能技术的安全、可靠发展产生深远影响。
这两项新发布的国际标准由云安全联盟大中华区研究院副院长黄连金带领的一支专家团队编制而成,成员来自CSA大中华区、OpenAI、蚂蚁集团、谷歌、微软、亚马逊、英伟达、OPPO、科大讯飞、百度和腾讯等数十家单位。他们共同展现了业界的广泛协作与集体智慧。
在发布时,云安全联盟大中华区主席兼世界数字技术院执行理事长李雨航院士指出,“生成式人工智能应用安全测试标准”为测试和验证生成式AI应用的安全性提供了一个框架,特别是针对使用大语言模型构建的应用程序。该标准定义了对人工智能应用程序架构每一层的测试与验证范围,确保所有方面都经过严格的安全性和合规性审查。