大模型安全有了国际标准！联合国科技大会最新发布多家国内AI企业参编

行情中心

指数期指期权个股板块排行新股基金港股美股期货外汇黄金自选股自选基金

数据中心

资金流向主力排名板块资金个股研报新股申购转债申购北交所申购 AH股比价年报大全融资融券龙虎榜限售解禁 IPO审核大宗交易估值分析

首页 > 财经频道 > 正文

大模型安全有了国际标准！联合国科技大会最新发布多家国内AI企业参编

2024年04月17日 14:21

来源：上观新闻

小中大

东方财富APP

方便，快捷

手机查看财经快讯

专业，丰富

一手掌握市场脉搏

手机上阅读文章

提示：

微信扫一扫

分享到您的

朋友圈

　　4月15日—19日，第27届联合国科技大会在瑞士日内瓦召开。16日，在以“塑造AI的未来”为主题的AI边会上，世界数字技术院（WDTA）发布了一系列突破性成果，包括《生成式人工智能应用安全测试标准》和《大语言模型安全测试方法》两项国际标准。这是国际组织首次就大模型安全领域发布国际标准，代表全球人工智能安全评估和测试进入新的基准。

　　据了解，这两项国际标准是由OpenAI、谷歌、英伟达、蚂蚁、科大讯飞、百度、腾讯等数十家单位的专家学者共同编制。

WDTA发布大模型安全国际标准，OpenAI、蚂蚁集团、科大讯飞等参编。

　　WDTA人工智能安全可信负责任工作组组长黄连金表示，随着人工智能系统，特别是大语言模型继续成为社会各方面不可或缺的一部分，以一个全面的标准来解决它们的安全挑战变得至关重要。此次发布的标准汇集了全球AI安全领域的专家智慧，填补了大语言模型和生成式AI应用方面安全测试领域的空白，为业界提供了统一的测试框架和明确的测试方法，有助于提高AI系统安全性，促进AI技术负责任发展，增强公众信任。

　　世界数字技术院（WDTA）是在日内瓦注册的国际非政府组织，遵从联合国指导框架，致力于在全球范围内推进数字技术，促进国际合作。AI STR（安全、可信、负责任）计划是WDTA的核心倡议，旨在确保人工智能系统的安全性、可信性和责任性。

　　近年来，世界各国都在加强对于大模型安全的研究和管控。我国先后发布了《全球人工智能治理倡议》《生成式人工智能服务管理暂行办法》《生成式人工智能服务安全基本要求》等，旨在促进生成式人工智能安全可信发展，推进全球人工智能治理领域合作共识。

　　信息显示，此次发布的两项国际标准是大模型及生成式AI应用方面的安全测试标准。

　　其中，《生成式人工智能应用安全测试标准》由WDTA作为牵头单位。该标准为测试和验证生成式AI应用的安全性提供了一个框架，特别是那些使用大语言模型（LLM）构建的应用程序。它定义了人工智能应用程序架构每一层的测试和验证范围，包括基础模型选择、嵌入和矢量数据库、RAG或检索增强生成、AI应用运行时安全等等，确保AI应用各个方面都经过严格的安全性和合规性评估，保障其在整个生命周期内免受威胁和漏洞侵害。

　　《大语言模型安全测试方法》由蚂蚁集团作为牵头单位。该标准则为大模型本身的安全性评估提供了一套全面、严谨且实操性强的结构性方案。它提出了大语言模型的安全风险分类、攻击的分类分级方法以及测试方法，并率先给出了四种不同攻击强度的攻击手法分类标准，提供了严格的评估指标和测试程序等，可解决大语言模型固有的复杂性，全面测试其抵御敌对攻击的能力，使开发人员和组织能够识别和缓解潜在漏洞，并最终提高使用大语言模型构建的人工智能系统的安全性和可靠性。

（文章来源：上观新闻）

文章来源：上观新闻责任编辑：91

原标题：大模型安全有了国际标准！联合国科技大会最新发布，多家国内AI企业参编

郑重声明：东方财富发布此内容旨在传播更多信息，与本站立场无关，不构成投资建议。据此操作，风险自担。

东方财富网

分享到微信朋友圈

打开微信，

点击底部的“发现”

使用“扫一扫”

即可将网页分享至朋友圈