谷歌承认“窃取”OpenAI模型信息：成本150元，调用API即可得手

作者：量子位发布时间：2024-03-12

谷歌 OpenAI

谷歌承认“窃取”OpenAI模型信息：成本150元，调用API即可得手

明敏丰色发自凹非寺

量子位 | 公众号 QbitAI

什么？谷歌成功偷家OpenAI，还窃取到了gpt-3.5-turbo关键信息？？？

是的，你没看错。

根据谷歌自己的说法，它不仅还原了OpenAI大模型的整个投影矩阵（projection matrix），还知道了确切隐藏维度大小。

而且方法还极其简单——

只要通过API访问，不到2000次巧妙的查询就搞定了。

成本根据调用次数来看，最低20美元以内（折合人民币约150元）搞定，并且这种方法同样适用于GPT-4。

好家伙，这一回奥特曼是被将军了！

这是谷歌的一项最新研究，它报告了一种攻击窃取大模型关键信息的方法。

基于这种方法，谷歌破解了GPT系列两个基础模型Ada和Babbage的整个投影矩阵。如隐藏维度这样的关键信息也直接破获：

一个为1024，一个为2048。

所以，谷歌是怎么实现的？

攻击大模型的最后一层

该方法核心攻击的目标是模型的嵌入投影层（embedding projection layer），它是模型的最后一层，负责将隐藏维度映射到logits向量。

由于logits向量实际上位于一个由嵌入投影层定义的低维子空间内，所以通过向模型的API发出针对性查询，即可提取出模型的嵌入维度或者最终权重矩阵。

通过大量查询并应用奇异值排序（Sorted Singular Values）可以识别出模型的隐藏维度。

比如针对Pythia 1.4B模型进行超过2048次查询，图中的峰值出现在第2048个奇异值处，则表示模型的隐藏维度是2048.

可视化连续奇异值之间的差异，也能用来确定模型的隐藏维度。这种方法可以用来验证是否成功从模型中提取出关键信息。

在Pythia-1.4B模型上，当查询次数达到2047时出现峰值，则表明模型隐藏维度大小为2048.

并且攻击这一层能够揭示模型的“宽度”（即模型的总体参数量）以及更多全局性的信息，还能降低一个模型的“黑盒程度”，给后续攻击“铺路”。

研究团队实测，这种攻击非常高效。无需太多查询次数，即可拿到模型的关键信息。

比如攻击OpenAI的Ada和Babbage并拿下整个投影矩阵，只需不到20美元；攻击GPT-3.5需要大约200美元。

它适用于那些API提供完整logprobs或者logit bias的生成式模型，比如GPT-4、PaLM2。

论文中表示，尽管这种攻击方式能获取的模型信息并不多，但是能完成攻击本身就已经很让人震惊了。

已通报OpenAI

如此重要的信息被竞争对手以如此低成本破解，OpenAI还能坐得住吗？

咳咳，好消息是：OpenAI知道，自己人还转发了一波。

作为正经安全研究，研究团队在提取模型最后一层参数之前，已征得OpenAI同意。

攻击完成后，大家还和OpenAI确认了方法的有效性，最终删除了所有与攻击相关的数据。

所以网友调侃：

一些具体数字没披露（比如gpt-3.5-turbo的隐藏维度），算OpenAI求你的咯（doge）。

值得一提的是，研究团队中还包括一位OpenAI研究员。

这项研究的主要参与者来自谷歌DeepMind，但还包括苏黎世联邦理工学院、华盛顿大学、麦吉尔大学的研究员们，以及1位OpenAI员工。

此外，作者团队也给了防御措施包括：

从API下手，彻底删除logit bias参数；或者直接从模型架构下手，在训练完成后修改最后一层的隐藏维度h等等。

基于此，OpenAI最终选择修改模型API，“有心人”想复现谷歌的操作是不可能了。

但不管怎么说：

谷歌等团队的这个实验证明，OpenAI锁紧大门也不一定完全保险了。

（要不你自己主动点开源了吧）

论文链接：

https://arxiv.org/abs/2403.06634

参考链接：

https://twitter.com/arankomatsuzaki/status/1767375818391539753

相关资讯

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

适用于GPT-4

谷歌 OpenAI GPT-4

量子位 2024-03-12

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元！

什么？谷歌成功偷家OpenAI，还窃取到了gpt-3.5-turbo关键信息？？？是的，你没看错。根据谷歌自己的说法，它不仅还原了OpenAI大模型的整个投影矩阵（projection matrix），还知道了确切隐

谷歌 OpenAI

2024-03-12

摊牌不装了！谷歌承认“窃取”OpenAI模型关键信息，偷家成本低至150元【附人工智能行业技术分析】

3月12日，据报道，谷歌利用开放式人工智能领导者OpenAI的敏感信息处理能力获得重大突破，成功地从API调用中获取gpt-3.5-turbo的“投影矩阵”和相关“隐含维度”等关键数据，全程仅用不足两万次请求达到显著成果。具体来看，此项攻击策略着重于对模型内嵌投射层尾端的突破，核心要素在于把隐藏信息转换为逻辑回归数字（即logit向量）。

谷歌 OpenAI 人工智能

前瞻网 2024-03-12

OpenAI核心资料被盗，谷歌承认“主动攻击”，成本仅150元？

通过模型窃取技术，谷歌成功破解了ChatGPT基础模型Ada和Babbage的投影矩阵，甚至连内部隐藏维度的关键信息也是直接破获，分别是1024和2048。谁也没想到，号称“CloseAI”的OpenAI竟然也会被窃取模型机密的一天。

OpenAI 谷歌 ChatGPT

蓝鲸财经 2024-03-18

新火种AI|OpenAI核心资料被盗！谷歌承认“主动攻击”，成本仅150元？

作者：文子编辑：小迪谷歌，一招杀入OpenAI大本营。谷歌再放大招，窃取OpenAI模型机密如果全世界只有一家公司能赶超OpenAI，那谷歌应该是第一。最近，谷歌重磅发布了一篇论文报告，里面提出了一种名为“模型窃取”的技术。通过模型窃取技术，谷歌成功破解了ChatGPT基础模型Ada和Babbage的投影矩阵，甚至连内部隐藏维度的关键信息也是直接破获，分别是1024和2048。这一发现犹如一记重磅炸弹，在AI界引发了强烈的震动。谁也没想到，号称“CloseAI”的OpenAI竟然也会被窃取模型机密的一天。

OpenAI 谷歌 ChatGPT

新火种 2024-03-15

近期资讯

佛山市南海中胜石油气有限公司取得一种安全阀门专利，能最大程度上保障安全阀正常运行

金融界2024年12月27日消息，国家知识产权局信息显示，佛山市南海中胜石油气有限公司取得一项名为“一种安全阀门”的专利，授权公告号CN222209168U，申请日期为2024年7月。

金融界 2024-12-27

河北鹏凯取得自启闭阀门专利，解决现有手动阀门问题

金融界2024年12月27日消息，国家知识产权局信息显示，河北鹏凯机械设备制造有限公司取得一项名为“种自启闭阀门”的专利，授权公告号CN222209172U，申请日期为2024年5月。

金融界 2024-12-27

台州格扬阀门取得超高压防漏截止阀专利，避免阀体受雨水侵蚀延迟了使用寿命

金融界2024年12月27日消息，国家知识产权局信息显示，台州格扬阀门制造有限公司取得一项名为“超高压防漏截止阀”的专利，授权公告号CN222209167U，申请日期为2024年5月。

金融界 2024-12-27

咸阳鑫瓷泵业取得用于泥浆泵单向阀相关专利，解决单向阀阀盖更换成本高及材料浪费问题

金融界2024年12月27日消息，国家知识产权局信息显示，咸阳鑫瓷泵业有限公司取得一项名为“用于泥浆泵的单向阀阀盖、单向阀组件及其泥浆泵”的专利，授权公告号CN222209169U，申请日期为2024年7月。专利摘要显示，本实用新型公开了一种用于泥浆泵的单向阀阀盖、单向阀组件及其泥浆泵。

金融界 2024-12-27

日照港油品码头有限公司取得可进行控制方式调控的阀门组件专利，能够实现两种远程控制模式的切换

金融界2024年12月27日消息，国家知识产权局信息显示，日照港油品码头有限公司取得一项名为“一种可进行控制方式调控的阀门组件”的专利，授权公告号CN222209173U，申请日期为2024年3月。

金融界 2024-12-27

江西皆成取得金属球阀保温套专利，能够有效的减少阀门内流体温度散失,提高保温效果

金融界2024年12月27日消息，国家知识产权局信息显示，江西皆成新型材料有限公司取得一项名为“一种金属球阀保温套”的专利，授权公告号CN222209165U，申请日期为2024年5月。

金融界 2024-12-27

中核核电运行管理有限公司取得一种电磁阀阀芯专利，使活塞稳定封堵通道

金融界2024年12月27日消息，国家知识产权局信息显示，中核核电运行管理有限公司取得一项名为“一种电磁阀阀芯”的专利，授权公告号CN222209175U，申请日期为2024年1月。

金融界 2024-12-27

河北诺赛供水工程取得供水管路阀门专利，延长阀门使用寿命

金融界2024年12月27日消息，国家知识产权局信息显示，河北诺赛供水工程有限公司取得一项名为“一种供水管路阀门”的专利，授权公告号CN222209163U，申请日期为2024年5月。专利摘要显示，本实用新型公开了一种供水管路阀门。

金融界 2024-12-27

常州华立取得一种阀门电动执行器的安装支架专利，能够将电动执行器快速安装在安装座上

金融界2024年12月27日消息，国家知识产权局信息显示，常州华立阀门控制设备有限公司取得一项名为“一种阀门电动执行器的安装支架”的专利，授权公告号CN222209171U，申请日期为2024年4月。

金融界 2024-12-27

方太取得能冷却散热的电磁阀结构专利，散热效果好

金融界2024年12月27日消息，国家知识产权局信息显示，宁波方太厨具有限公司取得一项名为“一种能冷却散热的电磁阀结构”的专利，授权公告号CN222209176U，申请日期为2024年1月。

金融界 2024-12-27

谷歌承认“窃取”OpenAI模型信息：成本150元，调用API即可得手

谷歌承认“窃取”OpenAI模型信息：成本150元，调用API即可得手

推荐体验

相关资讯

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元，调用API即可得手

谷歌承认“窃取”OpenAI模型关键信息：成本低至150元！

摊牌不装了！谷歌承认“窃取”OpenAI模型关键信息，偷家成本低至150元【附人工智能行业技术分析】

OpenAI核心资料被盗，谷歌承认“主动攻击”，成本仅150元？

新火种AI|OpenAI核心资料被盗！谷歌承认“主动攻击”，成本仅150元？

近期资讯

佛山市南海中胜石油气有限公司取得一种安全阀门专利，能最大程度上保障安全阀正常运行

河北鹏凯取得自启闭阀门专利，解决现有手动阀门问题

台州格扬阀门取得超高压防漏截止阀专利，避免阀体受雨水侵蚀延迟了使用寿命

咸阳鑫瓷泵业取得用于泥浆泵单向阀相关专利，解决单向阀阀盖更换成本高及材料浪费问题

日照港油品码头有限公司取得可进行控制方式调控的阀门组件专利，能够实现两种远程控制模式的切换

江西皆成取得金属球阀保温套专利，能够有效的减少阀门内流体温度散失,提高保温效果

中核核电运行管理有限公司取得一种电磁阀阀芯专利，使活塞稳定封堵通道

河北诺赛供水工程取得供水管路阀门专利，延长阀门使用寿命

常州华立取得一种阀门电动执行器的安装支架专利，能够将电动执行器快速安装在安装座上

方太取得能冷却散热的电磁阀结构专利，散热效果好

推荐体验

AIGC重要产品

AI对话：类ChatGPT产品体验

好用的AI绘画工具

火热的AIGC产品

AIGC近期要闻

大公司发布的大模型产品都有哪些？

政府对AIGC的扶持政策

AIGC对就业的影响：我们会失业吗？

AIGC产业影响

AIGC对内容创作的影响

AIGC对绘画设计领域的影响

AIGC对各行各业的影响