风险提示:理性看待区块链,提高风险意识!
谷歌承认“窃取”OpenAI模型关键信息:成本低至150元,调用API即可得手
首页 > 业界 > 区块链 2024-03-12 14:02:45
币界网报道:

文章来源:量子位

明敏 丰色 发自 凹非寺


图片来源:由无界AI生成


什么?谷歌成功偷家OpenAI,还窃取到了gpt-3.5-turbo关键信息???


是的,你没看错。


根据谷歌自己的说法,它不仅还原了OpenAI大模型的整个投影矩阵(projection matrix),还知道了确切隐藏维度大小。


而且方法还极其简单——


只要通过API访问,不到2000次巧妙的查询就搞定了。


成本根据调用次数来看,最低20美元以内(折合人民币约150元)搞定,并且这种方法同样适用于GPT-4


好家伙,这一回奥特曼是被将军了!



这是谷歌的一项最新研究,它报告了一种攻击窃取大模型关键信息的方法。


基于这种方法,谷歌破解了GPT系列两个基础模型Ada和Babbage的整个投影矩阵。如隐藏维度这样的关键信息也直接破获:


一个为1024,一个为2048。


所以,谷歌是怎么实现的?
攻击大模型的最后一层


该方法核心攻击的目标是模型的嵌入投影层(embedding projection layer),它是模型的最后一层,负责将隐藏维度映射到logits向量。


由于logits向量实际上位于一个由嵌入投影层定义的低维子空间内,所以通过向模型的API发出针对性查询,即可提取出模型的嵌入维度或者最终权重矩阵。


通过大量查询并应用奇异值排序(Sorted Singular Values)可以识别出模型的隐藏维度。


比如针对Pythia 1.4B模型进行超过2048次查询,图中的峰值出现在第2048个奇异值处,则表示模型的隐藏维度是2048.


可视化连续奇异值之间的差异,也能用来确定模型的隐藏维度。这种方法可以用来验证是否成功从模型中提取出关键信息。


在Pythia-1.4B模型上,当查询次数达到2047时出现峰值,则表明模型隐藏维度大小为2048.


并且攻击这一层能够揭示模型的“宽度”(即模型的总体参数量)以及更多全局性的信息,还能降低一个模型的“黑盒程度”,给后续攻击“铺路”。


研究团队实测,这种攻击非常高效。无需太多查询次数,即可拿到模型的关键信息。


比如攻击OpenAI的Ada和Babbage并拿下整个投影矩阵,只需不到20美元;攻击GPT-3.5需要大约200美元。


它适用于那些API提供完整logprobs或者logit bias的生成式模型,比如GPT-4、PaLM2。


论文中表示,尽管这种攻击方式能获取的模型信息并不多,但是能完成攻击本身就已经很让人震惊了。


已通报OpenAI


如此重要的信息被竞争对手以如此低成本破解,OpenAI还能坐得住吗?


咳咳,好消息是:OpenAI知道,自己人还转发了一波。



作为正经安全研究,研究团队在提取模型最后一层参数之前,已征得OpenAI同意。


攻击完成后,大家还和OpenAI确认了方法的有效性,最终删除了所有与攻击相关的数据。


所以网友调侃:


一些具体数字没披露(比如gpt-3.5-turbo的隐藏维度),算OpenAI求你的咯。



值得一提的是,研究团队中还包括一位OpenAI研究员。



这项研究的主要参与者来自谷歌DeepMind,但还包括苏黎世联邦理工学院、华盛顿大学、麦吉尔大学的研究员们,以及1位OpenAI员工。


此外,作者团队也给了防御措施包括:


从API下手,彻底删除logit bias参数;或者直接从模型架构下手,在训练完成后修改最后一层的隐藏维度h等等。


基于此,OpenAI最终选择修改模型API,“有心人”想复现谷歌的操作是不可能了。


但不管怎么说:


谷歌等团队的这个实验证明,OpenAI锁紧大门也不一定完全保险了。


(要不你自己主动点开源了吧)


论文链接:
https://arxiv.org/abs/2403.06634
参考链接:
https://twitter.com/arankomatsuzaki/status/1767375818391539753

上一篇: 为什么FLOKI应该在这个牛市的观察名单上
下一篇: 实务探讨:虚拟货币投资挖矿中的要点问题梳理
推荐专栏
Boss Wallet Web3 Econom Pass
专注币圈最新资讯
通俗浅显地聊透Web3大事小情
读懂区块链生态与未来,尽在币界网!
热门币种
更多
币种
美元价格
24H涨跌幅
BTC比特币
66,697.90 USDT
¥476,029.58
+0.43%
ETH以太坊
3,566.20 USDT
¥25,452.32
+0.81%
BNB币安币
607.62 USDT
¥4,336.64
+0.01%
USDT泰达币
1.02 USDT
¥7.30
+0.61%
SOL
145.81 USDT
¥1,040.66
+0.88%
TON
7.97 USDT
¥56.86
-1.52%
USDC
1.00 USDT
¥7.15
+0.07%
XRP瑞波币
0.49750 USDT
¥3.55
+3.6%
DOGE狗狗币
0.13650 USDT
¥0.97420
+0.29%
ADA艾达币
0.41440 USDT
¥2.96
+0.93%
热搜币种
更多
币种
美元价格
24H涨跌幅
Curve
0.309 USDT
¥2.24
+4.53%
比特币
66650.63 USDT
¥483,536.99
+0.54%
Rocket Pool
28.0221 USDT
¥203.29
+11.21%
Livepeer Token
22.12 USDT
¥160.48
-2.47%
面包
0.46 USDT
¥3.34
+1.75%
Arweave
28.4411 USDT
¥206.33
-2.66%
dYdX
1.538 USDT
¥11.16
-1.87%
Filecoin
5.2115 USDT
¥37.81
+0.65%
Solana
145.3 USDT
¥1,054.12
+0.99%
Terra Classic
0.00010047 USDT
¥0.00
+5.35%
Shiba Inu
2.079E-5 USDT
¥0.00
-0.05%
Uniswap
11.5416 USDT
¥83.73
+5.14%
最新快讯
更多
Curve创始人:最近的UwULend黑客事件与Curve无关
2024-06-16 19:06:13
疑似ether.fi财库一地址1小时前向币安存入了30万枚ETHFI
2024-06-16 18:56:51
ZKX:决定取消公募轮次和所有launchpads
2024-06-16 18:39:06
DMMBitcoin完成比特币采购以补偿用户,被盗事件原因仍在调查中
2024-06-16 18:35:51
ZKX决定取消公募融资与所有Launchpad
2024-06-16 18:33:21
LayerZeroCEO:未通过Nansen和ChaosLabs检查的赏金猎人集群将会被剔除
2024-06-16 18:27:46
超1.3万枚ETH于3分钟前转移到Coinbase
2024-06-16 18:18:23
下载币界网APP