AI打败AI！谷歌科学家用GPT-4 击败AI防篡改系统

站长之家（ChinaZ.com）8月1日消息:Google 科学家进行一项实验研究，他们使用 OpenAI 的 GPT-4聊天机器人来攻破其他机器学习模型的安全防护措施。这项实验证明了聊天机器人作为研究助手的价值。

AI，机器人打架，撕逼，战斗

具体来说，谷歌 Deep Mind 的研究科学家 Nicholas Carlini在一篇题为“AI-Guardian 的 LLM 辅助开发”的论文中，探讨了如何通过指导 GPT-4设计攻击方法并撰写攻击原理的文本，以欺骗 AI-Guardian 的防御机制。AI-Guardian 是一种防御对模型的攻击的系统，旨在检测可能被篡改的图像以欺骗分类器。

GPT-4会发出用于调整图像的脚本（和解释）来欺骗分类器——例如，让它认为某人拿着枪的照片是某人拿着无害苹果的照片——而不会引发 AI-Guardian 的怀疑。AI-Guardian 旨在检测图像何时可能被操纵以欺骗分类器，而 GPT-4的任务是逃避该检测。

通过 GPT-4的帮助，攻击者能够成功地破解 AI-Guardian 的防御，使其从98% 的稳健性降低到仅8%。然而，AI-Guardian 的开发者指出，这种攻击方法可能在改进的版本中失效。

据了解，GPT-4作为研究助手的价值在于它能够快速生成代码，并且不会分心或疲劳，始终可用于完成指定的任务。然而，依赖 GPT-4并不完全解除人类合作者的责任，因为它仍然需要人类提供正确的提示并修复生成的代码中的错误。

虽然 GPT-4还存在一些限制，但随着大型语言模型的改进，它们将为计算机科学家提供更多时间来开展有趣的研究问题。

论文地址:https://arxiv.org/abs/2307.15008

谷歌利用 AI 发现 20 年前的软件漏洞：「模糊测试」改写安全游戏规则

2024-11-231.1万阅读

首页

IT业界

热点视频

站长资讯

好物榜

更多分类

更多主题

AI打败AI！谷歌科学家用GPT-4 击败AI防篡改系统

推荐关键词

24小时热搜

大家正在看

AI Agent再迎一巨头！谷歌重磅发力AI Agent ，商用大爆发！

AI助手会成为AI OS吗

双11特惠，不满减，无套路，AI数字人分身、AI视频、AI论文等各种AI相关产品价格一步到底 !

谷歌回应AI让用户去死：已采取措施以防止类似情况再次发生

谷歌Gemini AI惊人回复用户请求帮助：竟收到“请去死吧”！

谷歌发布双思维AI Agent：像人类一样思考，重大技术突破！

谷歌利用 AI 发现 20 年前的软件漏洞：「模糊测试」改写安全游戏规则

秘塔AI上线“知识库”，他们直接超进化成AI搜索完全体了。

AI大神开始疯狂洗牌

大佬喊话，AI寒冬已来？

英伟达发布视觉AI Agent，能用AI总结真实世界了

AI+？，吸量又赚钱

当AI搜索开始赚钱养家

AI版《我的世界》震撼欧美，AI实时生成游戏成下一个大风口？

AI日报：字节推图像编辑模型SeedEdit；Suno发布V4音乐生成模型；谷歌最新AI视频制作神器Vids

AI日报：快手推“可灵AI”独立APP；百度将推AI智能眼镜；智谱AI开源CogVideoX v1.5并上线“新清影”；Krea AI上线Lora训练功能

大厂裸辞靠AI年入百万后，不会编程的他用AI做出一个爆火App

手机卷向AI，没有开门红

AI 1.0公司的节节败退

AI日报：360将发布新一代AI搜索；蜜雪冰城进军AI领域；Suno v4新增翻唱等功能

首页

IT业界

热点视频

站长资讯

好物榜

更多分类

更多主题

AI打败AI！谷歌科学家用GPT-4 击败AI防篡改系统

推荐关键词

24小时热搜

大家正在看

AI Agent再迎一巨头！谷歌重磅发力AI Agent ，商用大爆发！

AI助手会成为AI OS吗

双11特惠，不满减，无套路，AI数字人分身、AI视频、AI论文等各种AI相关产品价格一步到底 !

谷歌回应AI让用户去死：已采取措施以防止类似情况再次发生

谷歌Gemini AI惊人回复 用户请求帮助：竟收到“请去死吧”！

谷歌发布双思维AI Agent：像人类一样思考，重大技术突破！

谷歌利用 AI 发现 20 年前的软件漏洞：「模糊测试」改写安全游戏规则

秘塔AI上线“知识库”，他们直接超进化成AI搜索完全体了。

AI大神开始疯狂洗牌

大佬喊话，AI寒冬已来？

英伟达发布视觉AI Agent，能用AI总结真实世界了

AI+？，吸量又赚钱

当AI搜索开始赚钱养家

AI版《我的世界》震撼欧美，AI实时生成游戏成下一个大风口？

AI日报：字节推图像编辑模型SeedEdit；Suno发布V4音乐生成模型；谷歌最新AI视频制作神器Vids

AI日报：快手推“可灵AI”独立APP；百度将推AI智能眼镜；智谱AI开源CogVideoX v1.5并上线“新清影”；Krea AI上线Lora训练功能

大厂裸辞靠AI年入百万后，不会编程的他用AI做出一个爆火App

手机卷向AI，没有开门红

AI 1.0公司的节节败退

AI日报：360将发布新一代AI搜索；蜜雪冰城进军AI领域；Suno v4新增翻唱等功能

谷歌Gemini AI惊人回复用户请求帮助：竟收到“请去死吧”！