谷歌DeepMind新方法Gecko，为测试AI图像生成器引入严格新标准

划重点:
⭐ 谷歌 DeepMind 发布了新的基准 Gecko，揭示了当前文本到图像 AI 评估方法的缺陷，并引入了一个包含超过10万份人类评分的严格新标准。
⭐ “Gecko” 基准通过2000个文本提示对文本到图像模型全面评估，同时提供了增强的自动评估指标，揭示了先前未被发现的模型优和劣势。
⭐ 研究人员希望通过 “Gecko” 基准的引入，能够更准确地评估和诊模型的能力，促进 AI 技术的进一步发展。

站长之家（ChinaZ.com）4月30日消息:谷歌 DeepMind 最近的研究示了当前我们对文本到图像 AI 模型性能评估的隐藏局限性。在其发布在预印本服务器 ariv 上的研究中，他们引入了一种全新的方法称为 “Gecko”，承诺提供一个更全和可靠的基准，以评估这一蓬勃发展的技术。

研究团队在其题为 “用 Gecko 审视文本到图像评估:对度量、提示和人类评分” 的论文中警告称:“虽然文到图像生成模型已经变得无处不在，但它们并不一定生成与给定提示相一致的图。” 他们指出，目前主要用于评估 DALL-E、Midjourney 和 Stable Diffusion 等模型能力数据集和自动度量并不能全面反映实际情况。

小规模的人类评估提供了有限的解，而自动度量可能会忽略重要细微之处，甚至与人类评委产生分歧。为了揭示这些问题，研究人员开发了 “Gecko”—— 一个新的基准套件，它为文本到图模型提供了更高难度的测试。Gecko基准通过2000个文本提示对模型进行全面考核，探究各种技能和复杂程度。它将这些提示分成具体的子技能，超越模糊的类，以准确找出限制模型的确切弱点。

研究人员还收集了对数个领先模型生成的图像进行的超过10万份人类评分。这一基准可以揭示模型性能差距是源自模型真正的局限性、模糊的提示，还是评估方法的不一致。

“Gecko” 基准还采用了一个基于问的增强自动评估指标，与人类判断更为相关。当用于比较新基准下的最先进模型时，这一组合揭示了先前未被发现的模型优势和劣势。研究人员希望他的工作能够证明使用多样的基准和评估方法来真正了解文本到图像 AI 在实际部署前能做什么，不能做什么的重要性。他们计划免费公开 “Gecko” 代码和数据，推动进一步的进展。因此，尽管那些看似令人印象深刻的作品可能乍一看令人印象深刻，但我们仍然需要严格的测试来区分真假。Gecko为我们展示了如何做到这一。

论文:https://arxiv.org/pdf/2404.16820

DeepSeek创始人梁文锋：中国AI不可能永远跟随必然有人站到技术的前沿

2025-01-272.0万阅读

首页

IT业界

热点视频

站长资讯

好物榜

更多分类

更多主题

谷歌DeepMind新方法Gecko，为测试AI图像生成器引入严格新标准

推荐关键词

24小时热搜

大家正在看

AI日报：阿里入局AI眼镜；套壳AI产品TypingMind赚百万美元；DeepMind天才科学家去世

英伟达回应股价遭DeepSeek暴击：DeepSeek是出色的AI进步

中国AI模型震惊硅谷 DeepSeek为何一夜火出圈？

谷歌前CEO：DeepSeek标志着全球AI竞赛"转折点"

DeepSeek爆火网友热议广东AI三杰

DeepSeek创始人梁文锋：中国AI不可能永远跟随必然有人站到技术的前沿

DeepSeek推翻两座大山

DeepSeek-V3 是怎么训练的｜深度拆解

为什么说DeepSeek是2025年的Kimi

雷军挖角的AI天才少女来自DeepSeek：开源大模型关键开发者之一

力挺！Intel前CEO已在新公司用DeepSeek代替OpenAI

终于忍不住了：美国称DeepSeek是“偷窃”

雷军千万年薪挖角95后AI天才少女 DeepSeek罗福莉将加入小米

物理测试暴击AI圈，DeepSeek R1稳超o1、Claude，我们已进入RL黄金时代

DeepSeek用莫言风格写《蔚来换电记》还真是那个味儿

DeepSeek称遭受大规模恶意攻击注册可能繁忙

冯骥谈DeepSeek：可能是个国运级别的科技成果

特朗普称赞DeepSeek诞生是好事：给美国敲警钟集中精力要赢

ChatGPT回应被DeepSeek超越：排名变化也许是暂时的

Meta AI首席科学家杨立昆谈DeepSeek：不是中国AI超越美国而是开源模型超越专有模型

首页

IT业界

热点视频

站长资讯

好物榜

更多分类

更多主题

谷歌DeepMind新方法Gecko，为测试AI图像生成器引入严格新标准

推荐关键词

24小时热搜

大家正在看

AI日报：阿里入局AI眼镜；套壳AI产品TypingMind赚百万美元；DeepMind天才科学家去世

英伟达回应股价遭DeepSeek暴击：DeepSeek是出色的AI进步

中国AI模型震惊硅谷 DeepSeek为何一夜火出圈？

谷歌前CEO：DeepSeek标志着全球AI竞赛"转折点"

DeepSeek爆火 网友热议广东AI三杰

DeepSeek创始人梁文锋：中国AI不可能永远跟随 必然有人站到技术的前沿

DeepSeek推翻两座大山

DeepSeek-V3 是怎么训练的｜深度拆解

为什么说DeepSeek是2025年的Kimi

雷军挖角的AI天才少女来自DeepSeek：开源大模型关键开发者之一

力挺！Intel前CEO已在新公司用DeepSeek代替OpenAI

终于忍不住了：美国称DeepSeek是“偷窃”

雷军千万年薪挖角95后AI天才少女 DeepSeek罗福莉将加入小米

物理测试暴击AI圈，DeepSeek R1稳超o1、Claude，我们已进入RL黄金时代

DeepSeek用莫言风格写《蔚来换电记》 还真是那个味儿

DeepSeek称遭受大规模恶意攻击 注册可能繁忙

冯骥谈DeepSeek：可能是个国运级别的科技成果

特朗普称赞DeepSeek诞生是好事：给美国敲警钟 集中精力要赢

ChatGPT回应被DeepSeek超越：排名变化也许是暂时的

Meta AI首席科学家杨立昆谈DeepSeek：不是中国AI超越美国 而是开源模型超越专有模型

DeepSeek爆火网友热议广东AI三杰

DeepSeek创始人梁文锋：中国AI不可能永远跟随必然有人站到技术的前沿

DeepSeek用莫言风格写《蔚来换电记》还真是那个味儿

DeepSeek称遭受大规模恶意攻击注册可能繁忙

特朗普称赞DeepSeek诞生是好事：给美国敲警钟集中精力要赢

Meta AI首席科学家杨立昆谈DeepSeek：不是中国AI超越美国而是开源模型超越专有模型