站长之家 - 业界 2023-10-11 15:17

AI视野:Adobe发布新一代AI生成模型Firefly Image2;Meta发布Llama2-Long模型;TikTok支持从AI应用直接发布内容;Opera浏览器推出升级版的AI工具Aria

文头.jpg

🤖📈💻💡大模型动态

Adobe发布新一代AI生成模型Firefly Image2,PS+AI生图一步完成

今天凌晨,Adobe甩出Adobe Firefly创意生成式AI模型系列中的三个主要新模型:Adobe Firefly Image2(萤火虫二代成像模型)、Firefly Vector Model(萤火虫矢量模型)和Firefly Design Model(萤火虫设计模型)。

image.png

【AiBase提要:】

🌟 Adobe发布三款新AI模型,包括图像生成、矢量图形和模板设计,提供更高质量和效率。

🖼️ Firefly Image2模型改善图像渲染质量,支持生成匹配、照片设置和提示指导功能。

✏️ Firefly矢量模型是世界首个生成高质量矢量和图案输出的AI模型,简化设计工作,支持渐变、分组分层、无缝平铺等功能。

📝 Firefly设计模型支持文本到模板功能,帮助用户快速生成并定制化设计模板,提高设计效率。

在线体验地址:

PS在线体验地址:https://photoshop.adobe.com/discover

Illustrator体验地址:https://www.adobe.com/hk_zh/products/illustrator/generative-recolor.html

Meta再放「长文本」杀器Llama2-Long

Meta发布Llama2-Long模型,可高效处理长文本,降低计算需求40%,采用创新策略,提升性能,领先自然语言处理领域。

image.png

论文地址:https://arxiv.org/pdf/2309.16039.pdf

【AiBase提要】

🚀 Meta发布Llama2-Long模型,处理长文本不增加计算需求,保持卓越性能。

🧠 模型采用预训练、位置编码改进和数据混合策略,不依赖更多长文本数据。

📊 Llama2-Long在长短任务上表现出色,超越其他长上下文模型,具有潜力改变自然语言处理。

📰🤖📢AI新鲜事

TikTok支持从Adobe和其他AI应用直接发布内容

TikTok 推出名为「Direct Post」的新功能,允许用户直接从多个编辑应用发布视频,包括 Adobe 的 Premiere Pro 和 Adobe Express,以及其他应用如 CapCut 和 Twitch。

e9a75f3569fe8dd032791723f9f34969.jpeg

【AiBase提要】

📌 TikTok 推出「Direct Post」功能,支持多个编辑应用直接发布内容。

📌 合作伙伴包括 Adobe 的 Premiere Pro 和 Adobe Express,以及 CapCut 和 Twitch。

📌 创作者需要在第三方应用内进行 TikTok 账户验证,并经过审核才能使用 Direct Post 功能。

英伟达取消原定10月15日在以色列举行的 AI 峰会

英伟达取消以色列AI峰会,因巴以冲突。不确定是否重新安排活动或录制主题演讲,这决定可能影响以色列AI生态系统。地缘政治紧张局势影响全球科技活动。

【AiBase提要】📰

1. 英伟达取消以色列AI峰会,受巴以冲突影响。

2. 尚未确定是否重新安排或录制主题演讲。

3. 决定可能对以色列的AI生态系统和全球科技活动产生影响。

谷歌 Assistant 集成 Bard 聊天机器人 Pixel8用户将受益

谷歌的最新Pixel8Pro手机将整合Google Assistant与Bard聊天机器人,提供更智能的用户体验,包括智能答案、图像和文字识别功能。

【AiBase提要】:

1️⃣ 谷歌的Pixel8Pro手机将成为首款支持生成式人工智能的智能手机,整合Google Assistant与Bard聊天机器人,提供更便捷和创新的功能。

2️⃣ 用户将能够通过Google Assistant访问Gmail和地图应用,以获取更智能化的答案,同时支持照片中物体和文字的识别。

3️⃣ 谷歌计划首先将这些功能提供给少数早期测试者,然后扩大至更广泛的用户,以获得反馈并提供更好的用户体验。

AMD收购Nod.ai以加速AI硬件优化

AMD计划收购Nod.ai,一家专注于高性能硬件优化的初创公司,以提升其在快速增长的人工智能芯片市场中的地位。

【AiBase提要:】

🚀 AMD计划收购Nod.ai,旨在加速其在人工智能芯片市场的竞争地位。

🔧 Nod.ai的软件可加速AI模型在AMD硬件平台上的部署。

👩‍💻 除了技术,AMD还希望利用Nod.ai的工程人才来提升其在开源开发者社区的声誉。

OpenAI科学家演讲:GPT-4将突破拐点,性能提升1000倍

OpenAI科学家Hyung Won Chung的演讲指出,通过扩大GPT-4参数规模1000倍,采用第一性原理方法,将实现大幅性能提升。

【AiBase提要:】

📈 参数规模扩大,GPT-4性能将显著提升。

🔍 第一性原理方法是解决规模扩大的关键。

💡 归纳偏差和后训练是实现更大规模的瓶颈,需要持续研究。

美国小型企业看好AI近三分之二企业希望更多地利用AI技术

Intuit QuickBooks的调查显示,美国小型企业普遍认为AI技术降低成本、提高竞争力,但担心数据隐私和安全问题。

QuickBooks

AiBase提要:

1. 🚀83%的受访者已在工作中使用AI,65%期望更多应用,视AI为提高效率、增加利润和开拓商机的机会。

2. 🤔 尽管积极看待AI,80%对其数据隐私和安全表示担忧,可能限制广泛应用。

3. 📚 教育和培训被认为是采用AI技术的重要因素,政府和行业组织应提供更多支持,以帮助员工适应这一技术革新。

高通宣布下一代智能PC计算平台命名为骁龙X系列

高通下一代智能 PC 计算平台将采用全新命名体系——骁龙 X 系列。目前,采用下一代定制高通 Oryon CPU 的骁龙 X 系列将实现性能和能效的显著提升,此外其所搭载的 NPU 将面向生成式 AI 新时代提供加速的终端侧用户体验。

【AiBase提要】

1.高通宣布下一代智能 PC 计算平台将以「骁龙 X 系列」为名。

2.高通预测2024年将成为PC行业的转折点。

3.该系列将面向生成式 AI 新时代提供加速的终端侧用户体验。

AI女友怂恿男子暗杀英女王,男子被判9年监禁

一名19岁男子因AI女友的鼓励,试图暗杀英女王,最终被判监禁9年,法院认为他思维失常需精神病治疗。

【AiBase提要】:

1️⃣19岁男子计划暗杀英女王,得到AI女友的支持,法院认为他失去对现实的判断能力。

2️⃣ 法院判处男子9年监禁,并要求他接受精神病治疗。

3️⃣ 检方呈示了男子与AI女友的对话记录,揭示了暗杀计划的起因和背后的精神病态。

使用AI语言模型协助精神分裂症诊断

伦敦大学学院的科学家开发了基于AI语言模型的工具,可以特征化精神分裂症患者语音,有望提供更准确的精神疾病诊断。

【AiBase提要:】

🧠科学家开发了AI语言模型工具,用于分析精神分裂症患者的语音特征。

🔬研究旨在改进精神疾病的诊断和评估,减少不准确性。

🗣️AI语言模型在精神病学领域的应用潜力,未来或广泛用于临床。

🤖📱💼AI应用

Opera浏览器推出升级版的AI工具Aria

Opera浏览器最新版本引入了升级版的AI工具Aria,旨在让用户更轻松地与人工智能互动,以提高查询和内容创作的效率。Aria的新工具“Refiner”具备“重用”和“改述”的功能,使用户可以更灵活地优化AI的输出。

【AiBase提要】

🚀 Aria为Opera浏览器用户提供升级的AI工具,优化与AI的互动,提高查询和内容创作效率。

🔄 "Refiner"功能允许用户重用以前的回答元素,减少输入次数,提高工作效率。

✍️ 用户还可以通过"改述"和"高亮器"功能个性化定制AI,训练AI以模仿其写作风格,实现更个性化的内容创作。

ElevenLabs推AI工具“AI Dubbing”,可将语音翻译成20多种语言

ElevenLabs的新产品“AI Dubbing”可以在几分钟内将任何语音内容翻译成20多种不同语言,为内容创作者提供全球化的语音配音解决方案。

image.png

ElevenLabs网址:https://elevenlabs.io/

【AiBase提要】:

- 🌐 ElevenLabs的“AI Dubbing”工具可以帮助内容创作者跨越语言障碍,实现全球化内容配音,同时保留原语音者的声音和情感。

- 🤖 该工具的翻译流程是自动化的,用户只需上传文件并选择目标语言,无需人工干预,提供高质量的语音翻译。

- 📈 除ElevenLabs外,其他公司如OpenAI和Meta也活跃在语音翻译领域,为AI配音工具市场带来了更多可能性。

Podwise:一键提取播客关键信息的AI助手

Podwise是一款AI助手应用,利用人工智能技术能够从播客中提取关键信息并自动整理成逐字脚本、大纲、关键字,帮助用户快速了解播客内容。

image.png

体验地址:https://podwise.xyz/

【AiBase提要:】

🤖 Podwise利用人工智能技术,提取播客中的关键信息。

📄 可自动生成逐字脚本、大纲、关键字,并创建脑图。

🔗 连接现有知识库,提供个性化推荐,不消耗流量和存储空间。

👨‍💻💡🎯聚焦开发者

在图像、视频生成上,语言模型首次击败扩散模型

最新研究发现,通过引入MAGVIT-v2视频tokenizer,语言模型首次在图像和视频生成领域胜过扩散模型,突显视觉tokenizer的重要性。

【AiBase提要】

🌟 研究强调良好的视觉tokenizer对语言模型在图像和视频生成领域的重要性。

🖼️ 传统大型语言模型在图像生成方面一直不如扩散模型,因缺乏有效的视觉表示。

💡 新研究引入MAGVIT-v2视频tokenizer,采用无查找量化和增强功能,在图像和视频生成、视频压缩以及动作识别领域取得显著性能提升。

GPT Pilot:高效编程神器,开发速度提升20倍

GPT Pilot是一款高效编程工具,可将AI用于生成应用程序代码,提高开发速度,同时与开发者合作,可用于多种应用程序类型。

【AiBase提要】:

1. ⚙️ 开发速度提升:GPT Pilot可以提高开发速度20倍,生成代码并与开发者合作,协助创建可用的应用程序。

2. 🧩 灵活需求选择:工具允许用户指定应用程序类型,并提供灵活的需求选择,以更好地满足开发需求。

3. 🔄 可扩展性和TDD:GPT Pilot被设计用于处理各种规模的应用程序,遵循测试驱动开发方法,以确保代码质量。

相关话题

推荐关键词

24小时热搜

查看更多内容

大家正在看

首次盈利,B站怎么做到的?

所有AI应用的尽头,是MBTI?