Facebook发布的这个AI,可以生成以前从未见过的事物图像

揭秘 Facebook 人工智能如何革新社交模式 人工智能正在深刻改变Facebook的社交模式。通过精准的内容推荐、智能社交推荐和情感分析,AI提升了用户体验,也推动了社交网络的创新。随着技术的进一步发展,Facebook将继续探索AI在社交平台中的更多应用,带给用户更加智能化和个性化的社交体验。 阅读详情

生成对抗网络 (GAN) 是一种行之有效的 AI 方法来创建图像,无论是逼真的图片还是抽象的拼贴画。然而,迄今为止,这些模型有一个重要的局限性:它们通常只能生成与训练数据集密切相关的物体或场景的图像。

Facebook发布的这个AI,可以生成以前从未见过的事物图像

例如,在汽车图像上训练的传统 GAN 在被要求生成其他汽车图像时显示出令人印象深刻的结果,但如果被要求生成汽车数据集之外的鲜花或其他物体的图像,则可能会失败。

Facebook AI 使用 Instance-Conditioned GAN (IC-GAN) 在解决这个问题方面取得了长足进步. 与以前的方法不同,IC-GAN 可以生成逼真的、不可预见的图像组合,例如被雪包围的骆驼或城市中的斑马。Facebook的方法展示了跨不同类型对象的卓越传输能力。研究人员可以将现成的 IC-GAN 与以前看不见的数据集一起使用,并且仍然生成逼真的图像,而无需标记数据。

凭借这些新功能,IC-GAN 可用于创建新的视觉示例,以扩充数据集以包含不同的对象和场景;为艺术家和创作者提供更广泛、更有创意的 AI 生成内容;并推进高质量图像生成的研究。

训练和使用 IC-GAN

称为类条件 GAN 的标准方法专注于对类标签进行调节,有效地将数据划分为与这些标签相对应的组。这使他们能够生成比无条件样本更高质量的样本。这些 GAN 不仅能够创建随机图像,还能够创建适合特定标签的图像,例如“衣服”或“汽车”。然而,它们依赖于可能无法获得或无法获得的标记数据。

以前的无标签学习方法(不使用标签数据)用于图像生成一直很有前景,但在训练对复杂数据集(如 ImageNet)进行建模时,它们的输出质量通常很差。它们要么使用粗糙的、不重叠的数据分区(导致非常大的集群,每个集群包含非常不同对象的图像,因此在语义上不会与模型试图创建的图片相似)。或者他们使用精细的分区,这些分区往往会使结果恶化,因为集群包含的数据点太少。

Facebook的新方法 IC-GAN 可用于标记和未标记的数据集。它扩展了 GAN 框架以对本地和重叠数据集群的混合进行建模。它可以获取单个图像(或“实例”),然后生成与数据集中该实例的最近邻居相似的图像。Facebook使用邻居作为判别器的输入,强制生成器创建与每个实例的邻居样本相似的样本。这避免了将数据划分为小集群的问题,因为如此多的数据是重叠的,因此模型可以更有效地使用数据集。

一旦模型经过训练,Facebook就会在它从未见过的图像上对其进行测试。使用单个图像,该模型可以生成与数据集中最近的邻居相似的视觉丰富的图像。

IC-GAN 使用左侧的实例生成右侧显示的相应图像。在这种情况下,没有提供类标签。

对于这类条件设置(其中训练集包括标记图像)和根本没有标签的情况,IC-GAN 可以转移到训练期间看不到的其他数据集。在 IC-GAN 的情况下,Facebook通过在推理时交换条件的实例来做到这一点。在类条件 IC-GAN 的情况下,Facebook可以交换实例条件或类标签。通过适当地组合实例和类标签,类条件 IC-GAN 可以创建异常场景,这些场景要么不存在,要么在当前数据集中非常罕见。例如,给定一个被雪包围的扫雪机图像和一个没有出现在实例条件化中的类标签“骆驼”,Facebook可以生成被雪包围的骆驼,绕过骆驼只生活在沙漠中的偏见。

Facebook发布的这个AI,可以生成以前从未见过的事物图像

当以左侧显示的图像和类别标签为条件时,IC-GAN 生成右侧显示的图像。

IC-GAN 可用于扩充数据并包含训练数据中不常见的项目或对象。此外,由于它适用于不同的领域,Facebook的方法可以为对象识别模型生成更多样化的训练数据。例如,传统的 GAN 模型无法生成站在城市地区的斑马图像,因为它的训练数据可能只包含草原斑马的图像。IC-GAN 模型可用于扩充数据并包含标准数据集中不常见的项目或对象。Facebook已经证明Facebook可以使用受控语义来生成不寻常的图像组合,例如沙子里的奶牛。

未来,Facebook希望探索为这个模型带来更多控制的方法。它不再只是关于背景和中心的物体。Facebook想探索如何在背景中放置更多对象并确定放置项目的位置,从而创建复杂、完美的场景。

IC-GAN 能够使用此处显示的房屋图形来创建如下所示的更逼真的建筑物。

Facebook发布的这个AI,可以生成以前从未见过的事物图像

通过将Facebook的预训练模型以及用于重现论文结果的代码发布到开源社区,Facebook希望这项研究将导致 AI 模型能够比以往任何时候都更加灵活、准确和高效地生成图像。

Facebook开源多款AI工具,支持游戏、翻译等 翻译 | 林椿眄编辑 | 阿司匹林出品 | AI科技大本营(公众号ID:rgznai100)近日,Facebook 在年度开发者大会 F8 上宣布开源多款 AI 工具,除了 PyTorch、Caffe... 阅读详情

相关推荐

FacebookAI 翻身之战!

未来的用户友好度真的很高。 来源:medium.com 作者 |Michael K. Spencer 译者 | 王艳妮,责编 | 屠敏 出品 | CSDN(ID:CSDNnews) Facebook最近举办了F8会议,这是了解这个平台未来发展的绝佳机会。 F8是Facebook的年度开发者大会——一个为期数日的活动,期间Facebook通常会公布其主要计划的实施方案以及其产品的...

CSDN资讯 1817

Facebook将反馈融入AI系统,视觉障碍者现在也能“读懂”照片啦

雷锋网按:Automatic Alt-Text(AAT)的发布让盲人(或使用屏幕阅读器的用户)更好地读懂新闻推送 (News Feeds) 里的照片的内容。以访谈,可用性测试以及调查为手段的用户研究给工具的发明提供了帮助。我们将在本文简要介绍这项工作的一些亮点,雷锋网(公众号:雷锋网)独家编译,未经许可不得转载。 这项工作的主要作者、数据科学...

weixin_33726318的博客 158

Facebook利用人工智能的六种方式,有些你可能想不到

Facebook的世界,首席全球安全官Nick Lovrien说:“一天是一周,一周是一月,一月是一年。”换句话说,在Facebook节奏很快。作为一家公司,Faceb...

深度学习世界 3092

深度 | 人工智能的黑暗秘密:如何让AI解释自身行为?

▼大型年度AI人物评选——2017中国AI英雄风云榜已于12月4日在乌镇张榜,12月18日在北京国贸三期举行颁奖典礼。榜单评选出年度技术创新人物TOP 10;商业创新人物TOP 10,获取完整榜单请关注网易智能公众号(ID:smartman163),回复关键词“评奖”。本文系网易智能工作室出品聚焦AI,读懂下一个大时代【网易智能讯 12月15日消息】人工智能正渗透到我们现代生活的每一个角落,人工智

网易智能 789

Facebook是世界上最具创新的科技企业?

全球最具创新的科技公司是谁?也许首先从投资者脑海中跳出来的名字就是--Alphabet,这是合乎情理的,毕竟旗下拥有众多令人瞠目结舌引领未来的科技项目。而最令我们津津乐道的莫过于《杰森一家》(The Jetsons)的空中飞车雏形--无人驾驶汽车,它正在正在书写未来交通新篇章,甚至已经从 Google X 毕业开始和菲亚特克莱斯勒汽车(Fiat Chry...

weixin_33828101的博客 173

AI每日播报】吴恩达离职百度 腾讯任命张潼为AI Lab主任

欢迎人工智能相关的技术投稿、约稿、行业分析、热点新闻、编译等,请发送邮件至baiyan@csdn.net,期待大家投稿 资讯快讯 | 百度首席科学家吴恩达宣布即将离职3月22日,百度首席科学家、在线教育平台Coursera的联合创始人吴恩达宣布将会辞去在百度的工作,吴恩达于2014年5月加入百度,负责百度研究院的领导工作,尤其是Baidu Brain计划。据悉,在同一天,百度通过内部邮件,任...

yssycz的博客 457

人人都在谈论人工智能 可它到底为啥这么热?

人工智能AI)这个术语的诞生可追溯到20世纪50年代,此后它曾出现过短暂繁荣。然而在过去5年间,计算能力的大幅进步触发了AI革命,谷歌(微博)母公司Alphabet、亚马逊、苹果、Facebook以及微软等科技巨头争先进入这个领域。现在几乎人人都在谈论AI,可它到底为何物?为何它现在被炒得如此之热? 在我们的生活中,AI几乎已经无处不在,从苹果的i...

weixin_34392843的博客 428

扎克伯格:我们为什么要研究人工智能与虚拟现实?

作为全世界最大社交网络的Facebook,正在向新的领域突破,这当中包括了虚拟现实、人工智能,当然也包括面向全世界发展中国家提供互联网接入的Internet.org计划。其中,扎克伯格斥资20亿美元收购虚拟现实技术公司OculusVR的标志性事件,点燃了整个科技行业对虚拟现实的热情,2016年将成为虚拟现实头盔开始普及的“元年”。 在6月30日(周二)的例行网民问答活动上,扎克伯格谈到了Fa

wesay1的专栏 957

科技热点周刊|Linux 30 周年、Horizon Workroom 发布、Humanoid Robot、元宇宙

Linux 之父:完全没想到我的实验习作能存在 30 年 Linux 之父:完全没想到我的实验习作能存在 30 年 2021 年 8 月 25 日,Linux 迎来了 30 岁的生日。30 年前,芬兰计算机系研究生 Linus Torvalds 发布了一份简短的说明,介绍自己正出于业余爱好开发一款操作系统 —— Linux 。如今,30 年过去了,Linux 已经成为软件开发历史上的传奇。 参考链接 [1] https://www.zdnet.com/article/linus-torvalds-on-li

Qingcloudedu的博客 6247

Yann LeCun最新文章:自监督学习的统一框架

作者:Yann LeCun、Ishan Misra编译:梦佳、贾伟Facebook 今天宣布了一项重大突破: Facebook 的 自监督AI 模型 SEER 能够在没有人类帮助的情况下,...

BAAIBeijing的博客 1114

5大机器学习免费开源工具!人工智能3分钟入门!

如今,科技公司似乎无法足够快地雇用他们的AI或ML专家。 因此,如果您正在寻求升级您的技能组合或只是使用一个很酷的新工具,我们已经为您提供了前5个选择,以获得最佳的机器学习开源工具。   如今,机器学习经历了复兴。 似乎每天都有这项技术的新进展,从图像和声音识别的进步到唇读,以及在所有游戏中击败我们。 然而,这种复兴主要由硅谷资助。 公司正在争先恐后地寻找能够编写ML和深度学习代码的足够...

引力空间 万物互联 303

深层学习是AI更像人类的关键

深层学习正在AI人工智能)社区里嗡嗡作响。微软的Eric Horvitz和Facebook的Yann LeCun阐释了为什么这种机器学习如此令人兴奋。 当前AI的复苏会转变成另一个AI的冬天吗?两位该领域杰出的专家——Eric Horvitz和Yann LeCun认为不会。“到底与机器智力相关的事物会发展的多快?我自己都不确定。”Horvitz说。他是...

weixin_33985679的博客 87

无监督学习?Yann LeCun说:或许应该叫它预测性学习

随着机器学习的不断发展,无监督学习在近年来备受关注。Yann LeCun提出赋予无监督学习新的名字——预测性学习。 随着机器学习的不断发展,无监督学习在近年来备受关注。近日,有人提出赋予无监督学习新的名字——预测性学习。推崇这次改名的正是前些日子在推特「大火」的Facebook的首席AI科学家,Yann LeCun。 Yann LeCun将「预测性学习」称为「下一个AI前沿」。因为在过去的十年中,监督学习有着丰硕的成果。而接下来的十年,无监督学习,即预测性学习可能会变得越来越流行。 监..

喜欢打酱油的老鸟 814

扎克伯格与黄仁勋共同展示Meta最新版的视觉AI模型Segment Anything 2

在描述 SA2 的论文中,另一个包含 10 万多个"内部可用"视频的数据库也被用于训练,但这个数据库并没有公开–我已经要求 Meta 提供更多信息,说明这是什么,以及为什么没有公开。但最近,LLaMa、Segment Anything 和它免费发布的其他一些模型,已经成为这些领域人工智能性能的一个相对可及的标准,尽管它们的"开放性"还有待商榷。分割是一个专业术语,是指视觉模型观察图片并找出其中的部分:希望是"这是一只狗,狗后面是一棵树",而不是"这是一棵从狗身上长出来的树"。

weixin_41446370的博客 547

深度学习开源平台能否成为下个“Android”?

如你所知,追溯历史,踩在某些意义深远的技术普及之前,这个世界上的科技巨头往往在合适时机选择开源一些产品,促使社区和整个行业进步——种种迹象表明,最新一轮开源运动来自人工智能领域,就在此刻,全球最顶尖的科技公司正掀起一场“AI技术开放”共享风潮。 时至今日已没太多人怀疑,人工智能是新一轮产业革命的土壤,人类社会也正在从“互联网+”向更高阶的“人工智能+”跃迁,而从专业视角,当人工智能(目前以深

Enweitech Software Works 849

知物由学 | 内容监管系列,硅谷巨头如何自我监管?

“知物由学”是网易云易盾打造的一个品牌栏目,词语出自汉·王充《论衡·实知》。人,能力有高下之分,学习才知道事物的道理,而后才有智慧,不去求问就不会知道。“知物由学”希望通过一篇篇技术干货、趋势解读、人物思考和沉淀给你带来收获的同时,也希望打开你的眼界,成就不一样的你。   本文转自东西互娱(EW-Entertainment),作者: 东西宏观研究组 导读   今年,视频网站和社交网站内容...

757

深度学习图像相似度:从语义理解到业务闭环的实战指南

图像相似度是计算机视觉的基础能力,本质是建模视觉语义一致性而非像素比对。传统方法如pHash、颜色直方图和SIFT受限于光照敏感、空间信息丢失与维度灾难,难以支撑真实场景需求;而深度学习通过端到端训练将图像映射至语义向量空间,使余弦距离可表征人类感知的‘同类性’。该技术具备强泛化性与可迁移性,广泛应用于电商去重、版权监测、工业质检与医疗影像分析等高价值场景。本文聚焦工程落地,覆盖模型选型、特征归一化、向量数据库配置及业务阈值校准等关键环节,并强调‘相似度数值必须翻译为可执行动作’这一核心理念,助力开发者跨越

hck341204的专栏 453
上一篇: 时间魔法,HyperStyle算法给你“返老还童”的真实体验
下一篇: 直播带货只是昙花一现,人工智能、万物互联与消费升级,才是未来的发展趋势
老贡讲Python
博客等级 码龄5年 513粉丝 129原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值