当前位置:首页 > 元宇宙 > AI

AI 逆向绘画:一键重绘梵高《罗纳河上的星夜》,来自华盛顿大学

来源: 责编: 时间:2024-10-13 14:11:11 4观看
导读 梵高名作也能被 AI 逆向破解了?!直接喂一张原图,AI 就能化身梵高・本高一点点重绘整张图画(原图可任意)。▲梵高《罗纳河上的星夜》仔细对照两边,AI 几乎实现了 1:1 复刻,还为我们这些绘画小白清晰展示了整幅图的构

梵高名作也能被 AI 逆向破解了?!bGL28资讯网——每日最新资讯28at.com

直接喂一张原图,AI 就能化身梵高・本高一点点重绘整张图画(原图可任意)。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

▲梵高《罗纳河上的星夜》

仔细对照两边,AI 几乎实现了 1:1 复刻,还为我们这些绘画小白清晰展示了整幅图的构建过程。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

这项魔法来自华盛顿大学,项目名为 Inverse Painting,相关论文已入选 SIGGRAPH Asia 2024,其中两位作者还是东北大学(Bowei Chen )和上海科技大学(Yifan Wang)的校友。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

项目一经发布后即在 Reddit 引起热议,最高赞更是为艺术家群体操起了心(doge)。bGL28资讯网——每日最新资讯28at.com

艺术家可能会对此感到愤怒bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

不过也有人表示,这对于人们学习如何绘画非常有帮助。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

甚至可以用来“破解”一些大师遗作,提取隐藏或失传的技术。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

基于扩散模型

从原图 → 绘画过程延时视频,Inverse Painting 采用基于扩散的逆绘画方法。bGL28资讯网——每日最新资讯28at.com

通过学习真实艺术家的绘画视频,结合文本和区域理解来定义绘画“指令”,并使用基于扩散的渲染器更新画布,从而生成类似于人类艺术家绘画过程的视频。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

进一步拆解,这一过程主要包括以下步骤:bGL28资讯网——每日最新资讯28at.com

学习艺术家的绘画过程。收集了 294 个丙烯酸风景画绘画过程视频(平均时长 9 分钟),并进行视频帧分割、裁剪和筛选等预处理操作,让模型学习绘画过程;bGL28资讯网——每日最新资讯28at.com

定义绘画指令。基于对画作不同元素(比如天空、树木、人物等)以及元素相互关系的理解,模型会生成一组“绘画指令”,告诉模型应该先画什么,后画什么;bGL28资讯网——每日最新资讯28at.com

使用扩散模型。用扩散模型生成逼真图像,并逐步在画布上添加细节,就像艺术家绘画时一样;bGL28资讯网——每日最新资讯28at.com

文本和区域理解。模型还会生成文本指令和区域掩码,前者告诉模型要绘制的内容,后者用来指定内容的确切位置;bGL28资讯网——每日最新资讯28at.com

逐步渲染。从一个空白画布开始,逐步生成完整绘画过程;bGL28资讯网——每日最新资讯28at.com

时间控制。为了模拟真实世界中艺术家的绘画速度,模型还会考虑每步之间的时间间隔;bGL28资讯网——每日最新资讯28at.com

这些步骤整体可归为两阶段训练 + 测试,如下所示:bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

第一阶段:指令生成(Instruction Generation)

这个阶段主要生成两个关键指令集,文本指令生成器(Text Instruction Generator)和区域掩码生成器(Mask Instruction Generator)。bGL28资讯网——每日最新资讯28at.com

前者通过比较目标画作和当前画布的状态,生成一个简短的文本指令,比如“画天空”或“加花朵”,以此决定下一步应该添加哪些元素。bGL28资讯网——每日最新资讯28at.com

后者是一个二进制图像,指明了画布上应该更新哪些部分。bGL28资讯网——每日最新资讯28at.com

两者一结合,确保模型只在画布上合适的区域进行绘制。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

▲生成的文本指令第二阶段:画布渲染(Canvas Rendering)

接下来使用第一阶段生成的指令来更新画布。bGL28资讯网——每日最新资讯28at.com

利用文本指令和区域掩码,以及当前画布的图像和目标画作,一个基于扩散的渲染器被用来更新画布。bGL28资讯网——每日最新资讯28at.com

这个渲染器采用了一种叫做“去噪扩散概率模型”的技术,它逐步从噪声图像中去除噪音,以生成连续的图像帧。bGL28资讯网——每日最新资讯28at.com

总之,渲染器在更新画布时会考虑多种条件信号,包括文本指令、区域掩码、时间间隔,以及目标画作和当前画作的特征。bGL28资讯网——每日最新资讯28at.com

这些条件信号帮助渲染器更准确地模拟人类艺术家的绘画风格和过程。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

测试(Test-Time Generation)

在测试阶段,模型使用训练好的管道从头开始生成一幅画作。bGL28资讯网——每日最新资讯28at.com

这里主要有两个关键:bGL28资讯网——每日最新资讯28at.com

自回归过程。每一步都依赖于前一步生成的结果,以此生成一个连贯的绘画过程;bGL28资讯网——每日最新资讯28at.com

固定时间间隔。在每一步之间采用固定时间来更新画布,模拟真实绘画过程中的时间流逝;bGL28资讯网——每日最新资讯28at.com

最终,与三个基线方法(Timecraft、Paint Transformer、Stable Video Diffusion)相比,其生成结果明显更优。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

同时,相关变体也取得了 SOTA 结果。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

其中两位作者为华人

简单介绍下项目作者,一共 5 位,其中两位是华人。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

Bowei Chen (陈柏维),本科就读于国内东北大学软件工程专业(2016 年入学),后分别在卡内基梅隆大学机器人研究所和华盛顿大学攻读硕博。bGL28资讯网——每日最新资讯28at.com

研究兴趣为计算机视觉和图形学的交叉点,重点是图像和视频生成。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

Yifan Wang,本科就读于上海科技大学计算机专业,今年刚获得华盛顿大学 CS 博士学位。bGL28资讯网——每日最新资讯28at.com

个人主页显示了多段工作经历(含字节、谷歌、Adobe 等),目前是 Meta Reality Labs Research 的一名研究科学家。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

实际上,这个团队进行的 AI 逆向绘画之前也有,网友们还提到了 Paints Undo 这个项目。bGL28资讯网——每日最新资讯28at.com

当时主要应用于动漫领域,短短 3 个月已在 GitHub 揽星 3.3K。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

对于这事儿,人们一直褒贬不一,最大争议在于人们担心有人会利用 AI 谎称作者。bGL28资讯网——每日最新资讯28at.com

毕竟通过讲解艺术思路是作者证明作品原创性的手段之一。bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

甚至对于它能教人们学绘画这事儿,也有网友以自身经历出来反驳:bGL28资讯网——每日最新资讯28at.com

目前不太符合真实绘画过程bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

bGL28资讯网——每日最新资讯28at.com

所以,有了解绘画的童鞋来说说看吗?bGL28资讯网——每日最新资讯28at.com

参考链接:bGL28资讯网——每日最新资讯28at.com

[1]https://inversepainting.github.io/bGL28资讯网——每日最新资讯28at.com

[2]https://www.reddit.com/r/singularity/comments/1fybddi/inverse_painting_can_generate_timelapse_videos_of/bGL28资讯网——每日最新资讯28at.com

本文来自微信公众号:量子位(ID:QbitAI),作者:一水,原标题《AI 逆向绘画火了!一键重绘梵高《星空》,来自华盛顿大学》bGL28资讯网——每日最新资讯28at.com

本文链接://www.dmpip.com//www.dmpip.com/showinfo-45-8796-0.htmlAI 逆向绘画:一键重绘梵高《罗纳河上的星夜》,来自华盛顿大学

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 首个开源 AI 候选版定义稿发布:四大要求,训练数据上有妥协

下一篇: 微软助推医疗行业 AI 变革:新增智能体服务、扩充 Azure 大模型

标签:
  • 热门焦点
  • 汽车元宇宙,是概念还是未来?

    汽车元宇宙,是概念还是未来?

    作者|何文 元宇宙是未来趋势已经无需验证。 从概念上来看,元宇宙是两种存在多年的概念的融合:虚拟现实和数字第二人生。这也就意味着,元宇宙所代表的是一种新的数
  • 元宇宙是投资中国的第五次重大机遇

    元宇宙是投资中国的第五次重大机遇

    作者为凯思博投资董事长导语:投资逻辑要来自于人性在社会发展过程中的普遍规律,由第一性原理出发找出重大的投资机会来。1978年的改革开放到今天,中国总共经历了
  • 传腾讯已推出全新XR业务;摩托罗拉正打造5GXR颈戴式计算组件

    传腾讯已推出全新XR业务;摩托罗拉正打造5GXR颈戴式计算组件

    今日热点:传腾讯已推出全新XR业务;摩托罗拉与Verizon合作打造5G XR颈戴式计算组件;小米AR购物导航专利获授权;VR一体机Simula One放弃众筹并开放直接预订;VR游戏《
  • 超级碗的加密时刻:是主流信号还是“网络超级碗2.0”?

    超级碗的加密时刻:是主流信号还是“网络超级碗2.0”?

    2 月 13 日,美东时间 18:30,有着“美国春晚”之誉的超级碗(Super Bowl)落下帷幕。超级碗是美国国家美式足球联盟(也称为国家橄榄球联盟)的年度冠军赛,胜者将成为“世
  • 纽约街头出现NFT自动贩卖机

    纽约街头出现NFT自动贩卖机

    一家初创公司宣布在纽约市开放一台NFT自动售货机,允许任何人——即使是没有加密资产的人也能购买NFT。该交易平台名为Neon,上个月完成了一轮300万美元的种子募捐
  • 权限风波过后 X2Y2如何挑战OpenSea?

    权限风波过后 X2Y2如何挑战OpenSea?

    继LooksRare之后,又一个OpenSea挑战者X2Y2来了。上周,X2Y2宣布向超过86万个OpenSea交易用户发放X2Y2通证空投,并启动了「挂单挖矿」的奖励机制。这场早期激励活动
  • 量子计算在未来能否提高区块链技术的效率

    量子计算在未来能否提高区块链技术的效率

    区块链技术的主要成功之处在于对不透明的金融流程进行了去中心化的访问量子计算机的内在目标是解决传统计算机不可能解决的问题随着区块链技术的使用案例逐渐
  • 元宇宙+剧本杀:“在异世界里当演员”

    元宇宙+剧本杀:“在异世界里当演员”

    你玩过剧本杀吗?体验过“元宇宙+剧本杀”吗?2月,恒信东方推出了一款次时代剧本杀原创作品——《失落的王朝》。其剧本和线索以数字化资产打造,通过VR技术塑造了与
  • 初探元宇宙

    初探元宇宙

    2021年可以被称为“元宇宙”元年。继2021年3月沙盒游戏平台Roblox将“元宇宙”概念放入招股书中,被称为“元宇宙”第一股后,Facebook更名为Meta, 引发全球范围内
Top
Baidu
map