谷歌上线AI新玩法:随手乱涂鸦,一键变怪兽
2020/12/07 15:37AI云资讯10965
小明随意地涂鸦了一个头部,再简单地画了个翅膀,加上一个大尾巴……再单击「转换」键。
一只面目狰狞、皮肤粗糙、纹理细致的大怪兽就创造出来了。

这是Google研究人员制作的AI工具奇美拉画家(Chimera Painter)。
这是个线上绘画工具,可以将涂鸦变成一个栩栩如生的怪物。
奇美拉的条件型GAN
研究人员建立了一个生物混合体的概念,就像是一个纸牌游戏。
比如你拿到一张「鲸」卡,通过组合,可以变成一个「鲸VS大象」的嵌合体怪兽。
这个组合而成艺术作品,还能保留原始图像的视觉特征。

在此之前生成式对抗网络 (GAN, Generative Adversarial Networks )被广泛用于图像创作上。GAN一般包含两个模块:
生成模型(Generative Model) 判别模型(Discriminative Model)
两个模块互相博弈学习产生相当好的输出。一个优秀的GAN应用需要有良好的训练方法,否则可能由于神经网络模型的自由性而导致输出不理想。
例如,麻省理工学院和IBM合作,开发出了“GAN绘画工作室”。
允许用户上传自选图像以从多种角度修改其外观,从更改对象的大小到添加全新的物体,例如如树木、窗户、建筑物、桌子……等等。

再有,英伟达(Nvidia)最新的AI软件将粗糙的涂鸦变成真实的风景。

而在奇美拉画家中,与前两者注重照片写实的GAN不一样,他们采用了一种称作条件型GAN的方法。
这种方法与一般的GAN不一样,一般的GAN是在一系列图片基础上,生成器和判别器相互对抗磨合,形成全新的图。
奇美拉画家则是需要在生成器中输入一张创作图,在此基础上,再通过GAN生成新图。
将怪兽肢解建模,再组合渲染
为了训练GAN,研究人员创建了10000多个全彩色图像的数据集,包含不同生物的3D模型。
在这个生物模型的数据库中,不仅描绘了每个生物整体的大小和形状,还提供了肢体、器官、躯干的分割图。
艺术家就在这些“肢解”模型的基础上,重新组合出新的“生物”。可以选择头、牙齿、躯干、翅膀等不同部分进行绘画。
可以看到左侧有各种肢体部分选项按钮。

然后经过GAN,选出组合得最好的模型,将之合并,输出到Chimera Painter中。
得先制作生物纹理
在GAN模型中,在渲染对比度低的图像部分时,会有跳格,使图像失去空间连贯性。
例如这张图的腿和眼睛的识别界限不清晰,导致输出来的图像奇奇怪怪。

为了解决这个问题,奇美拉画家的研究人员开发了一种新的半自动化方法。
奇美拉画家对每种所需的生物类型(例如鬣狗或狮子)都会建立一个模型。
然后,艺术家使用虚幻引擎制作了叠加在3D模型上的彩色纹理。

再将「分割图」的单色(例如头,耳,颈等部分)套用到模型上,确保GAN了解到艺术家指定的的结构,形状,纹理和比例。

再次使用虚幻引擎将3D生物模型放置在简单的3D场景中。
为了增加数据库的模型数量,一个自动化脚本会主动采用这个3D场景。在10000张生物模型的基础上,继续补充,生成了10000+张图像+分割图。
根据生物的不同姿势,在视点和缩放级别之间进行插值,创建出全色图像和分割图,形成GAN新的训练数据集。
而每次手动创建这些数据,需要20多分钟。
谷歌表示,奇美拉画家为艺术家节省了数百万小时的时间。
相关文章
- 谷歌推出全新 Gemini 3.8 Flash 模型:性能再升级,成本或将上涨
- 尚贤科技SX-Creval外贸独立站搭建,海量型号库,获取谷歌精准流量
- 谷歌 AI 核心管理层迎来重大调整,负责人戴密斯·哈萨比斯卸任
- 谷歌 DeepMind 推出新一代 AI 模型,能够操控机器人的全身躯体
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- 谷歌携手联发科打造下一代TPUv9芯片,将CPU与计算晶粒合封于一体,助力AI智能体发展
- 谷歌投资A24,共同开发人工智能电影制作工具
- 数据中心耗电远超电网负荷,迫使英伟达与谷歌在2026年第三季度前启动800V直流电架构改造
- 苹果和谷歌新增对Thread 1.4的支持
- 宜选科技出席2026谷歌合作伙伴峰会
- 苹果在新版Siri上作出妥协:依靠英伟达B200 GPU加密技术,防止谷歌窃取用户数据
- 谷歌Beam抢滩多人会议全息赛道,微美全息以AI+5G解锁虚实融合视觉新想象
- Google I/O 2026亮点回顾:晶晨股份携手谷歌共拓端侧AI新生态
- 谷歌搜索的人工智能进化包含更多广告
- 谷歌的未来是一个无所不能的搜索框
- Google I/O 2026:Gemini 将成为谷歌年度开发者大会的主角
AI企业
更多>>AI硬件
更多>>- 联合开源!因时机器人携手上海交大、复旦发布HandEdit数据集与评测基准
- 华沿机器人与骅升科技达成战略合作,携手布局具身智能与协作机器人市场
- 元点机器人Bridge斩获IFA年度创新奖,全球首款AI原生人形机器人柏林首秀
- 华硕 ProArt 创梦 27 OLED:以 4K QD-OLED 与专业色彩表现,支持精细化创作
- 芯展速 Gen 6 Retimer 正式上市,副总裁李蓁 ODCC大会演讲官宣 获媒体热议
- 行业首款60℃热雾巨无霸滚筒扫拖旗舰!iRobot Roomba 875发布,重新定义扫地机器人清洁力
- 华硕主板助国产颗粒内存达成四槽满插6000C30与双条8000C36双重突破
- 首日销量突破600台!8888元的元点机器人Bridge正在赢得开发者
AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









