见识了AI作图,我对未来充满了焦虑,甚至怀疑这个世界
DALL-E 2 与Stable diffusion的一些体验和对比
还有天理吗?还有王法吗?还有未来吗?
一年前一款叫DALL-E的AI模型。
只要你给出一段文字描述,它就能立刻把图给你画出来。
当时,它做的画还比较粗糙。
然而,仅仅过了一年!
给它喂了6.5亿张图片进行训练后,
DALL-E 2摇身一变成为绘画大师了!
不管多奇葩的文字,它都能给你画出来,而且有些效果简直太惊艳!
比如用文字输入:"用维米尔《戴珍珠耳环的少女》的风格画一只海獭":
立马整活...
输入文字:“用格兰特·伍德《美国哥特式》画风画一对宇航员夫妻”。
生成的图片...
文字输入:“一只穿斗篷的皮卡丘,8K HD,超高清”。
没问题!
文字输入:“野外的朱鹮,按照约翰·奥杜邦的风格绘制”。
秒出图...
文字输入:“一幅埃及动物神使用电脑的古埃及壁画”。
给你...
文字输入:“一只老鼠在晚上惬意地喝茶,油画”。
好嘞~~
文字输入:“一个胖灰熊戴着墨镜,穿着夹克接受Joe Rogan的播客采访画面”
拿去~
输入文字:“一头赛博电子北美野牛,高清,工作室数字艺术”。
搞定!
文字输入:“橘猫奥托·冯·加菲尔德的画,俾斯麦伯爵,劳恩堡公爵,普鲁士内阁首长。画中人戴着普鲁士的Pickelhaube尖顶盔,吃着
他最喜欢的食物--宽面条。”
您要的画像...
文字输入:“柴犬宇航员的肖像,油画,16世纪”
是这样吗?
它既可以生成画作,也可以根据你的描述生成任何犹如真实照片的图...
文字输入:“一只毛茸茸的树懒宝宝戴着一顶针织帽子,在研究一台
笔记本电脑,近距离拍摄,高清,工作室的灯光,屏幕反射在它的眼睛里”。
这结果,你能想象这完全是AI无中生有搞出来的吗?
我不寒而栗,我很焦虑。默默退掉了刚报名的两个研习班的课程。
我不知道还能说什么,也不知道应该说什么。
文字输入:“用VR的老鼠”...
AI生成的图不仅给老鼠戴上了VR眼镜,连动作都很有戏!
输入文字:“小狐狸对着草莓打喷嚏, 细节, 微距, 影室灯光, 水滴, 背光耳朵”
这效果...
老板说要一张海报,输入文字:“一只猫拿着一块芝士,穿着拿破仑的衣服,画一副宣传画报”
好吧,两秒钟后,拿去?
老板让它整一个古罗马的蜘蛛侠:
它真能给你整:
什么?不满意? 安排!
什么?不满意? 安排!
什么?不满意? 安排!
你要让科米蛙出演任何电影/卡通都行,AI全都能帮你把剧照生成出来...
《银翼杀手2049》中的科米蛙的剧照:
1999年《黑客帝国》中科米蛙的剧照
《千与千寻》中科米蛙的剧照:
1977年《星球大战》中的科米蛙的剧照:
《降世神通:最后的气宗》中科米蛙的剧照:
2008年《瓦力》中的科米蛙剧照:
《辉夜姬物语》中的科米蛙剧照:
《布达佩斯大酒店 》中科米蛙的剧照:
《黑道家族》中科米蛙的剧照:
让AI画自画像,输入文字:“DALL-E梦想成为通用人工智能”
它给自己生出这么一个萌萌的形象:
不管多么天马行空的文字输入,它都能画。
只要你给出人物,动作,画风,它能给你画出一切。
而且它还能在不同画风之间随意切换。
输入文字:“宇航员骑马,超现实风格”,出来这种图
但如果输入“安迪·沃霍尔风格”,它又会生出这样的图片:
有人给DALL-E 2喂了来自名画的“掩膜”,
告诉算法该扩展图像的哪些区域,
以及详细的文字要求后,
AI还能帮你自动补充名画的其他部分。
比如蒙娜丽莎,下半身是啥样?你有没有脑补过?
别再浪费脑细胞了,AI帮你画了。
站着?
坐着?统统给你补出来...
戴珍珠耳环的少女全景?
收图
梵高戴草帽的自画像。
这张没画完的乔治·华盛顿的肖像也可以给你补充完整。
老板说我要一个滑滑板的泰迪熊,多出几稿。
安排!
输入:“一个在时代广场滑板的泰迪熊”,它能立马整出这么一大堆……
背景啥的完全没有违和感,如果小熊离灯光远,背后的灯光就非常逼真地失焦了。
朋友,你焦虑吗?
它还可以进行同类画像再创作。
比如你上传《戴珍珠耳环的少女》...
它可以给你创作出相似的其他画像…
上传:1900-1910年小原古邨的《樱花树枝上的山雀》
AI生成的其他相似图片:
PS更是分分钟的事儿。
圈出图中的小狗,输入文字:可爱的小猫。
小猫马上出现,而且毫无违和感。
这种逼真程度,简直了……
最后再来欣赏一波三火AI作画大师的作品。
输入文字:达芬奇风格的宇宙诞生
输入文字:《指环王》中土世界由梵高所绘,细节精美
输入文字:在一个雨夜,超级英雄栖息在城市的上空,漫画风格。
输入文字:穿着彩色高领毛衣的快乐小浣熊..
输入文字:“一个咖啡机用人类灵魂制作咖啡”:
输入文字:被鲜艳的花朵包围的湖泊,披上了雾气,数字艺术
输入文字:半张脸是机器人的达利肖像画...
输入文字:猫头鹰侠
文字输入:“长出树叶的手掌,近景
文字输入:“一把苹果形状的中世纪椅子”
文字输入:“一个浣熊宇航员,他的头盔玻璃上反射着宇宙,梦想着星空”
文字输入:“算术课上懵比的灰熊”:
输入文字:泰迪熊正在水下用上世纪90年代的技术进行新的人工智能研究
输入文字:泰迪熊购买杂货,浮世绘风格
文字输入:"泰迪熊作为疯狂科学家混合闪亮的化学品",20世纪90年代周六早上的动画片风格和数字艺术风格。
输入文字:一碗汤,通往另一个维度的门户,数字艺术风格
输入文字:一只戴帽子和黑围巾的柴犬:
输入文字:一只小鸟看着镜头的宝丽来照片
输入文字:四月的雨带来五月的花,数字艺术
输入文字:“一只魔法太空水豚穿着闪亮蓬蓬裙祝福你,数字艺术”
输入文字:“动物焦急地等待牙医,数字艺术(老虎、熊、长颈鹿、兔子)”:
文字输入:一张萨摩耶狗伸出舌头拥抱白色暹罗猫的照片
????这不是拍的?
文字输入:“小仓鼠在户外喝茶,油画”
然而更狠的还在后面
Stable diffusion
Stable diffusion 工具的生成效果甚在生成内容的轮廓合理性上超越了Disco Diffusion和Midjourney
然后我试着用stable diffusion网页版生成了几个图
梵高风格吉普车
少女
悬崖边的夕阳
悬崖 夕阳 背影
瀑布 皮划艇
插画风 狗
悬崖边的大熊猫
虽然是精简版,但仍然让我感到沮丧。真不知道未来AI会怎么去改变我们的世界。

















































































