Gemini 2.0说话语就能一键 P 图的功能爆火,把玩不了的大伙儿齐馋哭了!
比如一辆小车车:

输入请示"把这辆车改装成敞篷车",它就能立马将笔墨请示和图片辘集起来,完成一键 P 图。

让咱们来找茬儿,发现除了车酿成了敞篷的,其它元素木有变化,很好地保抓了一致性。
不仅于此,Gemini 2.0 还有点"多模态版 o1 "那味儿。
络续输入请示:思象一下,这辆车内装满了海滩用品。接着,将车身格式改为一种令东说念主联思到夏季的格式,并在蜕变经由中进行讲明。
然后 Gemini 2.0 就运行图文并茂地一步步推理生成了,先把车酿成了亮堂的黄色,接着又再车里装满了遮阳伞等海滩用品

这等于 Gemini 2.0 系列的原生图像输出智商。
驳倒区下面,一水儿齐是求具体上线时分的:

被谷歌挖走的 OpenAI 大将 Logan Kilpatrick 恢复,大伙儿别急,来岁年头将更世俗地推出。

除了上头展示的无意 P 图,你致使不错同期 P 图片中的多个元素,还能把一个物件酿成另一个。
比如,把蓬松的夹克酿成一个小枕头,况且拿掉毯子:

这还没完,辘集不同的图来 P也行。
猫和抱枕辘集,就取得了一个很有质感的猫猫抱枕:

把猫猫和滑板辘集就取得了猫猫代言滑板。
信托笔墨请示,Gemini 2.0 收效将猫猫酿成了插画贴纸形态。

除此除外,Gemini 2.0 P 图时还能更有思象力。
比如一个箱子,把箱子灵通就酿成了酱婶儿:

开端展示的小车车,也能酿成"飞车":

另外,还有一种玩法。
在图像中圈出需要 P 的区域,只需" Open this ",Gemini 2.0 不错胜利辘集笔墨请示交融图像,知说念" this "的指代:

不得不说,那些有内测资历的玩家,可算了把大伙儿馋坏了。

参考结合:https://x.com/OfficialLoganK/status/1868364831948251419
— 完 —
点这里� � 善良我,牢记标星哦~
一键三连「共享」、「点赞」和「在看」
科技前沿线路日日再会 ~
