谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话

吴厣人工智能 2024-12-18 3

Gemini 2.0 说说话就能一键 P 图的功能爆火，把玩不了的大伙儿都馋哭了！

比如一辆小车车：

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第1张图片-小猪号

输入指令“把这辆车改装成敞篷车”，它就能立马将文字指令和图片结合起来，完成一键 P 图。

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第2张图片-小猪号

让我们来找茬儿，发现除了车变成了敞篷的，其它元素木有变化，很好地保持了一致性。

不仅于此，Gemini 2.0 还有点“多模态版 o1”那味儿。

继续输入指令：想象一下，这辆车内装满了海滩用品。接着，将车身颜色改为一种令人联想到夏日的颜色，并在改变过程中进行说明。

然后 Gemini 2.0 就开始图文并茂地一步步推理生成了，先把车变成了明亮的黄色，接着又再车里装满了遮阳伞等海滩用品。

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第3张图片-小猪号

这就是 Gemini 2.0 系列的原生图像输出能力。

评论区底下，一水儿都是求具体上线时间的：

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第4张图片-小猪号

被谷歌挖走的 OpenAI 大将 Logan Kilpatrick 回应，大伙儿别急，明年年初将更广泛地推出。

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第5张图片-小猪号

各种 P 图都是一句话的事儿

除了上面展示的简单 P 图，你甚至可以同时 P 图片中的多个元素，还能把一个物件变成另一个。

比如，把蓬松的夹克变成一个小枕头，并且拿掉毯子：

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第6张图片-小猪号

这还没完，结合不同的图来 P 也行。

猫和抱枕结合，就得到了一个很有质感的猫猫抱枕：

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第7张图片-小猪号

把猫猫和滑板结合就得到了猫猫代言滑板。

遵从文字指令，Gemini 2.0 成功将猫猫变成了插画贴纸形态。

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第8张图片-小猪号

除此之外，Gemini 2.0 P 图时还能更有想象力。

比如一个箱子，把箱子打开就变成了酱婶儿：

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第9张图片-小猪号

开头展示的小车车，也能变成“飞车”：

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第10张图片-小猪号

另外，还有一种玩法。

在图像中圈出需要 P 的区域，只需“Open this”，Gemini 2.0 可以直接结合文字指令理解图像，知道“this”的指代：

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第11张图片-小猪号

不得不说，那些有内测资格的玩家，可算了把大伙儿馋坏了。

谷歌 Gemini 2.0 成“P 图神器”，各种 P 图只需一句话-第12张图片-小猪号

本文来自微信公众号：量子位（ID：QbitAI），作者：西风，原标题《Gemini 2.0 成 P 图神器，各种 P 图只需一句话的事儿，可把网友馋哭了》

广告声明：文内含有的对外跳转链接（包括不限于超链接、二维码、口令等形式），用于传递更多信息，节省甄选时间，结果仅供参考，小猪号所有文章均包含本声明。

本文地址： https://xzxzc.com/xz/111997.html

版权声明：除非特别标注，否则均为本站原创文章，转载时请以链接形式注明文章出处。侵权删联系：site777#qq.com #换@

上一篇消息称今年智元临港工厂预计下线超 900 台人形机器人

下一篇OpenAI 向所有用户免费开放 ChatGPT 搜索功能，新增实时搜索和高级语音

抱歉，评论功能暂时关闭!