在 IT 之家 11 月 20 日的时候有消息传来, 今日谷歌正式推出了全新的图像生成与编辑模型 Nano Pro ( 3 Pro Image) , 这个模型是基于 3 Pro 架构构建起来的, 它号称能够凭借“前所未有的控制力、完美的文字渲染效果以及增强的世界知识储备” , 从而把用户的构想转化为“工作室级(-)”的设计作品。与今年 9 月发布的、因为生成超写实 3D 手办而走红的初代模型相比较而言, 此次的更新代表了谷歌在图像生成领域的又一次重要跃升。
从即日起, Nano Pro 针对全球范围的用户开启免费试用通道。用户只要登录相关应用, 挑选“生成图像(image)”功能, 并且切换到特定“”模式, 便能体验这一最新的模型。
按照谷歌所讲, Nano Pro于处理繁杂麻烦的信息这一方面展现得相当优秀, 它可以造出来那种涵盖丰富上下文详情信息的关联对应图标图例之类的, 能够特别明白、直接地把像天气情况呀、体育比赛这些及时的实时数据清晰呈现出来。
该模型有个重大突破是其文本渲染能力, Nano Pro 能生成细节更为丰富、文字更为准确的图像, 还支持以不同风格、字体以及语言来生成文本内容, 不管是简短的标语还是长长的段落文本, Nano Pro 均可清晰且准确地把它直接渲染于图像里, 这一特性让它极具实用性, 很适合制作多种语言版本的海报或者邀请函, 另外, 模型拥有强大的合成能力, 支持在一个画面当中融合最多 14 张图像素材以及多达 5 个人物主体。
按 IT 之家所知晓的情况, 于编辑功能这块, Nano Pro引进了更具高级性的创意控制选项, 不仅用户能够针对图像开展局部选择以及编辑, 而且还能够对摄像机角度予以调整、增添背景虚化(Bokeh)效果、使焦点产生改变、实施专业色彩分级(Color), 甚而能够随意切换日夜光照效果, 在输出规格层面, 模型支持多种长宽比, 最高情况下能够生成 4K 分辨率的高清图像。
需要留意的是, 所有借助 Nano Pro 生成或者编辑的图像, 都会嵌入有 C2PA 元数据。伴着行业规范渐渐建立起来, 这样的举措意在助力用户更轻松地于搜索结果以及社交媒体里认出生成式 AI 内容以及深度伪造()。就在本周, 也宣告会采用 C2PA 元数据给 AI 生成内容增添隐形水印。
不过, 谷歌也表明,即便 Nano Pro 的图像质量有了明显的提高, 可是它的生成速度却有所降低, 并且使用成本也变得更高: 原本 Nano 单张图像生成的费用是 0.039 美元(IT 之家注明: 目前汇率大概折合为 0.28 元人民币);然而 Nano Pro 生成 1080p/2K 图像的费用涨到了 0.139 美元(当前汇率大约折合 0.99 元人民币)每张, 4K 图像的费用则是 0.24 美元(当前汇率大约折合 1.7 元人民币)每张。
现今, 免费版本的 Nano Pro 用户有着相应的使用限定额度, 然而, AI Plus、Pro 以及 Ultra 的订阅用户却具备更多的配额数量。另外, 身处美国的 AI Pro 和 Ultra 订阅用户能够借助搜索功能里的“AI 模式”来使用这款模型, 全球范围之内的科研助手用户同样也能够直接进行调用。
当下, Nano Pro 正一点一点地融入到谷歌好些主流的 AI 工具里面:
针对开发者层面, 已然开放接入了 API, 还有 AI, 以及谷歌全新集成开发环境(IDE)。