全部Web服务

Okou上的图像生成

描述你要的画面,直接拿到文件。多个图像模型,不用你自己的图像服务账号,按张计费。

生成 · 无需配置 · 每次成功调用按托管积分计费

在对话里要一张图,文件就回来了。你可以指定尺寸,决定愿意为质量付多少,图像要叠在别的东西上时就要求透明背景,或者干脆给它一张图作底,而不是从空白开始。

可用的模型不止一个,因为它们各有所长,选哪个是提问的一部分,而不是另做一次集成。账号由Okou持有,每张图按积分计费,所以你团队里没人需要保管图像API密钥。

图像生成是什么

让模型出一张能用的图很容易。难的是按同一种风格出五十张,定时产出,再放进页面或演示文稿里,真正的工作量在这儿,而这一段靠的是一条流水线,不是一句提示词。

这里把那条流水线里的生成环节,做成了智能体能调用的东西。提示词进去,文件出来,智能体可以接着把它放进报告、帖子或托管页面,全程不用谁去下载什么。

用哪个模型画很重要。有的更擅长干净的图形设计,有的更擅长写实场景,有的更擅长改你已有的图,还有的单纯就是出草稿更便宜。选哪个是提问的一部分,而质量档位决定一张图的价格。

这和大家在找的「文字转图片API」是同一件事。区别在账号放在哪里:不用注册,不用把密钥塞进环境变量,不用单独一份账单,而且权限是按智能体授予的,不是把一串密钥共享出去。

图像生成能做什么

智能体能用它做什么,做完又会拿回什么。

你给它什么一段描述,也可以再给一张作为底图的图片
你拿回什么一个图片文件,以及智能体可以直接拿去用的链接
可控项尺寸、质量档位、输出格式,以及在支持的模型上生成透明背景
编辑图生图,包括用蒙版指定范围的编辑
模型选择多个图像模型,每次请求单独选

覆盖范围与限制

把它做不到的事先说清楚,免得有人围着能力范围之外的东西去设计工作流。

质量是一道价格选择题

同一段提示词,按质量档位和模型不同,花费差别很大。一张草稿几积分,一张成品可能要几百积分,所以批量生成的工作流应该先便宜地出草稿,再挑着出成品。

图里的文字不可靠

模型写字的能力是有进步,但没有一个是在做排版。凡是文案必须一字不差的地方,都应该放在HTML或设计稿里,图片只作背景。

风格一致要靠参考

同一种风格问两次,得到的是表亲,不是双胞胎。要让一整组图保持同一个调子,就得每次都给模型一张参考图或一段写清楚的风格说明。

内容规则照样生效

模型该拒绝的还是会拒绝,其中包括真人肖像和有版权的角色形象。如果一个工作流非得让这类内容通过,它跑不起来。

图像生成怎么收费

Web服务按调用次数扣积分,不按token计费。也没有另一份厂商账单要对。

计费每次成功调用按托管积分计费
运行在OpenAI, Google and fal.ai models
命令zero generate image

按张计积分,具体多少取决于你选的模型、尺寸和质量档位。一张低质量草稿只要几积分;顶级模型出的大尺寸高质量图可能要几百积分。底下没有图像API订阅,也没有每月最低消费,所以一个月做十二张图的团队,就只为十二张图付费。

产品名称和标识归各自所有者所有,出现在这里只是为了说明某项服务基于什么运行,不代表任何背书或合作关系。

设置与接入

无需设置

没有什么要连接。不用图像模型账号,不用粘贴密钥,也不用单独对一份账单。如果你更想用自己的账号跑某一家服务商,Okou也为其中几家提供了连接器;而内置服务,是给那些干脆不想要这个账号的人用的。

谁可以用

生成文件是按智能体、按人授予的权限。这一项值得多想一步,因为一旦工作流跑起循环,它是最烧积分的那项权限。

团队都用图像生成做什么

给已经自动化的内容配图

一篇博客、一份更新说明、一份周报。写它的智能体可以顺手把头图画了,而不是留个占位图,等人周一来补。

补齐一组风格相关的图

空状态图、分类图标、栏目头图。风格说明给一次,整组生成,出问题的那两张单独重做,不用整批重来。

从手头已有的素材出发

一张草图、一张截图、一张背景不对的产品照。比起从一句空白提示词开始,图生图通常更接近人们真正需要的东西。

什么时候不该用图像生成

图里的文案必须一字不差时别用它,改用HTML来做。要的就是一张真实照片时也别用它,生成的图是另一回事。还有,别在没想清楚质量档位的情况下大批量生成,那是把积分花在没人看的图上最快的方式。

别处怎么称呼它

同一件事在市场上有好几种叫法。如果你比较过其中某一类产品,这里说明它对应到这边的什么能力。

文字转图片API

提示词进去,图片文件出来,通过一个程序能调用的接口完成。就是这个,只不过账号和密钥在我们这边。

免注册的AI图像生成

人们搜这个词时通常想要的就是:不用注册,不用密钥,不用另买套餐。你在对话里说一句,文件就回来了。

图像编辑API

图生图和用蒙版指定范围的编辑,这是从你已有素材出发、而不是从零开始的那一半活儿。

透明背景图像API

生成时不带背景,结果可以直接放到页面、卡片或演示文稿上。部分模型支持,每次请求单独指定。

批量图像生成

要的是一整组而不是一张,这正是智能体体现价值的地方:同一种风格,一个循环跑完,每张的花费都看得见。

图像生成横向对比

图像生成对比自己开一个图像模型账号

模型一样,底下的管路不一样。自己来,就是每家服务商一个账号、一把密钥、一份账单,换模型还得重做一次集成。在这里,只是一次请求里写上模型名,账上多一行积分。

图像生成对比设计工具

设计工具是人带着明确意图去做东西的地方,有字体、有版式、有品牌。这里是工作流在没有人参与的情况下产出图像。多数团队两者都需要,常见的错误是让这一边去做版式。

图像生成对比图库素材

图库单张更便宜,授权清楚,结果可预期,看上去也就是图库的样子。当图必须讲你自己的那件事,或者根本没人有时间去翻素材时,生成才划算。

一句话总结

把一张图放进自动化工作流的办法。草稿便宜地出,成品挑着出,精确的文案别放进图里。

常见问题

我需要OpenAI或fal的账号吗?

不需要。Okou代你执行生成,并按积分计费。整个工作流里不会出现你的任何密钥。

我可以用哪些模型?

跨多家服务商的若干个模型,每次请求单独选,因为它们各有所长。智能体会挑一个合适的默认值,你也可以直接指定。

一张图要多少积分?

按张计积分,取决于模型、尺寸和质量档位。草稿便宜到可以反复改;大尺寸高质量的图才是需要想清楚再出的。

能改我已有的图吗?

可以。把图给它,再描述要改什么;如果只动画面的一部分,就用蒙版。

能要透明背景吗?

可以,在支持的模型上。只要图要放在有颜色的底上,就值得加这个要求。

跑两次会是同一种风格吗?

光跑两次不会。一致性来自每次都给模型同一张参考图或同一段风格说明,这件事智能体很容易做到,人却很容易忘。

生成的图可以商用吗?

图归你使用,前提是遵守模型对可画内容的那套规则。常见会被拒绝的是真人肖像和有版权的角色形象。

这和图像连接器有什么区别?

连接器是在你已经有服务商账号时,用你自己的账号跑。内置服务不用配置,拿来就能用,多数团队只是想要那张图时,要的就是这个。

怎么让智能体用图像生成

你用日常语言说清楚要什么,智能体自己判断该用哪个服务,再去发起调用。

给帖子配图

写一份这周的更新说明,并按前三期同样的风格给它画一张头图。

一整组同风格

给我们的帮助中心画六个分类图标,扁平风格,只用一个点缀色,一眼看得出是同一套。

从现有素材开始

把这张产品照放到干净的中性背景上,再给我一个方形版本用于商品详情页。