全部Web服务

Okou上的视频生成

用一段描述或一张静图,生成几秒钟的视频,有声无声都行。多个视频模型,不用你自己的视频服务账号。

生成 · 无需配置 · 每次成功调用按托管积分计费

描述一个镜头,就能拿回一段几秒钟的片子,分辨率可以很高,可以无声,也可以带上模型自己生成的声音。当运动比想象更重要时,给它一张起始静图,或者给出首帧和尾帧。

可用的模型有好几个,它们在时长、分辨率、声音和价格上各不相同,选哪个是提问的一部分。账号由Okou持有,每条片子按积分计费,所以不会有一份挂在你名下的视频生成套餐。

视频生成是什么

视频生成如今已经够用,足以覆盖那些过去要么外包、要么干脆放弃的短片段:标题后面几秒钟的动态、一个产品瞬间、长片里的一个交代镜头。

这里把那一步做成了一次调用。输入是一段描述,可以再加一张要让它动起来的图,或者一对首尾帧。输出是一个视频文件,智能体可以直接交给下一步,而不是交给某个抱着下载文件夹的人。

这些模型不能互相替换。它们在片长上限、能达到的分辨率、是否自带音频生成、以及参考素材的处理方式上都不一样,价格也跟着这些走。指明用哪个模型,是提问的一部分。

和自己买一份视频生成套餐相比,账号和账单都在Okou这边,使用权是按智能体授予的权限。和视频剪辑软件相比,这里产出的是素材而不是成片,剪辑仍然是你的事。

视频生成能做什么

智能体能用它做什么,做完又会拿回什么。

你给它什么一段描述,也可以再加一张参考图,或者首帧和尾帧
拿到什么一个视频文件,附一个链接,智能体可以直接拿去用
时长和尺寸每段几秒,从标准分辨率到部分模型支持的4k
声音看模型,有的无声,有的会自己生成音频
模型选择多个视频模型,每次请求单独指定

覆盖范围与限制

把它做不到的事先说清楚,免得有人围着能力范围之外的东西去设计工作流。

单位是秒,不是分钟

一段片子只有几秒。更长的内容是好几段加一次剪辑,也就是说你得去规划镜头,而不是张口要一部片子。

它是这里最贵的一次调用

视频按秒计费,或者按生成的画面量计费,分辨率和声音都会把价格往上推。账单是合理还是吓人,差别就在于有没有先用低分辨率出草稿,再决定跑最终渲染。

渲染是真的要等

一段片子回来要几分钟,不是几秒。要生成好几段的工作流得留出等待时间,正盯着聊天窗口的人也该知道现在发生了什么。

细节上不精确

准确的文字、准确的logo、准确的人脸、准确的产品外形,生成视频到今天还是会在这些地方露馅。凡是必须准确的东西,都该作为叠加层压在画面之上。

视频生成怎么收费

Web服务按调用次数扣积分,不按token计费。也没有另一份厂商账单要对。

计费每次成功调用按托管积分计费
运行在MiniMax, BytePlus and fal.ai models
命令zero generate video

按段扣积分,价格取决于模型、时长、分辨率,以及这段有没有声音。它是本目录里最贵的服务,而且贵出不少,所以模型和分辨率值得在请求里写明,别交给默认值。

产品名称和标识归各自所有者所有,出现在这里只是为了说明某项服务基于什么运行,不代表任何背书或合作关系。

设置与接入

无需设置

不用连接任何东西。不需要视频模型的账号、密钥或套餐。如果你已经在给某家服务商付费、想把用量记在自己账上,Okou为其中几家提供了连接器;内置服务是给那些压根不想要账号的人准备的。

谁可以用

生成文件是一项权限,按智能体、按人逐个授予。考虑到视频的花费,这项权限值得收着给,只给为此而建的那几个智能体。

团队都用视频生成做什么

给已经写好的内容配一小段动态画面

一条发布帖、一条更新日志、一张社交卡片。写文案的那个智能体可以顺手产出三秒动态画面配上去,而不是只发一张静态图。

让静态图动起来

你手上已有的产品照或插画,加一点轻微的运动,通常比凭空生成的片段更好用,也更贴合品牌。

补上长片剪辑里的缺口

一个没人愿意去拍的定场镜头或转场。把缺的那几秒生成出来,剪进你已经做好的片子里。

什么时候不该用视频生成

如果这段画面必须一字不差地说清什么,就别用它,把文字放到剪辑里叠上去。超过几秒的内容也别想着一次调用搞定,那是好几段片子加一份计划。还有,别把它设成高频定时工作流里的默认步骤,那里的费用涨得比人审片的速度快得多。

别处怎么称呼它

同一件事在市场上有好几种叫法。如果你比较过其中某一类产品,这里说明它对应到这边的什么能力。

文生视频API

输入一段描述,输出一个视频文件,通过程序可以调用的接口完成。说的就是这件事,只是账号和密钥在我们这边。

图生视频API

从一张静态图出发,要一段运动。多数团队真正想要的是这个版本,因为画面里的主体本来就是他们自己的。

不用注册账号的AI视频生成

不用注册、不用密钥、不用包月。你在对话里说一句,文件就回来了,按段扣积分。

AI空镜素材

剪辑里用来填充的短素材。生成的片段最擅长的就是这件事,最不擅长的是任何必须精确的东西。

数字人口播视频

一件相关但不同的活:一位主讲人照稿念,由形象和声音生成,而不是由一段场景描述生成。Okou也能做,走的是同一套命令。

视频生成横向对比

视频生成对比自己开一个视频模型账号

模型一样,区别在管理成本。自己来,就是每家服务商一个账号、一个密钥、一份账单,想换个模型就是一次集成。在这里,模型写在请求里,用量落在同一条积分记录上。

视频生成对比视频剪辑软件

剪辑软件负责组接、卡时间、加字幕。这里产出的是原始素材。好的配合是:没人能拍的镜头交给它,决定片子要说什么的部分交给剪辑。

视频生成对比素材库视频

素材库更便宜、有授权、也更稳妥,代价是它看起来就像素材库。只有当镜头必须是关于你自己那件具体的东西,或者这个镜头根本不存在时,生成才对得起它的价格。

一句话总结

给已经产出文案的工作流配上一小段生成画面。先出小样,写明模型,凡是必须准确的东西都用叠加层解决,别指望提示词。

常见问题

我需要有视频模型的账号吗?

不需要。生成由Okou来跑,按积分计费。你这边不需要服务商账号、密钥或套餐。

一段片子最长能有多久?

几秒,具体上限看模型。更长的内容是好几段加一次剪辑。

可以从一张图开始吗?

可以。给一张参考图,部分模型还支持给首帧和尾帧,这是让运动最可预期的做法。

会生成声音吗?

有的模型会自己生成音频,有的是无声的。带声音通常更贵,所以值得明确决定,而不是用默认。

一段片子要花多少?

按段扣积分,由时长、分辨率、有无声音和模型决定。它是本目录里最贵的服务,常规做法是先跑一版低分辨率草稿,把花费控住。

要等多久?

几分钟,不是几秒。要生成好几段的工作流应当按会等来设计,并且告诉正在看的人一声。

可以在视频里加文字吗?

靠提示词做不稳。先生成画面,文字在剪辑里加,这样每次都不会错。

能做出对着镜头讲话的主讲人吗?

那走的是数字人口播那条路,不是这条:一份稿子,加上选好的形象和声音,用同一套命令生成,计费方式也一样。

怎么让智能体用视频生成

你用日常语言说清楚要什么,智能体自己判断该用哪个服务,再去发起调用。

给发布配动态画面

做一段六秒无声视频:一架纸飞机在黄昏暖光里飞过城市,1080p,把文件给我。

让静态图动起来

用这张产品照,给我四秒缓慢推近,不要声音,别的都不动。

补上剪辑里的缺口

我需要三秒清晨空办公室的画面,剪在两段采访中间。先出个小样,我看看感觉。