
Okou上的视频生成
用一段描述或一张静图,生成几秒钟的视频,有声无声都行。多个视频模型,不用你自己的视频服务账号。
生成 · 无需配置 · 每次成功调用按托管积分计费
描述一个镜头,就能拿回一段几秒钟的片子,分辨率可以很高,可以无声,也可以带上模型自己生成的声音。当运动比想象更重要时,给它一张起始静图,或者给出首帧和尾帧。
可用的模型有好几个,它们在时长、分辨率、声音和价格上各不相同,选哪个是提问的一部分。账号由Okou持有,每条片子按积分计费,所以不会有一份挂在你名下的视频生成套餐。
视频生成是什么
视频生成如今已经够用,足以覆盖那些过去要么外包、要么干脆放弃的短片段:标题后面几秒钟的动态、一个产品瞬间、长片里的一个交代镜头。
这里把那一步做成了一次调用。输入是一段描述,可以再加一张要让它动起来的图,或者一对首尾帧。输出是一个视频文件,智能体可以直接交给下一步,而不是交给某个抱着下载文件夹的人。
这些模型不能互相替换。它们在片长上限、能达到的分辨率、是否自带音频生成、以及参考素材的处理方式上都不一样,价格也跟着这些走。指明用哪个模型,是提问的一部分。
和自己买一份视频生成套餐相比,账号和账单都在Okou这边,使用权是按智能体授予的权限。和视频剪辑软件相比,这里产出的是素材而不是成片,剪辑仍然是你的事。
视频生成能做什么
智能体能用它做什么,做完又会拿回什么。
覆盖范围与限制
把它做不到的事先说清楚,免得有人围着能力范围之外的东西去设计工作流。
单位是秒,不是分钟
一段片子只有几秒。更长的内容是好几段加一次剪辑,也就是说你得去规划镜头,而不是张口要一部片子。
它是这里最贵的一次调用
视频按秒计费,或者按生成的画面量计费,分辨率和声音都会把价格往上推。账单是合理还是吓人,差别就在于有没有先用低分辨率出草稿,再决定跑最终渲染。
渲染是真的要等
一段片子回来要几分钟,不是几秒。要生成好几段的工作流得留出等待时间,正盯着聊天窗口的人也该知道现在发生了什么。
细节上不精确
准确的文字、准确的logo、准确的人脸、准确的产品外形,生成视频到今天还是会在这些地方露馅。凡是必须准确的东西,都该作为叠加层压在画面之上。
视频生成怎么收费
Web服务按调用次数扣积分,不按token计费。也没有另一份厂商账单要对。
zero generate video按段扣积分,价格取决于模型、时长、分辨率,以及这段有没有声音。它是本目录里最贵的服务,而且贵出不少,所以模型和分辨率值得在请求里写明,别交给默认值。
产品名称和标识归各自所有者所有,出现在这里只是为了说明某项服务基于什么运行,不代表任何背书或合作关系。
设置与接入
无需设置
不用连接任何东西。不需要视频模型的账号、密钥或套餐。如果你已经在给某家服务商付费、想把用量记在自己账上,Okou为其中几家提供了连接器;内置服务是给那些压根不想要账号的人准备的。
谁可以用
生成文件是一项权限,按智能体、按人逐个授予。考虑到视频的花费,这项权限值得收着给,只给为此而建的那几个智能体。
团队都用视频生成做什么
给已经写好的内容配一小段动态画面
一条发布帖、一条更新日志、一张社交卡片。写文案的那个智能体可以顺手产出三秒动态画面配上去,而不是只发一张静态图。
让静态图动起来
你手上已有的产品照或插画,加一点轻微的运动,通常比凭空生成的片段更好用,也更贴合品牌。
补上长片剪辑里的缺口
一个没人愿意去拍的定场镜头或转场。把缺的那几秒生成出来,剪进你已经做好的片子里。
什么时候不该用视频生成
如果这段画面必须一字不差地说清什么,就别用它,把文字放到剪辑里叠上去。超过几秒的内容也别想着一次调用搞定,那是好几段片子加一份计划。还有,别把它设成高频定时工作流里的默认步骤,那里的费用涨得比人审片的速度快得多。
别处怎么称呼它
同一件事在市场上有好几种叫法。如果你比较过其中某一类产品,这里说明它对应到这边的什么能力。
文生视频API
输入一段描述,输出一个视频文件,通过程序可以调用的接口完成。说的就是这件事,只是账号和密钥在我们这边。
图生视频API
从一张静态图出发,要一段运动。多数团队真正想要的是这个版本,因为画面里的主体本来就是他们自己的。
不用注册账号的AI视频生成
不用注册、不用密钥、不用包月。你在对话里说一句,文件就回来了,按段扣积分。
AI空镜素材
剪辑里用来填充的短素材。生成的片段最擅长的就是这件事,最不擅长的是任何必须精确的东西。
数字人口播视频
一件相关但不同的活:一位主讲人照稿念,由形象和声音生成,而不是由一段场景描述生成。Okou也能做,走的是同一套命令。
视频生成横向对比
视频生成对比自己开一个视频模型账号
模型一样,区别在管理成本。自己来,就是每家服务商一个账号、一个密钥、一份账单,想换个模型就是一次集成。在这里,模型写在请求里,用量落在同一条积分记录上。
视频生成对比视频剪辑软件
剪辑软件负责组接、卡时间、加字幕。这里产出的是原始素材。好的配合是:没人能拍的镜头交给它,决定片子要说什么的部分交给剪辑。
视频生成对比素材库视频
素材库更便宜、有授权、也更稳妥,代价是它看起来就像素材库。只有当镜头必须是关于你自己那件具体的东西,或者这个镜头根本不存在时,生成才对得起它的价格。
一句话总结
给已经产出文案的工作流配上一小段生成画面。先出小样,写明模型,凡是必须准确的东西都用叠加层解决,别指望提示词。
常见问题
我需要有视频模型的账号吗?
不需要。生成由Okou来跑,按积分计费。你这边不需要服务商账号、密钥或套餐。
一段片子最长能有多久?
几秒,具体上限看模型。更长的内容是好几段加一次剪辑。
可以从一张图开始吗?
可以。给一张参考图,部分模型还支持给首帧和尾帧,这是让运动最可预期的做法。
会生成声音吗?
有的模型会自己生成音频,有的是无声的。带声音通常更贵,所以值得明确决定,而不是用默认。
一段片子要花多少?
按段扣积分,由时长、分辨率、有无声音和模型决定。它是本目录里最贵的服务,常规做法是先跑一版低分辨率草稿,把花费控住。
要等多久?
几分钟,不是几秒。要生成好几段的工作流应当按会等来设计,并且告诉正在看的人一声。
可以在视频里加文字吗?
靠提示词做不稳。先生成画面,文字在剪辑里加,这样每次都不会错。
能做出对着镜头讲话的主讲人吗?
那走的是数字人口播那条路,不是这条:一份稿子,加上选好的形象和声音,用同一套命令生成,计费方式也一样。
怎么让智能体用视频生成
你用日常语言说清楚要什么,智能体自己判断该用哪个服务,再去发起调用。
“做一段六秒无声视频:一架纸飞机在黄昏暖光里飞过城市,1080p,把文件给我。”
“用这张产品照,给我四秒缓慢推近,不要声音,别的都不动。”
“我需要三秒清晨空办公室的画面,剪在两段采访中间。先出个小样,我看看感觉。”

