I2V Studio – 基于 Google Flow 的自动 AI 视频生成工具
输入一个想法,得到一条完整视频。软件在你的电脑上运行,使用你自己的谷歌账号 —— 授权一次性买断,不按视频计费。

软件介绍
I2V Studio 是安装在你电脑上的桌面软件。你输入一个想法,软件用你自己的谷歌账号打开 Chrome,向 Gemini 或 ChatGPT 取脚本,在 Google Flow 生成片段,配上旁白,压制字幕,再合成一条完整视频。没有中间服务器,没有人保管你的账号。
与网页版 AI 视频服务不同,你只需一次性购买永久授权。生成额度用的是你已经购买的 Google AI Pro 或 Ultra 套餐额度 —— 软件只在事前估算一条视频要花多少额度、你的账号还剩多少,然后把决定权交给你。
软件内置 96 个现成脚本模板,按行业分类:服装配饰、美妆、健康健身、餐饮、图书、科技、农业以及带货广告,后续更新还会继续增加新模板。每个模板是一种做视频的方式。选好模板后,软件会问它的聊天机器人今天有哪些值得做的主题;你从列表中挑选,审阅脚本,然后才开始消耗额度。
项目、导出的视频和谷歌登录会话都在你自己的硬盘上。授权售出之后软件不再收取任何费用,也绝不接触你的密码 —— 它只是打开一个 Chrome 窗口,等你登录完成。
演示视频
I2V Studio 演示:从一个想法到一条完整视频
在 YouTube 上观看演示视频时长: 3:22
演示:在 Google Flow 上自动生成 AI 视频
在 YouTube 上观看演示视频时长: 3:03
一个想法、五个步骤、一条完整视频
创作界面分成五个清晰阶段:选聊天机器人(脚本模板)、选主题、审阅脚本、生成视频、发布。前两步不消耗谷歌额度,所以可以放心先看再决定。
在选主题这一步,软件用你的谷歌账号打开该模板的聊天机器人,问它今天有什么值得做,通常半分钟左右就有回复。你可以从返回的列表里挑,也可以自己输入主题;还能把时长锁定在 30 到 180 秒之间,并事先为每个角色指定音色,让所有分镜的声音保持一致。
返回的脚本会拆成一个个分镜,每个分镜都有自己的旁白、给生成模型用的英文提示词和时间码。这里是消耗额度前的关口:你逐个分镜阅读,修改旁白、修改提示词、增删分镜,或者让 AI 重写整份脚本。
片段生成在 Google Flow 上运行,共四个视频模型:Omni 1.1 Flash(可选 4、6、8 或 10 秒,每次 7–15 额度)、Veo 3.1 Lite(10 额度)、Veo 3.1 Fast 与 Veo 3.1 Quality。选哪个由你决定,软件会在你确认之前显示价格。
并非每个模板都严格走这五步。带货模板会把主题推荐换成一张填写产品信息的表单;有多种处理方式的模板则会多插入一步让你选择做法。进度条按模板变化,而不是把所有项目塞进同一个框架。

先看到每一个画面,再花额度
走图片路线的模板,第三步叫“审阅脚本与图片”,并分成两个阶段。第一阶段用 Google Flow 上的 Nano Banana 为每个分镜生成静态图,软件明确写着这一阶段不扣额度,所以尽管挑最好的画质档位,反复重生成到满意为止。
你先确认眼前这组图片,再进入第二阶段:选视频模型,看软件报出需要多少额度,然后才把图片变成片段。你花额度生成的,是你已经看过并认可的画面,而不是一次赌博。
修改某个分镜的图片提示词,会同时作废旧图片和由它生成的片段 —— 软件就写在输入框下方,而不是让你从额度账单里才发现。
右侧面板在开跑前会先汇总这一批:多少个分镜、即将生成几张图、花费多少。分镜图还会接力生成,让场景和光线不会一镜一个样。

分镜工作台:只改需要改的那一个分镜
每个项目都会打开一个工作台:当前分镜的预览画面、分镜时间轴,以及右侧用于编辑该分镜内容、片段、音频和字幕的栏位。
这里最能省额度。模型把某个分镜做坏了,你就改那个分镜的提示词再重新生成 —— 软件会显示这次重新生成要花多少额度。其余做得好的分镜保持原样,不必整条重做。
旁白、配音和字幕也在同一处修改。给某个分镜换配音、修正模型读错的一句字幕,然后重新导出 —— 没有改动的部分不会重新生成。
时间轴标明哪些分镜已有片段、哪些还没有、哪些已有字幕。发布之前可以复制分镜、新增分镜或删除多余分镜。

96 个现成模板,一个模板一种视频风格
模板库就在创作界面的第一步。每个模板都是一套独立的写稿大脑 —— 一套人设、一套脚本框架和自己的插图 —— 对应一种视频风格:带货测评、动画角色、火柴人讲故事、第一视角生活窍门、图书推荐、虚拟健身教练等等。
网格按九个行业分类,每个标签都标着该行业有多少个模板,搜索框还支持不带声调的越南语。点一下卡片就能试看这个模板做出来的视频是什么样,再点一下停止。选好模板之后软件才去问聊天机器人,这一整段都不消耗任何额度。
“自定义模板”按钮会打开一块面板,在你正式开做之前讲清楚这个模板怎么做视频:每个分镜几秒、视频是保留 Veo 生成的原声还是配旁白、后一个分镜是否接着前一个分镜的末帧、追加到每条提示词后面的画面风格段落,以及聊天机器人学习用的范例库。其中七个模板可以用一张参考图固定角色,让角色在多条视频里保持同一形象。
内置模板的内容随安装包发布,并且刻意不开放修改:只要改动一条范例提示词,整个模板的脚本框架就会走样,而且下一次更新也会把它覆盖掉。作为交换,每次更新通常都会往模板库里添加新模板,覆盖安装后直接就能用,不用另外付费。真正属于你的是每个模板的角色照片 —— 它保存在你电脑上的数据目录里,所以覆盖安装更新不会动到它。

为频道固定角色:每条视频都是同一个人
每个模板都有自己的自定义面板,其中最有价值的是频道的角色图。生成片段时软件会把这张图挂到每一个分镜上,所以所有分镜出来都是同一个人。没有它,Google Flow 会按文字为每个分镜重新想象一张脸 —— 衣服对得上,脸却会飘。
角色图在软件内生成,不消耗谷歌额度:软件用你的账号打开 Flow,直接按角色描述要一张全身肖像。想更贴近心中形象,也可以自己上传 —— 站直、正对镜头、背景干净、画面里没有别人。
角色描述用英文书写,并被原样复制到每一条图片提示词的开头。修改它时,软件会连模板示例提示词里的前缀一起改写,因为聊天机器人学的是示例而不是叮嘱 —— 旧示例不改,你的修改就不生效。
同一个面板里还有画面风格(追加到每条图片提示词末尾,让所有分镜保持同一质感)、模板的分镜节奏,以及视频里声音的处理方式。内置模板正是在这里变成你自己的频道。

配音:五个来源,字幕逐词对齐
Edge 是默认来源:8 个越南语、英语、日语、韩语、中文配音,免费,无需申请,并且会返回逐词时间点,字幕能精确对齐。
CapCut 另外提供 24 个有性格的越南语配音 —— 新闻播报、影评、讲故事 —— 而不是平淡的朗读。同样免费、无需申请,但走的是非官方通道,所以软件明确说明它随时可能停止可用。
Piper 与 VieNeu 完全在本机运行:每个配音按一次下载(20–63 MB),之后不需要网络,也没有人统计使用次数。代价是这两个来源不返回时间点,字幕只能按词长平均分配 —— 在长短词交错的句子里会略有偏差,界面会先说明而不是隐瞒。
ElevenLabs 音质最好,使用你自己的 API 密钥,并由 ElevenLabs 按字符计费。密钥保存在你本机的数据目录中,且绝不会完整回显到界面上。尚未就绪的配音会在确认时就被拦下,而不是等到合成阶段 —— 避免整批渲染额度浪费在最后一步失败的视频上。

在你的电脑上运行,用你的谷歌账号
谷歌账号由你自己添加。软件打开一个空白 Chrome 窗口,你照常登录,登录完成的那一刻软件就会察觉并替你关掉窗口。它绝不接触你的密码 —— 只是打开窗口然后等待。
每个账号有自己独立的 Chrome 目录,因此多个账号可以并行运行:在 Windows 11 上实测,8 个 Chrome 窗口启动共需 8.2 秒,每个占用 0.6–1 GB 内存,16 GB 内存的机器大约可同时承载 13 个。
项目、授权和导出的视频都放在本机的软件数据目录里,而不是放在可执行文件旁边 —— 所以更新时覆盖安装不会动到你的成果。导出目录可以在设置里更改。
授权按机器码激活:一次购买,永久使用;更换电脑时先在旧机上解除授权,再在新机上激活,全部在软件内完成。更新直接从授权服务器下载,并校验 checksum。

主要功能
- 从想法到视频的五个步骤:选模板、选主题、审阅脚本、生成、发布
- 聊天机器人推荐今天值得做的主题,也可以自己输入主题
- 把视频时长锁定在 30 到 180 秒之间,或交给聊天机器人决定
- 为每个角色指定音色,让所有分镜的声音保持一致
- 96 个现成脚本模板,按九个行业分类,每次更新都会继续增加,可快速筛选,搜索支持不带声调的越南语
- 直接用你自己的账号向 Gemini 或 ChatGPT 取脚本,不经中间服务器
- 点任意一张模板卡片,就能在选定之前试看它做出来的视频是什么样
- 在 Google Flow 上用四个模型生成片段:Omni 1.1 Flash(4/6/8/10 秒)、Veo 3.1 Lite、Fast 与 Quality
- 先用 Nano Banana 为每个分镜生成静态图并确认(不扣额度),再把图片变成片段
- 三个图片档位:Nano Banana Pro、Nano Banana 2 与 Nano Banana 2 Lite
- 共用的产品参考图库:上传一次,每个项目可挂最多 4 张图,让模型不画错你的产品
- 分镜工作台:逐个分镜预览、修改提示词、只重新生成该分镜而不是整条视频
- 五个配音来源:Edge、CapCut、本机运行的 Piper 与 VieNeu,以及使用你自己密钥的 ElevenLabs
- 逐词对齐的字幕压制进视频,位置与字体可配置
- 生成前的额度估算:这条视频需要多少,你的账号还剩多少
- 去除已生成的 Gemini 与 Veo 片段、图片上的水印(Windows 版功能完整)
- 多个 Chrome 窗口并行,每个谷歌账号使用独立目录
- 软件内的成品库:回看、下载、打开视频目录、重开项目导出新版本
- 独立的文字转语音工具:粘贴脚本或导入 .txt/.srt,选配音,得到音频文件
- 账号列表丢失时,可恢复本机上已有的谷歌账号
- 浅色与深色主题,越南语与英语界面,记住窗口尺寸
- 软件内更新,从授权服务器下载并在运行前校验 checksum
使用的技术
Python 3.14 + FastAPI + pywebview + Playwright(Chromium)+ ffmpeg,使用 PyInstaller 与 Inno Setup 打包
界面截图
1 / 29
注意事项
- 原价 1,500,000 越南盾,现优惠至 1,000,000 越南盾。
- 永久授权:一次购买,永久使用,直到产品停售之前免费更新。
- 每个授权在一台机器上激活。更换电脑时先在旧机解除授权,再在新机激活,全部在软件内完成。
- 购买之后软件不再收取任何费用。生成额度用的是你自己的 Google AI Pro 或 Ultra 套餐额度。
- CMSNT 不保管你的谷歌账号:由你自行添加并登录,软件绝不接触你的密码。
- 每个账号的 Chrome 目录与创建它的机器绑定,无法拷贝到别处 —— 更换电脑意味着重新登录。
- 片段生成走 Google Flow 的网页界面。谷歌改动该界面时需要软件更新;更新在“授权”页面下载。
- 去水印功能在 Windows 上完整可用;macOS 版本尚无对应的原生工具。
- 鉴于数字产品的特殊性——授权密钥在付款后即完成交付并可立即使用——授权许可发放后我们不予退款,但因产品自身技术缺陷且我们在合理期限内无法修复的情形除外。
- 服务政策: 点此查看.
准备好实现在线业务自动化了吗?
联系 CMSNT,获取产品建议、深入演示和免费首次部署。