I2VSTUDIO桌面软件新品

I2V Studio – 基于 Google Flow 的自动 AI 视频生成工具

输入一个想法,得到一条完整视频。软件在你的电脑上运行,使用你自己的谷歌账号 —— 授权一次性买断,不按视频计费。

I2V Studio – 基于 Google Flow 的自动 AI 视频生成工具

软件介绍

I2V Studio 是安装在你电脑上的桌面软件。你输入一个想法,软件用你自己的谷歌账号打开 Chrome,向 Gemini 或 ChatGPT 取脚本,在 Google Flow 生成片段,配上旁白,压制字幕,再合成一条完整视频。没有中间服务器,没有人保管你的账号。

与网页版 AI 视频服务不同,你只需一次性购买永久授权。生成额度用的是你已经购买的 Google AI Pro 或 Ultra 套餐额度 —— 软件只在事前估算一条视频要花多少额度、你的账号还剩多少,然后把决定权交给你。

软件内置 96 个现成脚本模板,按行业分类:服装配饰、美妆、健康健身、餐饮、图书、科技、农业以及带货广告,后续更新还会继续增加新模板。每个模板是一种做视频的方式。选好模板后,软件会问它的聊天机器人今天有哪些值得做的主题;你从列表中挑选,审阅脚本,然后才开始消耗额度。

项目、导出的视频和谷歌登录会话都在你自己的硬盘上。授权售出之后软件不再收取任何费用,也绝不接触你的密码 —— 它只是打开一个 Chrome 窗口,等你登录完成。

演示视频

I2V Studio 演示:从一个想法到一条完整视频

在 YouTube 上观看演示视频时长: 3:22

演示:在 Google Flow 上自动生成 AI 视频

在 YouTube 上观看演示视频时长: 3:03

一个想法、五个步骤、一条完整视频

创作界面分成五个清晰阶段:选聊天机器人(脚本模板)、选主题、审阅脚本、生成视频、发布。前两步不消耗谷歌额度,所以可以放心先看再决定。

在选主题这一步,软件用你的谷歌账号打开该模板的聊天机器人,问它今天有什么值得做,通常半分钟左右就有回复。你可以从返回的列表里挑,也可以自己输入主题;还能把时长锁定在 30 到 180 秒之间,并事先为每个角色指定音色,让所有分镜的声音保持一致。

返回的脚本会拆成一个个分镜,每个分镜都有自己的旁白、给生成模型用的英文提示词和时间码。这里是消耗额度前的关口:你逐个分镜阅读,修改旁白、修改提示词、增删分镜,或者让 AI 重写整份脚本。

片段生成在 Google Flow 上运行,共四个视频模型:Omni 1.1 Flash(可选 4、6、8 或 10 秒,每次 7–15 额度)、Veo 3.1 Lite(10 额度)、Veo 3.1 Fast 与 Veo 3.1 Quality。选哪个由你决定,软件会在你确认之前显示价格。

并非每个模板都严格走这五步。带货模板会把主题推荐换成一张填写产品信息的表单;有多种处理方式的模板则会多插入一步让你选择做法。进度条按模板变化,而不是把所有项目塞进同一个框架。

I2V Studio 的选模板步骤,展示按行业分类的 96 个现成脚本模板
第一步和第二步不消耗谷歌额度。模板网格可按行业筛选,点一下卡片即可试看样片。截图为越南语界面,软件同样支持英文界面。

先看到每一个画面,再花额度

走图片路线的模板,第三步叫“审阅脚本与图片”,并分成两个阶段。第一阶段用 Google Flow 上的 Nano Banana 为每个分镜生成静态图,软件明确写着这一阶段不扣额度,所以尽管挑最好的画质档位,反复重生成到满意为止。

你先确认眼前这组图片,再进入第二阶段:选视频模型,看软件报出需要多少额度,然后才把图片变成片段。你花额度生成的,是你已经看过并认可的画面,而不是一次赌博。

修改某个分镜的图片提示词,会同时作废旧图片和由它生成的片段 —— 软件就写在输入框下方,而不是让你从额度账单里才发现。

右侧面板在开跑前会先汇总这一批:多少个分镜、即将生成几张图、花费多少。分镜图还会接力生成,让场景和光线不会一镜一个样。

I2V Studio 的审阅脚本与图片步骤:分镜列表、图片提示词与整批图片的费用面板
两个阶段中的第一阶段:先出图,不扣额度。额度只在下一阶段消耗,那时整组图片已经摆在你面前。

分镜工作台:只改需要改的那一个分镜

每个项目都会打开一个工作台:当前分镜的预览画面、分镜时间轴,以及右侧用于编辑该分镜内容、片段、音频和字幕的栏位。

这里最能省额度。模型把某个分镜做坏了,你就改那个分镜的提示词再重新生成 —— 软件会显示这次重新生成要花多少额度。其余做得好的分镜保持原样,不必整条重做。

旁白、配音和字幕也在同一处修改。给某个分镜换配音、修正模型读错的一句字幕,然后重新导出 —— 没有改动的部分不会重新生成。

时间轴标明哪些分镜已有片段、哪些还没有、哪些已有字幕。发布之前可以复制分镜、新增分镜或删除多余分镜。

I2V Studio 分镜工作台:预览画面、视频提示词与分镜时间轴
改一个分镜的提示词,只重新生成这一个分镜。软件会在你按下按钮前写明所需额度。

96 个现成模板,一个模板一种视频风格

模板库就在创作界面的第一步。每个模板都是一套独立的写稿大脑 —— 一套人设、一套脚本框架和自己的插图 —— 对应一种视频风格:带货测评、动画角色、火柴人讲故事、第一视角生活窍门、图书推荐、虚拟健身教练等等。

网格按九个行业分类,每个标签都标着该行业有多少个模板,搜索框还支持不带声调的越南语。点一下卡片就能试看这个模板做出来的视频是什么样,再点一下停止。选好模板之后软件才去问聊天机器人,这一整段都不消耗任何额度。

“自定义模板”按钮会打开一块面板,在你正式开做之前讲清楚这个模板怎么做视频:每个分镜几秒、视频是保留 Veo 生成的原声还是配旁白、后一个分镜是否接着前一个分镜的末帧、追加到每条提示词后面的画面风格段落,以及聊天机器人学习用的范例库。其中七个模板可以用一张参考图固定角色,让角色在多条视频里保持同一形象。

内置模板的内容随安装包发布,并且刻意不开放修改:只要改动一条范例提示词,整个模板的脚本框架就会走样,而且下一次更新也会把它覆盖掉。作为交换,每次更新通常都会往模板库里添加新模板,覆盖安装后直接就能用,不用另外付费。真正属于你的是每个模板的角色照片 —— 它保存在你电脑上的数据目录里,所以覆盖安装更新不会动到它。

I2V Studio 的 96 个脚本模板库:按行业筛选的标签带数量,模板卡片标着名称和分类标签
行业标签自带数量;选中一个模板后按“自定义模板”,就能看到它是怎么做视频的。

为频道固定角色:每条视频都是同一个人

每个模板都有自己的自定义面板,其中最有价值的是频道的角色图。生成片段时软件会把这张图挂到每一个分镜上,所以所有分镜出来都是同一个人。没有它,Google Flow 会按文字为每个分镜重新想象一张脸 —— 衣服对得上,脸却会飘。

角色图在软件内生成,不消耗谷歌额度:软件用你的账号打开 Flow,直接按角色描述要一张全身肖像。想更贴近心中形象,也可以自己上传 —— 站直、正对镜头、背景干净、画面里没有别人。

角色描述用英文书写,并被原样复制到每一条图片提示词的开头。修改它时,软件会连模板示例提示词里的前缀一起改写,因为聊天机器人学的是示例而不是叮嘱 —— 旧示例不改,你的修改就不生效。

同一个面板里还有画面风格(追加到每条图片提示词末尾,让所有分镜保持同一质感)、模板的分镜节奏,以及视频里声音的处理方式。内置模板正是在这里变成你自己的频道。

I2V Studio 的模板自定义面板,包含频道角色图与其英文角色描述
角色图会挂到每一个分镜上,让所有分镜都是同一个人;用 AI 生成这张图不消耗谷歌额度。

配音:五个来源,字幕逐词对齐

Edge 是默认来源:8 个越南语、英语、日语、韩语、中文配音,免费,无需申请,并且会返回逐词时间点,字幕能精确对齐。

CapCut 另外提供 24 个有性格的越南语配音 —— 新闻播报、影评、讲故事 —— 而不是平淡的朗读。同样免费、无需申请,但走的是非官方通道,所以软件明确说明它随时可能停止可用。

Piper 与 VieNeu 完全在本机运行:每个配音按一次下载(20–63 MB),之后不需要网络,也没有人统计使用次数。代价是这两个来源不返回时间点,字幕只能按词长平均分配 —— 在长短词交错的句子里会略有偏差,界面会先说明而不是隐瞒。

ElevenLabs 音质最好,使用你自己的 API 密钥,并由 ElevenLabs 按字符计费。密钥保存在你本机的数据目录中,且绝不会完整回显到界面上。尚未就绪的配音会在确认时就被拦下,而不是等到合成阶段 —— 避免整批渲染额度浪费在最后一步失败的视频上。

I2V Studio 的配音界面,包含免费的 Edge 分组与越南语 CapCut 分组
选之前可以试听。本机配音各有下载按钮,并写明模型体积。

在你的电脑上运行,用你的谷歌账号

谷歌账号由你自己添加。软件打开一个空白 Chrome 窗口,你照常登录,登录完成的那一刻软件就会察觉并替你关掉窗口。它绝不接触你的密码 —— 只是打开窗口然后等待。

每个账号有自己独立的 Chrome 目录,因此多个账号可以并行运行:在 Windows 11 上实测,8 个 Chrome 窗口启动共需 8.2 秒,每个占用 0.6–1 GB 内存,16 GB 内存的机器大约可同时承载 13 个。

项目、授权和导出的视频都放在本机的软件数据目录里,而不是放在可执行文件旁边 —— 所以更新时覆盖安装不会动到你的成果。导出目录可以在设置里更改。

授权按机器码激活:一次购买,永久使用;更换电脑时先在旧机上解除授权,再在新机上激活,全部在软件内完成。更新直接从授权服务器下载,并校验 checksum。

I2V Studio 首页,显示项目数量、谷歌账号、授权状态与本机配音包
首页只回答一个问题:这台机器能不能开始做视频。缺什么,它就说缺什么。

主要功能

  • 从想法到视频的五个步骤:选模板、选主题、审阅脚本、生成、发布
  • 聊天机器人推荐今天值得做的主题,也可以自己输入主题
  • 把视频时长锁定在 30 到 180 秒之间,或交给聊天机器人决定
  • 为每个角色指定音色,让所有分镜的声音保持一致
  • 96 个现成脚本模板,按九个行业分类,每次更新都会继续增加,可快速筛选,搜索支持不带声调的越南语
  • 直接用你自己的账号向 Gemini 或 ChatGPT 取脚本,不经中间服务器
  • 点任意一张模板卡片,就能在选定之前试看它做出来的视频是什么样
  • 在 Google Flow 上用四个模型生成片段:Omni 1.1 Flash(4/6/8/10 秒)、Veo 3.1 Lite、Fast 与 Quality
  • 先用 Nano Banana 为每个分镜生成静态图并确认(不扣额度),再把图片变成片段
  • 三个图片档位:Nano Banana Pro、Nano Banana 2 与 Nano Banana 2 Lite
  • 共用的产品参考图库:上传一次,每个项目可挂最多 4 张图,让模型不画错你的产品
  • 分镜工作台:逐个分镜预览、修改提示词、只重新生成该分镜而不是整条视频
  • 五个配音来源:Edge、CapCut、本机运行的 Piper 与 VieNeu,以及使用你自己密钥的 ElevenLabs
  • 逐词对齐的字幕压制进视频,位置与字体可配置
  • 生成前的额度估算:这条视频需要多少,你的账号还剩多少
  • 去除已生成的 Gemini 与 Veo 片段、图片上的水印(Windows 版功能完整)
  • 多个 Chrome 窗口并行,每个谷歌账号使用独立目录
  • 软件内的成品库:回看、下载、打开视频目录、重开项目导出新版本
  • 独立的文字转语音工具:粘贴脚本或导入 .txt/.srt,选配音,得到音频文件
  • 账号列表丢失时,可恢复本机上已有的谷歌账号
  • 浅色与深色主题,越南语与英语界面,记住窗口尺寸
  • 软件内更新,从授权服务器下载并在运行前校验 checksum

使用的技术

Python 3.14 + FastAPI + pywebview + Playwright(Chromium)+ ffmpeg,使用 PyInstaller 与 Inno Setup 打包

界面截图

1 / 29

注意事项

  • 原价 1,500,000 越南盾,现优惠至 1,000,000 越南盾。
  • 永久授权:一次购买,永久使用,直到产品停售之前免费更新。
  • 每个授权在一台机器上激活。更换电脑时先在旧机解除授权,再在新机激活,全部在软件内完成。
  • 购买之后软件不再收取任何费用。生成额度用的是你自己的 Google AI Pro 或 Ultra 套餐额度。
  • CMSNT 不保管你的谷歌账号:由你自行添加并登录,软件绝不接触你的密码。
  • 每个账号的 Chrome 目录与创建它的机器绑定,无法拷贝到别处 —— 更换电脑意味着重新登录。
  • 片段生成走 Google Flow 的网页界面。谷歌改动该界面时需要软件更新;更新在“授权”页面下载。
  • 去水印功能在 Windows 上完整可用;macOS 版本尚无对应的原生工具。
  • 鉴于数字产品的特殊性——授权密钥在付款后即完成交付并可立即使用——授权许可发放后我们不予退款,但因产品自身技术缺陷且我们在合理期限内无法修复的情形除外。
  • 服务政策: 点此查看.
启动项目

准备好实现在线业务自动化了吗?

联系 CMSNT,获取产品建议、深入演示和免费首次部署。

按需求提供建议免费在线演示及时技术支持