桌面软件新品I2V Studio – 基于 Google Flow 的自动 AI 视频生成工具
I2V Studio 把 AI 视频的整条流程自动化:向 Gemini 或 ChatGPT 取脚本、在 Google Flow 生成片段、配音、压制字幕并合成完整视频。全部在你的电脑上运行,使用你自己的谷歌账号。
整套价格
1.000.000đ
只需一个漫画链接:软件自动读懂剧情、撰写脚本、配音、裁切镜头、加入运镜和字幕,再合成解说视频。可在本机免费运行 AI,也可使用云端 AI 获得更好的文笔。

Comic Recap Studio 安装在你自己的电脑上,承包了过去需要花几个小时手动剪辑的整套漫画解说流程。粘贴章节链接,软件会下载全部页面,AI 逐格阅读以理解谁做了什么,用越南语重新讲述剧情并转成配音,为每一句话匹配合适的画格,裁剪图片、加入运镜和转场、烧录字幕,最后导出 MP4。
AI 有两种运行方式。本地 AI 通过 Ollama 在你的电脑上运行,完全免费,漫画不会外传。想要更流畅的脚本,可用你自己的 API 密钥开启云端 AI(Gemini 或任何兼容 OpenAI 的网关)——实际费用通常仅约每章 1,000–3,000 越南盾,视服务商而定。
配音使用本地运行的 VieNeu-TTS:免费、不限次数,提供 25 种越南语男女声,涵盖北部、中部、南部口音。字幕根据配音自动生成,字体、颜色、描边、阴影均可调整。在画面四周缓慢移动的文字水印让频道更易识别,也更难被搬运。
所有 AI 结果都能手动修改:重命名角色、改写句子、更换画格、调整裁剪,并锁定满意的部分,之后重新运行也不会被改动。界面刻意精简,打开即可上手,无需任何剪辑经验。软件以越南语撰写脚本和配音,界面为越南语。
在 YouTube 上观看演示视频时长: 3:18
打开“从网页链接导入”,粘贴章节阅读页链接,每行一个。软件会在隐藏窗口中打开页面,逐屏滚动让懒加载图片全部加载,只保留阅读区域内的图片,剔除 logo、横幅和广告。章节名称也会自动从页面标题获取。
想做整部作品,可粘贴作品介绍页:软件会扫描章节列表供你选择范围,也可以从一个链接自动追加后续 N 章。除网页链接外,还支持图片文件夹、ZIP、CBZ 和 PDF。
分析前,软件会自动标记非剧情页:重复页、多章反复出现的汉化组横幅、过小的图片,以及章节首尾的制作名单、招募和宣传页。被标记的页面仍会保留并附上原因,一键即可恢复使用。
竖向条漫会被切成带重叠区域的片段,确保 AI 不会漏掉任何画格。“漫画页面”界面支持拖动排序、旋转页面,以及批量排除、恢复或重新分析多个页面。

视觉模型逐页阅读,按阅读顺序切分画格,描述场景,识别角色、动作、情绪和场景,并转录对白气泡中的文字。每个画格都会按重要程度和画面质量打分,方便制作视频时选对镜头。
角色会汇总成整部作品共用的名单:姓名、别名、外貌、身份、关系,甚至越南语解说中自然的人称用法。进入新章节时,软件能认出老角色,而不是当成陌生人。
每章剧情整理成事件时间线,并建立剧情记忆,包括梗概、世界观设定和尚未解决的伏笔,让下一章衔接自然。AI 不确定的地方会标记为低可信度,提醒你复核。
分析结果按页面缓存:中途关闭软件,下次点击“继续”即可;新增章节时只分析新内容。角色和事件都可以手动修改、合并和锁定。

分析完成即有脚本,无需再点任何按钮:每个事件成为一段越南语解说,句子长短适中便于收听,用新的语言重述剧情而非照搬对白。软件还会估算每段和整章的时长。
“对照画面核查”按钮会让视觉模型把每段解说与对应的画格逐一比对,改写与画面不符的段落,大幅减少 AI 编造情节。
每段都可以直接修改,或让 AI 按你的要求和项目的叙述风格改写:中性、快节奏 YouTube、电影感、轻喜剧、严肃、文学化,或你自己的频道规范。
满意的段落可以锁定,之后重新运行不会被改动;修改某段后只需重新配这一段,不必重配整章。

本地 AI 通过 Ollama 在你的电脑上运行:视觉模型 qwen2.5vl 与写作模型 qwen3,并为 8 GB 内存的电脑准备了轻量组合。软件会自动检测 Ollama、引导安装并带进度条下载模型,另有从“快速”到“高质量”的四档性能配置。不收费,漫画也不会离开你的电脑。
云端 AI 适合想要更流畅、更聪明脚本的用户:选择 Gemini 或任何兼容 OpenAI 的网关,粘贴你的 API 密钥。密钥通过 macOS 钥匙串或 Windows DPAPI 加密保存。费用通常仅约每章 1,000–3,000 越南盾,视服务商而定。
你可以只让云端负责写作、读图仍在本地运行,也可以两者都交给云端。云端网络出错时会自动退回本地 AI;云端任务并行运行,处理速度快得多。
侧边栏始终显示哪个模型在写作、哪个在读图、分别在本地还是云端运行,以及已用 token 和预估费用——不会有意外账单。

软件为每句解说匹配最合适的画格:事件对得上、角色对得上,优先重要且好看的画格,避免重复,不用纯文字画格。每个镜头的时长跟随真实配音长度。
图片会围绕画格的视觉焦点智能裁剪。不满意可以打开裁剪编辑器拖动调整,点“自动”让软件重新裁剪,或一次性重裁整章。
每个镜头可选七种 Ken Burns 运镜之一——静止、推近、拉远、左移、右移、上移、下移——强度可调;转场有四种:硬切、溶解、淡入淡出、滑动。长图会在模糊背景上缓慢滚动,而不是被压扁。
文字遮挡功能可模糊对白气泡或画面上的全部文字,让视频成为你的讲述,而非漫画的翻拍。任何镜头都能拆分、删除、调整顺序、镜像、锁定或单独试渲染。

VieNeu-TTS 在本机运行:模型只需下载一次(约 540 MB),之后离线配音,不按字符收费、不限次数。提供 25 种越南语男女声,涵盖北部、中部、南部口音,风格包括自然、讲故事、新闻和有声书。
语速可在 0.6 至 1.6 倍之间调节。音频会自动去除静音并统一响度,让各个镜头听起来均衡。每部作品都有专属读音词典,确保角色名、招式和生僻词读得准确。
字幕与配音完全同步,一键开关。可选择电脑中的任意字体、字号、文字颜色、描边颜色和粗细、阴影、左右边距和底部边距,贴合频道风格。

文字水印沿八个锚点在画面四周缓慢移动,无法靠裁掉一角去除。可自定义文字、字体、字号、颜色、描边、不透明度和绕行一圈的速度——提升频道辨识度,减少被搬运。
按预设导出 H.264 MP4:YouTube 1080p、YouTube 1440p、Shorts/TikTok 9:16、1:1 方形,以及用于快速检查的 480p 草稿。16:9、9:16 或 1:1 画幅在创建项目时选择。
渲染前软件会进行质量检查:缺少配音或画面的镜头、过短或过长的镜头、重复画格和过长句子,并由 AI 检查剧情连贯性。导出后,可在“视频”界面回看每一章,并把多章合并成一个 FULL 完整视频,无需重新渲染。

Electron + React + TypeScript, SQLite, Ollama (Local AI), VieNeu-TTS, sharp và ffmpeg
1 / 13
联系 CMSNT,获取产品建议、深入演示和免费首次部署。