一套软件,
两条创作路线
不再从一张泛化的“功能清单”开始。根据你的素材起点,直接选择口播智能体或短视频混剪智能体,把 AI 放到最适合它的位置。
两个智能体共用素材库、音色、字幕、剪辑引擎和作品中心。
先选对起点,再开始创作
它们不是两套割裂的软件,而是针对两类任务设计的两个工作台。你可随时回到创作中心切换。
口播智能体
从想法到数字人口播成片适合做个人 IP、知识分享和营销口播。给出想法或参考文案后,在一条连续工作流里完成改写、配音、数字人、剪辑和发布。
- ✓文案智能改写
- ✓标题与话题生成
- ✓音色与数字人
- ✓字幕、画中画与发布
- 01输入想法或参考内容
- 02生成文案与标题
- 03配音与数字人口播
- 04剪辑、封面与发布
短视频混剪智能体
让真实素材自己讲完整故事适合已经拍好素材、需要快速组织成短视频的人。导入多段视频后,AI 会理解画面、组织整篇文案、匹配镜头并生成可继续调整的剪辑方案。
- ✓批量素材识别
- ✓行业与人设表达
- ✓自动生成脚本
- ✓智能匹配镜头与一键粗剪
- 01导入自己拍摄的素材
- 02逐段理解真实画面
- 03生成文案与剪辑方案
- 04配音、字幕、封面与成片
看你手上有什么,决定从哪里开始
不要为了迁就软件而重做素材。两个工作台分别对应“从想法出发”和“从真实画面出发”。
选择口播智能体
先让 AI 帮你把表达、标题和配音整理好,再用数字人、字幕和剪辑完成口播成片。
想法 → 文案 → 数字人口播 → 成片选择短视频混剪智能体
先让 AI 识别素材里发生了什么,再组织讲述逻辑、匹配镜头,生成可调整的剪辑方案。
真实素材 → 理解画面 → 剪辑方案 → 成片无论从哪条路线开始,最后都回到你的作品中心
两位智能体从不同起点进入同一套项目空间:继续编辑、保存作品,以及封面、字幕、配音和作品管理,都不再是散落的工具。


先确认电脑是否合适
本地模型会使用显卡处理配音和数字人等计算;配置越高,等待时间通常越短。完整软件本体约 25GB。
Windows 10 / 11
仅支持 64 位 Windows
NVIDIA 独立显卡
推荐 8GB 及以上显存
16GB 起
推荐 32GB,长素材更从容
建议预留 100GB+
软件本体约 25GB,另需缓存与作品空间
稳定宽带网络
激活、云端文案与平台发布需要联网
软件已内置
无需另装 Python 或浏览器环境
从内容获取到成片与平台上传
新版教程使用真实软件界面,完整演示口播智能体和短视频混剪智能体:包括文案获取与改写、克隆配音、数字人、素材导入、智能剪辑、成片展示和自动上传。
第一次使用,按这四步走
完整客户端已内置运行环境。下载并正确解压后,先完成激活,再进入双智能体创作中心选择本次路线。
完整解压文件夹
软件约 25GB,请放到空间充足的 SSD 中;不要只复制启动文件。
等待服务准备完成
看到启动窗口后进入系统;请保留原生后端窗口运行。
按授权解锁功能
输入激活码后进入创作中心;可用功能以当前授权版本显示为准。
按素材起点进入工作台
有想法选口播,有真实素材选混剪;成片统一回到作品中心管理。
关闭原生后端窗口会停止本地服务并退出软件;需要重新进入时,在启动窗口中打开创作中心即可。
获取软件,
再选择你的创作路线
完整客户端、激活信息和后续交付记录由订单中心统一处理。完成授权后,进入双智能体创作中心选择本次要做的内容。
口播智能体 ¥698,永久,口播智能体权限,含 1,000 次额度;混剪智能体 ¥698,永久,混剪智能体权限,含 1,000 次额度。
全功能组合优惠价:双智能体 ¥998,永久全功能,含 2,000 次额度;分开购买两次合计 ¥1,396。
已购买任一单智能体后,解锁另一智能体仍支付 ¥698:原激活码升级为全功能,并再叠加 1,000 次额度。
订单中心
不用设置密码。使用下单时填写的手机号接收一次性短信验证码,即可查看历史订单、激活码和下载入口。
使用前,你可能还想知道
两个智能体有什么区别?+
口播智能体从一个想法或参考内容出发,适合做数字人口播;短视频混剪智能体从你自己拍摄的多段素材出发,适合让真实画面被组织成完整短视频。
两个智能体的素材和设置要重复准备吗?+
不需要。它们共用素材库、音色、字幕、剪辑引擎和作品中心;进入哪条工作流取决于本次创作的起点。
软件需要安装 Python 吗?+
不需要。软件以完整文件夹形式提供,运行依赖已经内置;下载后请完整解压,不要只复制启动文件。
为什么完整软件有约 25GB?+
本地语音、数字人和运行组件占了大部分空间。还应为项目缓存、源素材和成片预留额外 SSD 空间。
视频教程包含两个智能体吗?+
包含。新版教程用真实软件界面完整演示口播智能体和短视频混剪智能体,并分别展示 10 秒真实成片;生成与上传等待过程已做快进。
为什么速度这么慢?+
新版声音算法使用大语言模型。首次生成音频或视频需要完整加载与处理,耗时通常会比后续步骤更长;教程中的等待段已做快进。显卡、显存、磁盘和素材长度都会影响实际速度。
为什么感觉口型不够好?+
数字人主要完成口型同步。拍摄素材时保持自然表情,嘴巴稍慢、清楚地念“1234”,并避免频繁扭头、侧脸或遮挡嘴部,通常能明显提升效果。
为什么感觉表情不自然?+
它不会替人物重新设计表情,而是尽量保留原始人物状态。录制数字人素材时保持自然、放松的表情,效果会更稳定。
怎么提升声音效果?+
录制克隆声音时尽量多准备干净、连续的原始音频,并覆盖不同语速和情绪;避免明显噪声、回声和背景音乐。
操作太难,感觉不适合我?+
先从一条路线和一条短内容开始,按教程一步一步完成即可。遇到生成等待时可以先检查结果再继续,熟悉一次完整流程后会更容易上手。
支持哪些发布平台?+
当前工作台提供抖音、视频号和快手的发布流程;是否可用取决于当前软件版本、授权和平台登录状态。