Windows 桌面端 · 双智能体创作中心

一套软件,
两条创作路线

不再从一张泛化的“功能清单”开始。根据你的素材起点,直接选择口播智能体或短视频混剪智能体,把 AI 放到最适合它的位置。

✓ 软件本体约 25GB✓ 本地模型运行✓ 授权按版本解锁
2条独立创作路线
1套共享创作资产
25GB完整客户端约占空间
Windows桌面端本地运行
两个智能体

先选对起点,再开始创作

它们不是两套割裂的软件,而是针对两类任务设计的两个工作台。你可随时回到创作中心切换。

01ORAL VIDEO AGENT

口播智能体

从想法到数字人口播成片

适合做个人 IP、知识分享和营销口播。给出想法或参考文案后,在一条连续工作流里完成改写、配音、数字人、剪辑和发布。

  • 文案智能改写
  • 标题与话题生成
  • 音色与数字人
  • 字幕、画中画与发布
  1. 01输入想法或参考内容
  2. 02生成文案与标题
  3. 03配音与数字人口播
  4. 04剪辑、封面与发布
02SMART MIX AGENT

短视频混剪智能体

让真实素材自己讲完整故事

适合已经拍好素材、需要快速组织成短视频的人。导入多段视频后,AI 会理解画面、组织整篇文案、匹配镜头并生成可继续调整的剪辑方案。

  • 批量素材识别
  • 行业与人设表达
  • 自动生成脚本
  • 智能匹配镜头与一键粗剪
  1. 01导入自己拍摄的素材
  2. 02逐段理解真实画面
  3. 03生成文案与剪辑方案
  4. 04配音、字幕、封面与成片
怎么选

看你手上有什么,决定从哪里开始

不要为了迁就软件而重做素材。两个工作台分别对应“从想法出发”和“从真实画面出发”。

我有一个选题 / 一段参考内容

选择口播智能体

先让 AI 帮你把表达、标题和配音整理好,再用数字人、字幕和剪辑完成口播成片。

想法 → 文案 → 数字人口播 → 成片
我已经拍好了多段真实素材

选择短视频混剪智能体

先让 AI 识别素材里发生了什么,再组织讲述逻辑、匹配镜头,生成可调整的剪辑方案。

真实素材 → 理解画面 → 剪辑方案 → 成片
共享创作资产素材库音色字幕剪辑引擎作品中心
同一套交付标准

无论从哪条路线开始,最后都回到你的作品中心

两位智能体从不同起点进入同一套项目空间:继续编辑、保存作品,以及封面、字幕、配音和作品管理,都不再是散落的工具。

口播路线让表达更完整、更适合稳定输出
混剪路线让真实素材更有叙事、更快成片
硬件要求

先确认电脑是否合适

本地模型会使用显卡处理配音和数字人等计算;配置越高,等待时间通常越短。完整软件本体约 25GB。

操作系统

Windows 10 / 11

仅支持 64 位 Windows

显卡

NVIDIA 独立显卡

推荐 8GB 及以上显存

运行内存

16GB 起

推荐 32GB,长素材更从容

可用磁盘

建议预留 100GB+

软件本体约 25GB,另需缓存与作品空间

网络

稳定宽带网络

激活、云端文案与平台发布需要联网

运行环境

软件已内置

无需另装 Python 或浏览器环境

双智能体真实操作教程

从内容获取到成片与平台上传

新版教程使用真实软件界面,完整演示口播智能体和短视频混剪智能体:包括文案获取与改写、克隆配音、数字人、素材导入、智能剪辑、成片展示和自动上传。

双智能体真实操作完整教程05:39 · 1080p · 2026 年 9 月测试3克隆音色版
生成音频、视频和平台处理需要等待,教程中已做快进;外部聊天通知已做隐私遮挡。查看两个智能体
使用说明

第一次使用,按这四步走

完整客户端已内置运行环境。下载并正确解压后,先完成激活,再进入双智能体创作中心选择本次路线。

1
下载与解压

完整解压文件夹

软件约 25GB,请放到空间充足的 SSD 中;不要只复制启动文件。

2
启动软件

等待服务准备完成

看到启动窗口后进入系统;请保留原生后端窗口运行。

3
完成激活

按授权解锁功能

输入激活码后进入创作中心;可用功能以当前授权版本显示为准。

4
选择智能体

按素材起点进入工作台

有想法选口播,有真实素材选混剪;成片统一回到作品中心管理。

!
网页操作窗可以关闭,原生后端窗口不要关闭

关闭原生后端窗口会停止本地服务并退出软件;需要重新进入时,在启动窗口中打开创作中心即可。

官方订单中心 · 授权交付

获取软件,
再选择你的创作路线

完整客户端、激活信息和后续交付记录由订单中心统一处理。完成授权后,进入双智能体创作中心选择本次要做的内容。

价格规则

口播智能体 ¥698,永久,口播智能体权限,含 1,000 次额度;混剪智能体 ¥698,永久,混剪智能体权限,含 1,000 次额度。

全功能组合优惠价:双智能体 ¥998,永久全功能,含 2,000 次额度;分开购买两次合计 ¥1,396。

已购买任一单智能体后,解锁另一智能体仍支付 ¥698:原激活码升级为全功能,并再叠加 1,000 次额度。

交付说明Windows 完整客户端约 25GB · 授权范围与可用功能以订单及软件内显示为准
正在检查官方支付通道…
付款后找回

订单中心

不用设置密码。使用下单时填写的手机号接收一次性短信验证码,即可查看历史订单、激活码和下载入口。

常见问题

使用前,你可能还想知道

两个智能体有什么区别?

口播智能体从一个想法或参考内容出发,适合做数字人口播;短视频混剪智能体从你自己拍摄的多段素材出发,适合让真实画面被组织成完整短视频。

两个智能体的素材和设置要重复准备吗?

不需要。它们共用素材库、音色、字幕、剪辑引擎和作品中心;进入哪条工作流取决于本次创作的起点。

软件需要安装 Python 吗?

不需要。软件以完整文件夹形式提供,运行依赖已经内置;下载后请完整解压,不要只复制启动文件。

为什么完整软件有约 25GB?

本地语音、数字人和运行组件占了大部分空间。还应为项目缓存、源素材和成片预留额外 SSD 空间。

视频教程包含两个智能体吗?

包含。新版教程用真实软件界面完整演示口播智能体和短视频混剪智能体,并分别展示 10 秒真实成片;生成与上传等待过程已做快进。

为什么速度这么慢?

新版声音算法使用大语言模型。首次生成音频或视频需要完整加载与处理,耗时通常会比后续步骤更长;教程中的等待段已做快进。显卡、显存、磁盘和素材长度都会影响实际速度。

为什么感觉口型不够好?

数字人主要完成口型同步。拍摄素材时保持自然表情,嘴巴稍慢、清楚地念“1234”,并避免频繁扭头、侧脸或遮挡嘴部,通常能明显提升效果。

为什么感觉表情不自然?

它不会替人物重新设计表情,而是尽量保留原始人物状态。录制数字人素材时保持自然、放松的表情,效果会更稳定。

怎么提升声音效果?

录制克隆声音时尽量多准备干净、连续的原始音频,并覆盖不同语速和情绪;避免明显噪声、回声和背景音乐。

操作太难,感觉不适合我?

先从一条路线和一条短内容开始,按教程一步一步完成即可。遇到生成等待时可以先检查结果再继续,熟悉一次完整流程后会更容易上手。

支持哪些发布平台?

当前工作台提供抖音、视频号和快手的发布流程;是否可用取决于当前软件版本、授权和平台登录状态。