第一人称脚本 · 短剧内容标签 · 配音字幕对齐 · 1080x1920 竖屏 · 本地处理
splicr Desktop—Tauri 2 极速桌面端,7步卡片 DAG 状态机一览
Tauri 2 Core Active

点击放大高清 UI 视窗
7 步DAG 状态机流水线
11 大LLM 独白脚本模型
< 50msVAD 字幕对齐精度
.draft剪映草稿原生工程
✂️FFmpeg 智能切面
智能语义切片与关键帧打点
基于镜头突变与情绪峰值自动打点,生成 keyframe 缩略图索引,告别繁琐人工打点。
🤖11 大 LLM 独白
第一人称主角独白脚本
通义千问 (qwen3.8-max)、DeepSeek (deepseek-v4-pro)、OpenAI (gpt-5.6-sol) 深度微调,黄金3秒 Hook 留存,大幅拉升完播率。
🎙️GPT-SoVITS 克隆
声波人声克隆与黄金音色
50+ 种 Azure 黄金说话人音色,以及 5 秒音频极速人声克隆,复刻专属品牌解说音色。
📝50ms VAD 对齐
silencedetect 毫秒轴对齐
自动探测人声自然停顿与静音区间,校准配音与 SRT/ASS 字幕时间戳,偏差 < 50ms。
🎬9:16 多轨混流
音画多轨混音与 BGM 避让
毫秒级时间轴混流,解说人声自动压过 BGM 背景声 (-6dB),9:16 竖屏高清实时渲染。
📤.draft 原生导出
剪映工程草稿一键导出
原生导出剪映 PC 端工程草稿文件夹 (.draft),保留多轨关系、字幕与材质,二次微调零门槛。
STEP 01 OF 07● DAG Node Active
Step 1: 本地音视频素材解析与预处理
自动解析本地 4K/1080P 音视频元数据(Resolution, FPS, Video Codec, Audio Bitrate),生成毫秒级关键帧快照缩略图,并对音频轨进行标准化重采样。
📥 输入数据:MP4 / MOV / AVI / WebM 本地视频源
📤 产出结果:AppContext 元数据 JSON + 帧缩略图序列
let probe = FfmpegProbe::analyze("input_episode_01.mp4")?;
println!("Resolution: {}x{}, FPS: {:.2}", probe.width, probe.height, probe.fps);
let thumbnails = probe.extract_keyframes(Interval::Sec(2))?;
🇨🇳 Aliyun DashScope
LLM 脚本引擎通义千问 (Qwen)
阿里云百炼官方推荐,原生支持视频帧语义解析与人物情绪拟定,Hook 爆点抓取极佳。
官方默认模型qwen3.8-max
响应耗时~1.1s
# qwen3.8-max# qwen-plus# 短剧桥段识别
DeepSeek
深度思考推理引擎,擅长处理错综复杂的多人反转与悬疑短剧冲突逻辑链。
官方默认模型deepseek-v4-pro
响应耗时~1.5s
# deepseek-v4-pro# deepseek-v4-flash# 高密度情节
OpenAI
全球顶尖多模态模型,文笔流畅优美,角色第一人称内心独白渲染极强。
官方默认模型gpt-5.6-sol
响应耗时~1.2s
# gpt-5.6-sol# gpt-4o-mini# 多语种解说
Claude
极具电影质感的文风输出,无机械感,适合治愈系、怀旧与纪录片腔调。
官方默认模型claude-sonnet-5
响应耗时~1.4s
# claude-sonnet-5# 电影感修辞
Gemini
超长上下文窗口,支持长达 2 小时的全季短剧批量分析与连续集梗概。
官方默认模型gemini-3.6-flash
响应耗时~0.8s
# gemini-3.6-flash# gemini-3.1-pro# 整季批量
Kimi (月之暗面)
擅长处理百万字级别小说改编剧本与短剧背景设定集。
# kimi-k3# moonshot-v1# 小说改编
智谱 GLM
智谱清言大模型引擎,针对中文影视剧本与情感递进深度调优。
# glm-5.2# glm-4-plus# 中文剧本拟真
豆包 (Doubao)
火山引擎抖音生态大模型,天然契合短视频高完播率节奏与热梗解说。
官方默认模型doubao-seed-2-1-pro
响应耗时~0.9s
# doubao-seed-2-1-pro# doubao-pro-128k# 抖音爆款
腾讯混元 (Hunyuan)
腾讯混元大模型旗舰版,中文逻辑严密,适合影视剧情梗概与影评分析。
官方默认模型hunyuan-pro
响应耗时~1.2s
# hunyuan-pro# 影视解析# 结构化剧情
🏠 Ollama / LMStudio
本地开源推理本地模型 (Local Engine)
支持本地离线运行 Qwen2.5 / Llama3.2,保护剧本隐私与数据安全,0 费用。
官方默认模型llama3.2 / qwen2.5
响应耗时取决于本地 GPU
# llama3.2# qwen2.5# 100% 离线隐私
🎙️ Microsoft Azure
TTS 语音合成Edge-TTS 黄金配音
微软官方 TTS 引擎,内置 50+ 种多语种黄金发音人,免费极速无需 API Key。
官方默认模型zh-CN-XiaoxiaoNeural / Yunxi
响应耗时~0.4s
# 50+ 音色# 语速/音调可调# 免费极速
MiMo TTS (小米 MiMo)
小米 MiMo 开放平台限时免费大模型语音合成,支持自然语气表达、情感控制与风致韵味调控。
官方默认模型mimo-v2.5-tts
响应耗时~0.5s
# mimo-v2.5-tts# 小米 MiMo# 限时免费 API
OpenAI-TTS
OpenAI 影视级语音合成引擎,音质极其逼真,呼吸感与情感抑扬顿挫丰富。
官方默认模型gpt-4o-mini-tts / tts-1-hd
响应耗时~1.2s
# gpt-4o-mini-tts# tts-1-hd# 影视高清配音
GPT-SoVITS 零样本克隆
只需要 5 秒参考音频,即可极速克隆指定主播或影视主角音色,带黄金波形探针。
官方默认模型Zero-shot Sovits (127.0.0.1:9880)
响应耗时~2.0s
# Zero-shot 5秒克隆# 黄金波形探针# 音色保真
准备好体验超凡的 AI 影视解说生产力了吗?
只需 3 分钟即可完成桌面端安装与 API 密钥配置,立即开启标准化解说创作。