Skip to content
第一人称脚本 · 短剧内容标签 · 配音字幕对齐 · 1080x1920 竖屏 · 本地处理
splicr v1.0.0 · Tauri 2.0 + Rust 旗舰版桌面端

为短剧拆条与影视解说而生的 全自动 AI 工厂

从视频切片拆条、剧情独白生成、人声声波克隆到剪映草稿原生导出,一站式极致流畅体验。

splicr DesktopTauri 2 极速桌面端,7步卡片 DAG 状态机一览
Tauri 2 Core Active
全景工作台
点击放大高清 UI 视窗
7 步DAG 状态机流水线
11 大LLM 独白脚本模型
< 50msVAD 字幕对齐精度
.draft剪映草稿原生工程
核心技术亮点

为专业短剧拆条与影视解说团队打造

每一个模块均经过高完播率剪辑 SOP 调优,兼顾生成效率与爆款品质。

✂️FFmpeg 智能切面

智能语义切片与关键帧打点

基于镜头突变与情绪峰值自动打点,生成 keyframe 缩略图索引,告别繁琐人工打点。

🤖11 大 LLM 独白

第一人称主角独白脚本

通义千问 (qwen3.8-max)、DeepSeek (deepseek-v4-pro)、OpenAI (gpt-5.6-sol) 深度微调,黄金3秒 Hook 留存,大幅拉升完播率。

🎙️GPT-SoVITS 克隆

声波人声克隆与黄金音色

50+ 种 Azure 黄金说话人音色,以及 5 秒音频极速人声克隆,复刻专属品牌解说音色。

📝50ms VAD 对齐

silencedetect 毫秒轴对齐

自动探测人声自然停顿与静音区间,校准配音与 SRT/ASS 字幕时间戳,偏差 < 50ms。

🎬9:16 多轨混流

音画多轨混音与 BGM 避让

毫秒级时间轴混流,解说人声自动压过 BGM 背景声 (-6dB),9:16 竖屏高清实时渲染。

📤.draft 原生导出

剪映工程草稿一键导出

原生导出剪映 PC 端工程草稿文件夹 (.draft),保留多轨关系、字幕与材质,二次微调零门槛。

DAG 状态机驱动

7 步智能全自动化生产流水线

点击下方任意节点,探索其核心技术实现、数据输入输出与可调节参数。

STEP 01 OF 07● DAG Node Active

Step 1: 本地音视频素材解析与预处理

自动解析本地 4K/1080P 音视频元数据(Resolution, FPS, Video Codec, Audio Bitrate),生成毫秒级关键帧快照缩略图,并对音频轨进行标准化重采样。

📥 输入数据:MP4 / MOV / AVI / WebM 本地视频源
📤 产出结果:AppContext 元数据 JSON + 帧缩略图序列
Rust / splicr-detectFFmpeg Probe Inspector
let probe = FfmpegProbe::analyze("input_episode_01.mp4")?;
println!("Resolution: {}x{}, FPS: {:.2}", probe.width, probe.height, probe.fps);
let thumbnails = probe.extract_keyframes(Interval::Sec(2))?;
Step 1: 本地音视频素材解析与预处理 — UI 视窗Live Visual
Step 1: 本地音视频素材解析与预处理
多模型协同能力矩阵

支持 11 大 LLM 独白引擎与 3 大 TTS 人声克隆

严格对应 splicr 核心代码与 README 规范,自动校验剧情独白一致性与完播率。

🇨🇳 Aliyun DashScope
LLM 脚本引擎

通义千问 (Qwen)

阿里云百炼官方推荐,原生支持视频帧语义解析与人物情绪拟定,Hook 爆点抓取极佳。

官方默认模型qwen3.8-max
响应耗时~1.1s
# qwen3.8-max# qwen-plus# 短剧桥段识别
🇨🇳 DeepSeek AI
LLM 深度推理

DeepSeek

深度思考推理引擎,擅长处理错综复杂的多人反转与悬疑短剧冲突逻辑链。

官方默认模型deepseek-v4-pro
响应耗时~1.5s
# deepseek-v4-pro# deepseek-v4-flash# 高密度情节
🇺🇸 OpenAI
LLM 旗舰模型

OpenAI

全球顶尖多模态模型,文笔流畅优美,角色第一人称内心独白渲染极强。

官方默认模型gpt-5.6-sol
响应耗时~1.2s
# gpt-5.6-sol# gpt-4o-mini# 多语种解说
🇺🇸 Anthropic
LLM 叙事大师

Claude

极具电影质感的文风输出,无机械感,适合治愈系、怀旧与纪录片腔调。

官方默认模型claude-sonnet-5
响应耗时~1.4s
# claude-sonnet-5# 电影感修辞
🇺🇸 Google AI
LLM 极速推理

Gemini

超长上下文窗口,支持长达 2 小时的全季短剧批量分析与连续集梗概。

官方默认模型gemini-3.6-flash
响应耗时~0.8s
# gemini-3.6-flash# gemini-3.1-pro# 整季批量
🇨🇳 Moonshot AI
LLM 长文本

Kimi (月之暗面)

擅长处理百万字级别小说改编剧本与短剧背景设定集。

官方默认模型kimi-k3
响应耗时~1.5s
# kimi-k3# moonshot-v1# 小说改编
🇨🇳 Zhipu AI
LLM 国产强核

智谱 GLM

智谱清言大模型引擎,针对中文影视剧本与情感递进深度调优。

官方默认模型glm-5.2
响应耗时~1.3s
# glm-5.2# glm-4-plus# 中文剧本拟真
🇨🇳 火山引擎
LLM 字节短视频

豆包 (Doubao)

火山引擎抖音生态大模型,天然契合短视频高完播率节奏与热梗解说。

官方默认模型doubao-seed-2-1-pro
响应耗时~0.9s
# doubao-seed-2-1-pro# doubao-pro-128k# 抖音爆款
🇨🇳 腾讯云
LLM 腾讯生态

腾讯混元 (Hunyuan)

腾讯混元大模型旗舰版,中文逻辑严密,适合影视剧情梗概与影评分析。

官方默认模型hunyuan-pro
响应耗时~1.2s
# hunyuan-pro# 影视解析# 结构化剧情
🏠 Ollama / LMStudio
本地开源推理

本地模型 (Local Engine)

支持本地离线运行 Qwen2.5 / Llama3.2,保护剧本隐私与数据安全,0 费用。

官方默认模型llama3.2 / qwen2.5
响应耗时取决于本地 GPU
# llama3.2# qwen2.5# 100% 离线隐私
🎙️ Microsoft Azure
TTS 语音合成

Edge-TTS 黄金配音

微软官方 TTS 引擎,内置 50+ 种多语种黄金发音人,免费极速无需 API Key。

官方默认模型zh-CN-XiaoxiaoNeural / Yunxi
响应耗时~0.4s
# 50+ 音色# 语速/音调可调# 免费极速
🇨🇳 Xiaomi MiMo
TTS 开放语音

MiMo TTS (小米 MiMo)

小米 MiMo 开放平台限时免费大模型语音合成,支持自然语气表达、情感控制与风致韵味调控。

官方默认模型mimo-v2.5-tts
响应耗时~0.5s
# mimo-v2.5-tts# 小米 MiMo# 限时免费 API
🎙️ OpenAI Voice
TTS 影视配音

OpenAI-TTS

OpenAI 影视级语音合成引擎,音质极其逼真,呼吸感与情感抑扬顿挫丰富。

官方默认模型gpt-4o-mini-tts / tts-1-hd
响应耗时~1.2s
# gpt-4o-mini-tts# tts-1-hd# 影视高清配音
🎙️ Local Engine
TTS 音色克隆

GPT-SoVITS 零样本克隆

只需要 5 秒参考音频,即可极速克隆指定主播或影视主角音色,带黄金波形探针。

官方默认模型Zero-shot Sovits (127.0.0.1:9880)
响应耗时~2.0s
# Zero-shot 5秒克隆# 黄金波形探针# 音色保真
多平台一键出片预设

8 大短视频与长视频平台发布预设

自动匹配最严谨的分辨率、画面比例、音调响度与剪映工程草稿结构。

🎵抖音 (Douyin)
9:16 竖屏
1080×1920
剪映 .draft 同步
📺B站 (Bilibili)
16:9 横屏
1920×1080
剪映 .draft 同步
📕小红书
9:16 竖屏
1080×1920
剪映 .draft 同步
▶️YouTube Shorts
9:16 竖屏
1080×1920
剪映 .draft 同步
🎶TikTok
9:16 竖屏
1080×1920
剪映 .draft 同步
快手
9:16 竖屏
1080×1920
剪映 .draft 同步
🍉西瓜视频
16:9 横屏
1920×1080
剪映 .draft 同步
💬微信视频号
9:16 竖屏
1080×1920
剪映 .draft 同步
🎵抖音 (Douyin) — 预设详情

短剧解说与第一人称视频的高完播率黄金规格,字幕居中下三界位。

分辨率 (Resolution)1080×1920
画面比例 (Aspect Ratio)9:16 竖屏
视频编码 (Video Codec)H.264 High Profile / 30-60fps
BGM 降噪避让 (Amix Ducking)解说声压过 BGM -6dB
剪映原生工程草稿 (.draft) 已自动应用此预设

导出后可直接拖入剪映 PC 端,轨道、字幕与音效完全保留。

准备好体验超凡的 AI 影视解说生产力了吗?

只需 3 分钟即可完成桌面端安装与 API 密钥配置,立即开启标准化解说创作。

splicr 文档中心 · 面向影视/短剧第一人称解说生产