第一人称脚本 · 短剧内容标签 · 配音字幕对齐 · 1080x1920 竖屏 · 本地处理
Vynaro Desktop—Tauri 2 极速桌面端,7步卡片 DAG 状态机一览
Tauri 2 Core Active

点击放大高清 UI 视窗
7 步DAG 状态机流水线
11 大LLM 独白脚本模型
< 50msVAD 字幕对齐精度
.draft剪映草稿原生工程
✂️FFmpeg 智能切面
智能语义切片与关键帧打点
基于镜头突变与情绪峰值自动打点,生成 keyframe 缩略图索引,告别繁琐人工打点。
🤖11 大 LLM 独白
第一人称主角独白脚本
通义千问 3.8、DeepSeek R1、GPT-4o 深度微调,黄金3秒 Hook 留存,大幅拉升完播率。
🎙️GPT-SoVITS 克隆
声波人声克隆与黄金音色
50+ 种 Azure 黄金说话人音色,以及 5 秒音频极速人声克隆,复刻专属品牌解说音色。
📝50ms VAD 对齐
silencedetect 毫秒轴对齐
自动探测人声自然停顿与静音区间,校准配音与 SRT/ASS 字幕时间戳,偏差 < 50ms。
🎬9:16 多轨混流
音画多轨混音与 BGM 避让
毫秒级时间轴混流,解说人声自动压过 BGM 背景声 (-6dB),9:16 竖屏高清实时渲染。
📤.draft 原生导出
剪映工程草稿一键导出
原生导出剪映 PC 端工程草稿文件夹 (.draft),保留多轨关系、字幕与材质,二次微调零门槛。
STEP 01 OF 07● DAG Node Active
Step 1: 本地音视频素材解析与预处理
自动解析本地 4K/1080P 音视频元数据(Resolution, FPS, Video Codec, Audio Bitrate),生成毫秒级关键帧快照缩略图,并对音频轨进行标准化重采样。
📥 输入数据:MP4 / MOV / AVI / WebM 本地视频源
📤 产出结果:AppContext 元数据 JSON + 帧缩略图序列
let probe = FfmpegProbe::analyze("input_episode_01.mp4")?;
println!("Resolution: {}x{}, FPS: {:.2}", probe.width, probe.height, probe.fps);
let thumbnails = probe.extract_keyframes(Interval::Sec(2))?;
🇨🇳 Aliyun Bailian
LLM 脚本引擎通义千问 (Qwen 3.8 / Plus)
原生支持视频帧语义解析与人物情绪拟定,Hook 引子爆点抓取极佳。
响应耗时~1.2s
叙事完播预估98.5% 高完播率
# qwen3.8-max# 短剧桥段识别# 原生结构化输出
DeepSeek (R1 / V3 Pro)
深度思考推理引擎,擅长处理错综复杂的多人反转与悬疑短剧冲突。
响应耗时~1.8s
叙事完播预估99.1% 逻辑门禁
# deepseek-r1# 反转打脸链# 高密度情节
OpenAI (GPT-4o / GPT-5.6)
全球顶尖多模态模型,文笔流畅优美,角色第一人称内心独白渲染极强。
响应耗时~1.4s
叙事完播预估98.8% 情感表达
# gpt-4o# 多语种解说# 角色人设对齐
Claude (Claude 3.5 Sonnet)
极具电影质感的文风输出,无机械感,适合治愈系、怀旧与纪录片腔调。
响应耗时~1.5s
叙事完播预估97.9% 电影质感
# claude-3.5# 高级修辞# 人称视角一致
Gemini (3.6 Flash / Pro)
超长上下文窗口,支持长达 2 小时的全季短剧批量分析与连续集梗概。
响应耗时~0.8s
叙事完播预估96.5% 长剧梗概
# gemini-3.6-flash# 整季批量# 秒级响应
Kimi (月之暗面 Moonshot)
擅长处理百万字级别小说改编剧本与短剧背景设定集。
响应耗时~1.6s
叙事完播预估97.2% 设定对齐
# kimi-k3# 小说改编# 人设卡片
🎙️ Microsoft Azure
TTS 语音合成Edge-TTS 黄金配音
内置 50+ 种多语种黄金发音人,涵盖云希、云扬、晓晓等解说界热门音色。
响应耗时~0.5s
叙事完播预估99.5% 播音质感
# 50+ 音色# 语速/音调可调# 零延迟
GPT-SoVITS 零样本克隆
只需要 5 秒参考音频,即可复刻任意指定主播、博主或博主角色音色。
响应耗时~2.5s
叙事完播预估98.2% 音色相似度
# Zero-shot Clone# 5秒极速采样# 音色保真
Ollama / LMStudio 本地大模型
支持本地离线运行 Qwen2.5 / Llama3.2,保护剧本隐私与数据安全。
响应耗时取决于本地 GPU
叙事完播预估100% 离线隐私
# qwen2.5-local# llama3.2# 完全本地化
准备好体验超凡的 AI 影视解说生产力了吗?
只需 3 分钟即可完成桌面端安装与 API 密钥配置,立即开启标准化解说创作。