Skip to content
第一人称脚本 · 短剧内容标签 · 配音字幕对齐 · 1080x1920 竖屏 · 本地处理
Vynaro v1.0.0 · Tauri 2.0 + Rust 旗舰版桌面端

为短剧拆条与影视解说而生的 全自动 AI 工厂

从视频切片拆条、剧情独白生成、人声声波克隆到剪映草稿原生导出,一站式极致流畅体验。

Vynaro DesktopTauri 2 极速桌面端,7步卡片 DAG 状态机一览
Tauri 2 Core Active
全景工作台
点击放大高清 UI 视窗
7 步DAG 状态机流水线
11 大LLM 独白脚本模型
< 50msVAD 字幕对齐精度
.draft剪映草稿原生工程
核心技术亮点

为专业短剧拆条与影视解说团队打造

每一个模块均经过高完播率剪辑 SOP 调优,兼顾生成效率与爆款品质。

✂️FFmpeg 智能切面

智能语义切片与关键帧打点

基于镜头突变与情绪峰值自动打点,生成 keyframe 缩略图索引,告别繁琐人工打点。

🤖11 大 LLM 独白

第一人称主角独白脚本

通义千问 3.8、DeepSeek R1、GPT-4o 深度微调,黄金3秒 Hook 留存,大幅拉升完播率。

🎙️GPT-SoVITS 克隆

声波人声克隆与黄金音色

50+ 种 Azure 黄金说话人音色,以及 5 秒音频极速人声克隆,复刻专属品牌解说音色。

📝50ms VAD 对齐

silencedetect 毫秒轴对齐

自动探测人声自然停顿与静音区间,校准配音与 SRT/ASS 字幕时间戳,偏差 < 50ms。

🎬9:16 多轨混流

音画多轨混音与 BGM 避让

毫秒级时间轴混流,解说人声自动压过 BGM 背景声 (-6dB),9:16 竖屏高清实时渲染。

📤.draft 原生导出

剪映工程草稿一键导出

原生导出剪映 PC 端工程草稿文件夹 (.draft),保留多轨关系、字幕与材质,二次微调零门槛。

DAG 状态机驱动

7 步智能全自动化生产流水线

点击下方任意节点,探索其核心技术实现、数据输入输出与可调节参数。

STEP 01 OF 07● DAG Node Active

Step 1: 本地音视频素材解析与预处理

自动解析本地 4K/1080P 音视频元数据(Resolution, FPS, Video Codec, Audio Bitrate),生成毫秒级关键帧快照缩略图,并对音频轨进行标准化重采样。

📥 输入数据:MP4 / MOV / AVI / WebM 本地视频源
📤 产出结果:AppContext 元数据 JSON + 帧缩略图序列
Rust / vynaro-detectFFmpeg Probe Inspector
let probe = FfmpegProbe::analyze("input_episode_01.mp4")?;
println!("Resolution: {}x{}, FPS: {:.2}", probe.width, probe.height, probe.fps);
let thumbnails = probe.extract_keyframes(Interval::Sec(2))?;
Step 1: 本地音视频素材解析与预处理 — UI 视窗Live Visual
Step 1: 本地音视频素材解析与预处理
多模型协同能力矩阵

支持 11 大 LLM 独白引擎与 TTS 人声克隆

内置各大模型 SDK 驱动与备用节点,自动校验剧情独白一致性与逻辑完播率。

🇨🇳 Aliyun Bailian
LLM 脚本引擎

通义千问 (Qwen 3.8 / Plus)

原生支持视频帧语义解析与人物情绪拟定,Hook 引子爆点抓取极佳。

响应耗时~1.2s
叙事完播预估98.5% 高完播率
# qwen3.8-max# 短剧桥段识别# 原生结构化输出
🇨🇳 DeepSeek AI
LLM 深度推理

DeepSeek (R1 / V3 Pro)

深度思考推理引擎,擅长处理错综复杂的多人反转与悬疑短剧冲突。

响应耗时~1.8s
叙事完播预估99.1% 逻辑门禁
# deepseek-r1# 反转打脸链# 高密度情节
🇺🇸 OpenAI
LLM 旗舰模型

OpenAI (GPT-4o / GPT-5.6)

全球顶尖多模态模型,文笔流畅优美,角色第一人称内心独白渲染极强。

响应耗时~1.4s
叙事完播预估98.8% 情感表达
# gpt-4o# 多语种解说# 角色人设对齐
🇺🇸 Anthropic
LLM 叙事大师

Claude (Claude 3.5 Sonnet)

极具电影质感的文风输出,无机械感,适合治愈系、怀旧与纪录片腔调。

响应耗时~1.5s
叙事完播预估97.9% 电影质感
# claude-3.5# 高级修辞# 人称视角一致
🇺🇸 Google AI
LLM 极速推理

Gemini (3.6 Flash / Pro)

超长上下文窗口,支持长达 2 小时的全季短剧批量分析与连续集梗概。

响应耗时~0.8s
叙事完播预估96.5% 长剧梗概
# gemini-3.6-flash# 整季批量# 秒级响应
🇨🇳 Moonshot AI
LLM 长文本

Kimi (月之暗面 Moonshot)

擅长处理百万字级别小说改编剧本与短剧背景设定集。

响应耗时~1.6s
叙事完播预估97.2% 设定对齐
# kimi-k3# 小说改编# 人设卡片
🎙️ Microsoft Azure
TTS 语音合成

Edge-TTS 黄金配音

内置 50+ 种多语种黄金发音人,涵盖云希、云扬、晓晓等解说界热门音色。

响应耗时~0.5s
叙事完播预估99.5% 播音质感
# 50+ 音色# 语速/音调可调# 零延迟
🎙️ Local / Cloud
TTS 音色克隆

GPT-SoVITS 零样本克隆

只需要 5 秒参考音频,即可复刻任意指定主播、博主或博主角色音色。

响应耗时~2.5s
叙事完播预估98.2% 音色相似度
# Zero-shot Clone# 5秒极速采样# 音色保真
🏠 Local GPU
本地开源推理

Ollama / LMStudio 本地大模型

支持本地离线运行 Qwen2.5 / Llama3.2,保护剧本隐私与数据安全。

响应耗时取决于本地 GPU
叙事完播预估100% 离线隐私
# qwen2.5-local# llama3.2# 完全本地化
多平台一键出片预设

8 大短视频与长视频平台发布预设

自动匹配最严谨的分辨率、画面比例、音调响度与剪映工程草稿结构。

🎵抖音 (Douyin)
9:16 竖屏
1080×1920
剪映 .draft 同步
📺B站 (Bilibili)
16:9 横屏
1920×1080
剪映 .draft 同步
📕小红书
9:16 竖屏
1080×1920
剪映 .draft 同步
▶️YouTube Shorts
9:16 竖屏
1080×1920
剪映 .draft 同步
🎶TikTok
9:16 竖屏
1080×1920
剪映 .draft 同步
快手
9:16 竖屏
1080×1920
剪映 .draft 同步
🍉西瓜视频
16:9 横屏
1920×1080
剪映 .draft 同步
💬微信视频号
9:16 竖屏
1080×1920
剪映 .draft 同步
🎵抖音 (Douyin) — 预设详情

短剧解说与第一人称视频的高完播率黄金规格,字幕居中下三界位。

分辨率 (Resolution)1080×1920
画面比例 (Aspect Ratio)9:16 竖屏
视频编码 (Video Codec)H.264 High Profile / 30-60fps
BGM 降噪避让 (Amix Ducking)解说声压过 BGM -6dB
剪映原生工程草稿 (.draft) 已自动应用此预设

导出后可直接拖入剪映 PC 端,轨道、字幕与音效完全保留。

准备好体验超凡的 AI 影视解说生产力了吗?

只需 3 分钟即可完成桌面端安装与 API 密钥配置,立即开启标准化解说创作。

Vynaro 文档中心 · 面向影视/短剧第一人称解说生产