Appearance
🤖 AI 工作流详解
Vynaro 的 AI 生产流程围绕 “剧情理解 ➔ 独白脚本 ➔ 黄金声波合成 ➔ 剪映草稿交付” 闭环设计。每个阶段都有明确的数据产出与质量评估,确保视频解说的完播率与观感。
⚡ 7 步卡片流水线架构
DAG 状态机驱动
7 步智能全自动化生产流水线
点击下方任意节点,探索其核心技术实现、数据输入输出与可调节参数。
Step 1: 本地音视频素材解析与预处理
自动解析本地 4K/1080P 音视频元数据(Resolution, FPS, Video Codec, Audio Bitrate),生成毫秒级关键帧快照缩略图,并对音频轨进行标准化重采样。
📥 输入数据:MP4 / MOV / AVI / WebM 本地视频源
📤 产出结果:AppContext 元数据 JSON + 帧缩略图序列
Rust / vynaro-detectFFmpeg Probe Inspector
let probe = FfmpegProbe::analyze("input_episode_01.mp4")?;
println!("Resolution: {}x{}, FPS: {:.2}", probe.width, probe.height, probe.fps);
let thumbnails = probe.extract_keyframes(Interval::Sec(2))?;Step 1: 本地音视频素材解析与预处理 — UI 视窗Live Visual

🧠 11 大大模型与人声克隆能力矩阵
多模型协同能力矩阵
支持 11 大 LLM 独白引擎与 TTS 人声克隆
内置各大模型 SDK 驱动与备用节点,自动校验剧情独白一致性与逻辑完播率。
🇨🇳 Aliyun Bailian
LLM 脚本引擎通义千问 (Qwen 3.8 / Plus)
原生支持视频帧语义解析与人物情绪拟定,Hook 引子爆点抓取极佳。
响应耗时~1.2s
叙事完播预估98.5% 高完播率
🇨🇳 DeepSeek AI
LLM 深度推理DeepSeek (R1 / V3 Pro)
深度思考推理引擎,擅长处理错综复杂的多人反转与悬疑短剧冲突。
响应耗时~1.8s
叙事完播预估99.1% 逻辑门禁
🇺🇸 OpenAI
LLM 旗舰模型OpenAI (GPT-4o / GPT-5.6)
全球顶尖多模态模型,文笔流畅优美,角色第一人称内心独白渲染极强。
响应耗时~1.4s
叙事完播预估98.8% 情感表达
🇺🇸 Anthropic
LLM 叙事大师Claude (Claude 3.5 Sonnet)
极具电影质感的文风输出,无机械感,适合治愈系、怀旧与纪录片腔调。
响应耗时~1.5s
叙事完播预估97.9% 电影质感
🇺🇸 Google AI
LLM 极速推理Gemini (3.6 Flash / Pro)
超长上下文窗口,支持长达 2 小时的全季短剧批量分析与连续集梗概。
响应耗时~0.8s
叙事完播预估96.5% 长剧梗概
🇨🇳 Moonshot AI
LLM 长文本Kimi (月之暗面 Moonshot)
擅长处理百万字级别小说改编剧本与短剧背景设定集。
响应耗时~1.6s
叙事完播预估97.2% 设定对齐
🎙️ Microsoft Azure
TTS 语音合成Edge-TTS 黄金配音
内置 50+ 种多语种黄金发音人,涵盖云希、云扬、晓晓等解说界热门音色。
响应耗时~0.5s
叙事完播预估99.5% 播音质感
🎙️ Local / Cloud
TTS 音色克隆GPT-SoVITS 零样本克隆
只需要 5 秒参考音频,即可复刻任意指定主播、博主或博主角色音色。
响应耗时~2.5s
叙事完播预估98.2% 音色相似度
🏠 Local GPU
本地开源推理Ollama / LMStudio 本地大模型
支持本地离线运行 Qwen2.5 / Llama3.2,保护剧本隐私与数据安全。
响应耗时取决于本地 GPU
叙事完播预估100% 离线隐私