MiniMax H3 视频 VAE 提速:编码最高 2.2 倍、解码 1.4-2.7 倍
MiniMax H3 视频 VAE 编码最高提速约 2.2 倍、解码提速约 1.4-2.7 倍,1344x768、129 帧的编解码往返从 24.3 秒降至 12.7 秒。
MiniMax H3 视频 VAE 编码最高提速约 2.2 倍、解码提速约 1.4-2.7 倍,1344x768、129 帧的编解码往返从 24.3 秒降至 12.7 秒。
ComfyUI 发布 v0.36.0,Gemini 文本节点新增 Gemini 3.8 Flash,并引入 GeminiNodeV3 弃用 V2。该版本新增 Marigold v2、Yue2 音乐模型与 MiniMax-H3 VAE 优化支持,同时加入 Flux Video Edit、Bria 图像编辑与视频擦除、Pruna P-Video-2 视频生成等 Partner Nodes。
ComfyUI 在 LTX-2.5 发布当天提供 Day-0 支持,用户更新到 0.32.0 或打开 Comfy Cloud 即可加载模板运行。
推荐理由:ComfyUI 在 LTX-2.5 发布当天给出接入说明,读者可据此了解新版本在渲染、解码与提示词处理上的改动。
Seedance 2.5 通过 Partner Nodes 在 ComfyUI 上线,单次运行可生成一段连续的 30 秒视频,无需拼接短片。单次生成最多接受 50 个参考素材,包括 30 张图片、10 个视频和 10 个音频文件,并支持在提示词中按时间轴控制分镜、剪辑和延长已有素材。
推荐理由:原文列出单次生成 30 秒连续片段、最多 50 个参考素材等具体能力,可据此判断视频生成工作流的变化。
Replicate 为开源视频生成模型 Wan 2.1 加入视频风格迁移能力,可在 480p 和 720p 文生视频模型上叠加预设风格,也可用至少 25 张图片在几分钟内训练自定义风格 LoRA。用户通过 lora_weights 输入任意 safetensors 链接即可应用风格,并支持 LoRA 快速推理。
Google DeepMind 在 Replicate 上线 ShieldGemma 2,可高精度检测 NSFW、暴力内容和 unsafe instructions,是 DeepMind 首个该类模型。
针对阿里 Wan2.1 14b 文生视频模型(720p),Replicate 做了 guide scale 与 shift 的参数扫描实验。guide scale 在 3-7 时效果最自然,8 以上会出现明显的"AI 感";shift 值越高整体观感越好,但差异比 guide scale 更细微。实验代码已在 GitHub 开源。
Replicate 现已支持微调 FLUX.1 图像生成模型,上传 12-20 张图片并选定触发词,约 30 分钟即可得到自定义模型。Tavus 推出 Conversational Video Interface,以不到 1 秒延迟实现实时视频对话的“数字孪生”API。