# Black Forest Labs 发布了 FLUX 3 Video 多模态模型，支持视频、音频、图像生成及动作预测，现已在 Replicate 平台可用

- 来源：Replicate
- 发布时间：2026-08-05 01:38
- AIWatch 分数：70
- AIWatch 标记：当日精选
- AIWatch 链接：https://aiwatch.icu/events/evt_01kz6zcp412b38mgm6wv2qhbg8
- 原文链接：https://x.com/replicate/status/2084695365370912909

## 精选理由

高信息密度，值得细读

## AI 摘要

Black Forest Labs 发布 FLUX 3 Video 多模态模型，统一视频、音频、图像生成及动作预测，现已在 Replicate 上线。支持生成20秒1080p视频，具备原生音频、文本/图像到视频、视频延续、多语言对话等功能，并提供草稿模式快速探索创意。开发者可通过 Replicate 直接调用，简化多模态生成开发，降低实验成本。
核心观点：
1. FLUX 3 Video 统一了视频、音频、图像生成及动作预测，是多模态模型。
2. 支持生成最长20秒、最高1080p的视频，具备原生音频和多帧图像到视频功能。
3. 提供 Draft 模式，以较低成本快速探索创意。

## 正文

Black Forest Labs 发布 FLUX 3 Video 多模态模型，统一视频、音频、图像生成及动作预测，现已在 Replicate 上线。支持生成20秒1080p视频，具备原生音频、文本/图像到视频、视频延续、多语言对话等功能，并提供草稿模式快速探索创意。开发者可通过 Replicate 直接调用，简化多模态生成开发，降低实验成本。
核心观点：
1. FLUX 3 Video 统一了视频、音频、图像生成及动作预测，是多模态模型。
2. 支持生成最长20秒、最高1080p的视频，具备原生音频和多帧图像到视频功能。
3. 提供 Draft 模式，以较低成本快速探索创意。
