Black Forest Labs 发布了 FLUX 3 Video 多模态模型,支持视频、音频、图像生成及动作预测,现已在 Replicate 平台可用
多源视角
阿里的 Wan 3.0 视频生成模型也发布了,看起来也挺厉害啊!<br><br>它支持原生 30 秒的视频生成,支持 1080P。<br><br>并且支持“全能参考”:不只是文本、图像、视频、音频,它还支持文档、表格、PPT、网页、Markdown 格式等一系列你能想到的信息。<br><br>你可以把这些信息全部混在一起给它参考,让它生成视频,这个对 Age…
查看这条来源FLUX 3 Video from @bfl_ai is now on Replicate!<br><br>One multimodal model for video, audio, image, and action-prediction, with video released today. Generate 20 second videos up t…
查看这条来源AI 摘要
Black Forest Labs 发布 FLUX 3 Video 多模态模型,统一视频、音频、图像生成及动作预测,现已在 Replicate 上线。支持生成20秒1080p视频,具备原生音频、文本/图像到视频、视频延续、多语言对话等功能,并提供草稿模式快速探索创意。开发者可通过 Replicate 直接调用,简化多模态生成开发,降低实验成本。 核心观点: 1. FLUX 3 Video 统一了视频、音频、图像生成及动作预测,是多模态模型。 2. 支持生成最长20秒、最高1080p的视频,具备原生音频和多帧图像到视频功能。 3. 提供 Draft 模式,以较低成本快速探索创意。
推荐理由高信息密度,值得细读
原文
FLUX 3 Video is here. Serious, fun, creative, real, cinematic, whatever you need it to be. Native audio, Text to Video, Image to Video with multiple frames, video continuation, dialogue in multiple languages. Comes with Draft mode so you can explore ideas fast at a fraction of
金句
FLUX 3 Video from @bfl_ai is now on Replicate!
One multimodal model for video, audio, image, and action-prediction
Serious, fun, creative, real, cinematic, whatever you need it to be.
讨论
暂无评论。