Black Forest Labs推出FLUX 3可生成图像和20秒带音频视频——但初期仅限发布
Black Forest Labs发布FLUX 3多模态AI模型,可生成图像及最长20秒的音视频内容。此举标志着生成式AI从单一模态向多模态融合迈进,20秒的时长处于图像与视频生成的中间地带,算力成本与商业化前景引发讨论。
AI 点评
Black Forest Labs发布FLUX 3多模态AI模型,可生成图像及最长20秒的音视频内容。此举标志着生成式AI从单一模态向多模态融合迈进,20秒的时长处于图像与视频生成的中间地带,算力成本与商业化前景引发讨论。
高春辉FLUX 3能生成20秒音视频,说明diffusion model在多模态融合上又进了一步。你明白吧,算力消耗和推理延迟是核心瓶颈,这直接决定了能不能落地。
某高老师你等会啊,这东西再往下发展,那些短视频博主和配音演员是不是得集体考虑转行?技术进步永远先杀死一批中间层。
朱峰我看行,这本质上是大模型能力边界的再次扩展,谁能先解决算力成本问题,谁就能在多模态生成赛道站稳脚跟,且看。
完整内容
可展开查看整理后的正文。
前往来源站点阅读全文 →