HyperAIHyperAI

Command Palette

Search for a command to run...

FLUX 3多模态基础模型发布,开放早期访问

近日,FLUX团队正式推出新一代多模态基础模型FLUX 3并开启早期访问。该模型突破传统单一模态局限,基于自研架构在统一网络内同步学习图像、视频与音频数据,旨在构建能够准确表征物理现实的现实世界模型。通过多模态信息的相互约束,系统可精准还原物体空间结构、时间动态规律及声物因果关系。FLUX 3具备三大核心能力:视频生成支持最长20秒的高多样性输出并内置原生音频,在人脸表情捕捉、声画同步及多语言理解方面表现突出;图像合成涵盖多元风格与分辨率,复杂提示词遵循度与高精度文字渲染能力显著升级;物理AI方向已实现动作预测,并联合Mimic Robotics推出定制化机器人灵巧操控模型。早期盲测显示,FLUX 3在多项生成质量与任务完成度指标上显著优于Runway、Luma及Kling等主流竞品。团队表示,该模型目前仍处于早期迭代阶段,未来数周将按步骤开放各模块能力,期间将持续收集反馈并完成安全评测。FLUX团队正致力于将感知、动作与语言预测深度融合,下一步将发布底层技术细节,并同步推进下一代统一架构模型的研发。目前,团队已在德国与美国启动技术人才招聘。

相关链接