FLUX 3与mimic联合推出新一代视频动作模型
Black Forest Labs与mimic robotics近期联合推出新一代多模态基础模型FLUX 3及其衍生视频动作模型FLUX-mimic。该架构打破内容生成与机器人控制的界限,通过统一训练图像、视频、音频与机械动作构建共享底座。其中视频预测承担超九成算力消耗,迫使模型在生成逼真动态画面的过程中内化接触力学与因果律等物理运行机制。结合Self-Flow技术,模型有效弥合生成质量与特征解耦的鸿沟,使世界认知表征更易被机器人解码调用。 在实际应用中,FLUX-mimic已进驻奥迪汽车生产线,执行柔性线缆处理、精密部件装配等高度定制化任务。得益于底层物理常识储备,该系统具备极高样本效率与自主纠错能力,可在未见过场景中自动规划路径完成任务。在端侧部署方面,主干网络在单张NVIDIA RTX 5090显卡上的推理延迟低于八十毫秒,配合全栈系统级调优实现一百零一毫秒端到端响应,实时性媲美人类视觉反射。 此次合作标志着物理AI从算法验证向工业落地的关键跨越。FLUX-mimic以统一基础模型同时驱动数字内容创作与实体操作,不仅攻克了传统自动化难以处理的柔性物态装配难题,更为高端制造提供了可快速迁移的智能化方案,显著拓展了产线柔性与人机协同边界。
