Black Forest Labs推出机器人模型 进军物理AI领域
来源:互联网
时间:2026-07-24 22:50:06
先看一个关键动态:德国AI实验室Black Forest Labs正在把触角从图像生成伸向物理AI领域。他们最新的Flux 3模型,不再只是“画图”,而是能同时处理图像、视频和音频,并根据所见信息预测下一步动作——这实际上是在为机器人打造“视觉智能”的大脑。
具体来说,Black Forest Labs已与Mimic Robotics AG合作,推出了一个名为Flux-mimic的动作模型。并且,这个模型正在与奥迪等制造合作伙伴进行测试。从实验室的照片级渲染到工厂里的真实机械臂,这条路走得比想象中快。

这件事背后的信号很明确:多模态学习能力正在从“生成内容”走向“理解世界”。Flux 3能同时从三种模态中提取特征,意味着它不再只是生成一张漂亮的图片,而是能理解场景中物体的运动逻辑、声音的方位、以及时间序列上的因果。这恰恰是机器人真正与环境交互所必需的核心能力。
与Mimic Robotics的合作,更像是一次“认知”与“动作”的联姻。Flux-mimic模型负责感知和决策,而Mimic Robotics提供执行层面的硬件与算法。奥迪的参与则说明,工业制造场景对这种“看得懂、能预测、会操作”的AI模型有真实需求——比如在装配线上,机器人需要根据视觉和听觉信号实时调整下一步动作,而不是死板地重复预设程序。
值得关注的是,Black Forest Labs并非从零起步。他们之前在图像生成领域积累的Flux系列模型,已经证明了对视觉数据的处理能力。现在向物理AI扩展,相当于把“看”的能力升级为“看+想+动”。不过,从实验室测试到大规模工业部署,还有很长的路要走——模型的实时性、鲁棒性、以及与不同硬件平台的兼容性,都是需要啃下的硬骨头。