Black Forest Labs представляет FLUX 3: мультимодальная модель потока, выходящая за рамки робототехники

Модели и инструменты Jul 24, 2026 at 09:338В закладки

Black Forest Labs представляет FLUX 3: мультимодальная модель потока, выходящая за рамки робототехники
Иллюстрация : Léa Fontaine

BFL заявляет о революционном прорыве по сравнению с Seedance 2.0, Gemini Omni и Grok Imagine — и вскоре представляет производный продукт «video-action» для робототехники.

Контекст

Black Forest Labs (BFL), немецкая лаборатория, созданная на основе оригинальной команды Stability, объявляет о FLUX 3, новой семье мультимодальных моделей flow. Согласно презентации, опубликованной в Latent Space (24 июля 2026 года), FLUX 3 занимает лидирующие позиции по сравнению с Seedance 2.0 (ByteDance), Gemini Omni (Google) и Grok Imagine (xAI) на бенчмарках, представленных BFL. В пресс-релизе также упоминается FLUX-mimic — модель «видео-действие», ориентированная на робототехнику.

Данные

  • Анонсированная семья: FLUX 3 (мультимодальный flow).
  • Конкуренты, упомянутые BFL: Seedance 2.0, Gemini Omni, Grok Imagine.
  • Производный продукт: FLUX-mimic — модель видео-действия для робототехники.
  • Источник: Latent Space, 24 июля 2026 года (бенчмарки требуют независимой валидации).

Анализ

Выделяются два ключевых сигнала. Во-первых, европейский разрыв в области мультимодальной генерации сокращается — ранее этот рынок был преимущественно американским и китайским. Во-вторых, производная модель FLUX-mimic знаменует собой сдвиг: архитектуры flow, ранее ограниченные генерацией изображений и видео, теперь переходят в область робототехнических действий. Это соответствует тренду, предсказанному участниками гонки embodied-foundation-race (X-Square, Xiaomi Robotics-U0, Nvidia GR00T) — единый бэкенд для восприятия, генерации и моторного контроля.

Сценарии

  • Краткосрочная перспектива: независимые бенчмарки (Artificial Analysis, LMArena Vision) дадут оценку в течение 4–6 недель.
  • Среднесрочная перспектива: BFL может стать объектом поглощения — Meta, Amazon или стратегический европейский игрок (SAP, Mistral), если результаты подтвердятся.
  • Альтернатива: FLUX-mimic останется демонстрацией. Бенчмарки для робототехники пока не стандартизированы, сравнение будет затруднено.

Выводы для профессионалов

Для команды, занимающейся разработкой продуктов, это объявление не отменяет существующие решения (Runway, Pika, Veo), пока не появятся независимые бенчмарки. Для лабораторий в области робототехники FLUX-mimic заслуживает пристального внимания: это одна из первых openly позиционированных моделей flow, ориентированных на действия, в то время как отрасль колеблется между диффузией, VLA и RT-2.

Сигналы для наблюдения

  • Публикация технического отчёта (статья или подробный блог).
  • Открытие доступа к API или выпуск моделей с открытыми весами (у BFL смешанная история).
  • Реакция ByteDance (Seedance) и Google (Gemini Omni) на оспариваемые бенчмарки.

Наше мнение

BFL делает смелый ход. Перспектива заманчива, но техническая демонстрация требует подтверждения. То, что уже ясно: мультимодальный flow больше не является нишевой технологией для генерации изображений — он становится кандидатом на роль универсального бэкенда, связывающего восприятие, генерацию и действие.

Resources

Статья создана искусственным интеллектом и проверена под редакционным контролем человека.

Наша редакция
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Была ли статья полезной?

9 чел. оценили эту статью

Нравится
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
Поделиться:
Комментарии (8)

Войдите, чтобы участвовать в обсуждении.

J.P.R. 2 24 Jul 2026 · 17:24

I wonder if FLUX 3's multimodal approach could lead to overfitting in specific robotic tasks. How does it handle edge cases?

J.P.R. 3 24 Jul 2026 · 17:20

I'd like to see a direct comparison of FLUX 3's performance against Gemini Omni in real-world robotic applications, not just benchmarks.

Dr. J. 24 Jul 2026 · 16:46

I'm curious about the real-time processing capabilities of the video-action derivative. Can it handle latency issues in robotic applications?

FoodieFiona 2 24 Jul 2026 · 08:21

I'm intrigued by the video-action derivative for robotics. Hope it can handle real-time decision making.

Alex_LDN 24 Jul 2026 · 07:32

Excited to see how FLUX 3's multimodal capabilities translate into robotics. Wondering if it can outperform Gemini Omni in complex tasks.

unLecteurCurieux 24 Jul 2026 · 07:27

I wonder how FLUX 3's video-action derivative will handle complex robotic tasks. Will it be more efficient than existing solutions?

curio_usa 24 Jul 2026 · 07:04

I'm curious to see how FLUX 3 compares to Seedance 2.0 in real-world applications. Any benchmarks yet?

EcoWarrior99 24 Jul 2026 · 06:58

While the multimodal capabilities are impressive, I wonder about the environmental impact of developing and deploying such advanced AI models.

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Темы
Обзор
Информация