Лагуна 118B работает на DGX Spark, Inkling становится мультимодальным, K3 фиксирует свою коммерческую лицензию: бенчмарки и условия резюме #23

Продолжение истории : Kimi K3 : de la preview au live· Часть 17/17

Модели и инструменты 16 h ago9В закладки

Лагуна 118B работает на DGX Spark, Inkling становится мультимодальным, K3 фиксирует свою коммерческую лицензию: бенчмарки и условия резюме #23
Иллюстрация : Léa Fontaine

Три архитектуры для сравнения: MoE 118B / 8B активных слоёв от Poolside, работающий на одной машине; мультимодальная модель 975B / 41B от Inkling, также выпущенная в версии 276B / 12B; и модель Kimi K3 с контекстом 1M и 2,8T / 104B параметров, чьё коммерческое соглашение может вытеснить американские компании.

Простыми словами. Три основных открытых модели, выпущенные одновременно: Laguna S2.1 (Poolside), Inkling (Thinking Machines) и Kimi K3 (Moonshot). Они не нацелены на одно и то же применение — простое развёртывание, база для мультимодального fine-tuning, максимальный frontier — и их лицензии делают их стратегически разными выборами для CTO.

Контекст

Подборка #23 от Interconnects (Натан Ламберт, 2 августа 2026) охватывает неделю в мире open-source. Три релиза выделяются, каждая с уникальным архитектурным профилем и лицензионным соглашением, которое не менее важно, чем бенчмарки.

Три архитектуры

  • Laguna S2.1 (Poolside): MoE 118B / 8B активных, лицензия OpenMDW (похожая на Apache-2), пред- и пост-обучение опубликованы — Ламберт отмечает прозрачность как необычную для открытого релиза. Работает на одном DGX Spark.
  • Inkling (Thinking Machines): мультимодальная MoE 975B / 41B активных (текст, изображения, аудио → текст). Также выпущена версия 276B / 12B. Ламберт позиционирует её как базу для fine-tuning, а не как топовый бенчмарк.
  • Kimi K3 (Moonshot): 2,8T / 104B активных, контекст 1M токенов, нативная поддержка vision (arXiv:2607.24653 — Kimi Delta Attention, Attention Residuals, Stable LatentMoE). Лицензия некоммерческая + обязательное коммерческое соглашение — пункт, вызывающий споры.
Под капотом — сравнение + побочные сигналы
  • Основные модели: Laguna 118B/8B (DGX Spark, OpenMDW)
  • Inkling 975B/41B мультимодальная
  • K3 2,8T/104B, 1M токенов, требуется коммерческое соглашение. Побочные релизы, упомянутые Ламбертом: Hy3 (Tencent, 295B/21B, Apache 2, математические доказательства)
  • Обновление DeepSeek V4-Flash, на следующий день после снижения цен OpenAI (см. #1738)
  • LongCat 2.0 (1,6T MoE, обучался на Ascend 910 — тред `china-sovereign-compute`).

Анализ — кто что использует

Сегментация по ограничениям развёртывания. Laguna для команды, которой нужно минимизировать инфраструктуру (единственная из троих, работающая на одной машине с документацией). Inkling 276B / 12B как лёгкая база для мультимодального R&D. K3 для максимального frontier — но пункт коммерческого соглашения может заблокировать американскую компанию с экспортными ограничениями.

Вероятные сценарии

  • K3 вне США, Laguna в Европе / для малого бизнеса в США, Inkling в R&D (~50%): естественная сегментация по лицензии.
  • Poolside продвигает Laguna в корпоративном секторе США как альтернативу Fable 5 (~30%).
  • Закрытая копия Inkling от Thinking Machines для своих клиентов (~20%).

Выводы для профессионалов

  • Разработчики / ML-инженеры: три серьёзные базы для fine-tuning; перед развёртыванием проверить пункт коммерческого соглашения K3.
  • CTO корпораций США: Kimi K3 = юридический анализ перед техническим.
  • Архитектор данных: Laguna — лучший кандидат для быстрого POC с саморазвёртыванием.

На что обратить внимание

Внешние бенчмарки; первые реализации K3 вне Китая; версия 276B / 12B Inkling на Hugging Face; реальная стоимость на токен.

Итог. На этой неделе open-source — это не одна модель, а три стратегических выбора, которые нужно сортировать по ограничениям развёртывания и условиям лицензии.

Resources

Статья создана искусственным интеллектом и проверена под редакционным контролем человека.

Наша редакция
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Была ли статья полезной?

10 чел. оценили эту статью

Нравится
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
Поделиться:
Комментарии (9)

Войдите, чтобы участвовать в обсуждении.

ArtLoverLA 03 Aug 2026 · 11:14

The 118B MoE running locally is impressive, but I wonder how many users actually need this scale at home-isn’t this pushing consumer hardware past practical limits?

Emma_London 03 Aug 2026 · 06:29

Still skeptical about running 2.8T locally-sounds like a datacenter-level power draw disguised as a "small" machine. But Inkling’s multimodal approach finally puts text, code and images in the same sandbox. Time to see how it handles ambiguity.

ArtLover99 03 Aug 2026 · 10:42

The 2.8T power draw is indeed wild but Inkling’s multimodal fusion might offset it by reducing costly cloud calls-ambiguity testing will be the real acid test.

EcoWarrior99 03 Aug 2026 · 06:23

Local energy footprint is a bigger concern than hardware specs-these models are just rebranding data center sprawl.

TechSavvy47 03 Aug 2026 · 05:59

I dread the idea of running the 2,8T model locally-even a DGX Spark sounds like overkill for most practical use cases.

TechGuru99 03 Aug 2026 · 05:49

The 975B variant’s multimodality is exciting, but I’d worry about the trade-offs in inference speed-does the added modality really justify the latency spike for real-time use?

Dr. L. 03 Aug 2026 · 05:46

Why is the 2.8T model even marketed as local-runnable? Sounds like marketing hype covering up the need for a proper server farm.

Alex_LDN 03 Aug 2026 · 05:23

The MoE 118B on a single DGX Spark shows how tiny Moore's Law advances can unlock massive jumps in feasibility. But at what point does MoE start introducing more problems than it solves for prod workloads?

BookWorm88 02 Aug 2026 · 20:37

Inkling's multimodal jump is impressive, but I wonder if the 276B/12B variant will be usable on consumer hardware or if that's reserved for enterprise only.

FoodieFiona 2 02 Aug 2026 · 20:08

The 118B MoE on Spark is wild-wonder how much latency jumps when you scale to 10 users on one machine.

Хронология истории

Kimi K3 : de la preview au live

  1. 1Kimi K3 goes live: Moonshot ships the model after the preview flood16/07/2026
  2. 2Kimi K3 goes live at 2.8 trillion parameters: Moonshot ships the biggest open-weight frontier bet yet17/07/2026
  3. 3The "pelican benchmark" by Simon Willison arbitrates Kimi K317/07/2026
  4. 4Kimi K3 pricing: China's frontier goes premium, ends the race-to-the-bottom18/07/2026
  5. 5Слой приёма Kimi K3: как аналитик читает сплиты — и что действительно было отправлено18/07/2026
  6. 6Moonshot приостанавливает новые подписки на Kimi K3: спрос в первую неделю превышает производственные мощности19/07/2026
  7. 7Moonshot AI нацелена на IPO в Гонконге: Kimi K3 зарабатывает на рынках20/07/2026
  8. 8Kimi K3 занимает второе место после Fable 5 в рейтинге AA-Briefcase — недавняя переоценка Moonshot сместила лидера на вершину лестницы22/07/2026
  9. 9Kimi K3: наступил ли «момент DeepSeek» для Moonshot?23/07/2026
  10. 10Kimi K3 не является дистилляцией Claude Fable — двухнедельный срок делает это невозможным.23/07/2026
  11. 11"AI коммунизм": Kimi K3 потрясает тезис о монополии на модели на Уолл-стрит24/07/2026
  12. 12Великобритания AISI и CAISI публикуют первую совместную кибер-оценку Kimi K325/07/2026
  13. 13Kimi K3 выходит с 2,8T параметров: Moonshot делает крупнейшую открытую ставку на фронтир-модель26/07/2026
  14. 14Великобритания AISI и CAISI публикуют первую совместную кибероценку Kimi K326/07/2026
  15. 15Moonshot планирует открыть Kimi K3 - крупнейшая постоянная ставка на открытие новых горизонтов получает постоянное место27/07/2026
  16. 16Что три внешних аспекта Kimi K3 говорят нам — архитектура, внимание к деталям и настоящие амбиции28/07/2026
  17. 17Лагуна 118B работает на DGX Spark, Inkling становится мультимодальным, K3 фиксирует свою коммерческую лицензию: бенчмарки и условия резюме #2302/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Темы
Обзор
Информация