Kimi k3 догоняет fable: кто теперь король ии-бенчмарков?

22.07.2026 · 5 мин

За последний год я перепробовал с десяток языковых моделей. Claude, GPT-4o, Gemini, Qwen — каждая хвалилась бенчмарками, каждая обещала прорыв. И вот теперь на арену выходят Kimi K3 и Fable, и картина снова меняется.

Если коротко: Kimi K3 конкурентоспособен с Fable, а вместе они выдают SoTA (State of the Art — передовое качество). Разбираемся, что это значит на практике.

Что за модели и почему о них стоит знать

Fable — модель от Fireworks AI, построенная для работы с длинными контекстами (до миллиона токенов). Это означает, что она может анализировать, скажем, кодовую базу целиком или читать тысячи страниц документации за один запрос.

Kimi K3 — модель от китайской компании Moonshot AI (создатели Kimi Chat). K3 — это их флагманская версия, которая активно используется в азиатском рынке и показывает сильные результаты на задачах рассуждения.

Обе модели позиционируются как конкуренты топовым решениям. И вот что интересно: Fireworks AI, которая стоит за Fable, официально заявляет, что Kimi K3 конкурентен их детищу.

Где kimi k3 держится на уровне

По данным бенчмарков, которые приводит Fireworks AI, Kimi K3 показывает сопоставимые результаты с Fable в нескольких ключевых областях:

Сравнение моделей на ключевых задачах
─────────────────────────────────────────────────────────
                        Fable       Kimi K3
Математика              ████████    ███████░   ≈5%
Кодирование             ███████░    ████████   ≈3%
Длинный контекст        █████████    ████████   ≈15%
───────────────────▶  производительность (бенчмарки)
Kimi K3 конкурентен Fable, отставая в основном на задачах с длинным контекстом

Цифры условные (точных данных в публичном посте Fireworks нет — только заявления), но тренд понятен: Kimi K3 — это не «китайский клон», а самостоятельная модель с сильными сторонами.

Где fable сохраняет перевес

Архитектурные преимущества Fable:

Почему это важно для рынка

Раньше казалось, что гонка — это дело нескольких американских гигантов. OpenAI, Anthropic, Google. Китайские модели воспринимались как «дешёвая альтернатива» с оговорками на качество.

Kimi K3 ломает это представление. Это не просто конкурент — это модель, которая стоит вровень с топовым решением от Fireworks.

Что это значит для вас:

Экосистема языковых моделей — 2026
───────────────────────────────────────
        Американские      Азиатские
Топ     ██████████████    ████████████
        (GPT-4o, Claude)  (Kimi K3, Qwen)
Сред    ████████████     ████████████
        (Mistral, Llama)  (GLM, Baichuan)
Низ     ████████         ████████████
        (open models)     (cheap APIs)
───────────────────────────────────────
Разрыв сокращается → выбор растёт
Китайские модели активно догоняют американские, предлагая конкурентное качество

Моя оценка

Я всегда скептически отношусь к заявлениям «мы SoTA». Бенчмарки — это лотерея, и любая компания может выбрать тесты, где её модель сильнее.

Что это значит практически:

Самый интересный вывод: Fable + Kimi K3 вместе дают SoTA. Это означает, что комбинация разных подходов работает лучше, чем любая модель в одиночку. Если у вас есть инфраструктура для работы с несколькими моделями — это ваш путь.

Выводы

Ссылки

Дмитрий Полухин — продуктовый дизайнер. Пишу про разработку, AI и дизайн интерфейсов. Обо мне, контакты и профили.