Открыть бота

Claude Haiku 5.5 против GPT-6 Luna, Gemini и DeepSeek: какая нейросеть даёт больше всего за свои деньги

, 10 мин чтения

Если коротко: самая умная модель в сравнении — Claude Opus 5.5 (58 баллов), а лучшее соотношение интеллекта, скорости и цены сейчас у Claude Haiku 5.5 — 43 балла в независимом рейтинге Artificial Analysis при цене $0,10 / $0,50 за миллион токенов. Но если считать реальную стоимость выполнения задачи, дешевле всех оказывается GPT-6 Luna Max — $0,07 против $0,21 у Haiku.

Anthropic выпустила Claude Haiku 5.5, и на этот раз «младшая» модель Claude получилась настолько сильной, что её уже нельзя считать просто дешёвой версией Sonnet. Самое интересное начинается, если поставить её рядом не только с Sonnet и Opus, но и с GPT-6 Luna, Gemini 3.8 Flash и DeepSeek V4.1 Flash. У Haiku 5.5 и GPT-6 Luna практически одинаковая цена API — а результаты заметно отличаются. Разбираемся, какая модель сейчас действительно выгоднее.

Данные актуальны на 8 октября 2026 года. Цены — для API, в долларах за 1 млн токенов.

Как мы сравнивали модели

Для основного рейтинга мы взяли Artificial Analysis Intelligence Index v4.3.2. Это важно: производители любят показывать собственные бенчмарки, где их модель выглядит особенно хорошо. Artificial Analysis проверяет все модели по единой методике.

В индекс входят 10 независимых оценок:

  • AA-Briefcase — агентная интеллектуальная работа;
  • GDPval-AA — реальные профессиональные задачи;
  • AutomationBench-AA — автоматизация SaaS-задач;
  • Terminal-Bench 4.0 — работа с терминалом и программирование;
  • SciCode — научное программирование;
  • Humanity's Last Exam — сложные вопросы на знания и рассуждение;
  • GDP.pdf — работа с профессиональными документами;
  • CritPt — физическое рассуждение;
  • AA-Omniscience — знания и устойчивость к галлюцинациям;
  • AA-LCR — задачи с длинным контекстом.

Чем выше Intelligence Index, тем лучше результат.

Главный рейтинг

Рейтинг моделей по Artificial Analysis Intelligence Index v4.3.2
Рейтинг моделей по Artificial Analysis Intelligence Index v4.3.2
  1. 🥇 Claude Opus 5.5 — 58
  2. 🥈 Claude Sonnet 5.5 — 56
  3. 🥉 Gemini 4 Argon — 53
  4. Claude Haiku 5.5 — 43
  5. Gemini 3.8 Flash — 41
  6. DeepSeek V4.1 Flash — 39
  7. GPT-6 Luna Max — 38

Haiku 5.5 обходит GPT-6 Luna Max на 5 пунктов, хотя обе модели стоят одинаково — $0,10 / $0,50 за миллион токенов.

Цена моделей

Модель Вход, 1 млн Выход, 1 млн Цена задачи AA
Claude Haiku 5.5 $0,10 $0,50 $0,21
GPT-6 Luna Max $0,10 $0,50 $0,07
DeepSeek V4.1 Flash $0,30 $1,20 $0,27
Gemini 3.8 Flash $0,75 $3,75 $1,24
Gemini 4 Argon $2 $10 $1,99
Claude Sonnet 5.5 $2 $10 $5,46
Claude Opus 5.5 $4 $20 $5,98

Цена задачи AA — это не цена обычного запроса, а средневзвешенная стоимость выполнения одной задачи из Intelligence Index с учётом входных, выходных, reasoning- и cache-токенов.

И здесь появляется важная деталь: цена токена и реальная цена задачи — не одно и то же. У Haiku и Luna одинаковый тариф, но Luna в тестах Artificial Analysis тратит заметно меньше токенов. Поэтому средняя стоимость задачи у Luna — $0,07, а у Haiku — $0,21.

То есть Haiku умнее, но Luna дешевле выполняет саму задачу. Смотреть только на цену миллиона токенов уже недостаточно.

Скорость

Модель Скорость, токенов/с
Claude Haiku 5.5 243
DeepSeek V4.1 Flash 216
GPT-6 Luna Max 128
Gemini 3.8 Flash 125
Claude Sonnet 5.5 125
Claude Opus 5.5 95
Gemini 4 Argon нет данных

Haiku 5.5 действительно очень быстрый: около 243 токенов в секунду. Это почти вдвое быстрее Luna Max и примерно в 2,5 раза быстрее Opus 5.5. Для Gemini 4 Argon Artificial Analysis пока не публикует скорость вывода.

Haiku 5.5 против GPT-6 Luna — главный сюрприз

Обе модели в одной ценовой категории, обе рассчитаны на массовое использование, у обеих контекст 1 млн токенов. Но:

Claude Haiku 5.5 GPT-6 Luna Max
Intelligence Index 43 38
Скорость 243 т/с 128 т/с
Цена API $0,10 / $0,50 $0,10 / $0,50
Цена задачи AA $0,21 $0,07

Преимущество Haiku по Intelligence Index — около 13%, и при этом он почти вдвое быстрее. Обратная сторона: на задачах Artificial Analysis Luna оказался примерно в три раза дешевле. Стоимость зависит не только от тарифа, но и от того, сколько токенов модель тратит на решение, — и Luna здесь гораздо экономнее.

Что умеет Haiku 5.5 на практике

Anthropic позиционирует Haiku 5.5 как модель для задач, где важны скорость, объём и цена:

  • суммаризация, классификация, извлечение информации;
  • обработка документов и запросы к базам данных;
  • поддержка клиентов;
  • работа в браузере (browser use);
  • суб-агенты и массовая обработка данных.

Но новая версия уже далеко не ограничивается простыми задачами. Результаты по данным Anthropic:

Тест Haiku 5.5
GDPval-AA 1620
AA-Briefcase 1578
OSWorld 72,4%
Humanity's Last Exam 45,9% без инструментов / 57,4% с инструментами
Terminal-Bench 4.0 39,2%
FrontierCode 1.1 46,4%

Для сравнения: Sonnet 5.5 в сложном агентном программировании заметно сильнее — около 70,6% в Terminal-Bench 4.0 по таблице Anthropic. Поэтому Haiku не заменяет Sonnet и Opus: он закрывает другой класс задач.

Sonnet 5.5 — возможно, самый интересный середняк

Sonnet 5.5 получает 56 баллов — всего на 2 меньше Opus 5.5. При этом тариф вдвое ниже: $2 / $10 против $4 / $20.

Но стоимость одной задачи Artificial Analysis почти одинаковая: $5,46 у Sonnet против $5,98 у Opus. Причина — количество токенов: на максимальном уровне рассуждения Sonnet 5.5 очень много «думает» и генерирует большой объём выходных токенов. Поэтому для Sonnet особенно важно правильно выбирать уровень reasoning.

Opus 5.5 — пока абсолютный лидер

Если отбросить стоимость, самая сильная модель списка — Claude Opus 5.5: 58 баллов, первое место.

  • скорость около 95 токенов/с;
  • $4 за вход и $20 за выход;
  • $5,98 за задачу Intelligence Index;
  • контекст 1 млн токенов.

Opus особенно силён там, где нужны многоступенчатые рассуждения, сложное программирование и агентная работа. Но и платить за этот уровень приходится существенно больше.

Gemini 4 Argon

53 балла — между Sonnet 5.5 и Haiku 5.5. Цена $2 / $10, около $1,99 за задачу Artificial Analysis, контекст 1 млн токенов, принимает текст и изображения. Главный минус в нашем сравнении — Artificial Analysis пока не показывает его скорость, поэтому в рейтинг скорости Argon не попал.

Gemini 3.8 Flash

41 балл — всего на 2 меньше Haiku. Цена $0,75 / $3,75, задача — $1,24, скорость 125 т/с, контекст 1 млн токенов. Принимает не только текст и изображения, но и аудио и видео.

Рядом с ним Haiku выглядит очень агрессивно: 43 против 41 балла, 243 против 125 т/с и в 7,5 раза дешевле по обоим базовым тарифам.

DeepSeek V4.1 Flash

39 баллов — ниже Haiku и Gemini Flash, но модель остаётся очень интересной: $0,30 / $1,20, задача — $0,27, скорость 216 т/с, контекст 1 млн токенов.

Главное — это открытые веса: 552 млрд общих параметров, около 16 млрд активных, лицензия MIT. Если компании нужны собственные веса и контроль над инфраструктурой, это совсем другая категория преимуществ, и одним Intelligence Index её не оценить.

Всё в одной таблице

Модель AA Index Вход Выход $ за задачу AA Скорость
🥇 Claude Opus 5.5 58 $4 $20 $5,98 95 т/с
🥈 Claude Sonnet 5.5 56 $2 $10 $5,46 125 т/с
🥉 Gemini 4 Argon 53 $2 $10 $1,99 —
Claude Haiku 5.5 43 $0,10 $0,50 $0,21 243 т/с
Gemini 3.8 Flash 41 $0,75 $3,75 $1,24 125 т/с
DeepSeek V4.1 Flash 39 $0,30 $1,20 $0,27 216 т/с
GPT-6 Luna Max 38 $0,10 $0,50 $0,07 128 т/с

Данные Artificial Analysis на 8 октября 2026 года; для моделей с рассуждением использованы опубликованные максимальные режимы.

Кто победил в каждой категории

Категория Победитель Почему
🧠 Максимальный интеллект Claude Opus 5.5 58 баллов
⚖️ Интеллект + цена Claude Haiku 5.5 43 балла при $0,10 / $0,50
💸 Самая дешёвая задача GPT-6 Luna Max $0,07 за задачу
⚡ Скорость Claude Haiku 5.5 около 243 т/с
💻 Сложное программирование и агенты Claude Opus 5.5 / Sonnet 5.5 заметный отрыв в агентном coding
🤑 Массовая обработка Claude Haiku 5.5 / GPT-6 Luna одинаковый тариф, разные сильные стороны
🔓 Открытая модель DeepSeek V4.1 Flash открытые веса и лицензия MIT

Главный вывод

Самое интересное в этом сравнении — не Opus против Sonnet и не Gemini против Claude, а Claude Haiku 5.5 против GPT-6 Luna Max. Они стоят одинаково, но:

  • Haiku умнее (43 против 38) и быстрее (243 против 128 т/с);
  • Luna дешевле выполняет задачи ($0,07 против $0,21).

Нельзя сказать, что одна модель просто «лучше» — они оптимизированы под разные сценарии. Нужны скорость и интеллект — Haiku 5.5. Важна минимальная фактическая стоимость — GPT-6 Luna Max.

И это важный тренд рынка: вопрос «какая нейросеть самая умная?» постепенно сменяется вопросом «какая модель решает мою задачу достаточно хорошо за минимальные деньги и время?».

Как распределить модели на практике

Модель Для чего
Claude Opus 5.5 самые сложные задачи, глубокие рассуждения, сложные coding-агенты, исследования — когда цена вторична
Claude Sonnet 5.5 основная рабочая модель: программирование, агенты, документы, профессиональные задачи
Gemini 4 Argon сложная универсальная работа, мультимодальные сценарии, большие контексты
Claude Haiku 5.5 массовые задачи, быстрые агенты, классификация, суммаризация, поддержка, browser use, суб-агенты
Gemini 3.8 Flash быстрые мультимодальные задачи: текст, изображения, аудио, видео
DeepSeek V4.1 Flash дешёвые задачи, открытые веса, своя инфраструктура, эксперименты
GPT-6 Luna Max очень дешёвое рассуждение и массовые задачи, когда цена готовой задачи важнее максимального балла

Итог

  • По интеллекту: Opus 5.5 > Sonnet 5.5 > Gemini 4 Argon > Haiku 5.5 > Gemini 3.8 Flash > DeepSeek V4.1 Flash > GPT-6 Luna Max.
  • По цене API: Haiku 5.5 = GPT-6 Luna < DeepSeek < Gemini Flash < Argon = Sonnet < Opus.
  • По скорости: Haiku 5.5 > DeepSeek V4.1 Flash > Luna ≈ Gemini Flash ≈ Sonnet > Opus.

Если строить сервис с тысячами и миллионами запросов, сейчас стоит очень внимательно тестировать Claude Haiku 5.5 и GPT-6 Luna Max на реальных задачах проекта. Между ними один из самых интересных компромиссов рынка: Haiku — больше качества и скорости, Luna — меньше стоимость задачи.

А для действительно сложных запросов удобно строить каскад Luna / Haiku → Sonnet → Opus: дорогая модель вызывается только тогда, когда она действительно нужна.

Важно: Artificial Analysis — это не «оценка качества нейросети вообще», а составной индекс из конкретного набора тестов. Разница в 2–5 баллов не означает, что одна модель автоматически будет лучше именно в вашем сценарии: для программирования, документов, агентов, мультимодальности и обычного чата победители могут отличаться.

GPT-6, Gemini, DeepSeek и Claude можно попробовать без зарубежной карты в Telegram-боте BrainAid — список доступных нейросетей.

Частые вопросы

Что лучше: Claude Haiku 5.5 или GPT-6 Luna?

По Artificial Analysis Haiku 5.5 умнее (43 балла против 38) и почти вдвое быстрее (243 против 128 токенов в секунду). Но GPT-6 Luna Max дешевле выполняет задачи: $0,07 против $0,21 за задачу теста. Нужны качество и скорость — Haiku, нужна минимальная стоимость — Luna.

Какая нейросеть самая умная в октябре 2026?

Среди моделей этого сравнения — Claude Opus 5.5: 58 баллов в Artificial Analysis Intelligence Index v4.3.2.

Сколько стоит Claude Haiku 5.5?

$0,10 за 1 млн входных токенов и $0,50 за 1 млн выходных — столько же, сколько GPT-6 Luna Max.

Почему цена токенов и цена задачи отличаются?

Модели тратят на одну и ту же задачу разное количество токенов, включая токены рассуждения. Поэтому модель с одинаковым тарифом может обходиться в разы дешевле или дороже на практике.

Что такое Artificial Analysis Intelligence Index?

Независимый составной рейтинг из 10 тестов: агентная работа, профессиональные задачи, программирование, научные вопросы, документы, длинный контекст и устойчивость к галлюцинациям. Все модели проверяются по единой методике.

Читайте также

Открыть в Telegram