lll.bz / llm

Какую ИИ-модель выбрать прямо сейчас?

Топ-3 моделей по 22 задачам. Обновляем рейтинг каждые 10 дней.

Обновлено 18 августа 2026 · данные за 9–18 августа

Следующее обновление: 28 августа

Универсальный чат

Для сложных повседневных задач, анализа, диалога и работы с большим контекстом.

СвежийТест: 12 августа 2026 · проверено 18 августа 2026LMArena Text Arena

#1

Claude Fable 5

Anthropic

Выбирать, когда нужен максимум качества на сложной интеллектуальной работе.

Score1506

Цена

$10 / 1M input · $50 / 1M output

  • длинные многоэтапные задачи
  • глубокий анализ
  • сильная самопроверка результата
Источник ↗
#2

Claude Opus 4.6

Anthropic

Tested: High

Почти уровень лидера при заметно меньшей цене.

Score1505

Цена

$5 / 1M input · $25 / 1M output

  • сильный общий reasoning
  • хорошо работает с большим контекстом
  • хорошее соотношение качества и цены
Источник ↗
#3

Claude Opus 4.7

Anthropic

Tested: High

Стабильный frontier-вариант для универсальных сложных задач.

Score1502

Цена

$5 / 1M input · $25 / 1M output

  • высокий общий уровень
  • большой контекст
  • стабильное выполнение сложных инструкций
Источник ↗

Русский язык

Для ответов, редактуры и сложных текстов на естественном русском языке.

СвежийТест: 12 августа 2026 · проверено 18 августа 2026LMArena Russian Arena

#1

Claude Fable 5

Anthropic

Лучший текущий результат именно на русском языке.

Score1518

  • естественный русский
  • сильная редактура
  • хорошо держит длинный контекст
Источник ↗
#2

Gemini 3.7 Flash

Google

Tested: HighPreliminary

Почти лидер по качеству, но значительно дешевле и быстрее.

Score1514

Цена

$0.75 / 1M input · $3.57 / 1M output

  • сильный русский
  • высокая скорость
  • низкая цена
Источник ↗
#3

Muse Spark 1.2

Tested: xHigh

Сильная недорогая альтернатива лидерам по русскому языку.

Score1514

  • результат на уровне Gemini
  • заметно дешевле дорогих frontier-моделей
  • полезна как независимая альтернатива
Источник ↗

Экспертный анализ

Для стратегии, сложных профессиональных вопросов, memo, due diligence и принятия решений.

СвежийТест: 12 августа 2026 · проверено 18 августа 2026Expert Arena

#1

Claude Fable 5

Anthropic

Выбирать, когда цена ошибки важнее стоимости токенов.

Score1548

  • сложный профессиональный анализ
  • длинные reasoning-задачи
  • работа с неоднозначными данными
Источник ↗
#2

Claude Opus 4.6

Anthropic

Tested: High

Практически ничья с Fable, но заметно дешевле.

Score1547

  • аналитика
  • стратегии
  • работа с большим массивом информации
Источник ↗
#3

Claude Opus 5

Anthropic

Tested: High

Особенно силён, когда анализ превращается в длинный рабочий процесс.

Score1541

Цена

$5 / $25 за 1M input/output

  • deep reasoning
  • long-horizon work
  • agentic workflows
Источник ↗

Математика

Для сложных вычислений, доказательств и многошаговых математических задач.

СвежийТест: 12 августа 2026 · проверено 18 августа 2026Math Arena

#1

Claude Opus 5

Anthropic

Лучший текущий выбор для самой тяжёлой математики.

Score1553

  • многошаговый reasoning
  • сильная проверка решения
  • хороший результат на сложных задачах
Источник ↗
#2

Claude Fable 5

Anthropic

Выбирать для математики, смешанной с исследованием и объяснением.

Score1527

Источник ↗
#3

Gemini 3.7 Flash

Google

Tested: HighPreliminary

Лучшее соотношение цены и качества среди этой тройки.

Score1521

Источник ↗

Следование инструкциям

Для промптов с множеством условий, форматов и ограничений.

СвежийТест: 12 августа 2026 · проверено 18 августа 2026Instruction Following Arena

#1

Claude Opus 4.6

Anthropic

Tested: High

Лучший выбор, когда каждое условие промпта действительно важно.

Score1514

Источник ↗
#2

Claude Fable 5

Anthropic

Лучше подходит, если инструкция превращается в большой многоэтапный проект.

Score1511

Источник ↗
#3

Claude Opus 4.7

Anthropic

Tested: High

Стабильный вариант для жёстко структурированных заданий.

Score1503

Источник ↗

Тексты и копирайтинг

Для статей, сценариев, лендингов, рекламы, редактуры и creative writing.

СвежийТест: 12 августа 2026 · проверено 18 августа 2026Creative Writing Arena

#1

Claude Fable 5

Anthropic

Лучший выбор, когда текст должен выглядеть не шаблонным и выдерживать несколько итераций редактуры.

Score1506

Источник ↗
#2

Claude Opus 4.6

Anthropic

Tested: High

Сильный профессиональный копирайтинг без максимальной цены Fable.

Score1500

Источник ↗
#3

Gemini 3.7 Flash

Google

Tested: HighPreliminary

Подходит, когда нужно быстро перебрать много разных концепций и вариантов.

Score1493

Источник ↗

Программирование

Для написания, разбора, исправления и рефакторинга программного кода.

СвежийТест: 12 августа 2026 · проверено 18 августа 2026Coding Arena

#1

Claude Fable 5

Anthropic

Выбирать для сложных изменений во всём репозитории и длинных coding-сессий.

Score1554

  • сложный рефакторинг
  • большие codebase
  • автономная разработка
Источник ↗
#2

Claude Opus 4.7

Anthropic

Tested: High

Практически уровень лидера при меньшей стоимости.

Score1552

Источник ↗
#3

Claude Opus 4.6

Anthropic

Tested: High

Стабильный вариант для production-кода и исправления существующих проектов.

Score1551

Источник ↗

WebDev

Для создания сайтов, интерфейсов и полноценных frontend-приложений.

СвежийТест: 15 августа 2026 · проверено 18 августа 2026WebDev Arena

#1

Claude Opus 5

Anthropic

Tested: Max

Лучший текущий выбор для полноценного продукта, а не отдельного UI-компонента.

Score1692

  • end-to-end разработка
  • сложные интерфейсы
  • multi-file изменения
Источник ↗
#2

Kimi K3

Moonshot

Tested: Max

Очень сильная альтернатива лидеру за меньшие деньги.

Score1674

Цена

$3 / $15 за 1M input/output

Источник ↗
#3

Qwen3.8

Qwen

Tested: MaxPreliminary

Лучшее соотношение цены и WebDev-качества в текущей тройке.

Score1667

Цена

$2 / $6

Источник ↗

AI-агенты

Для моделей, которые должны пользоваться инструментами и доводить задачу до результата.

СвежийТест: 13 августа 2026 · проверено 18 августа 2026Agent Arena

#1

Claude Opus 5

Anthropic

Tested: High

Лучший текущий выбор, когда AI должен не ответить, а выполнить работу.

Net improvement12.19%

Источник ↗
#2

Claude Fable 5

Anthropic

Tested: High

Особенно хорош для длинных автономных рабочих процессов.

Net improvement12.01%

Источник ↗
#3

GPT-5.6 Sol

OpenAI

Tested: xHigh

Сильный агентный выбор внутри OpenAI-стека.

Net improvement10.86%

Источник ↗

Поиск и deep research

Для поиска по сети, сбора источников и построения доказательного ответа.

Тест старше 10 днейТест: 21 июля 2026 · проверено 18 августа 2026Search Arena

#1

Claude Opus 4.6

Anthropic

Tested: Search

Лидер последнего специализированного Search Arena.

Score1253

Источник ↗
#2

GPT-5.5

Tested: Search

Сильный вариант для исследований внутри OpenAI-экосистемы.

Score1240

Источник ↗
#3

Claude Fable 5

Anthropic

Подходит для больших и неоднозначных исследований с большим числом источников.

Score1237

Источник ↗

PDF и документы

Для анализа длинных PDF, отчётов, договоров и больших наборов документов.

Тест старше 10 днейТест: 26 июля 2026 · проверено 18 августа 2026Document Arena

#1

Claude Opus 5

Anthropic

Лучший выбор для глубокого разбора длинного документа.

Score1520

Источник ↗
#2

Claude Opus 4.6

Anthropic

Проверенный вариант для больших PDF и сложного document reasoning.

Score1510

Источник ↗
#3

Claude Fable 5

Anthropic

Для документов, где нужен не summary, а полноценное расследование и synthesis.

Score1504

Источник ↗

Анализ изображений

Для понимания фотографий, схем, интерфейсов, диаграмм и визуального контекста.

Тест старше 10 днейТест: 6 августа 2026 · проверено 18 августа 2026Vision Arena

#1

Claude Fable 5

Anthropic

Лучше всего подходит для вопроса «что здесь происходит и почему?».

Score1315

Источник ↗
#2

Qwen3.8

Qwen

Tested: Max

Очень сильное vision-качество при заметно меньшей цене.

Score1301

Источник ↗
#3

Claude Opus 4.7

Anthropic

Tested: High

Надёжная мультимодальная альтернатива внутри Claude.

Score1301

Источник ↗

OCR

Для извлечения текста из сканов, фото, таблиц и изображений документов.

Тест старше 10 днейТест: 6 августа 2026 · проверено 18 августа 2026OCR Arena

#1

Claude Fable 5

Anthropic

Лучший вариант, когда после OCR нужно сразу понять содержимое документа.

Score1331

Источник ↗
#2

Qwen3.8

Qwen

Tested: Max

Сильный OCR при значительно меньшей стоимости.

Score1317

Источник ↗
#3

Claude Opus 4.6

Anthropic

Tested: High

Хорош для OCR плюс последующего reasoning по извлечённому тексту.

Score1315

Источник ↗

Генерация изображений

Для создания изображений по текстовому описанию.

СвежийТест: 10 августа 2026 · проверено 18 августа 2026Text-to-Image Arena

#1

GPT Image 2

OpenAI

Лучший текущий универсальный генератор изображений.

Score1381

  • сложные инструкции
  • текст внутри изображения
  • генерация и editing в одном стеке
Источник ↗
#2

MAI-Image-2.6

Preview

Главный свежий challenger GPT Image 2.

Score1336

Источник ↗
#3

Grok Imagine Image 2.0

Tested: LowPreliminary

Сильный третий вариант для независимой генерации визуальной концепции.

Score1316

Источник ↗

Редактирование изображений

Для изменения готового изображения по текстовой инструкции.

Живой лидербордпроверено 18 августа 2026Artificial Analysis Image Editing

Независимые лидерборды сейчас расходятся.

LMArena 7 августа давала другой порядок: GPT Image 2 → Grok Imagine Image 2.0 → Muse Image. lmarena.ai

#1

Reve 2.1

Текущий лидер специализированного image-editing рейтинга Artificial Analysis.

Score1263

Источник ↗
#2

GPT Image 2

OpenAI

Самый надёжный универсальный выбор: очень высокий результат сразу в нескольких независимых тестах.

Score1257

Источник ↗
#3

MAI-Image-2.5

Сильная третья модель для сравнения edit-вариантов.

Score1257

Источник ↗

Текст → видео

Для генерации готового видео непосредственно из текстового описания.

СвежийТест: 14 августа 2026 · проверено 18 августа 2026Text-to-Video Arena

#1

Gemini Omni Flash

Google

Лучший текущий text-to-video по свежему Arena.

Score1512

Источник ↗
#2

FLUX 3 Video

Preliminary

Ближайший новый конкурент лидера.

Score1494

Источник ↗
#3

Dreamina Seedance 2.0

Tested: 720p

Проверенный универсальный вариант с большой выборкой голосов.

Score1482

Источник ↗

Изображение → видео

Для превращения готового изображения или кадра в видео.

СвежийТест: 14 августа 2026 · проверено 18 августа 2026Image-to-Video Arena

#1

MiniMax H3

Лучший текущий способ оживить готовый кадр.

Score1489

Источник ↗
#2

Dreamina Seedance 2.5

Tested: 720p

Практически на уровне лидера и одновременно силён в video editing.

Score1484

Источник ↗
#3

Dreamina Seedance 2.0

Tested: 720p

Самый хорошо проверенный вариант из текущей тройки.

Score1478

Источник ↗

Редактирование видео

Для изменения существующего видео при сохранении движения, сцены и персонажей.

СвежийТест: 14 августа 2026 · проверено 18 августа 2026Video Edit Arena

#1

Dreamina Seedance 2.5

Tested: 720p

Лучший текущий AI video editor.

Score1411

Источник ↗
#2

MiniMax H3

Лучший универсал для image-to-video плюс последующих изменений.

Score1388

Источник ↗
#3

Dreamina Seedance 2.0

Tested: 720p

Проверенная версия, когда Seedance 2.5 недоступен.

Score1359

Источник ↗

Распознавание речи

Для транскрипции звонков, интервью, видео и длинных аудиозаписей.

Живой лидербордпроверено 18 августа 2026Artificial Analysis Speech-to-Text

#1

Fun-Realtime-ASR

Preview

Максимальная текущая точность распознавания речи.

AA-WER1.7%

Чем ниже WER, тем лучше.

Источник ↗
#2

ElevenLabs Scribe v2

Сильный production-вариант с развитой voice-экосистемой.

AA-WER2.2%

Чем ниже WER, тем лучше.

Источник ↗
#3

MAI-Transcribe-1.5

Точная транскрипция с хорошей производительностью на больших объёмах.

AA-WER2.4%

Чем ниже WER, тем лучше.

Источник ↗

Озвучка

Для превращения текста в естественную человеческую речь.

Живой лидербордпроверено 18 августа 2026Artificial Analysis Speech Arena

#1

Sonic 3.6

Самая предпочитаемая пользователями TTS-модель в текущем рейтинге.

Elo1282

Источник ↗
#2

Simba 3.2

Сильная альтернатива с другим голосовым характером.

Elo1239

Источник ↗
#3

Qwen-Audio-3.0-TTS-Plus

Практически на уровне второго места и полезна внутри Qwen-стека.

Elo1237

Источник ↗

Голосовой AI

Для голосовых ассистентов и AI-агентов, разговаривающих с человеком в реальном времени.

Живой лидербордпроверено 18 августа 2026Artificial Analysis Speech-to-Speech

#1

Qwen Audio 3.0 Realtime Plus

Лучший текущий выбор для полноценного разговаривающего AI-агента.

Conversational dynamics98.4%

Главный критерий здесь — качество самого разговора, а не только задержка.

Источник ↗
#2

Qwen Audio 3.0 Realtime Flash

Выбирать, когда особенно важна скорость разговора.

Conversational dynamics96.9%

Главный критерий здесь — качество самого разговора, а не только задержка.

Источник ↗
#3

GPT-Realtime-2

OpenAI

Tested: Minimal

Лучший вариант для voice-агента, тесно связанного с tools и OpenAI API.

Conversational dynamics96.1%

Главный критерий здесь — качество самого разговора, а не только задержка.

Источник ↗

Генерация музыки

Для создания законченной музыки и песен из текстового описания.

Живой лидербордпроверено 18 августа 2026Artificial Analysis Music Arena

#1

Suno V5.5

Лучший текущий универсальный генератор музыки.

Elo1187

Источник ↗
#2

Mureka V9

Практически ничья с Suno — обязательно стоит сравнивать обе генерации.

Elo1182

Источник ↗
#3

Mureka V8

Стабильный третий вариант для альтернативной музыкальной концепции.

Elo1167

Источник ↗
Как составлен рейтинг

Одной «лучшей ИИ-модели вообще» здесь нет. У каждой задачи свой источник: публичный лидерборд, независимые тесты, официальные данные моделей. Каждые 10 дней рейтинг перепроверяется. Разные режимы одной базовой модели не занимают два места в одном топ-3. Если тест давно не обновлялся, показываем дату последнего среза. Лайки — отдельный сигнал читателей: на рейтинг они не влияют.