Claude Fable 5
Anthropic
Выбирать, когда нужен максимум качества на сложной интеллектуальной работе.
Score1506
$10 / 1M input · $50 / 1M output
- длинные многоэтапные задачи
- глубокий анализ
- сильная самопроверка результата
lll.bz / llm
Топ-3 моделей по 22 задачам. Обновляем рейтинг каждые 10 дней.
Обновлено 18 августа 2026 · данные за 9–18 августа
Следующее обновление: 28 августа
Для сложных повседневных задач, анализа, диалога и работы с большим контекстом.
СвежийТест: 12 августа 2026 · проверено 18 августа 2026LMArena Text Arena ↗
Anthropic
Выбирать, когда нужен максимум качества на сложной интеллектуальной работе.
Score1506
$10 / 1M input · $50 / 1M output
Anthropic
Почти уровень лидера при заметно меньшей цене.
Score1505
$5 / 1M input · $25 / 1M output
Anthropic
Стабильный frontier-вариант для универсальных сложных задач.
Score1502
$5 / 1M input · $25 / 1M output
Для ответов, редактуры и сложных текстов на естественном русском языке.
СвежийТест: 12 августа 2026 · проверено 18 августа 2026LMArena Russian Arena ↗
Anthropic
Лучший текущий результат именно на русском языке.
Score1518
Почти лидер по качеству, но значительно дешевле и быстрее.
Score1514
$0.75 / 1M input · $3.57 / 1M output
Сильная недорогая альтернатива лидерам по русскому языку.
Score1514
Для стратегии, сложных профессиональных вопросов, memo, due diligence и принятия решений.
СвежийТест: 12 августа 2026 · проверено 18 августа 2026Expert Arena ↗
Anthropic
Выбирать, когда цена ошибки важнее стоимости токенов.
Score1548
Anthropic
Практически ничья с Fable, но заметно дешевле.
Score1547
Anthropic
Особенно силён, когда анализ превращается в длинный рабочий процесс.
Score1541
$5 / $25 за 1M input/output
Для сложных вычислений, доказательств и многошаговых математических задач.
СвежийТест: 12 августа 2026 · проверено 18 августа 2026Math Arena ↗
Anthropic
Лучший текущий выбор для самой тяжёлой математики.
Score1553
Anthropic
Выбирать для математики, смешанной с исследованием и объяснением.
Score1527
Лучшее соотношение цены и качества среди этой тройки.
Score1521
Для промптов с множеством условий, форматов и ограничений.
СвежийТест: 12 августа 2026 · проверено 18 августа 2026Instruction Following Arena ↗
Anthropic
Лучший выбор, когда каждое условие промпта действительно важно.
Score1514
Anthropic
Лучше подходит, если инструкция превращается в большой многоэтапный проект.
Score1511
Anthropic
Стабильный вариант для жёстко структурированных заданий.
Score1503
Для статей, сценариев, лендингов, рекламы, редактуры и creative writing.
СвежийТест: 12 августа 2026 · проверено 18 августа 2026Creative Writing Arena ↗
Anthropic
Лучший выбор, когда текст должен выглядеть не шаблонным и выдерживать несколько итераций редактуры.
Score1506
Anthropic
Сильный профессиональный копирайтинг без максимальной цены Fable.
Score1500
Подходит, когда нужно быстро перебрать много разных концепций и вариантов.
Score1493
Для написания, разбора, исправления и рефакторинга программного кода.
СвежийТест: 12 августа 2026 · проверено 18 августа 2026Coding Arena ↗
Anthropic
Выбирать для сложных изменений во всём репозитории и длинных coding-сессий.
Score1554
Anthropic
Практически уровень лидера при меньшей стоимости.
Score1552
Anthropic
Стабильный вариант для production-кода и исправления существующих проектов.
Score1551
Для создания сайтов, интерфейсов и полноценных frontend-приложений.
СвежийТест: 15 августа 2026 · проверено 18 августа 2026WebDev Arena ↗
Anthropic
Лучший текущий выбор для полноценного продукта, а не отдельного UI-компонента.
Score1692
Moonshot
Очень сильная альтернатива лидеру за меньшие деньги.
Score1674
$3 / $15 за 1M input/output
Qwen
Лучшее соотношение цены и WebDev-качества в текущей тройке.
Score1667
$2 / $6
Для моделей, которые должны пользоваться инструментами и доводить задачу до результата.
СвежийТест: 13 августа 2026 · проверено 18 августа 2026Agent Arena ↗
Anthropic
Лучший текущий выбор, когда AI должен не ответить, а выполнить работу.
Net improvement12.19%
Anthropic
Особенно хорош для длинных автономных рабочих процессов.
Net improvement12.01%
OpenAI
Сильный агентный выбор внутри OpenAI-стека.
Net improvement10.86%
Для поиска по сети, сбора источников и построения доказательного ответа.
Тест старше 10 днейТест: 21 июля 2026 · проверено 18 августа 2026Search Arena ↗
Anthropic
Лидер последнего специализированного Search Arena.
Score1253
Сильный вариант для исследований внутри OpenAI-экосистемы.
Score1240
Anthropic
Подходит для больших и неоднозначных исследований с большим числом источников.
Score1237
Для анализа длинных PDF, отчётов, договоров и больших наборов документов.
Тест старше 10 днейТест: 26 июля 2026 · проверено 18 августа 2026Document Arena ↗
Anthropic
Лучший выбор для глубокого разбора длинного документа.
Score1520
Anthropic
Проверенный вариант для больших PDF и сложного document reasoning.
Score1510
Anthropic
Для документов, где нужен не summary, а полноценное расследование и synthesis.
Score1504
Для понимания фотографий, схем, интерфейсов, диаграмм и визуального контекста.
Тест старше 10 днейТест: 6 августа 2026 · проверено 18 августа 2026Vision Arena ↗
Anthropic
Лучше всего подходит для вопроса «что здесь происходит и почему?».
Score1315
Qwen
Очень сильное vision-качество при заметно меньшей цене.
Score1301
Anthropic
Надёжная мультимодальная альтернатива внутри Claude.
Score1301
Для извлечения текста из сканов, фото, таблиц и изображений документов.
Тест старше 10 днейТест: 6 августа 2026 · проверено 18 августа 2026OCR Arena ↗
Anthropic
Лучший вариант, когда после OCR нужно сразу понять содержимое документа.
Score1331
Qwen
Сильный OCR при значительно меньшей стоимости.
Score1317
Anthropic
Хорош для OCR плюс последующего reasoning по извлечённому тексту.
Score1315
Для создания изображений по текстовому описанию.
СвежийТест: 10 августа 2026 · проверено 18 августа 2026Text-to-Image Arena ↗
OpenAI
Лучший текущий универсальный генератор изображений.
Score1381
Главный свежий challenger GPT Image 2.
Score1336
Сильный третий вариант для независимой генерации визуальной концепции.
Score1316
Для изменения готового изображения по текстовой инструкции.
Живой лидербордпроверено 18 августа 2026Artificial Analysis Image Editing ↗
Независимые лидерборды сейчас расходятся.
LMArena 7 августа давала другой порядок: GPT Image 2 → Grok Imagine Image 2.0 → Muse Image. lmarena.ai ↗
Текущий лидер специализированного image-editing рейтинга Artificial Analysis.
Score1263
OpenAI
Самый надёжный универсальный выбор: очень высокий результат сразу в нескольких независимых тестах.
Score1257
Сильная третья модель для сравнения edit-вариантов.
Score1257
Для генерации готового видео непосредственно из текстового описания.
СвежийТест: 14 августа 2026 · проверено 18 августа 2026Text-to-Video Arena ↗
Лучший текущий text-to-video по свежему Arena.
Score1512
Ближайший новый конкурент лидера.
Score1494
Проверенный универсальный вариант с большой выборкой голосов.
Score1482
Для превращения готового изображения или кадра в видео.
СвежийТест: 14 августа 2026 · проверено 18 августа 2026Image-to-Video Arena ↗
Лучший текущий способ оживить готовый кадр.
Score1489
Практически на уровне лидера и одновременно силён в video editing.
Score1484
Самый хорошо проверенный вариант из текущей тройки.
Score1478
Для изменения существующего видео при сохранении движения, сцены и персонажей.
СвежийТест: 14 августа 2026 · проверено 18 августа 2026Video Edit Arena ↗
Лучший текущий AI video editor.
Score1411
Лучший универсал для image-to-video плюс последующих изменений.
Score1388
Проверенная версия, когда Seedance 2.5 недоступен.
Score1359
Для транскрипции звонков, интервью, видео и длинных аудиозаписей.
Живой лидербордпроверено 18 августа 2026Artificial Analysis Speech-to-Text ↗
Максимальная текущая точность распознавания речи.
AA-WER1.7%
Чем ниже WER, тем лучше.
Сильный production-вариант с развитой voice-экосистемой.
AA-WER2.2%
Чем ниже WER, тем лучше.
Точная транскрипция с хорошей производительностью на больших объёмах.
AA-WER2.4%
Чем ниже WER, тем лучше.
Для превращения текста в естественную человеческую речь.
Живой лидербордпроверено 18 августа 2026Artificial Analysis Speech Arena ↗
Самая предпочитаемая пользователями TTS-модель в текущем рейтинге.
Elo1282
Сильная альтернатива с другим голосовым характером.
Elo1239
Практически на уровне второго места и полезна внутри Qwen-стека.
Elo1237
Для голосовых ассистентов и AI-агентов, разговаривающих с человеком в реальном времени.
Живой лидербордпроверено 18 августа 2026Artificial Analysis Speech-to-Speech ↗
Лучший текущий выбор для полноценного разговаривающего AI-агента.
Conversational dynamics98.4%
Главный критерий здесь — качество самого разговора, а не только задержка.
Выбирать, когда особенно важна скорость разговора.
Conversational dynamics96.9%
Главный критерий здесь — качество самого разговора, а не только задержка.
OpenAI
Лучший вариант для voice-агента, тесно связанного с tools и OpenAI API.
Conversational dynamics96.1%
Главный критерий здесь — качество самого разговора, а не только задержка.
Для создания законченной музыки и песен из текстового описания.
Живой лидербордпроверено 18 августа 2026Artificial Analysis Music Arena ↗
Лучший текущий универсальный генератор музыки.
Elo1187
Практически ничья с Suno — обязательно стоит сравнивать обе генерации.
Elo1182
Стабильный третий вариант для альтернативной музыкальной концепции.
Elo1167
Одной «лучшей ИИ-модели вообще» здесь нет. У каждой задачи свой источник: публичный лидерборд, независимые тесты, официальные данные моделей. Каждые 10 дней рейтинг перепроверяется. Разные режимы одной базовой модели не занимают два места в одном топ-3. Если тест давно не обновлялся, показываем дату последнего среза. Лайки — отдельный сигнал читателей: на рейтинг они не влияют.