Это длинная ссылка. Пятиминутную ским-версию (быстрая таблица + правила маршрутизатора) см. сопутствующий блог.
1. Зачем вообще сравнивать модели Клода?
Большинство команд теряют деньги не из-за плохих подсказок. Они теряют деньги, потому что для всего используют самую дорогую модель или потому, что относятся к выбору модели как к смутному предпочтению, а не как к смутному предпочтению. бюджетное решение по продукту. Состав Клода четко разделен по уровням: он построен так, чтобы вы могли соответствовать форма задачи до самой маленькой модели, которая хорошо ее завершит.
Практический результат: выбор модели — один из самых простых рычагов, с помощью которых можно улучшить ситуацию. задержка, качествои стоимость за результат в то же время.
2. Современный состав Клода (2026 г.)
Поддержка всех текущих моделей Claude. ввод текста и изображений, многоязычные возможностии видение, и они доступны через Claude API, Claude Platform на AWS, Amazon Bedrock, Google Cloud и Microsoft Foundry.
2.1 Характеристики, на которые стоит обратить внимание
| Модель | API Идентификатор | Контекстное окно | Максимальная мощность | Ценообразование (вход/выход) | Мыслительное поведение |
|---|---|---|---|---|---|
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 (псевдоним: claude-haiku-4-5) |
200 тыс. жетонов | 64 тыс. токенов | $1/$5 за MTok | Доступно расширенное мышление (адаптивное выключено) |
| Claude Sonnet 5 | claude-sonnet-5 |
1 млн токенов | 128 тыс. токенов | $3/$15 за MTok | Адаптивное мышление всегда включено |
| Claude Opus 4.8 | claude-opus-4-8 |
1 млн токенов | 128 тыс. токенов | $5/$25 за МТок | Адаптивное мышление всегда включено |
| Claude Fable 5 | claude-fable-5 |
1 млн токенов | 128 тыс. токенов | $10/$50 за МТок | Адаптивное мышление всегда включено |
Claude Mythos 5 (claude-mythos-5) является закрытым и имеет те же характеристики и цену, что и Fable 5, но в сочетании с другой архитектурой безопасности (нет классификаторов безопасности, как у Fable 5). Если у вас нет доступа, вы все равно можете запустить по существу ту же логику интеграции, используя Fable 5, где это возможно.
2.2 Ограничение знаний (почему это важно для «текущей информации»)
В обзоре моделей Anthropic перечислены:
- Надежное отсечение знаний: январь 2026 г. для Fable 5/Opus 4.8/Sonnet 5; Февраль 2025 г. для Haiku 4.5.
- Ограничение обучающих данных: в целом январь 2026 г. для Fable 5 / Opus 4.8 / Sonnet 5; Июль 2025 года для Haiku 4.5.
Практический подход: если вам нужны факты после завершения, используйте поиск (RAG) или инструмент, независимо от уровня модели.
3. Что означают уровни на практике
3.1 Задержка и реальность выходного токена
В линейке экономика токенов различается в большей степени вывод чем по вводу. Простой способ подумать об этом:
- Haiku — самый дешевый (и самый быстрый) вариант, если вам нужны короткие структурированные ответы.
- Opus и Sonnet тратят больше, но при этом хорошо масштабируются, когда количество запросов ограничено.
- Fable 5 стоит дорого, потому что он предназначен для сложных и длительных прогонов, когда модель должна оставаться в пределах масштаба с течением времени.
Если вы позволите любой модели создавать неограниченный текст, выходные токены будут доминировать над расходами. Вот почему максимальная мощность (или строгие инструкции для TLDR-first) важны для всех уровней, а не только Fable 5.
3.2 Адаптивное и расширенное мышление
Обзорная таблица Anthropic выделяет два различия:
- Fable 5 / Opus 4.8 / Sonnet 5 иметь адаптивное мышление всегда включенным.
- Haiku 4.5 доступно расширенное мышление, но адаптивное мышление отключено.
Практический подход: используйте Haiku для задач большого объема, но помните, что он не оптимизирован для такого же долгосрочного поведения «всегда адаптироваться». Когда вы сталкиваетесь с неопределенностью или необходимостью глубокого планирования, перейдите к Sonnet/Opus/Fable.
3.3 Усилия как соотношение цены и качества
Усилия — это основной элемент управления компромиссом между интеллектом, задержкой и стоимостью на Fable 5 и Mythos 5. Opus 4.8 и Sonnet 5 также предоставляют контроль усилий на поверхностях API.
Практическое значение: самая распространенная ошибка при миграции — это не «неправильная подсказка». Это «максимальное усилие повсюду». Для большинства производственных рабочих нагрузок вы получаете максимальную отдачу, сознательно распределяя усилия (дешевые задачи с низкими/средними усилиями, сложные задачи с более высокими усилиями).
4. Матрица решений, которую вы можете реализовать
Вместо того, чтобы спрашивать: «Какая модель лучше?», спросите: «Какая модель может закончить это рабочий процесс с наименьшим количеством дорогих токенов?»
| Форма задачи | Выберите | Почему |
|---|---|---|
| Классификация намерений, маршрутизация, извлечение сущностей | Хайку | Быстро, дешево и идеально подходит для высокой пропускной способности |
| Ежедневная помощь по кодированию, документация, структурированные рассуждения | Сонет | Лучший баланс скорости и качества |
| Комплексное агентное кодирование, анализ предприятия, глубокая отладка | Опус | Высокая производительность при выполнении длительных и многоэтапных корпоративных задач. |
| Работа агента в течение нескольких дней, синтез нескольких документов с делегированием | Fable 5 (или ворота Mythos 5) | Разработан для долгосрочной автономности и сохранения объема |
5. Схема маршрутизации производства (дешевое -> умное -> передовое)
Это практичный шаблон, который хорошо работает, когда у вас есть несколько задач: некоторые легкие, некоторые сложные и много «в основном легких, но иногда и сложных».
5.1 Пошаговый маршрутизатор
- Классифицируйте с помощью Haiku. Определить намерение и приблизительную сложность; также оцените, нужен ли вам длительный контекст или использование инструмента.
- Запустите основной путь в Sonnet или Opus. Сонет для самых «серьёзных, но ограниченных» задач. Опус, когда вы ожидаете сложного агентного кодирования или более глубокой отладки.
- Перейдите на Fable 5 для действительно долгосрочной работы. Примеры: рефакторинг перекрестных репозиториев, синтез нескольких документов, когда модель должна поддерживать действие нескольких ограничений, и автономные запуски, которые делегируют подзадачи.
- Обработка отступлений/отказов. Если Fable 5 отказывается из-за классификаторов безопасности, вернитесь к Opus 4.8 (или другой подходящей модели) в зависимости от требований к вашему продукту.
5.2 Составьте бюджет маршрутизатора (не позволяйте эскалации стереть сбережения)
Маршрутизатор может быть экономически эффективным только в том случае, если эскалация происходит редко. Добавьте ограничения, чтобы дорогой уровень не мог раздуться:
- Установите максимальное количество токенов вывода на каждом уровне.
- Используйте инструкции TLDR-first, чтобы модель могла остановиться раньше, когда будет известно достаточно.
- Кэшируйте стабильные префиксы (системные подсказки и схемы инструментов), чтобы сократить затраты на повторный ввод.
6. Экономика токенов, которую можно использовать в качестве проверки здравомыслия
Поскольку цены указаны за токен, вы можете приблизительно оценить стоимость каждого запроса. Используя значения цен обзора модели:
- Fable 5: 10 долларов США на входе / 50 долларов США на выходе за MTok
- Opus 4.8: 5 долларов США на входе / 25 долларов США на выходе за MTok
- Sonnet 5: 3 доллара США на входе / 15 долларов США на выходе за MTok
- Haiku 4.5: 1 доллар США на входе / 5 долларов США на выходе за MTok
Грубая формула (вставьте свои оценки):
cost ~= (input_tokens / 1_000_000) * input_price
+ (output_tokens / 1_000_000) * output_price
Правило здравого смысла: если выходные токены большие, Fable 5 быстро становится доминирующим фактором затрат. Вот почему структура оперативных задач и лимиты результатов имеют большее значение, чем ожидают многие команды.
7. Шаблоны подсказок на разных уровнях
Наиболее эффективные рекомендации применимы к каждой модели Claude: ставьте четкие цели, ограничивайте формат вывода и запрашивайте только то, что вам нужно. Различия между уровнями проявляются в том, как вы контрольная длина и усилие контроля.
7.1 Общие правила, предотвращающие утечку бюджета
- Руководствуйтесь результатом. В первой строке должно быть указано, что произошло или что вы нашли.
- Сначала запросите TLDR. Позвольте модели остановиться раньше, если это возможно.
- Ползучесть прицела крышки. Не просите о дополнительных функциях, рефакторингах или «приятных» улучшениях, если вас об этом не просят.
- Ограниченная выходная длина. Используйте максимальное количество токенов вывода или строгие форматы.
7.2 Когда Fable 5 меняет задание
Fable 5 создан для долгосрочной автономии: он может поддерживать продуктивную производительность в течение длительных периодов времени, делегировать подзадачи и сохранять согласованность, когда задача действительно многоэтапная. Побудительная разница заключается не просто в «большем количестве рассуждений». Суть в том, что вы можете (и должны) структурировать рабочие процессы как цели + контрольные точки + доказательства, основанные на инструментах, вместо того, чтобы сводить все к одноразовому ответу.
8. Примеры рабочих процессов (что и где использовать)
8.1 Haiku 4.5
- Классифицируйте входящие запросы (намерение + сложность) и направляйте их на нужный уровень.
- Извлекайте структурированные поля в JSON для последующих систем.
- Обобщите короткие отрывки со строгой схемой и максимальным ограничением вывода.
8.2 Sonnet 5
- Рефакторинг и объяснение кода в формате «что/почему/как».
- Проектируйте контент, ориентированный на клиента, с последовательным тоном и короткими выводами.
- Создайте инструментарий агента, которому по-прежнему нужна скорость (вызов инструмента + короткие циклы).
8.3 Opus 4.8
- Сложное агентное кодирование: многофайловые изменения, более глубокая отладка и более тщательное общесистемное рассуждение.
- Анализ корпоративных документов: электронные таблицы, слайды и длинные отчеты.
- Сложные, но ограниченные задачи, для которых вам по-прежнему нужен ответ корпоративного уровня, а не просто набросок.
8.4 Fable 5 (и Mythos 5)
- Длительная миграция кода между репозиториями с использованием инструментов и этапами проверки.
- Синтез нескольких документов, где важны сохранение инструкций и согласованность в течение длительного времени.
- Автономные рабочие процессы, которые делегируют подзадачи и продолжаются после промежуточных результатов.
9. Примечания по миграции
9.1 Миграция на Opus 4.8
Если вы сейчас используете Opus 4.7 или более раннюю версию, начните с:
- Убедившись, что вы установили
effortявно, когда у вас есть задержки или требования к бюджету. - Анализ любых подсказок, которые могут быть чрезмерно предписывающими. Более высокие возможности могут усилить чрезмерно конкретные инструкции.
- Повторное тестирование предположений о длине вывода и применение ограничений максимального объема вывода, где это необходимо.
9.2 Миграция с Opus на Fable 5
Fable 5 не является «более быстрым Опусом». Относитесь к нему как к инструменту рабочего процесса для долгосрочных задач:
- Движение к цели + структурирование контрольных точек (особенно для агентных прогонов).
- Делегируйте подзадачи вместо того, чтобы складывать все в один длинный поток.
- Используйте кэширование и ограниченный вывод, чтобы длинные прогоны не приводили к увеличению расходов.
10. Распространенные ошибки
- Использование Fable для всего. Он предназначен для сложных, долгосрочных случаев.
- Никаких ограничений по выходу. Даже Haiku может дорого обойтись, если вы позволите ему генерировать неограниченный текст.
- Предполагая, что контекстные окна взаимозаменяемы. У Haiku 200 тысяч токенов; остальные по умолчанию равны 1M.
- Игнорирование различий в порогах. Если вам нужна информация после завершения, используйте поиск/инструменты.
- Не направляя усилия. Установление максимальных усилий повсюду часто увеличивает затраты, не улучшая результатов.
11. Итог
Линейка Claude разработана таким образом, чтобы вы могли создать модель маршрутизатора, которая соответствует наименьшему уровню возможностей для каждой формы задачи. Начните с Haiku для дешевой маршрутизации и извлечения данных. Используйте Sonnet для большей части повседневной работы. Перейдите в Opus для сложного корпоративного и агентского кодирования. Зарезервируйте Fable 5 (и закрытый Mythos 5) для настоящих долгосрочных проектов, требующих устойчивой автономии и согласованности.
Если вы сомневаетесь, ограничивайте свои подсказки, ограничивайте длину вывода и измеряйте количество токенов вывода для каждого результата. Этот показатель делает выбор модели очевидным.
SEO-снимок для этой статьи
- SEO-заголовок: Сравнение моделей Клода: Haiku, Sonnet, Opus и Fable 5 (Mythos 5)
- Мета-описание: Сравните Anthropic Claude Haiku, Sonnet, Opus, Fable 5 и закрытое Mythos 5. Включает спецификации, стратегию затрат/токенов, схему маршрутизации и время использования каждого уровня.
- Основные ключевые слова: Сравнение моделей Клода, Claude Opus 4.8, Claude Fable 5, Claude Sonnet 5, Claude Haiku 4.5, Claude Mythos 5, бюджетирование токенов, агентное кодирование
- Твиттер/Х: Объяснение уровней модели Клода: Haiku для дешевой маршрутизации, Sonnet для повседневной работы, Opus для сложного кодирования, Fable 5 для многодневных агентских запусков. Схема маршрутизации бюджета токенов внутри.
- Линкедин: Практичное и реализуемое сравнение Anthropic Claude Haiku, Sonnet, Opus, Fable 5 и закрытого Mythos 5. Спецификации, модель стоимости и маршрутизатор, который контролирует выходные токены. Из Workstation.