Claude Sonnet или Opus: гид по выбору модели Anthropic под код и агентов

Claude Sonnet 5 — рабочая модель средней полки Anthropic: код, длинные агентные цепочки, управление компьютером, работа со знаниями, окно в миллион токенов. На части бенчмарков системной карты она спорит с Opus 4.8 и стоит на уровне моделей среднего класса — примерно в два–пять раз дешевле флагманов вроде Opus (точные ставки — у Anthropic). Угол материала — выбор, а не релиз: когда Sonnet 5 хватает на ежедневный код и агентов, а когда верхняя полка Opus всё ещё окупается точностью, свежей датой отсечки или особыми режимами.
Опубликовано 24 сентября 2026 г. · обновлено 27 сентября 2026 г.
Содержание
Зачем читать
Линейка Claude к осени 2026 плотная: Sonnet 5 как ежедневная рабочая модель, затем Opus 5 (24 июля) и Opus 5.5 (22 сентября) на верхней полке. Параллельно в анонсах мелькали обещания Haiku/Sonnet 5.5 «в ближайшие недели» — это дорожная карта, не общий доступ (общий доступ). Легко начать платить за флагман «на всякий случай».
Ниже — гид по выбору на 22 сентября 2026: спеки Sonnet 5, таблица 8.1.A, цены Anthropic, сравнение с 4.6 / Opus / Haiku / GPT-Gemini из системной карты, безопасность и честный «кому Sonnet / кому Opus». Где модель лежит в мультивендорном чате — коротко ближе к концу; середина про Anthropic и развилку решений.
Развилка: средней полки vs Opus
Anthropic называет Sonnet 5 самым агентным Sonnet. На знаниевых задачах в анонсе модель средней полки «чуть лучше» Opus 4.8; на агентной разработке для максимальной точности вендор по-прежнему указывает на Opus. GDPval-AA v2 Elo у Sonnet 5 — 1618, у Opus 4.8 по вторичным сводкам TechCrunch/Vellum со ссылкой на системную карту — 1615 (в колонке таблицы 8.1.A Opus нет — помечаем как вторичное).
Opus никуда не делся. Сложный код (SWE-bench Pro), ослабленные кибер-ограничения, более свежая дата отсечки знаний (у Opus 5.5 — июнь 2026 против января у Sonnet 5) — зоны, где верхняя линейка имеет смысл. Вопрос практический: нужен ли вам Opus каждый день, если основная рабочая модель уже тянет ревью, документы, скрины интерфейса и планы миграций.
Что такое Claude Sonnet 5
Место в линейке
Лестница Anthropic привычная:
— Haiku — скорость и цена. Haiku 4.5: прайс нижней полки, 200K контекст, 64K макс. выход, расширенное мышление (не адаптивная лестница уровней усилия), дата отсечки Feb 2025 / обучение Oct 2025 по досье. Haiku 5 в публичных обзорах моделей на 22 сентября 2026 не подтверждён; обещание Haiku 5.5 «в ближайшие недели» из анонса Opus 5.5 — не наличие модели.
— Sonnet — баланс возможностей и стоимости при масштабе. Документация рекомендует Sonnet 5 «для большинства приложений».
— Opus — максимальная точность и тяжёлые агентные сценарии: Opus 4.8 (~28 мая 2026 по заметкам о релизе) → Opus 5 (24 июля) → Opus 5.5 (22 сентября).
— Fable — верх рассуждений / длинного горизонта; в сравнении с Opus 5.5 Anthropic всё ещё оставляет Fable 5.1 для самых тяжёлых сценариев.
Sonnet 5 сменяет Sonnet 4.6 (релиз 4.6 — 17 февраля 2026). идентификатор API: claude-sonnet-5 (Bedrock: anthropic.claude-sonnet-5). Платформы: Claude.ai (по анонсу — по умолчанию для Free и Pro), Claude Code, Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS. Обязательство по сроку поддержки на платформах Anthropic — не раньше 30 июня 2027.
Короткий вопрос за долю секунды — класс Haiku. Агенты, код, 1M и зрение в одном профиле — Sonnet 5.
«Самый агентный Sonnet» на практике
Формулировка вендора — про сценарии: планирование, доведение до конца, самопроверка, браузер, терминал, управление компьютером, длинные циклы в коде и знаниевых задачах. В анонсе раннего доступа фигурировали Zapier, Lovable, Cursor/Kiro и похожие на Notion сценарии — места, где модель проходит цепочку, а не отвечает одним абзацем.
Как это выглядит без маркетинга:
— Даёте задачу с критериями готовности («PR зелёный», «сверь оферту с чеклистом», «разбери скрин и предложи правки»).
— Модель дробит работу, держит контекст до 1M, при необходимости «думает» через адаптивное мышление (уровень усилия по умолчанию — высокий).
— На выходе — план плюс артефакты: диффы, таблицы рисков, списки дыр — а не только «красивый абзац».
Sonnet 5 не заменит сеньора. Но модель средней полки 2026-го уже заточена под агентность, а не только под умный чат.
Полезный сдвиг относительно 4.6 по системной карте: ниже поддакивание. Модель реже соглашается с дырявой предпосылкой ради вежливости. Раздражает, если ждали комплиментов черновику. Спасает, если черновик реально дырявый.
Второй проход почти всегда окупается: «проверь ответ по чеклисту X, перечисли пропуски». Адаптивное мышление на высоком уровне уже тратит токены; ваша работа — измеримый критерий готовности, а не надежда, что «агентность» угадает бизнес-ограничения.
Как линейка Claude сложилась к осени 2026
Хронология
Sonnet 5 вышел, когда Opus 4.8 уже был рабочей лошадкой верхней полки, а Opus 5 ещё не анонсировали. Anthropic явно продавал модель средней полки как «почти Opus за деньги Sonnet». К осени флагман снова уехал вперёд по жёсткой агентной разработке / науке / управлению компьютером (отдельные анонсы Opus 5 и 5.5; единой таблицы «Sonnet 5 vs Opus 5.5» у Anthropic нет — сравнивать проценты 1:1 нельзя). Цена и доступность Sonnet 5 при этом остаются аргументом: не всем нужен последний флагман, чтобы закрыть большую часть рабочих задач.
Волна агентных моделей средней полки
К моменту релиза модель средней полки перестала быть «запасным Claude». Документация Anthropic прямо ставит Sonnet 5 как рекомендацию для большинства приложений с балансом возможностей и стоимости при масштабе. Это продуктовый сигнал: вендор готов отдавать ежедневную нагрузку модели средней полки, оставляя Opus для хвоста точности и особых режимов.
TechCrunch в день релиза формулировал рынок прямо: Sonnet 5 — более дешёвый способ гонять агентов, чем Opus 4.8; дешевле OpenAI GPT-5.5 и Google Gemini 3.1 Pro; дороже Gemini 3.5 Flash. Гонка шла за устойчивость многошаговых сценариев, а не за «ещё один чат».
Ярлык «агентный» и ваш пайплайн — разные вещи. У Cursor или Zapier обвязка инструментов другая, чем у текстового чата. Системная карта показывает потолок модели; продукт решает, какие инструменты реально торчат в интерфейсе.
Отдельная деталь лета: Sonnet 5 стал моделью по умолчанию на Claude.ai для Free и Pro (по анонсу). Модель средней полки перестала ощущаться «урезанной версией» для многих пользователей Claude.
| Дата | Событие |
|---|---|
| 17 февраля 2026 | Claude Sonnet 4.6 |
| ~28 мая 2026 | Claude Opus 4.8 (заметки о релизе) |
| 30 июня 2026 | Claude Sonnet 5 + системная карта |
| 24 июля 2026 | Claude Opus 5 |
| 10 августа 2026 | Вводная ставка прайса Sonnet 5 сделана постоянной |
| 22 сентября 2026 | Claude Opus 5.5 |
Спеки без воды
1M, 128K выход, зрение
Источник — документация Sonnet 5 и обзор моделей.
Практический смысл: длинный репозиторий, толстый PDF, переписка с вложениями и скрин интерфейса можно держать в одном диалоге. Зрение — картинки на входе, текст на выходе: макеты, дашборды, ошибка в консоли на скрине.
Осторожность: 1M ≠ «всегда заливай миллион». Адаптивное мышление и длинный выход едят бюджет. На больших прогонах важнее кэш и дисциплина промпта, чем максимальная ширина окна.
Пакетная бета на 300K выхода — для офлайн-пакетов (длинные отчёты, пакетная генерация). В интерактиве вы почти наверняка живёте около Messages API с потолком 128K на ответ. Хватает на крупные диффы; не повод просить «выпиши весь монорепо одним сообщением». Реалистичнее: один модуль / один документ / один экран за итерацию, общий план — в начале треда.
Задержка помечена как быстрая относительно верхней полки. Это не Haiku и не «ждать Opus на каждом чихе». Точных p50/p99 в публичной документации нет — ориентируйтесь на свой SLO, а не на ярлык.
Адаптивное мышление и уровни усилия
Мышление — адаптивное, включено по умолчанию. Уровни усилия: низкий / средний / высокий / максимальный (плюс смежные уровни на кривых «цена–качество» анонса). По умолчанию — высокий.
Модель сама решает, когда думать дольше. На среднем часто лучшее соотношение цена/качество; на высоком/максимальном Sonnet 5 на части задач догоняет Opus 4.8, но может сжечь больше выходных токенов.
Если ходите в API напрямую, имеет смысл явно ставить уровень усилия под класс задач. Высокий по умолчанию — выбор Anthropic в пользу качества; ваша юнит-экономика может потребовать другого рычага.
Ломающие изменения с 4.6
Подмена по семейству id — да. Поведение один в один — нет. Три жёстких изменения (заметки о релизе 30 июня 2026):
— Адаптивное мышление по умолчанию.
— Ручное расширенное мышление удалено — старый запрос даёт 400.
— Нестандартные temperature / top_p / top_k → 400 — сэмплирование фактически на значениях по умолчанию.
Плюс новый токенизатор. Типичные сюрпризы миграции:
— SDK, которые всегда слали temperature=0.2 «для детерминизма», ловят 400;
— промпты с ручным бюджетом расширенного мышления нужно переписать под адаптивное + уровень усилия;
— оценку стоимости по логам 4.6 нельзя переносить 1:1;
— приоритетного тарифа на Sonnet 5 нет.
Поменять имя модели и получить ответы — да. Считать, что поведение то же — уже нет.
Новый токенизатор: за символ ≠ за миллион токенов
Токенизатор как у Opus 4.7+: на тот же текст уходит примерно 1.0–1.35× больше токенов (в типичных формулировках документации — порядка ~30%). При равной ставке прайса за миллион модель дороже за символ, чем интуиция от старого прайса. Anthropic компенсировал более низкой ставкой прайса Sonnet 5 относительно Sonnet 4.6.
Грубый ориентир (не замена замеру): если текст токенизируется на 1.25× плотнее, а прайс входа упал сильнее этого множителя, эффективная цена за символ на входе всё ещё ниже, чем у 4.6. Смесь кода, JSON и не-английского текста может уехать к 1.35× — тогда выигрыш тоньше. Прогоните свой эталонный корпус, не верьте только таблице.
| Параметр | Значение |
|---|---|
| Окно контекста | 1M токенов (по умолчанию = максимум) |
| Макс. выход (Messages API) | 128K |
| Макс. выход (пакетный режим, бета до 300 тысяч токенов) | 300K |
| Вход → выход | Текст + картинки → текст |
| Дата отсечки знаний / обучения | январь 2026 |
| Сравнительная задержка | Быстрая (обзор моделей) |
| Приоритетный тариф | недоступен |
Возможности: код, агенты, управление компьютером, работа со знаниями
Код / Claude Code / PR до зелёных тестов
Код — главная витрина прироста vs 4.6. Системная карта, таблица 8.1.A (адаптивное мышление на максимальном уровне усилия, сэмплирование по умолчанию, среднее по 5 прогонам):
— SWE-bench Pro: 63.2% (4.6 — 58.1%)
— Terminal-Bench 2.1: 80.4% (4.6 — 67.0%, +13.4 п.п.)
— FrontierCode v1: 38.8% (4.6 — 15.1%, больше чем ×2)
— SWE-bench Verified (доп. секции): 85.2%
— CursorBench (независимо Cursor, §8.5): 61.2% vs 49% у 4.6 и 63.8% у Opus 4.8
На агентной разработке для максимальной точности Anthropic предпочитает Opus; на знаниевых задачах Sonnet 5 слегка обходит Opus 4.8. Перевод на практику: ревью PR, патчи, стектрейсы, «доведи до зелёных тестов» — сильная зона средней полки. Не обещание обогнать свежий флагман на самых жёстких миграциях.
Как читать приросты. Terminal-Bench 2.1 +13.4 п.п. — увереннее в терминальных циклах (пакет, конфиг, довести команду до успеха). FrontierCode с 15.1% до 38.8% — редкий скачок, но абсолютные 38.8% оставляют большую долю задач нерешёнными. CursorBench 61.2% почти дотягивает до Opus 4.8 (63.8%) — для сценариев в духе IDE модель средней полки стала близкой заменой прежней рабочей лошадки Opus.
Держите короткие итерации с явным «остановись и покажи дифф». Sonnet 5 лучше предшественника держит план; длинный автономный прогон без контрольных точек всё ещё способ сжечь контекст и бюджет. Паттерн: план → утверждение → следующий артефакт.
Ещё один рабочий приём на больших репозиториях: сначала карта модулей («что за что отвечает»), потом точечное ревью файлов из диффа. Так окно в 1M работает как карта, а не как свалка. Критерии лучше писать жёстко: обязательное / желательное, запрет на «всё отлично» без находок. Sonnet 5 по системной карте хуже Opus на хвосте сложного кода, но охотнее предшественника возвращается к чеклисту — если чеклист вы ему дали.
Браузер, терминал, управление компьютером
— OSWorld-Verified: 81.2% (4.6 — 78.5%; GPT-5.5 — 78.7%; Gemini 3.5 Flash — 78.4%)
— BrowseComp: 84.7% / 86.6% (один / несколько) vs 76.2% у 4.6
— AutomationBench: 13.5% (здесь Gemini 3.5 Flash выше — 14.5%)
В партнёрских кейсах анонса фигурировали страховые и рабочие сценарии (Pace и др.) — модель ведут через интерфейс и многошаговые действия.
BrowseComp показывает силу в поисково-исследовательских цепочках. AutomationBench 13.5% — напоминание, что «автоматизация всего» ещё ранний спорт; не делайте из одной строки вывод «Sonnet плох в автоматизации». Смотрите обвязку и типичные сбои, особенно когда срабатывают защитные ограничения.
Если описываете шаги текстом («открой раздел, сравни поля, выпиши расхождения»), модель хорошо держит сценарий даже без кликов по чужому SaaS. Настоящий клик по интерфейсу — вопрос слоя инструментов продукта, не только весов.
Документы, исследование, право/финансы
— GDPval-AA v2 Elo: 1618 (4.6 — 1395; GPT-5.5 — 1509; Gemini 3.5 Flash — 1357)
— HealthBench Professional: 57.8% (4.6 — 44.2%)
— HLE: 43.2% без инструментов / 57.4% с инструментами
Зона профессиональных задач: сверка документов, исследовательские сводки, юридические и финансовые черновики с жёсткими критериями. Оферты, ТЗ, сравнение версий договора, разбор отчёта по скрину таблицы.
GDPval на уровне/выше Opus 4.8 при цене Sonnet — главный экономический аргумент Anthropic для работы со знаниями. Elo 1618 vs 1615 — микроскопический зазор, его нельзя продавать как разгром; в паре с против у Opus 4.8 это уже про деньги.
HealthBench 57.8% vs 44.2% у 4.6 — рост на профессионально-медицинских вопросах. Оговорка обязательна: бенчмарк ≠ клиническое решение; в медицине и праве нужен человек в контуре.
Многоязычность 78.3% и мультимодальность 28.1% из доп. секций системной карты: русский текст — комфортная зона Claude; «голая» мультимодальность 28.1% напоминает, что зрение сильно на прикладных скринах/документах, но не превращает модель в универсальный движок компьютерного зрения.
Дата отсечки января 2026 ограничивает память о событиях после даты. Для лета–осени 2026 кладите источники в контекст сами.
Типовые сценарии, которые хорошо ложатся на профиль модели:
— Ревью кода — дифф или несколько файлов + критерии (безопасность, читаемость, тесты).
— Оферты и договоры — длинный PDF + обязательные пункты → таблица «есть / нет / неясно» с цитатами.
— UX по скриншотам — макет + вопрос про иерархию, CTA, доступность; зрение здесь не игрушка.
— Исследовательская сводка — пачка источников в контексте + разметка «факт из файла / вывод модели / дыра».
— Агентный план — «разбей миграцию на PR, для каждого — критерии зелёных тестов»; даже без настоящего терминала план получается рабочий.
Слабее: события после января 2026 без приложений; вредоносный кибер; ожидание, что модель средней полки выжмет SOTA как свежий Opus на самых жёстких бенчмарках следующего поколения.
Бенчмарки: что реально выросло
Таблица 8.1.A vs 4.6, GPT-5.5, Gemini 3.5 Flash
Конфиг: адаптивное мышление на максимальном уровне усилия, сэмплирование по умолчанию, среднее по 5 прогонам. BrowseComp — бюджет 10M токенов + уплотнение @ 200k.
Дополнительно: SWE-bench Verified 85.2%, многоязычность 78.3%, мультимодальность 28.1%. HLE у 4.6 и часть цифр OSWorld пересчитаны после смены методики/оценщика — не мешайте старые блог-посты с новой таблицей.
| Бенчмарк | Sonnet 5 | Sonnet 4.6 | GPT-5.5 | Gemini 3.5 Flash |
|---|---|---|---|---|
| SWE-bench Pro | 63.2% | 58.1% | 58.6% | 55.1% |
| Terminal-Bench 2.1 | 80.4% | 67.0% | 83.4% (Codex CLI) | 76.2% |
| BrowseComp (один / несколько) | 84.7% / 86.6% | 76.2% | 84.4% | — |
| HLE без инструментов / с инструментами | 43.2% / 57.4% | 34.6% / 46.8% | 41.4% / 52.2% | 40.2% / — |
| OSWorld-Verified | 81.2% | 78.5% | 78.7% | 78.4% |
| FrontierCode v1 | 38.8% | 15.1% | 25.5% | — |
| GDPval-AA v2 (Elo) | 1618 | 1395 | 1509 | 1357 |
| AutomationBench | 13.5% | 5.3% | 12.9% | 14.5% |
| HealthBench Professional | 57.8% | 44.2% | 51.8% | — |
Где модель средней полки спорит с Opus 4.8
Цифры ниже — TechCrunch / Vellum со ссылкой на системную карту; в колонке таблицы 8.1.A Opus нет:
Рамка анонса: работа со знаниями — модель средней полки слегка впереди; агентная разработка на максимальной точности — Opus. Модель средней полки закрывает почти всё ежедневное; флагман — последние проценты и особые зоны.
Оговорки
— Максимальный уровень усилия. Таблица 8.1.A снята на максимуме. На среднем Sonnet 5 часто выгоднее Opus 4.8 по цене/качеству; на максимальном может потратить больше выходных токенов, чем кажется по ставке прайса.
— Пересчитанные оценки. HLE 4.6 и OSWorld 4.6 пересчитаны.
— Обвязка. Terminal-Bench 2.1 у GPT-5.5 указан с Codex CLI (83.4%). Сравнение «модель vs модель» всегда ещё и «обвязка vs обвязка».
Прямой официальной единой таблицы Sonnet 5 vs Opus 5 / 5.5 нет. К сентябрю 2026 флагман (Opus 5.5, анонс 22 Sep) ушёл дальше по жёсткой агентной разработке / науке / управлению компьютером — без переноса чужих процентов из другого досье в эту таблицу. Модель средней полки не обязана догонять каждую строку SOTA; она обязана быть разумной основной рабочей моделью.
Прямого сравнения «лоб в лоб» Sonnet 5 vs GPT-5.6 Terra / Grok 4.5 в первичных источниках Anthropic нет — чужих лидербордов сюда не тащим. В системной карте модель средней полки бьёт GPT-5.5 на большинстве строк таблицы 8.1.A и уступает на Terminal-Bench 2.1 (Codex CLI) и на AutomationBench Gemini 3.5 Flash.
| Метрика | Sonnet 5 | Opus 4.8 | Комментарий |
|---|---|---|---|
| SWE-bench Pro | 63.2% | 69.2% | Opus впереди на сложном коде |
| HLE с инструментами | 57.4% | 57.9% | практически паритет |
| OSWorld-Verified | 81.2% | 83.4% | Opus чуть выше |
| GDPval-AA v2 Elo | 1618 | 1615 | Sonnet чуть выше |
| CursorBench | 61.2% | 63.8% | близко; независимый Cursor |
Сколько это стоит на практике — без прайс-листа
Точные ставки API Anthropic в этой статье не дублируем: они меняются, а пакеты хаба считаются иначе. Ориентир качественный, как на витрине вендора.
Sonnet 5 держит цену средней полки — на уровне моделей среднего класса, примерно в два–пять раз дешевле флагманов вроде Opus и Fable. 10 августа 2026 вводную ставку сделали постоянной: повышение до уровня 4.6 отменили.
Opus 4.8 и Opus 5 заметно дороже средней полки. Opus 5.5 чуть мягче прежнего Opus, но всё ещё примерно вдвое дороже Sonnet 5 по выходу. Haiku 4.5 — нижняя полка: быстрее и дешевле, короче контекст.
Пакеты и лимиты хаба — Тарифы. Цифры вендора туда не переносим.
Кэш, пакетный режим и география
— Повтор системного промпта и длинный тред выигрывают от кэша: чтение из кэша на порядок дешевле свежего входа. Точные коэффициенты — в документации Anthropic.
— Пакетный режим дешевле интерактива. Имеет смысл для офлайн-отчётов, не для живого ревью.
— Инференс только в США даёт надбавку к ставке. Быстрый режим для Sonnet 5 не заявлен — он в превью у линейки Opus. Приоритетного тарифа у Sonnet 5 нет.
Цена и качество по уровню усилия
На среднем уровне усилия Sonnet 5 часто даёт лучшее качество на единицу бюджета, чем гонять Opus 4.8 на всём подряд. На высоком и максимальном средняя полка догоняет Opus на части задач, но ответ становится длиннее и дороже.
Практическое правило: массовые ревью и черновики — средний уровень; сложный баг и жёсткие критерии — высокий; выжимать последний процент на хвосте сложного кода — смотреть Opus, а не крутить максимальный Sonnet без конца.
Если KPI — доля закрытых тикетов на бюджет, средняя полка на среднем и высоком часто выигрывает у ежедневного Opus. Если KPI — абсолютная точность на редких жёстких задачах, Opus (особенно 5.5) остаётся отдельной закупкой.
Подписки Claude.ai — Free, Pro, Max: скользящее пятичасовое окно и недельные потолки, без «N сообщений». Актуальные цифры только у Anthropic. В хабе смотрите Тарифы.
Связка токенизатор + уровень усилия + кэш важнее одной строки прайса. Один и тот же прогон на высоком без кэша и на среднем с тёплым кэшем даёт разный чек при похожем ощущении качества на рутине.
| Модель | Полка | Относительно Sonnet 5 | Когда смотреть |
|---|---|---|---|
| Sonnet 5 | средняя | ориентир для большинства задач | ежедневный код, документы, агентные планы |
| Sonnet 4.6 | средняя, дороже 5 | Anthropic снизил ставку 5 относительно 4.6 | если ещё не мигрировали |
| Opus 5.5 | верхняя | примерно вдвое дороже по выходу | свежая дата отсечки, хвост точности |
| Opus 5 / 4.8 | верхняя | ещё дороже 5.5 | сложный код, особые кибер-режимы |
| Haiku 4.5 | нижняя | заметно дешевле и быстрее | короткий ответ, не длинный агент |
| Fable 5.1 | самая верхняя | на несколько раз дороже средней полки | длинный горизонт рассуждений |
Что доступно в хабе
Sonnet 5 есть в каталоге с тарифов «Про» и «Ультра» (на бесплатном и «Плюс» — нет): карточка модели. Рядом в той же полке — карточка модели, карточка модели и карточка модели. Пакеты и лимиты — Тарифы.
Коротко про соседей без чужих лидербордов (сравнения «лоб в лоб» в первоисточниках Anthropic нет):
— Sonnet 5 — агентность, аккуратность, код и документы.
— GPT-5.6 Terra — ветка OpenAI; имеет смысл при стеке и привычках «вокруг GPT».
— Grok 4.5 — другой темперамент; удобно для второго мнения на спорном черновике.
— Kimi K3 — отдельный профиль для контраста.
Рабочий паттерн: один бриф через Sonnet 5 и одного соседа, с заранее записанными критериями («точность цитат», «полнота чеклиста», «ложные уверенности»). Четыре модели сразу — каша и лишний расход лимита.
Нужен ли Opus, если есть Sonnet 5?
Когда хватает Sonnet 5
— основная рабочая модель: код, ревью, спеки, переписка, исследование по приложенным файлам;
— нужны зрение + длинный контекст без прайса Opus;
— агентные планы и чеклисты важнее «последнего процента» на SWE-Pro;
— дата отсечки января 2026 вас не бьёт (новости после даты кладёте в контекст сами).
Для большинства продакшен-агентов и сценариев в духе Claude Code сам Anthropic указывает на баланс Sonnet 5.
Бытовой критерий: после двух–трёх итераций стабильно получается приемлемый артефакт (зелёный чеклист, вменяемый патч, таблица рисков без фантазий) — оставайтесь. Если задача регулярно ломается на хвосте (редкие баги, жёсткая научная логика, длинная миграция с неочевидными инвариантами) — сигнал смотреть Opus, а не бесконечно перефразировать промпт.
Когда всё ещё брать Opus
— жёсткая агентная разработка, где проценты на SWE-Pro критичны (Opus 4.8 — 69.2% vs Sonnet 5 63.2% по вторичным сводкам);
— нужна июньская дата отсечки 2026 (Opus 5.5) vs январская у Sonnet 5;
— максимальная точность на управлении компьютером / науке / длинных миграциях — зона, куда уехали Opus 5 и особенно Opus 5.5 (косвенно по отдельным анонсам, без единой таблицы);
— вредоносный кибер с ослабленными ограничениями — Anthropic рекомендует Opus 4.8 (+ Cyber Verification Program), не Sonnet;
— агенты, чувствительные к выравниванию: на автоматическом поведенческом аудите Opus 4.8 / Mythos Preview в анонсе Sonnet 5 выглядели лучше модели средней полки (при том что Sonnet 5 лучше 4.6).
Даже более мягкий по ставке Opus 5.5 остаётся примерно вдвое дороже Sonnet 5 по выходу — точные цифры у Anthropic.
По состоянию каталога на 22 сентября 2026 среди Claude в каталоге есть Sonnet 5; Opus 5.5 — нет. Практический вывод: рабочий Claude «внутри полки» — модель средней полки. Нужен Opus 5.5 — Claude.ai, API или облака партнёров Anthropic, либо ждать, пока карточку добавят. Без сигнала продукта «скоро» не пишем.
| Sonnet 5 | Opus 4.8 | Opus 5 | Opus 5.5 | |
|---|---|---|---|---|
| Релиз | 2026-06-30 | ~2026-05-28 | 2026-07-24 | 2026-09-22 |
| Ориентир по цене | средняя полка | верхняя, дороже | верхняя, дороже | верхняя, примерно вдвое дороже Sonnet по выходу |
| Контекст / макс. выход | 1M / 128K | 1M / 128K | 1M / 128K | 1M / 128K |
| Мышление | Адаптивное, по умолчанию высокий | Адаптивное | Адаптивное включено по умолчанию | Адаптивное всегда включено, по умолчанию средний |
| Дата отсечки | Jan 2026 | см. документацию | см. документацию | Jun 2026 |
Безопасность и ограничения
Системная карта vs 4.6
Системная карта (System Card) — 30 июня 2026. Ключевое:
— в целом нежелательное / плохо выровненное поведение ниже, чем у Sonnet 4.6;
— при этом выше, чем у Opus 4.8 / Mythos Preview на автоматическом поведенческом аудите;
— лучше отказ от вредоносных запросов и устойчивость к инъекции промпта в агентных контекстах;
— ниже галлюцинации и поддакивание vs 4.6.
«Тише, чем 4.6» ≠ «тише, чем лучший Opus».
Для продакта это значит: меньше поддакивания и чуть спокойнее агентные цепочки, чем у предшественника. Для безопасности/соответствия — модель средней полки всё ещё не «самый тихий» в линейке на автоматическом поведенческом аудите; если этот KPI критичен, смотрите полку Opus и политики Anthropic отдельно от бенчмарков кода.
В агентных продуктах инъекция промпта — не абстракция. Если модель читает страницу, письмо или тикет, туда могут подложить «игнорируй политику». Улучшение устойчивости — не индульгенция: минимальные привилегии для инструментов, разделение доверенного системного промпта и недоверенного контента, одобрение человеком на опасных действиях.
Кибер-ограничения
Anthropic не обучал Sonnet 5 целевым кибер-задачам; возможности заметно ниже Opus/Mythos. Оценка эксплойта Firefox — 0% рабочих эксплойтов (как у 4.6), чуть выше частичного успеха. Кибер-ограничения включены по умолчанию (ближе к Opus 4.7/4.8, мягче чем Fable 5). Cyber Verification Program — на родной Claude Platform, AWS, Microsoft Foundry; Vertex на момент анонса — скоро.
Рекомендация вендора для кибер с ослабленными ограничениями: Opus 4.8 (+ CVP). Намеренная «слабость» кибер-возможностей для большинства пользователей — плюс: модель меньше имеет смысл уговаривать на вредные сценарии. Легитимный сценарий безопасности с ослабленными ограничениями — зона верифицированных программ Anthropic и линейки Opus, не «обходных промптов» в чате.
Дата отсечки и расход токенов
— Дата отсечки ≈ январь 2026. Всё, что после — только из того, что вы вставили.
— 1M + адаптивное мышление + длинный выход легко раздувают расход. Новый токенизатор добавляет 1.0–1.35×. В API — кэширование и пакетный режим; в подписках — следите за лимитами тарифа.
Прочее: нет приоритетного тарифа; нельзя вернуть ручное расширенное мышление и кастомное сэмплирование; на AutomationBench модель средней полки уступает Gemini 3.5 Flash в таблице 8.1.A; GPT-5.5 выше на Terminal-Bench 2.1 с Codex CLI.
Отдельный риск — «залить миллион и ждать чуда». Длинный контекст помогает, когда вход структурирован (оглавление, метки файлов, приоритеты). Часто хватает 50–100k самого релевантного вместо «всего репозитория».
Как выбирать под задачу
Чеклист выбора
— [ ] Картинки на входе + длинный текст/код? → Sonnet 5 уместен.
— [ ] Ревью / документ / план / скрин UX? → начните с Sonnet 5.
— [ ] Самая свежая дата отсечки (лето 2026+) без приложений? → приложите источники или смотрите модели с более новой датой отсечки.
— [ ] Сложный код, где каждый процент точности критичен? → сравните с соседями средней/верхней полки; Opus — осознанная отдельная закупка.
— [ ] Вредоносный кибер? → не Sonnet 5; политика Anthropic (Opus 4.8 + CVP) и закон.
— [ ] Только сверхбыстрый дешёвый ответ? → класс Haiku / более лёгкие модели; Sonnet 5 — не про минимум задержки/цены.
Как формулировать задачи
Модель хорошо слушается явной структуры: роль, критерии, формат ответа, запрет на пустую похвалу. Для ревью кода — таблица файл → проблема → серьёзность. Для оферты — чеклист «есть / нет / частично» с цитатами (юрист в контуре обязателен). Для UX по скрину — визуальная иерархия, CTA, доступность без редизайна ради редизайна. Для агентного плана — шаги с критерием готовности и точками одобрения человеком.
Анти-галлюцинация: если факта нет в контексте — «нет данных»; дата отсечки модели — январь 2026. Адаптивное мышление по умолчанию на высоком уже подталкивает к тщательности — сужайте критерий успеха и формат («таблица на 10 строк»), а не надейтесь, что модель угадает невысказанный контекст компании.
Пошаговые промпты — гайд. Сравнение на практике — гайд. Общий выбор модели — гайд.
Вердикт
Выбор между Sonnet и Opus — главный вопрос этой линейки. Claude Sonnet 5 перестаёт быть «компромиссом» и становится разумным выбором по умолчанию: миллион контекста, зрение, длинный ответ, агентный профиль и цена средней полки закрывают код, документы и многошаговые сценарии без обязательного билета в Opus. По системной карте — жёсткий рост относительно Sonnet 4.6; на GDPval средняя полка спорит с Opus 4.8; на сложном коде всё ещё отстаёт на заметные пункты.
Кому да: разработчикам и тимлидам на ежедневном ревью; продактам и дизайнерам со скринами; аналитикам и операциям с длинными документами; командам, которым нужен один сильный Claude без зоопарка подписок и без оплаты Opus каждый день.
Кому нет / не первый выбор: вредоносный кибер; сверхтяжёлое исследование / сложный код, где Opus/Fable окупаются процентами; сценарии с жёсткой зависимостью от даты отсечки июня 2026+ без приложенных источников; охота за минимумом задержки/цены (смотрите класс Haiku).
Если уже сидите на Claude API с 4.6: миграция на Sonnet 5 обычно окупается по ставке и качеству агентов, но заложите день на ломающие изменения (сэмплирование, мышление, токенизатор). Если сравниваете с подпиской Claude.ai — там Sonnet 5 по анонсу стоит по умолчанию, а лимиты и несколько вендоров в одном чате — другая сделка. Сравнивайте использование и удобство, не только имя модели. В хабе точка входа — карточка модели.
Opus не отменён. Планка «зачем платить за него каждый день» после 30 июня 2026 стала выше. Флагман к 22 сентября снова расширил разрыв на жёстких задачах — это нормально для лестницы Anthropic. Для повседневных задач модель средней полки часто и точка входа, и точка остановки.
Коротко
- Sonnet 5 — модель средней полки Anthropic с окном на миллион токенов, зрением и агентным профилем; документация рекомендует её для большинства приложений.
- По системной карте она сильно выросла относительно Sonnet 4.6: на знаниевых задачах спорит с Opus 4.8, на сложном коде всё ещё отстаёт.
- Стоит на уровне моделей среднего класса — примерно в два–пять раз дешевле флагманов вроде Opus. Ежедневный Opus после этого реже обязателен; пакеты хаба — /rates.
- С 4.6 ломается поведение API: адаптивное мышление по умолчанию, ручное расширенное мышление и своё сэмплирование дают ошибку 400, плюс новый токенизатор.
- В каталоге хаба Sonnet 5 доступен с тарифов «Про» и «Ультра»; Opus 5.5 на дату обзора в каталоге нет.
Вопросы и ответы
Чем Claude Sonnet 5 отличается от Sonnet 4.6?
Контекст на миллион токенов, адаптивное мышление по умолчанию, выше результаты на разработке и знаниевых задачах в системной карте, другой токенизатор и ломающие изменения в API. Ставка средней полки стала постоянной с 10 августа 2026.
Нужен ли Opus, если есть Sonnet 5?
Для основной рабочей модели — часто нет. Opus остаётся для сложного кода, свежей даты отсечки (у Opus 5.5 — июнь 2026), максимальной точности на управлении компьютером и науке и сценариев с ослабленными кибер-ограничениями по правилам Anthropic.
Есть ли Claude Sonnet 5 в каталоге хаба?
Да, с тарифов «Про» и «Ультра»: /models/claude-sonnet-5. Пакеты и лимиты — /rates.
Что такое адаптивное мышление и какой уровень усилия ставить?
Мышление включено по умолчанию, модель сама решает, когда думать дольше. Уровень по умолчанию — высокий. Для массовых задач часто выгоднее средний; максимальный — только когда реально нужен хвост точности, иначе растёт расход ответа.
Безопасно ли использовать Sonnet 5 в агентах?
По системной карте средняя полка тише Sonnet 4.6 по плохо выровненному поведению, но на автоматическом поведенческом аудите всё ещё выше Opus 4.8. Инъекция промпта не исчезает: минимальные привилегии для инструментов и одобрение человеком на опасных действиях обязательны.
Связанные модели
Связанные гайды
- Модель для кода
Какую модель GPThub взять для багов, ревью и рефакторинга: Flash и Nano, «Плюс» (Luna, GLM, Kimi) или «Про» (Claude, Terra, Grok 4.5).
- Сравнение моделей
Как честно сравнить две модели в GPThub: один промпт, критерии, новый чат vs смена модели. Без фейковых «мы лучше всех» и API-рейтингов.
- Как выбрать модель
Какую модель взять: текст или картинки, бесплатный тариф, «Плюс» или «Про». Короткая схема выбора и примеры под код, письма и разбор.
Ещё по теме
Источники
- Anthropic — Introducing Claude Sonnet 5
- Anthropic — Claude Sonnet product page
- Docs — Sonnet 5 overview
- Docs — Models overview
- Docs — Pricing
- Claude Sonnet 5 System Card (PDF)
- TechCrunch — Anthropic launches Claude Sonnet 5
- The Verge — Claude Sonnet 5 is here
- Release notes overview
- Anthropic — Claude Opus 5
- Anthropic pricing (Claude.ai + API cards)
- Vellum — Claude Sonnet 5 benchmarks explained
- CodingFleet — Sonnet 5 vs Sonnet 4.6
- Anthropic — Introducing Claude Opus 5.5
Об авторе

пишет обзоры и сравнения моделей — что изменилось, критерии, сценарии выбора, без вердикта «X лучше Y»
Собирает модели лицом к лицу: чем отличаются по сценарию, что смотреть в таблице, когда reasoning нужен, а когда нет. Вердикт — по задачам, не по бренду; финал всегда про доступность в GPThub по каталогу, без намёка на партнёрство с вендорами. Бенчмарки — только с датой и ссылкой на первоисточник.
Открыть чат с Claude Sonnet 5
Доступ из России без VPN. Модели, гайды и тарифы — в одном продукте.