Новая модель

Anthropic выпустила Claude Opus 5.5: быстрее и дешевле для сложной работы

22 сентября Anthropic представила Claude Opus 5.5 - первую модель семейства 5.5. Главный практический тезис релиза не только в баллах тестов: на типичных задачах компания заявляет примерно на 40% меньшую стоимость по сравнению с Opus 5, а генерация стала более чем на 30% быстрее. Это может изменить экономику длительных агентных сессий, но не означает, что каждая задача автоматически станет дешевле или что цифры внутренней оценки повторятся в любом проекте.

Проверено 23 сентября 2026 годаМатериал основан на открытых источниках, перечисленных ниже. Самостоятельные тесты редакция не проводила.
Главное

Что изменилось

01

Снижается цена за токены и объем работы

Anthropic указывает цену $4 за миллион входных и $20 за миллион выходных токенов. Для чтения кэша заявлено $0,20 за миллион. По словам компании, эффект складывается не только из тарифа: модель чаще справляется с заданием меньшим числом шагов и токенов. На практике стоимость зависит от длины контекста, режима мышления, повторных вызовов инструментов и того, сколько результата человек отправляет на переделку. Поэтому сравнивать нужно цену завершенной проверенной задачи, а не только прайс одного токена.

02

Улучшения нацелены на агентную работу

Anthropic приводит примеры масштабной миграции кода, оптимизации загрузки страниц, исследований и финансового анализа. В опубликованных тестах Opus 5.5 сильнее предыдущего Opus 5 на ряде задач и сопоставим с более старшей Fable 5.1 в большинстве сценариев. Компания отдельно предупреждает, что различие в бенчмарках не всегда совпадает с ощущаемой разницей в работе: узкая задача конкретного проекта может не попасть в тестовый набор.

03

Ответы стали лаконичнее и яснее

Anthropic говорит, что модель чаще ставит важную информацию в начало, лучше следует стилевым правилам и понятнее пишет в длинных сессиях. Это не просто эстетическая мелочь для агентов: короткое резюме, явные допущения и аккуратные комментарии упрощают ревью. Команда все равно должна задать формат передачи результата: список измененных файлов, тесты, открытые вопросы и команды для воспроизведения. Ясный текст не гарантирует корректность выполненного действия.

04

Появились дополнительные барьеры безопасности

Релиз включает защиту от prompt injection и модельный контроль действий агента. Компания пишет о менее рискованном поведении при необратимых действиях и усиленном аудите. Для API сохранен механизм preserved thinking, направленный против извлечения рассуждений через манипуляции с контекстом. Для биологических и киберсценариев действуют дополнительные ограничения, а доступ к отдельным возможностям может требовать проверки организации.

05

Переход на новую модель стоит проверить собственным тестом

Сделайте контрольный набор из 20-50 реальных задач и сохраните их входы, ожидаемые критерии, инструменты и прежние результаты. Сравните не один ответ, а долю задач, прошедших проверку без критичных ошибок, расходы, время и объем ручного исправления. Для кода учитывайте прохождение тестов и лишние изменения; для анализа - корректность ссылок и цифр; для агента - соблюдение границ доступа. Начните с пилота и сохраните предыдущий model ID для отката.

Редакционная карта

Как применить новость без лишних выводов

Сначала сохраните официальную формулировку, дату проверки и точную область изменения: продукт, тариф, регион, тип аккаунта или этап теста. Отдельно запишите, что источник не утверждает. Для рабочего решения назначьте владельца, подготовьте безопасный контрольный пример и измеримый критерий. Не объявляйте самостоятельное тестирование, если редакция анализирует только открытые сведения. При изменении документации обновляйте конкретный факт и зависимые выводы, а прежнюю версию оставляйте в истории. Такой порядок отделяет подтвержденную новость от прогноза и помогает читателю понять, какое действие возможно уже сейчас.

Контекст

Сравнивать нужно стоимость принятой задачи

Opus 5.5 объединяет цену токенов, скорость и количество действий агента. Для миграции большого кода токенный тариф - лишь часть счета: нужно учитывать проверку diff, повторный запуск и ручную отладку. До пилота определите, что считается завершенной задачей, какие тесты должны пройти и сколько ручных минут допустимо потратить. Иначе заявленное снижение цены нельзя сопоставить со своей прежней моделью.

Проверка

Контрольный набор для перехода

Выбрать типичные и трудные задания, включая неудачный вход и пограничные требования.

Сохранить одинаковые инструменты, инструкции, тесты и лимиты для Opus 5 и 5.5.

Сравнить полную стоимость, число исправлений, качество тестов, время и пропущенные риски.

Рабочий эффект

Кому обновление может окупиться

Наибольший эффект вероятен у долгих задач с большим контекстом и несколькими итерациями, где новая модель сокращает повторную работу. Для короткого шаблонного текста или простого классификатора дорогая модель может быть избыточной. Решение о выборе тарифа стоит принять после измерения стоимости результата на собственных заданиях.

Следующая проверка

План отката и наблюдения

В пилоте оставьте прежний model ID активным. Если новая версия начинает неверно менять публичные интерфейсы, теряет требования или превышает установленный бюджет, остановите поток и вернитесь к базовой версии. Еженедельно анализируйте несколько завершенных задач вручную, особенно там, где модель сама использовала инструменты. Отдельно отслеживайте доступность защитных режимов и возможные изменения тарифа.

Практический смысл

Что это дает пользователю

Разработчикам с большими репозиториями имеет смысл отдельно посчитать стоимость длительной миграции, ревью и повторных запусков: заявленная экономия наиболее интересна именно на длинных многошаговых задачах.

При работе с вебом, почтой или оболочкой оставьте подтверждение человека для удаления, публикации и изменения доступа. Более устойчивая модель снижает вероятность ошибки, но не отменяет последствий.

Для команд закупок запросите фактическую цену рабочего сценария, доступность модели в нужном регионе и условия хранения данных, а затем сопоставьте их с текущим провайдером.

Для проверки качества храните фиксированные задания и эталонные критерии. Если поменялись системная инструкция или набор инструментов, результаты нельзя считать чистым сравнением моделей.

Без завышенных ожиданий

Что нужно учитывать

Сравнительные тесты и кейсы в анонсе опубликованы разработчиком; они не являются независимым прогнозом результата для любой организации.

Биология и кибербезопасность имеют дополнительные ограничения, а отдельный доступ выдается через верификационные программы.

Экономия зависит от поведения агента, длины контекста и числа исправлений, а не только от тарифа за миллион токенов.

Вывод СравнAI

Коротко

Opus 5.5 выглядит прежде всего как попытка сделать сильную агентную модель более экономичной и удобной в длительной работе. Наиболее убедительный повод проверить обновление - сочетание меньшей цены, меньшего числа шагов и более ясной коммуникации. Решение о переходе стоит принимать по собственной корзине задач и считать успешное выполнение с контролем качества, а не переносить маркетинговую цифру экономии напрямую в бюджет. Следующая проверка - появление Sonnet 5.5 и Haiku 5.5, которые Anthropic анонсировала на ближайшие недели.

Источники

Где проверить информацию