Компания Anthropic представила модель Claude Opus 5.5, открывающую новую линейку Claude 5.5. Разработчик позиционирует данную модель как флагманское решение для задач агентного программирования, выполнения сложных аналитических операций и автоматизированного взаимодействия с интерфейсами компьютеров. В ближайшие недели ожидается выход других представителей семейства — Claude Sonnet 5.5 и Claude Haiku 5.5, в которые будут перенесены основные изменения в производительности и безопасности.

Ключевые показатели стоимости использования API Opus 5.5 следующие:

Стоимость входных токенов составляет $4 за миллион, выходных — $20 за миллион. Для сравнения, тарифы Opus 5 составляли $5 и $25 соответственно.

Стоимость обработки токенов из кеша снижена с $0,50 до $0,20 за миллион.

Введен ускоренный режим работы с генерацией, скорость которого увеличена до 2,5 раз при тарифах $8 за миллион входных и $40 за миллион выходных токенов.

В области программирования модель демонстрирует высокую эффективность при работе с крупными проектами. Согласно данным Anthropic, Opus 5.5 работает на 30% быстрее предшествующей версии Opus 5. Примеры использования включают следующие результаты:

Миграция кодовой базы объемом 680 000 строк была выполнена менее чем за сутки.

Проверка и исправление 200 000 строк кода заняли менее 3 часов, тогда как Opus 5 требовалось более 20 часов.

Перевод проекта HAProxy с C на Rust занял 9,5 часа, что на 2,5 часа быстрее Claude Fable 5.1, при этом затраты были сокращены на 51%.

Изменения коснулись и обработки текстовой информации. Компания отмечает способность модели точнее следовать правилам оформления, избегать избыточного использования жаргона и выделять ключевые аспекты. В ходе внутреннего тестирования при подготовке финансового отчета на основе данных из веб-архива, 16 из 18 сгенерированных отчетов успешно прошли фактологическую проверку на отсутствие вымышленных цитат или числовых показателей.

Вопросы информационной безопасности остаются приоритетным направлением доработки. Anthropic провела автоматизированную проверку поведения Opus 5.5 почти по 2000 сценариям, по результатам которой модель показала более высокую устойчивость к атакам типа prompt injection по сравнению с Opus 5. Согласно отчету компании, в тестах на попытки обхода установленных ограничений частота таких действий снизилась примерно на 85% относительно результатов Opus 5 и Claude Mythos 5.1. При этом разработчик указывает, что данные проверки не дают полной гарантии предсказуемости поведения модели в реальных условиях эксплуатации. В настоящий момент Claude Opus 5.5 доступна пользователям на основных платформах.

Источник

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *