Anthropic представила Claude Sonnet 5.5 — вторую модель в линейке 5.5, призванную занять нишу высокопроизводительного, быстрого и экономичного инструмента для повседневных прикладных задач. Новинка дополняет флагманскую модель Opus 5.5, уступая ей в сценариях, требующих непрерывного глубокого суждения и рассуждений в открытых задачах, но приближаясь к ней по качеству в решении прикладных инженерных и аналитических вопросов при существенно более низких затратах. В ближайшие недели линейка также пополнится облегченной моделью Haiku 5.5.
Ключевым преимуществом Sonnet 5.5 стало сочетание возросшей скорости и экономической эффективности. Хотя номинальная стоимость токенов осталась на прежнем уровне — два доллара за миллион входных и десять долларов за миллион выходных токенов — реальные затраты на решение задач снизились на величину до тридцати процентов за счет оптимизации расхода токенов и более компактных цепочек рассуждений. Генерация текста и кода стала быстрее более чем на тридцать процентов по сравнению с Sonnet 5.
В тестах на агентное программирование модель продемонстрировала резкий качественный скачок: на бенчмарке Terminal-Bench 4.0 результат вырос до семидесяти целых шести десятых процента против чуть более десяти процентов у предшественника, а в тестах FrontierCode и CursorBench система показала результаты, сопоставимые с топовыми решениями индустрии. Партнеры и ранние тестировщики отметили эффективную группировку вызовов инструментов, меньшее количество промежуточных ошибок и способность автономно вести длительные сессии разработки и проектирования архитектуры.
Помимо программирования, модель значительно прибавила в решении офисных и интеллектуальных задач. В комплексном бенчмарке GDPval-AA Sonnet 5.5 практически сравнялась с Opus 5.5, показав высокие результаты в распознавании диаграмм, работе с интерфейсом операционной системы и подготовке документов, презентаций и аналитических отчетов. В области безопасности модель сохранила строгие ограничения в биологической сфере и впервые для серии Sonnet получила специализированные фильтры кибербезопасности аналогично старшим флагманским системам.
Ключевым преимуществом Sonnet 5.5 стало сочетание возросшей скорости и экономической эффективности. Хотя номинальная стоимость токенов осталась на прежнем уровне — два доллара за миллион входных и десять долларов за миллион выходных токенов — реальные затраты на решение задач снизились на величину до тридцати процентов за счет оптимизации расхода токенов и более компактных цепочек рассуждений. Генерация текста и кода стала быстрее более чем на тридцать процентов по сравнению с Sonnet 5.
В тестах на агентное программирование модель продемонстрировала резкий качественный скачок: на бенчмарке Terminal-Bench 4.0 результат вырос до семидесяти целых шести десятых процента против чуть более десяти процентов у предшественника, а в тестах FrontierCode и CursorBench система показала результаты, сопоставимые с топовыми решениями индустрии. Партнеры и ранние тестировщики отметили эффективную группировку вызовов инструментов, меньшее количество промежуточных ошибок и способность автономно вести длительные сессии разработки и проектирования архитектуры.
Помимо программирования, модель значительно прибавила в решении офисных и интеллектуальных задач. В комплексном бенчмарке GDPval-AA Sonnet 5.5 практически сравнялась с Opus 5.5, показав высокие результаты в распознавании диаграмм, работе с интерфейсом операционной системы и подготовке документов, презентаций и аналитических отчетов. В области безопасности модель сохранила строгие ограничения в биологической сфере и впервые для серии Sonnet получила специализированные фильтры кибербезопасности аналогично старшим флагманским системам.