Anthropic представила Claude Opus 5.5 — первую модель нового семейства.
Главный прирост по сравнению с предыдущей версией заметен в программировании. Модель быстрее работает с большими кодовыми базами и показывает более высокие результаты в тестах на разработку ПО.
Читают прямо сейчас:
Claude Code, Cursor и Codex: какой AI-агент выбрать — как прирост в Terminal-Bench и скорость работы с 680 000 строк кода меняют выбор агента для крупных проектов
Почему короткий промпт может стоить дороже длинного — почему снижение стоимости кэш-чтения до $0,20 критично для длинных агентных сессий с большими кодовыми базами
Нерешённые математические задачи, на которых можно заработать — что значит формально доказать алгоритм быстрее Дейкстры в Lean и почему теоретический результат ещё не означает практического превосходства
Сильнее в программировании
В Terminal-Bench 4.0 Claude Opus 5.5 набрала 66,4% против 52,3% у Opus 5 и 57,9% у GPT-6 Astra. На практике модель также показала себя при работе с крупными проектами.
Один из тестировщиков с ее помощью перенес 680 000 строк кода менее чем за сутки, а другой проверил и исправил кодовую базу на 200 000 строк примерно за три часа. Аналогичная задача с Opus 5 заняла больше 20 часов.
Anthropic также провела внутреннюю проверку почти на 2000 сценариях безопасности. По данным компании, Opus 5.5 показала лучший результат среди ее моделей. Большинство задач по кибербезопасности при этом по-прежнему передается более специализированной Opus 4.8.
Дешевле и быстрее
Стоимость использования новой модели снизилась. Миллион входных токенов теперь стоит $4 вместо $5, выходных — $20 вместо $25, а чтение данных из кэша подешевело с $0,50 до $0,20.
За счет меньшего расхода токенов, общая стоимость решения задач, по оценке Anthropic, может снизиться примерно на 40%.
Текст Claude Opus 5.5 генерирует примерно на 30% быстрее Opus 5. Кроме того, модель стала чаще ставить главное в начало ответа и лучше соблюдать заданные правила.
Opus 5.5 уже доступна через API под именем claude-opus-5-5, а также в облачных сервисах AWS, Google Cloud и Microsoft Azure.
Нашла алгоритм быстрее Дейкстры
Отдельно модель проверили на математической задаче. Исследователь Геби Джафф поручил десяти агентам на базе Opus 5.5 найти алгоритм поиска кратчайшего пути, который был бы асимптотически быстрее алгоритма Дейкстры.
За 15 часов агенты разработали алгоритм C-HD и формально доказали его корректность и оценку сложности в Lean.
На определенном классе плотных графов C-HD имеет оценку сложности O(n·log^(11/12)n), тогда как у Дейкстры она составляет O(n log n). При n = 2^1000 разница между оценками достигает примерно 1,78 раза.
Однако это пока теоретический результат. Константы в доказательстве очень велики, а работу C-HD на реальных графах еще не проверяли. Поэтому говорить о практическом превосходстве нового алгоритма над Дейкстрой пока рано.
Большая скидка — 16% на все курсы Практикума
Если вы читаете эту статью, тогда вы точно разбираетесь в технологиях. Стать лучше и зарабатывать больше можно после курсов Практикума — по программированию, анализу данных и искусственному интеллекту.
До 30 сентября на все курсы действует скидка 16%, она применится автоматически при оплате. Потом цены станут выше, поэтому не откладывайте!
