|
Опрос
|
реклама
Быстрый переход
Anthropic представила Claude Sonnet 5.5 — почти как Opus, но вдвое дешевле
28.09.2026 [22:46],
Андрей Созинов
Компания Anthropic представила Claude Sonnet 5.5 — вторую модель нового семейства Claude 5.5 вслед за флагманской Claude Opus 5.5. Разработчики позиционируют новинку как более быструю и экономичную модель для повседневных задач, программирования, работы с документами и создания презентаций. Главное изменение по сравнению с Claude Sonnet 5 — существенный рост производительности при одновременном сокращении количества вычислений, необходимых для выполнения типичных задач. По данным Anthropic, Sonnet 5.5 генерирует ответы более чем на 30 % быстрее предыдущей версии и в большинстве сценариев обходится до 30 % дешевле — новая модель обычно использует значительно меньше токенов для выполнения той же задачи. При этом цена одного токена не изменилась: $2 за 1 млн входных токенов и $10 за 1 млн выходных. Чтение токенов из кэша стоит $0,20 за 1 млн токенов. К слову, Claude Sonnet 5.5 поддерживает контекстное окно до 1 млн токенов и вывод до 128 тыс. токенов. Что касается показателей производительности, то особенно заметный прирост Anthropic заявляет в программировании. В тесте Terminal-Bench 4.0, оценивающем способность ИИ самостоятельно выполнять многоэтапные задачи в командной строке, Sonnet 5.5 набрала 70,6 % против всего лишь 10,3 % у Sonnet 5. В CursorBench 4.0 результат новой модели составил 55,5 %, тогда как предшественница получила лишь 34,1 %. Во FrontierCode 1.1 новая Sonnet 5.5 при максимальном уровне усилий набрала 46,2 % против 42,4 % у Sonnet 5. В свою очередь, флагманская Claude Opus 5.5 в этом тесте набрала 54,4 %. Anthropic отмечает, что в отдельных тестах при максимальном уровне усилий Sonnet 5.5 уже приближается к возможностям более дорогой Opus 5.5, хотя последняя сохраняет преимущество в сложной открытой работе, требующей длительного рассуждения и самостоятельного принятия решений. Напомним, что Opus 5.5 стоит вдвое дороже: $4 и $20 за миллион входных и выходных токенов соответственно. При этом Sonnet 5.5 рассчитана не только на разработчиков. Anthropic выделяет работу с документами, презентациями и таблицами, а также создание пользовательских интерфейсов. Компания утверждает, что новая модель лучше следует шаблонам презентаций и способна выдавать результаты, требующие меньшего объёма последующей ручной доработки. Существенно улучшилась и работа с длинными задачами. В тесте GDPval-AA v2.1, моделирующем выполнение реальной профессиональной работы в 44 профессиях и девяти отраслях, Sonnet 5.5 получила 1844 балла против 1449 у Sonnet 5. Результат оказался крайне близок к показателю Opus 5.5 — 1846 баллов. В тесте AA-Briefcase новая модель также заметно опередила предшественницу: 1811 против 1359 баллов. Anthropic отдельно отмечает улучшения в работе с изображениями и компьютерными интерфейсами. В тесте OSWorld 2.1, оценивающем способность ИИ взаимодействовать с операционной системой, Sonnet 5.5 получила 80,1 % против 57 % у Sonnet 5. Модель также стала лучше распознавать графики и визуальную информацию. Sonnet 5.5 стала первой моделью семейства Sonnet, которая смогла пройти игру Pokémon Red, используя только снимки экрана в качестве визуальной информации. Изменения коснулись и системы безопасности. Из-за существенного роста возможностей в области кибербезопасности Sonnet 5.5 стала первой моделью серии Sonnet, которая при запуске получила защитные механизмы и резервные ограничения, аналогичные используемым для более мощных моделей Anthropic. Для высокорисковых задач в сфере кибербезопасности система может переключаться на Sonnet 5. Кроме того, Sonnet 5.5 получила защиту от дистилляции — попыток извлечь данные модели с помощью массовых запросов от большого числа аккаунтов, чтобы потом использовать их для обучения другой высокопроизводительной модели. Anthropic применила в новой версии специальные классификаторы, препятствующие извлечению внутренних рассуждений. Claude Sonnet 5.5 уже доступна в чат-боте Claude, а также на всех основных платформах, включая собственную Claude Platform, Amazon Web Services, Google Cloud и Microsoft Azure. Для разработчиков модель доступна через API. В ближайшие недели Anthropic также обещает представить Claude Haiku 5.5 — ещё одну модель семейства Claude 5.5, ориентированную на высокую нагрузку и чувствительные к стоимости сценарии. Anthropic выпустила Claude Sonnet 5 — ИИ-модель «в среднем весе», которая приближается по уровню к Opus 4.8 и заточена под работу с агентами
01.07.2026 [09:17],
Павел Котов
Одной из важнейших возможностей для современных моделей искусственного интеллекта является их способность управлять агентскими приложениями, и при разработке новой Claude Sonnet 5 компания Anthropic уделила этому первостепенное внимание.
Источник изображений: anthropic.com «Она умеет планировать, пользоваться такими средствами как браузеры и терминал, а также работать автономно на уровне, который ещё несколько месяцев назад предполагали более крупные и дорогие модели», — рассказали в компании. Концепция Sonnet 5 основана на том, что управление ИИ-агентами является новым базовым требованием, которое предъявляется к моделям в любом сегменте. Решающим фактором является не то, какая из них лучше всего справляется с этой задачей, а то, насколько дёшево и надёжно она способна делать это без участия человека. ![]() Относящаяся к средней категории Claude Sonnet 5 обещает качество работы, близкое к Opus 4.8, но значительно дешевле; новая модель с сегодняшнего дня устанавливается по умолчанию для всех пользователей платформы Claude — тех, кто на бесплатном тарифе, и тех, кто оформил подписку. При доступе по API до 31 августа цена подключения к Sonnet 5 составляет $2 за 1 млн входных и $10 за 1 млн выходных токенов; далее цены вырастут до $3 и $15 соответственно. Новая модель демонстрирует значительные улучшения по сравнению с вышедшей в феврале Sonnet 4.6. В одном из тестов на написание кода Sonnet 5 набрала 63,2 % — Opus 4.8 показала 69,2 %, а Sonnet 4.6 — 58,1 %. В тесте на обработку данных Sonnet 5 даже немного обошла Opus 4.8, известную своей способностью решать самые сложные задачи, принимать сложные решения и проводить глубокие исследования. ![]() «Opus 4.8 всё ещё остаётся предпочтительной моделью для более высокой точности в таких задачах, но Sonnet 5 даёт разработчикам менее дорогие варианты с более высоким качеством, чем доступные ранее. С Sonnet 5 и Opus 4.8 пользователи могут выбирать уровень сложности, чтобы найти идеальный баланс между стоимостью и производительностью», — пояснил разработчик. У Sonnet 5 также снизился уровень «нежелательного поведения», то есть она менее подвержена злоупотреблениям и более безопасна в агентских контекстах, отклоняя вредоносные запросы и обходя попытки взлома при атаках с внедрением запросов. По сравнению с Sonnet 4.6 она реже демонстрирует галлюцинации и подобострастие. Конечно, ИИ-модель среднего класса Sonnet 5 всё-таки уступает Opus 4.8 и Claude Mythos Preview. «Оценки также показывают, что она обладает гораздо меньшей способностью выполнять опасные задачи в области кибербезопасности, чем наши текущие модели Opus», — предупредили в Anthropic. Меньше галлюцинаций и миллионный контекст: Anthropic представила Sonnet 4.6 и она уже доступна бесплатно в Claude
17.02.2026 [22:52],
Андрей Созинов
Anthropic обновила свою большую языковую модель Sonnet среднего уровня. В анонсе Sonnet 4.6 разработчики Anthropic подчеркнули улучшения в генерации программного кода, рассуждениях с длинным контекстом, выполнении инструкций и работе с компьютером. Новинка станет стандартной моделью для чат-бота Claude как для бесплатных пользователей, так и в платной подписке Pro.
Источник изображений: Anthropic Sonnet 4.6 предлагает контекстное окно размером 1 миллион токенов, что вдвое больше, чем было у предыдущей версии Sonnet. Anthropic описала новое контекстное окно как «достаточное для хранения целых кодовых баз, длинных контрактов или десятков исследовательских работ в одном запросе». В компании подчёркивают, что модель не только удерживает большой объём информации, но и эффективно работает с ним при построении логических цепочек. По данным Anthropic, разработчики, тестировавшие Sonnet 4.6 в раннем доступе, в 70 % случаев предпочли её версии 4.5. Пользователи отмечали более аккуратную работу с контекстом кода, меньшее количество дублирования логики и более последовательное выполнение инструкций. Разработчики также сообщают о снижении числа «галлюцинаций» и ложных заявлений об успешном выполнении задачи. Отдельное внимание уделено работе с компьютером без специализированных API. Модель взаимодействует с программами так же, как человек — через виртуальные клики мышью и ввод с клавиатуры. В бенчмарке OSWorld, который имитирует задачи в Chrome, LibreOffice и VS Code, свежая Sonnet 4.6 демонстрирует заметный прогресс по сравнению с предыдущими версиями. По словам представителей компании, в ряде сценариев — например, при работе со сложными таблицами или многошаговыми веб-формами — модель приближается к уровню человека. При этом Anthropic признаёт, что ИИ по-прежнему уступает наиболее опытным пользователям и что реальная работа с ПО сложнее лабораторных тестов. Anthropic отмечает, что Sonnet 4.6 предоставляет значительно улучшенные навыки программирования по сравнению с предыдущей версией. В соответствующих бенчмарках новинка оказалась лучше Gemini 3 Pro, а также почти сравнялась с Opus 4.5. По словам бета-тестеров модели, особенно заметны улучшения в задачах фронтенд-разработки и финансового анализа. Также отмечается, что Sonnet 4.6 в ряде задач смогла обеспечить уровень производительности, для достижения которого прежде требовалось использовать модели класса Opus, в том числе в реальных офисных задачах. Anthropic также раскрыла показатели на тесте ARC-AGI-2 — одном из наиболее сложных бенчмарков, оценивающих способность модели к абстрактному рассуждению и обобщению (навыков, характерных для человеческого интеллекта). Sonnet 4.6 достигла 60,4 % при высоком уровне «усилия мышления». Этот результат ставит Sonnet 4.6 выше большинства сопоставимых моделей, хотя он отстаёт от таких решений, как Opus 4.6, Gemini 3 Deep Think и одной из усовершенствованных версий GPT 5.2. В конце отметим, что релиз Sonnet 4.6 состоялся всего через две недели после запуска Opus 4.6, а значит, обновлённая модель Haiku, вероятно, появится в ближайшие недели. Модель уже доступна в боте Claude и приложении, а также через API для сторонних сервисов. Стоимость в последнем случае остаётся на уровне Sonnet 4.5 — от $3 за миллион входных токенов и $15 за миллион выходных. |