Anthropic выпустила Claude Sonnet 5 — агента подешевле Opus
Anthropic выпустила Claude Sonnet 5 — агентную модель дешевле Opus 4.8, GPT-5.5 и Gemini 3.1 Pro, ставшую дефолтной в Claude.
Anthropic выпустила Claude Sonnet 5 — новую версию своей средней по мощности модели. Главный акцент — на агентных задачах: модель сама строит план, пользуется браузером и терминалом и доводит дело до конца без постоянных подсказок.
С вторника Sonnet 5 становится моделью по умолчанию в бесплатном и Pro-тарифах Claude и доступна во всех подписках.
Цена до 31 августа — $2 за миллион входных токенов и $10 за миллион выходных. После — $3 и $10 соответственно. Это дешевле, чем Opus 4.8, GPT-5.5 от OpenAI и Gemini 3.1 Pro от Google. Дороже остаётся только Gemini 3.5 Flash.
По агентному кодингу Sonnet 5 набирает 63,2% против 58,1% у предыдущей Sonnet 4.6 и 69,2% у топовой Opus 4.8. А в тестах на работу со знаниями Sonnet 5 даже немного обходит Opus 4.8 — хотя именно Opus у Anthropic считается моделью для самых сложных задач, где нужна точность и тонкие суждения.
В Anthropic утверждают, что Sonnet 5 реже останавливается на полпути и сама проверяет результат своей работы, даже если её об этом не просили. Дэниел Шепард, старший инженер сервиса автоматизации Zapier, рассказал, что модель довела до конца двухэтапную задачу — обновить уровни аккаунтов в Salesforce и разослать письмо корпоративным клиентам — там, где предыдущие версии застревали на середине.
Модель также реже галлюцинирует и подыгрывает пользователю, чем Sonnet 4.6, и лучше отбивает попытки заставить её сделать что-то опасное через спрятанные в данных команды. Фабиан Хедин, сооснователь сервиса разработки Lovable, отметил, что Sonnet 5 «чисто и последовательно отказывается от небезопасных запросов».
При этом по уровню безопасности Sonnet 5 пока уступает Opus 4.8 и тестовой модели Claude Mythos Preview. Зато способность выполнять опасные задачи в кибербезопасности у неё заметно ниже, чем у моделей линейки Opus.