Anthropic представила Claude Sonnet 5 — обновленную нейросеть с продвинутыми автономными функциями

Anthropic представила Claude Sonnet 5 — обновленную нейросеть с продвинутыми автономными функциями


(Никто не голосовал)
Загрузка...

Разработчик систем искусственного интеллекта Anthropic выпустил новую версию своей среднеразмерной языковой модели — Claude Sonnet 5. Ключевым обновлением стало значительное улучшение агентных возможностей, позволяющих искусственному интеллекту самостоятельно планировать и выполнять сложные цепочки задач без постоянного контроля со стороны человека.

Эра автономных ИИ-агентов

Представители Anthropic отмечают, что Claude Sonnet 5 способен самостоятельно составлять планы, использовать веб-браузеры и терминалы, а также работать полностью автономно. Еще несколько месяцев назад для решения подобных задач требовались гораздо более крупные и дорогие модели.

Этот релиз подтверждает новый тренд в технологической индустрии, где способность ИИ действовать в качестве независимого агента становится базовым стандартом. Ранее аналогичные решения представили конкуренты: OpenAI запустила превью-версию GPT-5.6 Sol с возможностью делегирования задач субагентам, а Google позиционирует свою модель Gemini 3.5 Flash как полноценный рабочий инструмент, требующий минимального участия человека. В экспертном сообществе отмечают, что теперь ключевым фактором конкуренции становится не просто наличие агентных функций, а стоимость их использования и надежность работы без контроля со стороны пользователя.

Производительность и ценовая политика

По заявлениям разработчиков, Claude Sonnet 5 приближается по эффективности к флагманской Opus 4.8, но при этом обходится значительно дешевле. Модель уже стала доступна по умолчанию для пользователей бесплатных и платных тарифов.

Ценообразование для разработчиков выглядит следующим образом:

  • До 31 августа тариф составляет 2 доллара США за миллион входных токенов (обработанный текст) и 10 долларов за миллион выходных токенов (сгенерированный текст).
  • С 1 сентября стоимость поднимется до 3 долларов за миллион входных токенов при сохранении прежней стоимости выходных данных на уровне 10 долларов.

Такие расценки делают Sonnet 5 более выгодным решением по сравнению с Opus 4.8, а также конкурирующими GPT-5.5 от OpenAI и Gemini 3.1 Pro от Google. Тем не менее, модель остается дороже, чем Gemini 3.5 Flash.

Результаты тестов и практическое применение

Новая модель демонстрирует существенный качественный скачок по сравнению со своей предшественницей Sonnet 4.6, выпущенной в феврале. Улучшения коснулись логического мышления, работы с кодом и выполнения комплексных офисных задач.

Согласно внутренним тестам компании, в бенчмарке на написание кода Sonnet 5 набрала 63,2% (для сравнения, у Opus 4.8 этот показатель равен 69,2%, а у Sonnet 4.6 — 58,1%). В тестах на решение аналитических задач новинка даже незначительно превзошла флагманскую Opus 4.8, которая традиционно лидирует в проведении глубоких исследований и принятии сложных экспертных решений.

Разработчики подчеркивают, что Opus 4.8 по-прежнему остается приоритетным выбором для задач, требующих максимальной точности. Однако Sonnet 5 предоставляет разработчикам оптимальный баланс между снижением затрат и высоким качеством работы.

Сторонние специалисты, протестировавшие модель, отмечают ее способность доводить сложные многоэтапные процессы до конца. В отличие от предыдущих версий, Sonnet 5 умеет самостоятельно проверять результаты своей работы без дополнительных запросов. Например, в инженерной службе сервиса интеграций Zapier подтвердили, что новая модель успешно справилась с комплексной задачей по обновлению тарифных планов клиентов в Salesforce и последующей отправке уведомлений, тогда как более ранние версии ИИ обычно останавливались на середине процесса.

Безопасность и фильтрация нежелательного контента

В Anthropic также уделили внимание аспектам безопасности. Claude Sonnet 5 реже демонстрирует нежелательное поведение, устойчива к манипуляциям и попыткам обхода встроенных ограничений. Модель эффективнее распознает вредоносные запросы и реже склонна к галлюцинациям или чрезмерному соглашательству с пользователем по сравнению с версией 4.6.

При этом по уровню защиты от использования в опасных киберсценариях модель уступает флагманским решениям компании. По словам Фабиана Хедина, сооснователя платформы Lovable, Sonnet 5 умеет корректно и последовательно отклонять небезопасные запросы, что крайне важно при масштабировании ИИ-инструментов для миллионов пользователей.



Подпишитесь на новости блога
Добавить в закладки
Поучаствуйте в опросе:
Какой у вас производитель профиля окон?
Лучшие комментаторы:
Виолетта(26)
сергей(26)
Stan89(19)
adianon(15)
Слава(14)
andrei777
andrei777(8)