Темы

понедельник, 29 сентября 2025 г.

Anthropic представила Claude Sonnet 4.5 в понедельник, позиционируя модель искусственного интеллекта как прорыв в автономных возможностях программирования, способную работать без перерыва более 30 часов

Anthropic представила Claude Sonnet 4.5 в понедельник, позиционируя модель искусственного интеллекта как прорыв в автономных возможностях программирования, способную работать без перерыва более 30 часов — более чем в четыре раза дольше, чем её предшественник.


Сан-Францисская компания по разработке искусственного интеллекта, поддерживаемая Amazon и оценённая в $183 млрд, утверждает, что новая модель представляет собой «лучший кодирующий ИИ в мире» на основе результатов на отраслевых бенчмарках. Claude Sonnet 4.5 получила оценку 77,2% на SWE-Bench Verified — строгом тесте по программной инженерии, оценивающем ИИ на реальных задачах программирования.


Революционные автономные возможности


Расширенные рабочие возможности модели знаменуют собой значительный скачок по сравнению с Claude Opus 4, которая при запуске в мае могла сохранять концентрацию лишь примерно в течение семи часов. Во время внутренних тестов Claude Sonnet 4.5 самостоятельно разработал полноценное чат-приложение, сгенерировав около 11 000 строк кода при сохранении связности на протяжении всего процесса разработки.


«Claude Sonnet 4.5 меняет наши ожидания — он справляется с более чем 30 часами автономного кодирования, что позволяет нашим инженерам решать задачи, занимавшие месяцы сложной архитектурной работы, в разы быстрее, при этом поддерживая целостность огромных кодовых баз», — сказал Шон Уорд, генеральный директор iGent AI.


Модель также показала превосходные результаты в задачах взаимодействия с компьютером, набрав 61,4% на бенчмарке OSWorld — почти на 20 процентных пунктов больше, чем показатель Claude Sonnet 4 (42,2%) всего четырьмя месяцами ранее.


Усовершенствованные инструменты для разработчиков и функции безопасности


Помимо высокой производительности при программировании, Claude Sonnet 4.5 вводит значительные улучшения в рабочие процессы разработчиков благодаря расширенным инструментам и мерам безопасности. Модель теперь поддерживает контрольные точки в Claude Code, позволяя разработчикам сохранять прогресс и возвращаться к предыдущим состояниям — эта функция была одной из самых востребованных в сообществе программистов. Кроме того, теперь пользователи могут выполнять код и создавать файлы, включая электронные таблицы, презентации и документы, прямо в рамках бесед.


Anthropic позиционирует это как свою «наиболее согласованную передовую модель на сегодняшний день», с существенным снижением проблемного поведения, такого как подхалимство, обман и стремление к власти. Компания также усилила защиту от атак с внедрением вредоносных подсказок, когда злоумышленники пытаются манипулировать ИИ с помощью специально созданных входных данных. Эти улучшения безопасности сопровождаются выпуском Claude Agent SDK, предоставляющего разработчикам ту же инфраструктуру, на которой работает Claude Code, чтобы создавать собственных автономных агентов, способных управлять памятью, контролировать права доступа и координировать работу нескольких субагентов.



Комментариев нет:

Отправить комментарий

Избранные

Квантовый компьютер на захваченных ионах моделирует физику частиц с помощью кубитов и фононов

Учёные из Университета Мэриленда впервые использовали колебательные фононные моды захваченных ионов как нативный бозонный регист...

Часто просматриваемве