Anthropic представляет Claude Sonnet 4.5 — новый уровень ИИ в программировании

Компания Anthropic анонсировала Claude Sonnet 4.5 — инновационную модель искусственного интеллекта, которая кардинально меняет подход к программированию и разработке автономных агентов. Эта версия выделяется значительными улучшениями в логических задачах, математике и управлении сложными проектами, открывая новые возможности для научных исследований и практического применения.

Claude Sonnet 4.5 обладает функцией редактирования контекста и памятью, что позволяет ИИ-агентам эффективно сохранять и использовать информацию в течение длительного времени. Это дает возможность работать над проектами, не теряя данные. Модель также поддерживает автономное программирование, позволяя агентам разрабатывать, тестировать и завершать проекты практически без человеческого вмешательства, вплоть до 30 часов подряд.

В тестах по программированию Claude Sonnet 4.5 продемонстрировала рекордный результат — 77.2% на SWE-bench Verified, что делает её лидером в мире. Модель успешно функционирует в браузере через расширение Chrome, что позволяет агентам анализировать конкурентов, управлять закупками и выполнять другие бизнес-задачи.

Claude Sonnet 4.5 справляется с задачами любой сложности, от простого финансового анализа до сложной предиктивной аналитики. Концепция LLMOS от Карпатия становится реальностью, позволяя генерировать рабочее программное обеспечение всего одной командой. Экономичность модели также впечатляет: стоимость начинается от 3 долларов за миллион входных токенов, с возможностью экономии до 90% при использовании кэша и батчей.

Эта модель открывает новые горизонты для ученых и инженеров в области ИИ и автоматизации процессов. Более подробную информацию о Claude Sonnet 4.5 можно найти на сайте Anthropic.

Вопрос-ответ

Каковы ключевые нововведения Claude Sonnet 4.5 по сравнению с предыдущими версиями?

Claude Sonnet 4.5 добавляет редактируемый контекст и долговременную память, автономное программирование до 30 часов без вмешательства человека, улучшенные навыки в логике и математике, а также поддерживает работу через браузер в Chrome. Это позволяет агентам сохранять данные, тестировать проекты и управлять задачами с меньшей необходимостью человеческого участия.

Как работает функция редактирования контекста и памяти в этой модели?

Функция редактирования контекста позволяет обновлять и корректировать информацию, находящуюся в рамках текущего сеанса работы модели, а память обеспечивает сохранение данных на протяжении длительного времени. Это позволяет агентам продолжать проекты позже, не теряя ранее полученную информацию и решения.

Насколько эффективна Claude Sonnet 4.5 в программировании и автоматизации проектов?

В тестах на SWE-bench Verified модель достигла 77.2%, что является лидирующим результатом. Она поддерживает автономное программирование, тестирование и завершение проектов без значимого человеческого вмешательства, что существенно ускоряет выполнение задач и упрощает управление сложными проектами.

Какие дополнительные возможности и условия применения стоит учитывать?

Модель функционирует через браузерное расширение Chrome, облегчая анализ конкурентов, управление закупками и другие бизнес-задачи. Стоимость начинается от 3 долларов за миллион входных токенов и может снизиться до 90% за счет кэширования и батчей, что делает использование экономичным на крупных проектах.

Вам также может понравиться...