Claude 3.5 Sonnet

- Обновление
Условия использования для потребителей и Политика конфиденциальности
28 авг. 2025 г.
Сегодня мы выпускаем Claude 3.5 Sonnet — нашу первую модель в рамках готовящегося к выходу семейства моделей Claude 3.5. Claude 3.5 Sonnet поднимает планку возможностей искусственного интеллекта в отрасли, превосходя конкурирующие модели и Claude 3 Opus в широком спектре тестов, сохраняя при этом скорость и стоимость нашей модели среднего уровня — Claude 3 Sonnet.
Claude 3.5 Sonnet теперь доступна бесплатно на Claude.ai и в приложении Claude для iOS, в то время как подписчики тарифов Claude Pro и Team могут работать с ней при значительно более высоких лимитах запросов. Она также доступна через API Anthropic, на платформе Amazon Bedrock и в Google Cloud Vertex AI. Стоимость модели составляет $3 за миллион входных токенов и $15 за миллион выходных токенов при размере контекстного окна в 200 тыс. токенов.

Передовой интеллект с удвоенной скоростью
Claude 3.5 Sonnet устанавливает новые отраслевые стандарты в области рассуждений на уровне выпускников вузов (GPQA), знаний на уровне студентов бакалавриата (MMLU) и навыков программирования (HumanEval). Она демонстрирует заметное улучшение в понимании нюансов, юмора и сложных инструкций, а также превосходно справляется с созданием высококачественного контента в естественном, располагающем тоне.
Claude 3.5 Sonnet работает в два раза быстрее, чем Claude 3 Opus. Такой прирост производительности в сочетании с доступной ценой делает Claude 3.5 Sonnet идеальным решением для сложных задач, таких как контекстно-зависимая техподдержка и оркестрация многоэтапных рабочих процессов.
В ходе внутреннего тестирования агентского программирования Claude 3.5 Sonnet успешно справилась с 64% задач, превзойдя Claude 3 Opus, результат которой составил 38%. Наша оценка проверяет способность модели исправлять баги или добавлять функциональность в кодовую базу с открытым исходным кодом на основе текстового описания желаемого улучшения. При получении инструкций и соответствующих инструментов Claude 3.5 Sonnet может самостоятельно писать, редактировать и выполнять код, обладая сложными возможностями рассуждения и устранения неполадок. Она легко справляется с переводом кода, что делает ее особенно эффективной для обновления устаревших приложений и миграции кодовых баз.

Современные возможности работы с изображениями
Claude 3.5 Sonnet — наша самая мощная мультимодальная модель на сегодняшний день, превосходящая Claude 3 Opus по стандартным бенчмаркам визуального восприятия. Эти качественные улучшения наиболее заметны в задачах, требующих визуального анализа, таких как интерпретация диаграмм и графиков. Claude 3.5 Sonnet также способна точно распознавать текст с некачественных изображений — это ключевая возможность для розничной торговли, логистики и финансовых услуг, где ИИ может извлечь больше ценной информации из изображения или иллюстрации, чем из одного лишь текста.

Артефакты (Artifacts) — новый способ использования Claude
Сегодня мы также представляем «Артефакты» (Artifacts) на платформе Claude.ai — новую функцию, которая расширяет возможности взаимодействия пользователей с Claude. Когда пользователь просит Claude сгенерировать контент, например фрагменты кода, текстовые документы или дизайн веб-сайта, эти артефакты появляются в отдельном окне рядом с диалогом. Это создает динамичное рабочее пространство, где можно просматривать, редактировать и дорабатывать творения Claude в режиме реального времени, органично интегрируя контент, созданный ИИ, в свои проекты и рабочие процессы.
Эта предварительная функция знаменует собой эволюцию Claude из разговорного ИИ в среду для совместной работы. Это лишь начало более масштабного видения для Claude.ai, которое вскоре расширится за счет поддержки командной работы. В ближайшем будущем команды —, а со временем и целые организации — смогут безопасно централизовать свои знания, документы и текущую работу в едином общем пространстве, где Claude будет выступать в роли виртуального коллеги по команде.
Приверженность принципам безопасности и конфиденциальности
Наши модели проходят строгие испытания и обучаются минимизации рисков злоупотребления. Несмотря на качественный скачок в интеллекте Claude 3.5 Sonnet, оценки нашей команды «красных хакеров» (red teaming) показали, что уровень безопасности модели по-прежнему соответствует ASL-2. Более подробную информацию можно найти в приложении к паспорту модели.
В рамках нашего стремления к безопасности и прозрачности мы привлекли внешних экспертов для тестирования и доработки механизмов безопасности в этой новейшей модели. Недавно мы предоставили Claude 3.5 Sonnet Институту безопасности искусственного интеллекта Великобритании (UK AISI) для оценки безопасности перед развертыванием. UK AISI завершила тестирование 3.5 Sonnet и поделилась его результатами с Институтом безопасности ИИ США (US AISI) в рамках Меморандума о взаимопонимании, заключенного благодаря партнерству между институтами США и Великобритании, о котором было объявлено ранее в этом году.
Мы интегрировали отзывы экспертов по профильным вопросам извне, чтобы убедиться, что наши оценки надежны и учитывают новые тенденции злоупотреблений. Это сотрудничество помогло нашим командам расширить возможности оценки 3.5 Sonnet на предмет различных видов неправомерного использования. Например, мы использовали отзывы экспертов по защите детей из организации Thorn для обновления наших классификаторов и тонкой настройки моделей.
Одним из фундаментальных принципов нашей конституции, определяющих разработку моделей ИИ, является конфиденциальность. Мы не обучаем наши генеративные модели на данных пользователей, если пользователь не дал нам на это прямого разрешения.
Скоро в продаже
Наша цель — каждые несколько месяцев существенно улучшать баланс между интеллектом, скоростью и стоимостью. Для завершения формирования семейства моделей Claude 3.5 позже в этом году мы выпустим Claude 3.5 Haiku и Claude 3.5 Opus.
Помимо работы над новым поколением моделей, мы разрабатываем новые модальности и функции для поддержки большего числа корпоративных сценариев использования, включая интеграцию с бизнес-приложениями. Наша команда также изучает такие функции, как «Память» (Memory), которая позволит Claude запоминать предпочтения пользователя и историю взаимодействия по его указанию, делая взаимодействие еще более персонализированным и эффективным.
Мы постоянно работаем над улучшением Claude и будем рады вашим отзывам. Вы можете оставить отзыв о Claude 3.5 Sonnet прямо в продукте — это поможет нам сформировать план разработки и сделать работу с сервисом еще удобнее. Как всегда, мы с нетерпением ждем возможности увидеть, что вы построите, создадите и откроете для себя с помощью Claude.
Полный текст статьи читайте на Anthropic
