Top.Mail.Ru
Anthropic представила Claude Opus 5 — флагманская ИИ-модель на уровне Fable 5, но вдвое дешевле | Блог Serverflow Скачать
прайс-лист
Бесплатная
доставка по РФ
Бонус за
обратную связь
Интернет-магазин
Серверного оборудования
8 (800) 222-70-01 Консультация IT-специалиста Сравнение

Anthropic представила Claude Opus 5 — флагманская ИИ-модель на уровне Fable 5, но вдвое дешевле

~ 2 мин
17
Простой
Новости
Anthropic представила Claude Opus 5 — флагманская ИИ-модель на уровне Fable 5, но вдвое дешевле

Введение

Компания Anthropic представила Claude Opus 5 — свою новую ИИ-модель, которая  при цене $5 за миллион входных и $25 за миллион выходных токенов обеспечивает производительность почти на одном уровне с флагманской Claude Fable 5, стоимость которой в два раза выше. Opus 5 становится новой базовой моделью для тарифного плана Claude Max и самой мощной моделью для тарифа Claude Pro, а разработчики смогут получить доступ к Claude Opus 5 через API с дополнительным ускоренным режимом Fast, обеспечивающим задержки примерно в 2,5 раза ниже базовых.

Подробнее о Claude Opus 5

Ключевое преимущество Claude Opus 5 — существенный скачок ИИ-производительности по сравнению с предшествующей версией Claude Opus 4.8 при сохранении той же стоимости токенов. В тесте Frontier-Bench v0.1, измеряющем способность решать сложные инженерные задачи, Opus 5 более чем в 2 раза превосходит Opus 4.8 и обходит все конкурирующие модели, включая решения OpenAI GPT-5.6 Sol, при этом затраты на выполнение задачи оказываются существенно ниже. На CursorBench 3.2 при максимальной глубине размышлений Claude Opus 5 демонстрирует прирост в 0,5% относительно флагманской Fable 5, но при вдвое меньшей стоимости использования.  В задачах на знания и решение проблем превосходство выражено еще ярче. В бенчмарке ARC-AGI 3, где модели решают новые для себя задачи, показатель производительности Claude Opus 5 в 3 раза превышает результат ближайших конкурентов. В остальных базовых ИИ-бенчмарках Claude Opus 5 также держится на уверенном уровне, обходя конкурентов и вплотную приближаясь к показателям эффективности Fable 5 при значительно более бюджетной стоимости.

ИИ-производительность Claude Opus 5
ИИ-производительность Claude Opus 5 в сравнении с другими топовыми LLM. Источник: Anthropic.

Помимо высочайшей ИИ-эффективности, Claude Opus 5 является наиболее точной моделью с точки зрения соблюдения пользовательских инструкций. Автоматизированный поведенческий аудит показал наименьший уровень несоответствия требованиям среди всех последних моделей — 2,3 балла по шкале общего несоответствия. Модель демонстрирует минимальную склонность к обманному поведению и наименее подвержена манипуляциям, а также меньше всех моделей из семейства Claude допускает критические ошибки, вроде уже ставшего мемом внезапного удаления баз данных.

Показатель допуска несогласованного поведения Claude Opus 5
Показатель допуска несогласованного поведения Claude Opus 5. Источник: Anthropic.

Поскольку модель подобного уровня могла бы с легкостью повторить судьбу Fable 5, которая была заблокирована для иностранного использования из соображений безопасности, Anthropic значительно переработала защитные механизмы Claude Opus 5. Совместные оценки с частными и государственными партнерами показали, что модель уступает Mythos 5 как в биологических исследованиях, так и в наступательной кибербезопасности. Хотя Opus 5 практически сравнялся с Mythos 5 в обнаружении уязвимостей, включая тест OSS-Fuzz, он значительно отстает в превращении найденных уязвимостей в эксплойты — Anthropic сознательно не обучала модель выполнению подобных задач и в целом не готовила ее для операций кибербезопасности. Прмимо этого, для защиты от джеилбрейка в Opus 5 встроены киберклассификаторы: они разрешают поиск уязвимостей в исходном коде, но блокируют бинарное сканирование, пентестинг и генерацию эксплойтов. Ожидается, что классификаторы будут вмешиваться примерно на 85% реже, чем в Claude Fable 5. Запросы, помеченные флажками, будут по умолчанию обрабатываться с использованием Opus 4.8, как это было на релизе Fable 5. Но для верифицированных участников программы CVP доступна особая версия Claude Opus 5 с ослабленными ограничениями в подобных задачах. В биологических разработках запросы, блокировавшиеся в Fable 5, теперь будут перенаправляться на Claude Opus 5 вместо Claude Opus 4.8.

Эффективность нахождения эксплоитов Claude Opus 5
Эффективность нахождения эксплоитов Claude Opus 5. Источник: Anthropic.

Выводы

Claude Opus 5 задает новую планку соотношения цены и ИИ-производительности на рынке LLM для агентных задач и кодинга. Конечно, Anthropic сознательно пожертвовала частью эффективности в задачах кибербеза, чтобы пройти контроль со стороны правительства США, но без этого Claude Opus 5 ждала бы такая же участь, что и Claude Fable 5. Тем не менее, даже с этим лишением Claude Opus 5 не сдает позиции и утирает нос не только моделям конкурентов, вроде GPT от OpenAI, но и флагманской Fable 5 в большинстве сценариев использования, при этом оставаясь в два раза более бюджетным решением. Именно стоимость использования формирует интерес у большинства ИИ-энтузиастов, поэтому Claude Opus 5 обязательно придется по душе как корпоративным клиентам Anthropic, так и обычным юзерам.
Автор: Serverflow Serverflow
Поделиться

Комментарии 0

Написать комментарий
Сейчас тут ничего нет. Ваш комментарий может стать первым.
Написать отзыв
До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Написать комментарий

Комментарий появится на сайте после предварительной модерации

До 6 фото, размером до 12Мб каждое
Мы получили ваш отзыв!

Он появится на сайте после модерации.

Мы свяжемся с вами утром

График работы: Пн-Пт 10:00-18:30 (по МСК)

Обработаем вашу заявку
в ближайший рабочий день

График работы: Пн-Пт 10:00-18:30 (по МСК)