Forklog 2026-07-25 07:25:50

Anthropic выпустила Claude Opus 5

Anthropic представила Claude Opus 5, возможности которой «приближаются к интеллекту» флагманской Fable 5. Компания сразу открыла доступ к модели на всех платформах.  https://twitter.com/claudeai/status/2080699495453528290 Она стала моделью по умолчанию в подписке Max, а цены остались на уровне Opus 4.8 — $5 за млн входных токенов и $25 за млн выходных. Anthropic утверждает, что Opus 5 приблизилась к уровню Claude Fable 5 при вдвое меньших затратах на токены. В компании также заявили, что модель «стала новым эталоном» в тестах на оценку навыков программирования и интеллектуального труда, таких как Frontier-Bench и GDPval-AA, хотя в задачах кибербезопасности она по-прежнему уступает Mythos 5. Источник: Anthropic. По данным Anthropic, в бенчмарке Frontier-Bench v0.1 Opus 5 более чем вдвое превзошла Opus 4.8 при меньшей стоимости на задачу. В CursorBench 3.2 отставание от пикового результата Fable 5 составило менее 0,5% при вдвое более низкой стоимости. В тесте ARC-AGI 3 Opus 5 показала результат в три раза выше ближайшего конкурента. На платформе Zapier AutomationBench, оценивающей решение бизнес-задач, показатель успешного исполнения оказался примерно в полтора раза выше при равных финансовых затратах. В тесте OSWorld 2.0 (оценка производительности компьютера) модель превзошла лучший результат Fable 5. В Anthropic отдельно отметили прогресс в научных задачах. По данным компании, Opus 5 обошла Opus 4.8 во всех оценках по наукам о жизни. На внутреннем бенчмарке по органической химии результат вырос на 10,2 п.п., а в задачах, связанных с белками, — на 7,7 п.п. По словам Anthropic, Opus 5 стала самой согласованной с правилами компании моделью. В автоматизированном поведенческом аудите показатель общего несогласованного поведения составил 2,3 — это лучший результат среди последних моделей Anthropic. Источник: Anthropic. Для киберзадач Anthropic ослабила ограничения по сравнению с Fable 5. Компания оценила, что вмешательства классификаторов будут срабатывать примерно на 85% реже. При этом запросы, которые системы безопасности пометят в Claude.ai, Claude Code и Claude Cowork, по умолчанию будут перенаправляться на Opus 4.8. Аналогичное переключение можно включить и в API. Отдельно Anthropic указала, что биологические запросы, которые блокируются на Fable 5, теперь будут направляться на Opus 5, а не на Opus 4.8. Вместе с моделью Anthropic запустила в бета-режиме два обновления: возможность менять доступные инструменты по ходу диалога без сброса кеша промпта и автоматические переключения на резервные модели в API. Напомним, Opus 4.8 компания представила в мае, одновременно добавив в Claude Code функцию динамических рабочих процессов.

Прочтите Отказ от ответственности : Весь контент, представленный на нашем сайте, гиперссылки, связанные приложения, форумы, блоги, учетные записи социальных сетей и другие платформы («Сайт») предназначен только для вашей общей информации, приобретенной у сторонних источников. Мы не предоставляем никаких гарантий в отношении нашего контента, включая, но не ограничиваясь, точность и обновление. Никакая часть содержания, которое мы предоставляем, представляет собой финансовый совет, юридическую консультацию или любую другую форму совета, предназначенную для вашей конкретной опоры для любых целей. Любое использование или доверие к нашему контенту осуществляется исключительно на свой страх и риск. Вы должны провести собственное исследование, просмотреть, проанализировать и проверить наш контент, прежде чем полагаться на них. Торговля - очень рискованная деятельность, которая может привести к серьезным потерям, поэтому проконсультируйтесь с вашим финансовым консультантом, прежде чем принимать какие-либо решения. Никакое содержание на нашем Сайте не предназначено для запроса или предложения