Anthropic представи Claude Opus 5, новия си водещ AI модел за програмиране, проучвания, бизнес задачи и сложни работни процеси. Компанията твърди, че моделът значително превъзхожда Opus 4.8, без да променя базовата цена за използване през API.
Claude Opus 5 е достъпен във всички платформи на Claude и през API с идентификатор claude-opus-5. Моделът става стандартният избор за абонатите на Claude Max и най-мощният модел, включен в Claude Pro, съобщава Anthropic.
Колко близо е Claude Opus 5 до Fable 5
В CursorBench 3.2, тест за AI агенти, които изпълняват реални задачи по разработка на софтуер, Claude Opus 5 се доближава на 0,5% до най-добрия резултат на Fable 5 при максимално ниво на изчислително усилие.
Според Anthropic Opus 5 постига този резултат при наполовина по-ниска средна цена на задача. Компанията посочва също, че моделът предлага по-добро съотношение между резултат и разход при нивата high, xhigh и max effort.
При OSWorld 2.0, който измерва способността на AI агентите да управляват компютър и да работят с приложения и файлове, Opus 5 надминава най-добрия резултат на Fable 5 при малко над една трета от разходите.
Тези сравнения обаче са публикувани от самата Anthropic. Реалната производителност може да се различава според задачата, използваните инструменти, зададеното ниво на усилие и качеството на инструкциите.
Какво се подобрява спрямо Claude Opus 4.8
При Frontier-Bench v0.1 Claude Opus 5 постига повече от два пъти по-висок резултат от Opus 4.8, като според компанията средната цена за изпълнение на задача е по-ниска.
Тестът обхваща сложни задачи по софтуерно инженерство, при които моделът трябва да работи самостоятелно в няколко последователни стъпки. Anthropic уточнява, че резултатите са средни стойности от пет опита за всяка задача и са получени чрез вътрешно провеждане на теста.
Основните подобрения са свързани със способността на Opus 5 да:
- проверява собствената си работа;
- открива първопричината за програмни грешки;
- продължава изпълнението на трудни задачи;
- тества решенията си, преди да ги представи като завършени;
- коригира не само видимия симптом, но и основния технически проблем.
В един от примерите на Anthropic моделът е открил граничен случай, пропуснат в съществуваща корекция, предложена от общността. Подобни демонстрации показват потенциала на модела, но не представляват независимо доказателство за еднакво поведение във всички софтуерни проекти.
Приложения извън програмирането
Anthropic позиционира Claude Opus 5 и като модел за професионална работа, автоматизация и научни изследвания.
При Zapier AutomationBench моделът отчита около 1,5 пъти по-висок процент на успешно изпълнени бизнес задачи от следващия най-добър модел при съпоставима цена. Тестът проверява дали AI системата може да завърши цял работен процес, а не само отделна стъпка.
Компанията съобщава и за подобрения при задачи в структурната биология, органичната химия и биоинформатиката. На вътрешен тест за извеждане на молекулярни структури от спектроскопски данни Opus 5 превъзхожда Opus 4.8 с 10,2 процентни пункта. При задачи, свързани с влиянието на вариации в протеинови последователности, разликата е 7,7 процентни пункта.
И в този случай резултатите произлизат от тестове на Anthropic и не бива автоматично да се пренасят към всички реални научни или бизнес приложения. При работа с чувствителни данни и решения с висок риск остава необходим човешки контрол.
Колко струва Claude Opus 5
Базовата API цена остава същата като при Opus 4.8:
- около 4,40 евро за 1 млн. входни токена (5 долара);
- около 21,97 евро за 1 млн. изходни токена (25 долара).
Anthropic предлага и Fast mode, който работи приблизително 2,5 пъти по-бързо, но цената му е двойна. В Claude Code този режим се използва чрез допълнителни кредити.
Компанията не обявява отделна регионална версия или специална цена за България. Достъпът до някои възможности може да зависи от абонаментния план, платформата и ограниченията за използване на съответния акаунт.
Какво означава моделът за потребителите на Claude
Claude Opus 5 е насочен към потребители, които се нуждаят от по-мощен модел за програмиране, анализи и продължителни многоетапни задачи, но не искат да плащат цената на Fable 5 за всяка заявка.
Най-същественият въпрос не е дали Opus 5 печели отделен тест, а дали може да поддържа по-стабилно качество при реална работа и по-нисък разход. Публикуваните резултати са обещаващи, но все още са доминирани от измервания на самата Anthropic и партньори с ранен достъп.


