Claude Opus 5 доближава Fable 5 при част от задачите

Anthropic представи Claude Opus 5 за програмиране, проучвания и сложни бизнес задачи. Моделът доближава Fable 5 в някои тестове, запазва цената на Opus 4.8 и става стандартният избор за абонатите на Claude Max.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
Anthropic Claude Opus 5
Съдържание

Anthropic представи Claude Opus 5, новия си водещ AI модел за програмиране, проучвания, бизнес задачи и сложни работни процеси. Компанията твърди, че моделът значително превъзхожда Opus 4.8, без да променя базовата цена за използване през API.

Claude Opus 5 е достъпен във всички платформи на Claude и през API с идентификатор claude-opus-5. Моделът става стандартният избор за абонатите на Claude Max и най-мощният модел, включен в Claude Pro, съобщава Anthropic.

Колко близо е Claude Opus 5 до Fable 5

В CursorBench 3.2, тест за AI агенти, които изпълняват реални задачи по разработка на софтуер, Claude Opus 5 се доближава на 0,5% до най-добрия резултат на Fable 5 при максимално ниво на изчислително усилие.

Според Anthropic Opus 5 постига този резултат при наполовина по-ниска средна цена на задача. Компанията посочва също, че моделът предлага по-добро съотношение между резултат и разход при нивата high, xhigh и max effort.

Claude Opus 5 OSWorld 2.0 benchmark

Claude Opus 5 CursorBench benchmark

При OSWorld 2.0, който измерва способността на AI агентите да управляват компютър и да работят с приложения и файлове, Opus 5 надминава най-добрия резултат на Fable 5 при малко над една трета от разходите.

Тези сравнения обаче са публикувани от самата Anthropic. Реалната производителност може да се различава според задачата, използваните инструменти, зададеното ниво на усилие и качеството на инструкциите.

Какво се подобрява спрямо Claude Opus 4.8

При Frontier-Bench v0.1 Claude Opus 5 постига повече от два пъти по-висок резултат от Opus 4.8, като според компанията средната цена за изпълнение на задача е по-ниска.

Тестът обхваща сложни задачи по софтуерно инженерство, при които моделът трябва да работи самостоятелно в няколко последователни стъпки. Anthropic уточнява, че резултатите са средни стойности от пет опита за всяка задача и са получени чрез вътрешно провеждане на теста.

Claude Opus 5 Frontier-Bench v0.1 benchmark

Основните подобрения са свързани със способността на Opus 5 да:

  • проверява собствената си работа;
  • открива първопричината за програмни грешки;
  • продължава изпълнението на трудни задачи;
  • тества решенията си, преди да ги представи като завършени;
  • коригира не само видимия симптом, но и основния технически проблем.

В един от примерите на Anthropic моделът е открил граничен случай, пропуснат в съществуваща корекция, предложена от общността. Подобни демонстрации показват потенциала на модела, но не представляват независимо доказателство за еднакво поведение във всички софтуерни проекти.

Приложения извън програмирането

Anthropic позиционира Claude Opus 5 и като модел за професионална работа, автоматизация и научни изследвания.

При Zapier AutomationBench моделът отчита около 1,5 пъти по-висок процент на успешно изпълнени бизнес задачи от следващия най-добър модел при съпоставима цена. Тестът проверява дали AI системата може да завърши цял работен процес, а не само отделна стъпка.

Компанията съобщава и за подобрения при задачи в структурната биология, органичната химия и биоинформатиката. На вътрешен тест за извеждане на молекулярни структури от спектроскопски данни Opus 5 превъзхожда Opus 4.8 с 10,2 процентни пункта. При задачи, свързани с влиянието на вариации в протеинови последователности, разликата е 7,7 процентни пункта.

И в този случай резултатите произлизат от тестове на Anthropic и не бива автоматично да се пренасят към всички реални научни или бизнес приложения. При работа с чувствителни данни и решения с висок риск остава необходим човешки контрол.

Колко струва Claude Opus 5

Базовата API цена остава същата като при Opus 4.8:

  • около 4,40 евро за 1 млн. входни токена (5 долара);
  • около 21,97 евро за 1 млн. изходни токена (25 долара).

Anthropic предлага и Fast mode, който работи приблизително 2,5 пъти по-бързо, но цената му е двойна. В Claude Code този режим се използва чрез допълнителни кредити.

Компанията не обявява отделна регионална версия или специална цена за България. Достъпът до някои възможности може да зависи от абонаментния план, платформата и ограниченията за използване на съответния акаунт.

Какво означава моделът за потребителите на Claude

Claude Opus 5 е насочен към потребители, които се нуждаят от по-мощен модел за програмиране, анализи и продължителни многоетапни задачи, но не искат да плащат цената на Fable 5 за всяка заявка.

Най-същественият въпрос не е дали Opus 5 печели отделен тест, а дали може да поддържа по-стабилно качество при реална работа и по-нисък разход. Публикуваните резултати са обещаващи, но все още са доминирани от измервания на самата Anthropic и партньори с ранен достъп.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 25.07.2026
  • /
  • Дигитална реклама
Рекламите в Google AI Mode се появяват при 29% от изследваните търговски заявки, но рекламодателите рядко присъстват сред цитираните източници. Това показва нов анализ на SE Ranking, който сравнява текстовите реклами, източниците в отговорите на AI Mode и органичните резултати за едни и същи ключови думи. При заявките, задействали реклама, домейнът на рекламодателя е присъствал […]
  • 25.07.2026
  • /
  • SEO
Google може да продължи да индексира нежелани URL адреси, когато robots.txt е конфигуриран неправилно или се използва за цел, която файлът не изпълнява. Джон Мюлер от Google обърна внимание на лесна за пропускане грешка в robots.txt, която може да попречи на контрола върху обхождането на сайта. Конкретният случай е свързан със спам през вътрешната търсачка […]
  • 25.07.2026
  • /
  • Социални мрежи
YouTube уточнява правилата за монетизация в YouTube, за да ограничи приходите на каналите с масово произвеждани, манипулативни или подвеждащи AI видеа. Промените засягат YouTube Partner Program (YPP) и са в сила от 16 юли 2026 г. Те не представляват пълна забрана на съдържанието, създадено с изкуствен интелект. Платформата по-скоро конкретизира три категории, при които каналите […]
  • 24.07.2026
  • /
  • Изкуствен интелект
Gemini Spark започва поетапно да достига до абонатите на Google AI Pro в САЩ, с което агентът излиза извън най-скъпия Ultra план. Google потвърди разширяването на 23 юли 2026 г. чрез официалния профил на Gemini в X. Компанията посочва, че достъпът ще бъде предоставен и на абонати на AI Pro в други държави, но не […]
  • 23.07.2026
  • /
  • Социални мрежи
Добре изграденото присъствие на бранд в Reddit през 2026 г. може да помогне на компаниите да разбират аудиторията и да участват в важни разговори. С навлизането във втората половина на годината маркетолозите вече планират празничните кампании и начините за увеличаване на обхвата, разпознаваемостта и продажбите. Дори при готов комуникационен календар обаче има смисъл традиционният подход […]
  • 23.07.2026
  • /
  • Изкуствен интелект
Google се нуждае от по-мощен Gemini 4, за да подобри позициите си при програмирането и автономните AI агенти, призна Сундар Пичай. По време на разговора с инвеститорите след финансовите резултати на Alphabet за второто тримесечие на 2026 г. главният изпълнителен директор посочи, че компанията трябва да постигне напредък при генерирането на код и така нареченото […]
AI Assistant