Claude Opus 5 доближава Fable 5 при част от задачите

Anthropic представи Claude Opus 5 за програмиране, проучвания и сложни бизнес задачи. Моделът доближава Fable 5 в някои тестове, запазва цената на Opus 4.8 и става стандартният избор за абонатите на Claude Max.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
Anthropic Claude Opus 5
Съдържание

Anthropic представи Claude Opus 5, новия си водещ AI модел за програмиране, проучвания, бизнес задачи и сложни работни процеси. Компанията твърди, че моделът значително превъзхожда Opus 4.8, без да променя базовата цена за използване през API.

Claude Opus 5 е достъпен във всички платформи на Claude и през API с идентификатор claude-opus-5. Моделът става стандартният избор за абонатите на Claude Max и най-мощният модел, включен в Claude Pro, съобщава Anthropic.

Колко близо е Claude Opus 5 до Fable 5

В CursorBench 3.2, тест за AI агенти, които изпълняват реални задачи по разработка на софтуер, Claude Opus 5 се доближава на 0,5% до най-добрия резултат на Fable 5 при максимално ниво на изчислително усилие.

Според Anthropic Opus 5 постига този резултат при наполовина по-ниска средна цена на задача. Компанията посочва също, че моделът предлага по-добро съотношение между резултат и разход при нивата high, xhigh и max effort.

Claude Opus 5 OSWorld 2.0 benchmark

Claude Opus 5 CursorBench benchmark

При OSWorld 2.0, който измерва способността на AI агентите да управляват компютър и да работят с приложения и файлове, Opus 5 надминава най-добрия резултат на Fable 5 при малко над една трета от разходите.

Тези сравнения обаче са публикувани от самата Anthropic. Реалната производителност може да се различава според задачата, използваните инструменти, зададеното ниво на усилие и качеството на инструкциите.

Какво се подобрява спрямо Claude Opus 4.8

При Frontier-Bench v0.1 Claude Opus 5 постига повече от два пъти по-висок резултат от Opus 4.8, като според компанията средната цена за изпълнение на задача е по-ниска.

Тестът обхваща сложни задачи по софтуерно инженерство, при които моделът трябва да работи самостоятелно в няколко последователни стъпки. Anthropic уточнява, че резултатите са средни стойности от пет опита за всяка задача и са получени чрез вътрешно провеждане на теста.

Claude Opus 5 Frontier-Bench v0.1 benchmark

Основните подобрения са свързани със способността на Opus 5 да:

  • проверява собствената си работа;
  • открива първопричината за програмни грешки;
  • продължава изпълнението на трудни задачи;
  • тества решенията си, преди да ги представи като завършени;
  • коригира не само видимия симптом, но и основния технически проблем.

В един от примерите на Anthropic моделът е открил граничен случай, пропуснат в съществуваща корекция, предложена от общността. Подобни демонстрации показват потенциала на модела, но не представляват независимо доказателство за еднакво поведение във всички софтуерни проекти.

Приложения извън програмирането

Anthropic позиционира Claude Opus 5 и като модел за професионална работа, автоматизация и научни изследвания.

При Zapier AutomationBench моделът отчита около 1,5 пъти по-висок процент на успешно изпълнени бизнес задачи от следващия най-добър модел при съпоставима цена. Тестът проверява дали AI системата може да завърши цял работен процес, а не само отделна стъпка.

Компанията съобщава и за подобрения при задачи в структурната биология, органичната химия и биоинформатиката. На вътрешен тест за извеждане на молекулярни структури от спектроскопски данни Opus 5 превъзхожда Opus 4.8 с 10,2 процентни пункта. При задачи, свързани с влиянието на вариации в протеинови последователности, разликата е 7,7 процентни пункта.

И в този случай резултатите произлизат от тестове на Anthropic и не бива автоматично да се пренасят към всички реални научни или бизнес приложения. При работа с чувствителни данни и решения с висок риск остава необходим човешки контрол.

Колко струва Claude Opus 5

Базовата API цена остава същата като при Opus 4.8:

  • около 4,40 евро за 1 млн. входни токена (5 долара);
  • около 21,97 евро за 1 млн. изходни токена (25 долара).

Anthropic предлага и Fast mode, който работи приблизително 2,5 пъти по-бързо, но цената му е двойна. В Claude Code този режим се използва чрез допълнителни кредити.

Компанията не обявява отделна регионална версия или специална цена за България. Достъпът до някои възможности може да зависи от абонаментния план, платформата и ограниченията за използване на съответния акаунт.

Какво означава моделът за потребителите на Claude

Claude Opus 5 е насочен към потребители, които се нуждаят от по-мощен модел за програмиране, анализи и продължителни многоетапни задачи, но не искат да плащат цената на Fable 5 за всяка заявка.

Най-същественият въпрос не е дали Opus 5 печели отделен тест, а дали може да поддържа по-стабилно качество при реална работа и по-нисък разход. Публикуваните резултати са обещаващи, но все още са доминирани от измервания на самата Anthropic и партньори с ранен достъп.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 08.08.2026
  • /
  • Изкуствен интелект
Claude Design може да промени начина, по който UX екипите, маркетолозите и продуктовите мениджъри превръщат идеите си във визуални концепции. Повечето инструменти за дизайн са създадени за дизайнери. Това е водещото разбиране от десетилетия и е довело до затруднение, добре познато на маркетолозите, продуктовите мениджъри и екипите за съдържание: имате идея, но превръщането ѝ във […]
  • 07.08.2026
  • /
  • GEO
Данните от AI търсенето в Google Search Console вече са отделени от стандартния отчет за ефективност. През последните две години представянето в AI търсачките оставаше до голяма степен непрозрачно. Брандовете виждаха, че AI Overviews се разрастват, процентът на кликване намалява и начинът, по който Google показва съдържание, се променя. Липсваха обаче данни от първа страна […]
  • 06.08.2026
  • /
  • Социални мрежи
AI съдържанието в LinkedIn вече се оценява по-строго, когато изглежда общо, повтарящо се или лишено от оригинална професионална гледна точка. Платформата не забранява използването на изкуствен интелект, но ограничава разпространението на публикации и коментари, при които AI заменя същинския принос на автора. В официална публикация от 20 май 2026 г. LinkedIn описва проблема като увеличаване […]
  • 05.08.2026
  • /
  • Дигитален маркетинг
Маркетингът на потребителска електроника има централен проблем: как се продава продукт, който шест месеца след премиерата си може да изглежда остарял и струва хиляди долари? Телефоните, телевизорите, слушалките, лаптопите, устройствата за умен дом, носимата електроника, гейминг хардуерът, камерите и свързаните домакински уреди попадат в една от най-взискателните категории за маркетолозите. Купувачите сравняват продуктите внимателно. Рецензентите […]
  • 03.08.2026
  • /
  • Социални мрежи
Нов инструмент за ключови думи в TikTok дава на създателите и брандовете повече контрол върху начина, по който съдържанието им се открива. Платформата вече позволява на потребителите да управляват ключовите думи в метаданните на своите видеа. Те могат да премахват неподходящи термини и да предлагат нови, които описват по-точно съдържанието. TikTok ще продължи да преглежда […]
  • 02.08.2026
  • /
  • Изкуствен интелект
Google Gemini през 2026 г. вече е значително повече от самостоятелен чатбот. Платформата постепенно се превръща в AI слой, който свързва търсенето, Android, Google Workspace и различни потребителски услуги. Промяната започна да се очертава ясно в края на 2025 г., но поредицата от актуализации през 2026 г. разшири както възможностите на моделите, така и начините, […]
AI Assistant