Claude Opus 5 доближава Fable 5 при част от задачите

Anthropic представи Claude Opus 5 за програмиране, проучвания и сложни бизнес задачи. Моделът доближава Fable 5 в някои тестове, запазва цената на Opus 4.8 и става стандартният избор за абонатите на Claude Max.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
Anthropic Claude Opus 5
Съдържание

Anthropic представи Claude Opus 5, новия си водещ AI модел за програмиране, проучвания, бизнес задачи и сложни работни процеси. Компанията твърди, че моделът значително превъзхожда Opus 4.8, без да променя базовата цена за използване през API.

Claude Opus 5 е достъпен във всички платформи на Claude и през API с идентификатор claude-opus-5. Моделът става стандартният избор за абонатите на Claude Max и най-мощният модел, включен в Claude Pro, съобщава Anthropic.

Колко близо е Claude Opus 5 до Fable 5

В CursorBench 3.2, тест за AI агенти, които изпълняват реални задачи по разработка на софтуер, Claude Opus 5 се доближава на 0,5% до най-добрия резултат на Fable 5 при максимално ниво на изчислително усилие.

Според Anthropic Opus 5 постига този резултат при наполовина по-ниска средна цена на задача. Компанията посочва също, че моделът предлага по-добро съотношение между резултат и разход при нивата high, xhigh и max effort.

Claude Opus 5 OSWorld 2.0 benchmark

Claude Opus 5 CursorBench benchmark

При OSWorld 2.0, който измерва способността на AI агентите да управляват компютър и да работят с приложения и файлове, Opus 5 надминава най-добрия резултат на Fable 5 при малко над една трета от разходите.

Тези сравнения обаче са публикувани от самата Anthropic. Реалната производителност може да се различава според задачата, използваните инструменти, зададеното ниво на усилие и качеството на инструкциите.

Какво се подобрява спрямо Claude Opus 4.8

При Frontier-Bench v0.1 Claude Opus 5 постига повече от два пъти по-висок резултат от Opus 4.8, като според компанията средната цена за изпълнение на задача е по-ниска.

Тестът обхваща сложни задачи по софтуерно инженерство, при които моделът трябва да работи самостоятелно в няколко последователни стъпки. Anthropic уточнява, че резултатите са средни стойности от пет опита за всяка задача и са получени чрез вътрешно провеждане на теста.

Claude Opus 5 Frontier-Bench v0.1 benchmark

Основните подобрения са свързани със способността на Opus 5 да:

  • проверява собствената си работа;
  • открива първопричината за програмни грешки;
  • продължава изпълнението на трудни задачи;
  • тества решенията си, преди да ги представи като завършени;
  • коригира не само видимия симптом, но и основния технически проблем.

В един от примерите на Anthropic моделът е открил граничен случай, пропуснат в съществуваща корекция, предложена от общността. Подобни демонстрации показват потенциала на модела, но не представляват независимо доказателство за еднакво поведение във всички софтуерни проекти.

Приложения извън програмирането

Anthropic позиционира Claude Opus 5 и като модел за професионална работа, автоматизация и научни изследвания.

При Zapier AutomationBench моделът отчита около 1,5 пъти по-висок процент на успешно изпълнени бизнес задачи от следващия най-добър модел при съпоставима цена. Тестът проверява дали AI системата може да завърши цял работен процес, а не само отделна стъпка.

Компанията съобщава и за подобрения при задачи в структурната биология, органичната химия и биоинформатиката. На вътрешен тест за извеждане на молекулярни структури от спектроскопски данни Opus 5 превъзхожда Opus 4.8 с 10,2 процентни пункта. При задачи, свързани с влиянието на вариации в протеинови последователности, разликата е 7,7 процентни пункта.

И в този случай резултатите произлизат от тестове на Anthropic и не бива автоматично да се пренасят към всички реални научни или бизнес приложения. При работа с чувствителни данни и решения с висок риск остава необходим човешки контрол.

Колко струва Claude Opus 5

Базовата API цена остава същата като при Opus 4.8:

  • около 4,40 евро за 1 млн. входни токена (5 долара);
  • около 21,97 евро за 1 млн. изходни токена (25 долара).

Anthropic предлага и Fast mode, който работи приблизително 2,5 пъти по-бързо, но цената му е двойна. В Claude Code този режим се използва чрез допълнителни кредити.

Компанията не обявява отделна регионална версия или специална цена за България. Достъпът до някои възможности може да зависи от абонаментния план, платформата и ограниченията за използване на съответния акаунт.

Какво означава моделът за потребителите на Claude

Claude Opus 5 е насочен към потребители, които се нуждаят от по-мощен модел за програмиране, анализи и продължителни многоетапни задачи, но не искат да плащат цената на Fable 5 за всяка заявка.

Най-същественият въпрос не е дали Opus 5 печели отделен тест, а дали може да поддържа по-стабилно качество при реална работа и по-нисък разход. Публикуваните резултати са обещаващи, но все още са доминирани от измервания на самата Anthropic и партньори с ранен достъп.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 15.09.2026
  • /
  • Изкуствен интелект
Нови функции в Gemini Notebook ще помагат на студентите да разбират сложни теми, да записват лекции и да проверяват знанията си. Google добавя гласови разговори в реално време, вграден диктофон, нови тестове и кратки видеообобщения. Gemini Notebook, познато преди като NotebookLM, получава сериозна актуализация, насочена към студентите. Новите инструменти трябва да улеснят разбирането на трудни […]
  • 14.09.2026
  • /
  • Социални мрежи
Meta пусна общия абонамент Meta One с над 50 платени функции за Instagram, Facebook, WhatsApp и Meta AI. Услугата включва планове за индивидуални потребители, създатели на съдържание и бизнеси, като цените и достъпните възможности зависят от региона и профила. Компанията обяви услугата след месеци на тестове. Разпространението на плановете става постепенно, уточнява Meta в официалното […]
  • 09.09.2026
  • /
  • Изкуствен интелект
ChatGPT Images 2.5 позволява на потребителите да покажат идеята си чрез рисунка, която изкуственият интелект да превърне в завършено изображение, според информацията в предоставения материал. Обновлението включва и подобрения в скоростта, реалистичността и прецизността при редактиране. В текста се посочва, че OpenAI започва разпространението на новата версия на фона на над 3 милиарда изображения, генерирани […]
  • 08.09.2026
  • /
  • Изкуствен интелект
ChatGPT тества функцията Writing Style, която цели да доближи генерираните текстове до начина, по който пише конкретният потребител. Вместо всеки път да получава инструкции за тона или копирани примери от стари имейли, чатботът ще може да използва текстове от свързани приложения. Идеята е да отпадне необходимостта потребителите многократно да обясняват как трябва да звучат отговорите. […]
  • 06.09.2026
  • /
  • SEO
Решението дали да бъдат блокирани AI ботовете е преди всичко бизнес въпрос. След като една компания прецени, че не желае нейното съдържание да бъде обхождано, използвано за обучение или достъпвано от определени AI системи, идва техническият въпрос: кой е най-добрият начин за блокиране? Основните подходи са два. AI ботовете могат да бъдат ограничени чрез файла […]
  • 06.09.2026
  • /
  • Изкуствен интелект
Google добави Lyria 3.5, своя най-усъвършенстван досега модел за генериране на музика, към приложението Gemini. Досега технологията беше достъпна чрез инструмента за създаване на филми с изкуствен интелект Flow. Моделът вече започва да достига до всички потребители на Gemini. Чрез него могат да бъдат генерирани песни, инструментали и саундтраци въз основа на обикновени текстови описания […]