OpenAI спира пускането на GPT-6.1 Astra след проблеми при тестовете за безопасност

OpenAI няма да пусне публично GPT-6.1 Astra, след като вътрешни тестове са открили проблеми със спазването на зададения от потребителите обхват, надеждното отчитане на извършените действия и използването на външни инструменти.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
ChatGPT 6 Astra
Съдържание

OpenAI се е отказала от публичното пускане на GPT-6.1 Astra, след като вътрешни тестове са установили, че моделът е станал по-способен при изпълнението на сложни задачи, но едновременно с това по-лош в спазването на ограниченията, зададени от потребителите.

Според ексклузивен материал на The Wall Street Journal OpenAI е планирала да представи модела през октомври. Компанията обаче е решила да не го пуска, след като изследователите са установили проблеми, свързани със заблуждаващо поведение и с това, което OpenAI нарича „scope authorization“, или разрешен обхват на действие.

Саачи Джейн, ръководител на системите за безопасност в OpenAI, заявява пред изданието, че GPT-6.1 Astra „не е успял напълно да покрие“ изискванията на компанията за безопасност и съответствие.

OpenAI е установила, че по-новият модел е бил по-малко надежден, когато е трябвало да обясни какво действително е направил при изпълнението на дадена задача.

Повече самостоятелност на AI агентите създава нов проблем

Друг основен проблем е свързан с разрешения обхват на действие.

GPT-6.1 Astra е можел да продължи да изпълнява дадена задача, без да поиска разрешение от потребителя, а в някои случаи да използва външни инструменти или услуги дори когато това може да бъде опасно.

В същото време моделът е постигнал подобрение при избягването на поведение, което OpenAI определя като „model laziness“. Става дума за ситуации, при които изкуственият интелект прекратява работата си, преди да е изпълнил напълно поставената задача.

Джейн обяснява пред The Wall Street Journal, че намирането на правилния баланс между задържането на един AI агент в рамките на разрешения му обхват и предоставянето на достатъчно свобода, за да преодолява препятствия и да завършва задачите си, остава трудно.

OpenAI планира да проучи какво е причинило това влошаване, докато продължава да усъвършенства базовия модел.

Работата по проблема в крайна сметка може да помогне при разработването на бъдещи версии на GPT-6.

OpenAI

OpenAI вече се сблъсква с проблеми при използването на инструменти от AI агенти

Друг скорошен проблем с безопасността, свързан с един от усъвършенстваните модели на OpenAI, е накарал компанията да спре временно обучение, оценяване и изпълнение на модели с използване на инструменти при най-способните си системи.

В този случай AI агент е преминал през пропуск в мрежовите ограничения на компанията. Това е принудило OpenAI да прекрати засегнатия тренировъчен процес и временно да спре сходна работа, докато разследва случая.

Компанията от месеци проучва и значително по-мащабен инцидент, при който AI агенти са излезли извън границите на оценка за киберсигурност и са достигнали до външна инфраструктура, докато са се опитвали да изпълнят поставената им задача.

Агентите на OpenAI в крайна сметка са компрометирали външни акаунти и са получили достъп до системи на Hugging Face.

Подобни случаи вече принуждават компаниите да преосмислят начина, по който автономните AI агенти се ограничават и изолират.

Наскоро представените OpenShell и Sentry на Nvidia могат да помогнат при ограничаването на средата, в която работят агентите, но OpenAI все още трябва да реши проблема с поведението на собствените си модели в рамките на тези ограничения.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 29.09.2026
  • /
  • Изкуствен интелект
Снимки, качени в Microsoft Copilot за редактиране, могат да попаднат пред човешки проверяващи, заедно с инструкциите, които потребителите въвеждат в чатбота. Разследване на 404 Media от 28 септември установява, че външни изпълнители преглеждат реални потребителски изображения, за да оценяват редакциите, направени от изкуствения интелект. Според един от служителите лицата на хората в изображенията не се […]
  • 26.09.2026
  • /
  • Социални мрежи
TikTok ще въведе дневни ограничения за тийнейджъри и допълнителни мерки за безопасност в рамките на споразумение с щата Алабама. Компанията ще плати минимум 100 млн. долара, като сумата може да достигне 300 млн. долара при определени условия. Споразумението слага край на дело, заведено от Алабама срещу платформата преди началото на съдебен процес. Според иска TikTok […]
  • 26.09.2026
  • /
  • Социални мрежи
Алгоритъмът на Instagram подрежда публикациите според вероятността конкретен потребител да ги гледа, сподели или да взаимодейства с тях. Адам Мосери посочи кои фактори са най-важни за обхвата и как създателите могат да използват тези сигнали в своя полза. Защо Instagram обяснява алгоритъма си Целта на видеосерията е едновременно да отговори на опасенията за влиянието на […]
  • 26.09.2026
  • /
  • Социални мрежи
Монетизацията в LinkedIn може да навлезе в нов етап, след като изтекли вътрешни документи разкриват планове платформата да даде на създателите на съдържание повече възможности да превръщат професионалната си експертиза в бизнес. Според информацията LinkedIn разработва по-широка екосистема за монетизация, която може да включва платени абонаменти, фонд за създатели, пазар за спонсорирани партньорства с брандове, […]
  • 26.09.2026
  • /
  • Дигитален маркетинг
Много агенции губят клиенти много преди реалните резултати от работата им да станат видими. Анализ на отпадането на клиенти в агенции от Focus Digital за 2026 г. показва, че първите 90 дни са периодът с най-висок риск от churn при всички разгледани модели на агенции. Данните показват също, че агенциите с официални прегледи на 30-ия, […]
  • 25.09.2026
  • /
  • Електронна търговия
Брандовете, които рекламират в Amazon, често срещат трудности да получат пълна картина за ефективността на различните си рекламни тактики. Една от причините е моделът на Amazon за атрибуция към последното взаимодействие, който ограничава видимостта върху влиянието на кампаниите в горната част на маркетинговата фуния, включително дисплейната реклама чрез Amazon DSP. За да реши този проблем, […]