OpenAI представи новия си модел Astra на фона на засилващ се мониторинг на AI агентите

Политика за бисквитки

OpenAI представи нов модел с изкуствен интелект, който определя като най-добрия си досега, но предупреди, че понякога се опитва да избегне човешкото наблюдение, дори когато компанията е изправена пред нарастващ контрол, след като нейни агенти бяха замесени в пробиви на системите на други компании, предаде Ройтерс.

OpenAI се бори с последиците, след като нейните агенти се освободиха от защитен тест през юли и хакнаха системите на платформата с отворен код Hugging Face, опитвайки се да прикрият собствените си следи. Инцидентът породи опасения за безопасността, като подобни инциденти се случиха и с модели на нейния конкурент Anthropic, докато разработчиците се надпреварват да внедряват все по-усъвършенствани модели.

Опасенията са съсредоточени върху агентния AI, който е проектиран да изпълнява задачи с малка или никаква човешка намеса. Обещанието за агенти, работещи денонощно, е от основно значение за доверието на инвеститорите в привлекателността на AI като трансформираща технология.

Новият модел обещава скорост и гъвкавост

OpenAI нарича най-новия си модел GPT-6 Astra, който следва пускането на GPT 5.6 Sol през юли, и заявява в публикация в блога си, че е по-бърз и способен да изпълнява повече задачи от всяка предишна версия. Сред уменията на Astra са: подготовка на данъчни декларации, разработване на игри , форматиране на правни бележки и търсене на апартаменти.

„Astra бележи нова граница в скоростта, точността и безопасността на използването на компютър“, съобщи OpenAI. По-рано в четвъртък президентът на OpenAI Грег Брокман заяви на брифинг, че Astra бележи „реална промяна в това каква работа хората могат да делегират на AI и как той може да им даде възможност“.

Например, компанията заяви, че Astra е намалила времето, необходимо за проучване за гледач на котки от 30 минути, когато се извършва от човек, до 5 минути и 27 секунди. А за търсене на работа - само 2 минути и 51 секунди, в сравнение с 5 часа без Astra.

OpenAI обаче заяви също, че Astra е по-вероятно умишлено да скрие или прикрие своите стъпка по стъпка методи за решаване на проблеми, известни като разсъждение, което затруднява по-късно хората да оценят техниките ѝ. При по-сложни проблеми Astra все още не може последователно да прикрива методите си, каза OpenAI, въпреки че се подобрява в прикриването на собствените си следи.

В брифинг в четвъртък сутринта главният учен на OpenAI посочи, че мониторингът става все по-труден, заедно със съгласуването, принципът, че ИИ трябва да отразява човешките ценности.

„Тъй като моделите стават все по-способни, разбирането какво точно могат да правят става все по-трудно“, каза Якуб Пахоцки. „Това не гарантира, че с увеличаването на интелигентността нашите методи ще бъдат достатъчни, защото напредъкът в интелигентността не гарантира напредък в съгласуването.“

Предизвикателствата пред мониторинга растат заедно с възможностите

Мониторингът на агентите е ключов компонент от уверението на OpenAI пред регулаторите и пред обществеността, за да ѝ помогне да избегне друг инцидент със сигурността. Освен това, тази седмица компанията съобщи в писмо до двама демократи от Камарата на представителите на САЩ, че разработва „автоматизирани възможности за изключване“ за своите модели.

Astra може също така да помогне на компаниите да откриват слабости в системите си по-бързо, заяви OpenAI, но това също така прави „тези слабости по-лесни за използване“. Поради тези причини компанията заяви, че може да се наложи да извършва допълнителни проверки за сигурност, които „понякога могат да забавят, спрат или спрат легитимна работа, включително защитна киберсигурност“.

Миналия месец OpenAI заяви, че спира разработването на някои модели, отчасти за да гарантира, че моделите могат да бъдат наблюдавани. Главният учен на OpenAI заяви, че е „много основателно“ да се притесняваме, че моделите могат да се развият, за да деактивират или напълно да избегнат мониторинга, като същевременно добави, че OpenAI се опитва да отстрани тези проблеми.

OpenAI се стреми да спечели позиции пред Anthropic сред бизнес клиентите, тъй като конкурентите му завладяват пазарен дял преди широко очакваното първично публично предлагане по-късно тази година.

Astra е насочена към широк кръг корпоративни клиенти, за които OpenAI заяви, че се надява да бъдат привлечени от нейната скорост и гъвкавост. Днес е достъпно за ограничен кръг клиенти и през следващите дни ще бъде пуснато в по-широк мащаб.

Коментари

НОВ КОМЕНТАР

НАЙ-НОВО

|

НАЙ-ЧЕТЕНИ

|

НАЙ-КОМЕНТИРАНИ