Anthropic блокира AI злоупотреби, свързани с разработването на биологични оръжия

Икономика

Anthropic заявява, че е установила и осуетила опити за използване на нейния AI модел за „злонамерена дейност“, която би могла да подпомогне разработването на биологични и конвенционални оръжия. AI моделът Claude на компанията също е бил използван в свързана с Русия кампания за кибершпионаж, както и от иранска пропагандна институция, според последния доклад на Anthropic за разузнаването на заплахите.

Случаите, предизвикали безпокойство и установени през последните осем месеца, варират от фалшиви приложения за запознанства и измами чрез хотелски Wi-Fi мрежи до системи за наблюдение, създадени за идентифициране на дисиденти, предава BBC.

Разкритията идват след предупреждения от водещ изследовател по безопасността в Anthropic относно потенциалните рискове на AI за човечеството. Anthropic също така обвини китайски AI компании, че се опитват да възпроизведат възможностите на Claude.

Компанията публикува последния си доклад за разузнаването на заплахите в четвъртък, като заяви, че го прави, защото смята, че „носи отговорност да разкрива злонамерената злоупотреба с нейните услуги“. Обширният доклад изброява случаи, при които предполагаеми спонсорирани от държави групи, престъпници, доставчици на шпионски софтуер, държавни пропагандни институции и политически мотивирани лица са злоупотребили с технологията на компанията.

Anthropic заяви, че е осуетила „злонамерено използване“ на моделите Claude Haiku, Sonnet и Opus в периода между декември 2025 г. и август 2026 г. Нито един от установените случаи на злоупотреба не е включвал Claude Fable или мощните модели от клас Mythos, с изключение на един случай на дистилация — процес, при който по-малки AI модели се обучават с помощта на по-големи и по-скъпи модели.

Освен че е установила използването на своите модели за кибероперации, операции за влияние, наблюдение, измами и разработване на оръжия, Anthropic заяви, че е блокирала и учени, които са използвали нейния AI по начини, които биха могли да подпомогнат разработването на биологични оръжия.

Докладът акцентира върху „пет конкретни случая на участници, използващи нашите модели по начини, които биха могли да подпомогнат разработването на биологични оръжия“. Злоупотребата с биологични технологии, се посочва в доклада, е „един от най-сериозните рискове при авангардните AI модели“. Без подходящи предпазни механизми подобни възможности „биха могли да имат катастрофални последици“, заявява Anthropic.

„Същата информация, която може да бъде използвана за разработването на биологично оръжие, може да бъде използвана и за разработването например на ваксина или лечение на заболяване“, заяви Anthropic.

Джейкъб Клайн, ръководител на отдела за разузнаване на заплахите в Anthropic, заяви пред New York Times, че ситуацията е „изключително сложна и изисква много нюансиран подход“.

„Не виждате някого по комиксов начин да казва: „Хей, искам да създам биологично оръжие, за да убия всички“, каза той.

В доклада се отбелязват и шест случая, при които Claude е бил използван „за разработване на софтуер за конвенционални оръжия, включително огнестрелни оръжия, ракети, въоръжени дронове, бомби и други боеприпаси, както и системи за насочване и управление, които ги управляват“.

Докладът показва, че киберпрестъпници и подкрепяни от държави хакери все по-често използват технологията на компанията, за да подпомагат своите операции. Сред посочените в доклада са хакерската група ShinyHunters, както и базирани в Китай лаборатории.

В доклада също се казва, че хакерска група, чиято дейност съответства на тази на базираната в Русия група Midnight Blizzard, предполагаемо е използвала AI за създаването на система, която автоматично открива кога нейният зловреден софтуер е бил засечен от защитните механизми и пренаписва кода, докато успее да избегне откриването.

Базираната в Калифорния компания заяви, че е включила направените от нея открития в своите процеси, „за да предотвратява, открива и осуетява по-добре подобни дейности в бъдеще“. Anthropic заяви, че когато е било подходящо, е споделяла разузнавателна информация с властите и партньори от индустрията.

Докладът — първият на компанията тази година — идва след предупреждение от водещ изследовател по безопасността в Anthropic, който заяви, че AI се развива толкова бързо, че според него съществува над 10% вероятност „да унищожи всички хора“ през следващото десетилетие. В статия, публикувана на 6 септември, главният научен директор на OpenAI Якуб Пачоцки призова индустрията да въведе „доброволно забавяне“, докато бъдат създадени подходящи предпазни механизми.

„Притеснявам се, че никой не е подготвен за последиците от продължаващото бързо нарастване на машинния интелект“, заяви Пачоцки, като добави, че OpenAI, компанията, която създава ChatGPT, ще продължи работата си по изграждането на предпазни механизми, макар че са необходими и по-широки мерки.

Предупреждението доведе до открито писмо до британския министър-председател Анди Бърнам, в което се призовава за нов многостранен договор за безопасното развитие на AI, както и до призив към правителствата да си сътрудничат по въпроса как би изглеждал договор, основан на развитието на свръхинтелигентност.

В САЩ демократът Бърни Сандърс внесе законопроект за забрана на AI свръхинтелигентността и временно преустановяване на разработването на напреднали AI системи.

„Когато учените ви казват, че съществува вероятност — вероятност това да има катастрофално въздействие върху човечеството — трябва да си пълен идиот, за да не кажеш: забавете темпото“, заяви той в четвъртък в предаването Newsnight на BBC.

Коментари

НОВ КОМЕНТАР

НАЙ-НОВО

|

НАЙ-ЧЕТЕНИ

|

НАЙ-КОМЕНТИРАНИ

Гърция отменя имотния данък в малките населени места, включително и за чужденците
Расте броят на работещите белгийци след навършване на пенсионна възраст
Мегапроект превижда да свръже Гърция, България и Румъния по шосе и жп линия
Мащабен транспортен проект ще свързва Гърция, България и Румъния
На днешната дата, 17 август. Рождениците днес
Недялко Димитров е новият изпълнителен директор на Telelink Infra Bulgaria
ТЕЦ „Марица изток 2“ и „Мини Марица-изток“ са обединени в нов холдинг
Домът като обществен проблем: защо жилищата стават недостъпни?
САЩ налагат забрана за внос на канадски алкохол, мотоциклети и други стоки
МС внася за одобрение промените в Кодекса на труда за нов механизъм за минималната заплата
Учредиха Инициативния комитет, който ще издигне кандидатурите на Андрей Гюров и Георги Кандев
От кариерни контакти до първа среща: LinkedIn се превръща в неочаквана платформа за запознанства