Anthropic блокира AI злоупотреби, свързани с разработването на биологични оръжия

Икономика

Anthropic заявява, че е установила и осуетила опити за използване на нейния AI модел за „злонамерена дейност“, която би могла да подпомогне разработването на биологични и конвенционални оръжия. AI моделът Claude на компанията също е бил използван в свързана с Русия кампания за кибершпионаж, както и от иранска пропагандна институция, според последния доклад на Anthropic за разузнаването на заплахите.

Случаите, предизвикали безпокойство и установени през последните осем месеца, варират от фалшиви приложения за запознанства и измами чрез хотелски Wi-Fi мрежи до системи за наблюдение, създадени за идентифициране на дисиденти, предава BBC.

Разкритията идват след предупреждения от водещ изследовател по безопасността в Anthropic относно потенциалните рискове на AI за човечеството. Anthropic също така обвини китайски AI компании, че се опитват да възпроизведат възможностите на Claude.

Компанията публикува последния си доклад за разузнаването на заплахите в четвъртък, като заяви, че го прави, защото смята, че „носи отговорност да разкрива злонамерената злоупотреба с нейните услуги“. Обширният доклад изброява случаи, при които предполагаеми спонсорирани от държави групи, престъпници, доставчици на шпионски софтуер, държавни пропагандни институции и политически мотивирани лица са злоупотребили с технологията на компанията.

Anthropic заяви, че е осуетила „злонамерено използване“ на моделите Claude Haiku, Sonnet и Opus в периода между декември 2025 г. и август 2026 г. Нито един от установените случаи на злоупотреба не е включвал Claude Fable или мощните модели от клас Mythos, с изключение на един случай на дистилация — процес, при който по-малки AI модели се обучават с помощта на по-големи и по-скъпи модели.

Освен че е установила използването на своите модели за кибероперации, операции за влияние, наблюдение, измами и разработване на оръжия, Anthropic заяви, че е блокирала и учени, които са използвали нейния AI по начини, които биха могли да подпомогнат разработването на биологични оръжия.

Докладът акцентира върху „пет конкретни случая на участници, използващи нашите модели по начини, които биха могли да подпомогнат разработването на биологични оръжия“. Злоупотребата с биологични технологии, се посочва в доклада, е „един от най-сериозните рискове при авангардните AI модели“. Без подходящи предпазни механизми подобни възможности „биха могли да имат катастрофални последици“, заявява Anthropic.

„Същата информация, която може да бъде използвана за разработването на биологично оръжие, може да бъде използвана и за разработването например на ваксина или лечение на заболяване“, заяви Anthropic.

Джейкъб Клайн, ръководител на отдела за разузнаване на заплахите в Anthropic, заяви пред New York Times, че ситуацията е „изключително сложна и изисква много нюансиран подход“.

„Не виждате някого по комиксов начин да казва: „Хей, искам да създам биологично оръжие, за да убия всички“, каза той.

В доклада се отбелязват и шест случая, при които Claude е бил използван „за разработване на софтуер за конвенционални оръжия, включително огнестрелни оръжия, ракети, въоръжени дронове, бомби и други боеприпаси, както и системи за насочване и управление, които ги управляват“.

Докладът показва, че киберпрестъпници и подкрепяни от държави хакери все по-често използват технологията на компанията, за да подпомагат своите операции. Сред посочените в доклада са хакерската група ShinyHunters, както и базирани в Китай лаборатории.

В доклада също се казва, че хакерска група, чиято дейност съответства на тази на базираната в Русия група Midnight Blizzard, предполагаемо е използвала AI за създаването на система, която автоматично открива кога нейният зловреден софтуер е бил засечен от защитните механизми и пренаписва кода, докато успее да избегне откриването.

Базираната в Калифорния компания заяви, че е включила направените от нея открития в своите процеси, „за да предотвратява, открива и осуетява по-добре подобни дейности в бъдеще“. Anthropic заяви, че когато е било подходящо, е споделяла разузнавателна информация с властите и партньори от индустрията.

Докладът — първият на компанията тази година — идва след предупреждение от водещ изследовател по безопасността в Anthropic, който заяви, че AI се развива толкова бързо, че според него съществува над 10% вероятност „да унищожи всички хора“ през следващото десетилетие. В статия, публикувана на 6 септември, главният научен директор на OpenAI Якуб Пачоцки призова индустрията да въведе „доброволно забавяне“, докато бъдат създадени подходящи предпазни механизми.

„Притеснявам се, че никой не е подготвен за последиците от продължаващото бързо нарастване на машинния интелект“, заяви Пачоцки, като добави, че OpenAI, компанията, която създава ChatGPT, ще продължи работата си по изграждането на предпазни механизми, макар че са необходими и по-широки мерки.

Предупреждението доведе до открито писмо до британския министър-председател Анди Бърнам, в което се призовава за нов многостранен договор за безопасното развитие на AI, както и до призив към правителствата да си сътрудничат по въпроса как би изглеждал договор, основан на развитието на свръхинтелигентност.

В САЩ демократът Бърни Сандърс внесе законопроект за забрана на AI свръхинтелигентността и временно преустановяване на разработването на напреднали AI системи.

„Когато учените ви казват, че съществува вероятност — вероятност това да има катастрофално въздействие върху човечеството — трябва да си пълен идиот, за да не кажеш: забавете темпото“, заяви той в четвъртък в предаването Newsnight на BBC.

Коментари

НОВ КОМЕНТАР

НАЙ-НОВО

|

НАЙ-ЧЕТЕНИ

|

НАЙ-КОМЕНТИРАНИ

Великобритания ще национализира един от най-големите железопътни оператори Avanti West Coast
Санирането - на фокус във видеокаста на Obekti.bg
Световните продажби на бензинови автомобили паднаха под 50% за първи път в историята
Емилиян Георгиев става зам.-кмет с ресор „Обществено строителство“ в Столична община
Едно наум, ако бившето гадже иска да останете приятели
Кристин Лагард: Не би било добра идея да се кандидатирам за президент на Франция
Готови за новите изисквания към сградите: как WEOZ™ съчетава автоматизация, комфорт и енергийна ефективност
Започва изплащането на еднократната помощ от 50 евро за скъпите горива
„Сова Харис“: Йотова-Вълчев са с 50,2% подкрепа, а Гюров-Кандев – с 23,7%
Пеевски: Ако има 36 фактури за платени мои полети, си подавам оставката като лидер на ДПС
Еврокомисарят по търговията: Трудните преговори с Китай все още не са дали резултат
Контактните лещи могат да са източник на зараза, експерти съветват да носим очила
Криптоборсата Bitget спира тегленията след кражба на 350 млрд. долара при хакерска атака
LinkedIn и краят на илюзията за “професионална” социална мрежа
Гълъб Донев: Бюджетният дефицит за тази година ще бъде до 5,7% от БВП
Системата на КАТ се сринала при инсталиране на нова версия
Зам.-министърът на финансите: По-високите данъчни оценки на имотите няма да променят такса „смет“
Зеленски очаква добри финансови новини от Брюксел, Мерц обеща по-силна подкрепа за Украйна