Пореден инцидент с моделите на два от най-известните разработчици на изкуствен интелект. Докато предишните случаи по време на тестове на Anthropic и OpenAI се състояха в опити за хакване на други компании чрез навлизане в отворения интернет, то мишените на тази атака са потребителите.

Според Институтът за сигурност на изкуствения интелект във Великобритания (AISI) моделът Mythos на Anthropic се е опитал да получи достъп до услуга, като е изпращал лични съобщения през фалшиви акаунти, които той е създал на базата на проучвания за реални потребители на атакуваната платформа. Макар и по-леки, Sol на OpenAI също е предприел подобни злонамерени действия, съобщава BBC.

Изследователите определиха инцидента като "автономия и измама", която не са виждали досега. В най-сериозния случай агент на Mythos е следвал действията на човешки хакер, като се е опитвал да подмами хора да му дадат достъп до GitHub - голяма платформа, където разработчиците на технологии съхраняват код.

Автономен агент на OpenAI избяга и атакува Hugging Face

Автономен агент на OpenAI избяга и атакува друга компания за изкуствен интелект

Сам Алтман определи това като "безпрецедентен киберинцидент"

Моделът е изпращал съобщения чрез услуга за споделяне на файлове като част от опит да окаже натиск и да подмами хората да одобрят злонамерения му код, обясняват от Института. При заплаха от разкриване на измамата той е редактирал предишната си дейност, за да изглежда безобидна, и е приел нова идентичност, за да продължи атаката.

"Това е първият път, когато виждаме рискове, свързани с автономността и измамата, да се проявяват ясно, без конкретно подтикване, в реалния свят", коментират от AISI.

В официално изявление от Anthropic заявиха, че параметрите за тестване на института не са представителни за нито един от техните производствени модели и ще проведат свое разследване. Подобна е и позицията на OpenAI, а AISI потвърди, че тестовите условия не отразяват как граничните модели се предоставят на обществеността.

Заплаха за киберсигурността: AI моделът на още един технологичен гигант хакна три компании

Заплаха за киберсигурността: AI моделът на още един технологичен гигант хакна три компании

Надпреварата за време, качество и доминация води до неглижиране на сигурността и допускане на грешки, които засягат трети страни

През последните седмици новините за инциденти с изкуствен интелект зачестиха. В голяма степен това е резултат от специални тестове и проверки, които целят именно по-голям контрол върху разработването и изследването на новата технология.

Освен Anthropic и OpenAI, Meta също алармира, че един от нейните модели с изкуствен интелект е хакнал друга компания по време на тестове за киберсигурност, след като грешка от страна на неин партньор е дала на модела неволен достъп до интернет.

Американският президент Дoнaлд Tpъмп вече пoдпиca зaпoвeд зa cъздaвaнeтo нa мexaнизъм зa пpoвepĸa нa pиcĸoвeтe зa нaциoнaлнaтa cигypнocт нa нaй-мoдepнитe cиcтeми c изĸycтвeн интeлeĸт пpeди пyбличнoтo им пycĸaнe, а европейските лидери вече интегрираха AI политики, започвайки с въвеждането на Акта за изкуствения интелект.

Нов кошмар като GDPR? Всичко, което трябва да знаете за новите AI правила на ЕС

Нов кошмар като GDPR? Всичко, което трябва да знаете за новите AI правила на ЕС

Според правозащитници AI Act в сегашния си вид всъщност даже не пази достатъчно добре потребителите