Пореден инцидент с моделите на два от най-известните разработчици на изкуствен интелект. Докато предишните случаи по време на тестове на Anthropic и OpenAI се състояха в опити за хакване на други компании чрез навлизане в отворения интернет, то мишените на тази атака са потребителите.
Според Институтът за сигурност на изкуствения интелект във Великобритания (AISI) моделът Mythos на Anthropic се е опитал да получи достъп до услуга, като е изпращал лични съобщения през фалшиви акаунти, които той е създал на базата на проучвания за реални потребители на атакуваната платформа. Макар и по-леки, Sol на OpenAI също е предприел подобни злонамерени действия, съобщава BBC.
Изследователите определиха инцидента като "автономия и измама", която не са виждали досега. В най-сериозния случай агент на Mythos е следвал действията на човешки хакер, като се е опитвал да подмами хора да му дадат достъп до GitHub - голяма платформа, където разработчиците на технологии съхраняват код.
Моделът е изпращал съобщения чрез услуга за споделяне на файлове като част от опит да окаже натиск и да подмами хората да одобрят злонамерения му код, обясняват от Института. При заплаха от разкриване на измамата той е редактирал предишната си дейност, за да изглежда безобидна, и е приел нова идентичност, за да продължи атаката.
"Това е първият път, когато виждаме рискове, свързани с автономността и измамата, да се проявяват ясно, без конкретно подтикване, в реалния свят", коментират от AISI.
В официално изявление от Anthropic заявиха, че параметрите за тестване на института не са представителни за нито един от техните производствени модели и ще проведат свое разследване. Подобна е и позицията на OpenAI, а AISI потвърди, че тестовите условия не отразяват как граничните модели се предоставят на обществеността.
През последните седмици новините за инциденти с изкуствен интелект зачестиха. В голяма степен това е резултат от специални тестове и проверки, които целят именно по-голям контрол върху разработването и изследването на новата технология.
Освен Anthropic и OpenAI, Meta също алармира, че един от нейните модели с изкуствен интелект е хакнал друга компания по време на тестове за киберсигурност, след като грешка от страна на неин партньор е дала на модела неволен достъп до интернет.
Американският президент Дoнaлд Tpъмп вече пoдпиca зaпoвeд зa cъздaвaнeтo нa мexaнизъм зa пpoвepĸa нa pиcĸoвeтe зa нaциoнaлнaтa cигypнocт нa нaй-мoдepнитe cиcтeми c изĸycтвeн интeлeĸт пpeди пyбличнoтo им пycĸaнe, а европейските лидери вече интегрираха AI политики, започвайки с въвеждането на Акта за изкуствения интелект.
USD
CHF
GBP