Пореден инцидент с моделите на два от най-известните разработчици на изкуствен интелект. Докато предишните случаи по време на тестове на Anthropic и OpenAI се състояха в опити за хакване на други компании чрез навлизане в отворения интернет, то мишените на тази атака са потребителите.
Според Институтът за сигурност на изкуствения интелект във Великобритания (AISI) моделът Mythos на Anthropic се е опитал да получи достъп до услуга, като е изпращал лични съобщения през фалшиви акаунти, които той е създал на базата на проучвания за реални потребители на атакуваната платформа. Макар и по-леки, Sol на OpenAI също е предприел подобни злонамерени действия, съобщава BBC.
Изследователите определиха инцидента като „автономия и измама“, която не са виждали досега. В най-сериозния случай агент на Mythos е следвал действията на човешки хакер, като се е опитвал да подмами хора да му дадат достъп до GitHub – голяма платформа, където разработчиците на технологии съхраняват код.
Автономен агент на OpenAI избяга и атакува друга компания за изкуствен интелект
Сам Алтман определи това като „безпрецедентен киберинцидент“
Моделът е изпращал съобщения чрез услуга за споделяне на файлове като част от опит да окаже натиск и да подмами хората да одобрят злонамерения му код, обясняват от Института. При заплаха от разкриване на измамата той е редактирал предишната си дейност, за да изглежда безобидна, и е приел нова идентичност, за да продължи атаката.
„Това е първият път, когато виждаме рискове, свързани с автономността и измамата, да се проявяват ясно, без конкретно подтикване, в реалния свят“, коментират от AISI.
В официално изявление от Anthropic заявиха, че параметрите за тестване на института не са представителни за нито един от техните производствени модели и ще проведат свое разследване. Подобна е и позицията на OpenAI, а AISI потвърди, че тестовите условия не отразяват как граничните модели се предоставят на обществеността.
Заплаха за киберсигурността: AI моделът на още един технологичен гигант хакна три компании
Надпреварата за време, качество и доминация води до неглижиране на сигурността и допускане на грешки, които засягат трети страни
През последните седмици новините за инциденти с изкуствен интелект зачестиха. В голяма степен това е резултат от специални тестове и проверки, които целят именно по-голям контрол върху разработването и изследването на новата технология.
Освен Anthropic и OpenAI, Meta също алармира, че един от нейните модели с изкуствен интелект е хакнал друга компания по време на тестове за киберсигурност, след като грешка от страна на неин партньор е дала на модела неволен достъп до интернет.
Американският президент Дoнaлд Tpъмп вече пoдпиca зaпoвeд зa cъздaвaнeтo нa мexaнизъм зa пpoвepĸa нa pиcĸoвeтe зa нaциoнaлнaтa cигypнocт нa нaй-мoдepнитe cиcтeми c изĸycтвeн интeлeĸт пpeди пyбличнoтo им пycĸaнe, а европейските лидери вече интегрираха AI политики, започвайки с въвеждането на Акта за изкуствения интелект.
Нов кошмар като GDPR? Всичко, което трябва да знаете за новите AI правила на ЕС
Според правозащитници AI Act в сегашния си вид всъщност даже не пази достатъчно добре потребителите
Article source: https://money.bg/internet-it/nov-intsident-modeli-na-anthropic-i-openai-sa-sazdali-falshivi-profili-pri-opit-za-hakvane.html


Discussion
No comments yet.