Побегнаа од изолираната средина за тестирање и се инфилтрираа во Hugging Face без човечка интервенција.
Замислете го ова: неколку моќни модели на вештачка интелигенција што ги тестира нивната компанија избегаа од контролирана средина, се поврзаа онлајн, а потоа независно, без никаков човечки фактор, хакираа складиште за машинско учење. Звучи како сценарио за филмот Terminator, нели? Само што овојпат навистина се случи. Неколку дена откако отворената платформа за вештачка интелигенција Hugging Face откри дека открила неовластен пристап до своите системи од страна на агент на вештачка интелигенција, OpenAI призна дека нејзините модели се виновни.
Во своето соопштение, OpenAI рече дека по истрагата, било утврдено дека инцидентот е предизвикан од комбинација од неговите модели, поточно GPT-5.6 Sol и она што го опишува како „уште поспособен модел пред официјалното објавување“. Ова очигледно се случило за време на интерен тест, во кој на моделите им било наложено да извршат напредни експлоатации користејќи сложени патеки за напад за компанијата да ги квантифицира своите сајбер способности.
Иако моделите беа во тест-окружување од типот „sandbox“ (изолирано за да не влијае на реалните системи), тие имаа и намалени безбедносни ограничувања за цели на евалуација. Во средината на тестирањето, тие станаа исклучително фокусирани на решавање на задачата за проценка, одејќи до екстремни должини за да најдат пристап до Интернет за да најдат решенија. Прво идентификуваа и искористија zero-day ранливост во самаото тест-окружување на OpenAI, а потоа истражуваа сè додека конечно не пронајдоа јазол со пристап до интернет.
Моделите заклучија дека Hugging Face може да содржи збирки податоци или решенија за нивната задача, па затоа користеа повеќе вектори на напад за да се инфилтрираат во неговите системи. Тие ги искористија ранливостите од нулти ден и користеа украдени акредитиви за да добијат влез. OpenAI и Hugging Face сега работат заедно за форензичко истражување на инцидентот, а исто така ги поправија и ранливостите што ги искористија моделите.
„Автономните алатки за напад со вештачка интелигенција повеќе не се теорија“, се вели во соопштението на Hugging Face, објаснувајќи дека користењето на вештачка интелигенција за сајбер напади го забрзува процесот и ги намалува трошоците за хакирање кампањи. Исто така, беше наведено дека заштитата на онлајн платформите денес вклучува и употреба на вештачка интелигенција за одбрана.
OpenAI во голема мера ги повтори тие мислења, наведувајќи дека очекува безбедносните нарушувања предизвикани од вештачката интелигенција да станат почести, како што се зголемуваат моделите со сè повеќе сајбер можности. Компанијата додаде дека овој инцидент покажува како напредните сајбер можности мора да се развиваат паралелно со посилни заштитни мерки и одбранбени алатки.