Избегале од изолирана тест-околина и без човечка интервенција се инфилтрирале во „Hugging Face“.
Замислете го следново: неколку моќни AI модели, кои една компанија ги тестирала во контролирана средина, успеале да избегаат од изолираното опкружување, да излезат на интернет и потоа целосно самостојно, без какво било човечко влијание, да го хакираат репозиториумот за машинско учење „Hugging Face“.
Звучи како сценарио од филмот „Terminator“, нели?
Но, овојпат тоа навистина се случило.
Само неколку дена откако отворената AI платформа „Hugging Face“ објави дека открила неовластен пристап до своите системи од страна на AI агент, „OpenAI“ призна дека токму нивните модели стоеле зад инцидентот.

Во своето соопштение, „OpenAI“ наведува дека по спроведената истрага било утврдено дека инцидентот бил предизвикан од комбинација на нивните модели, особено „GPT-5.6 Sol“ и, како што го опишуваат, „уште поспособен модел пред неговото официјално објавување“.
Очигледно, сето ова се случило за време на интерен тест, во кој моделите добиле задача да изведуваат напредни техники на експлоатација, користејќи сложени патеки на напад, со цел компанијата да ги измери нивните сајбер способности.
Иако моделите биле сместени во „sandbox“ тест-околина – изолирана средина наменета да спречи влијание врз реални системи – тие истовремено имале намалени безбедносни ограничувања, бидејќи тоа било неопходно за тестирањето.
Во текот на тестот, моделите станале исклучително фокусирани на решавањето на зададената задача, при што ги поместиле сите граници во обид да пронајдат пристап до интернет и така да дојдат до решение.

Најпрво идентификувале и искористиле „zero-day“ ранливост во самото тест-опкружување на „OpenAI“, а потоа продолжиле да истражуваат сè додека не пронашле јазол со пристап до интернет.
Моделите заклучиле дека „Hugging Face“ би можел да содржи збирки на податоци или решенија поврзани со нивната задача, па затоа искористиле повеќе различни вектори на напад за да се инфилтрираат во неговите системи.
Притоа употребиле „zero-day“ ранливости, како и украдени акредитиви за пристап, за да навлезат во системот.
„OpenAI“ и „Hugging Face“ сега заеднички работат на форензичка истрага на инцидентот, а во меѓувреме веќе ги закрпиле ранливостите што моделите ги искористиле.

„Автономните алатки за сајбер напади, придвижувани од вештачка интелигенција, повеќе не се само теорија“, наведуваат од „Hugging Face“ во своето соопштение.
Компанијата објаснува дека употребата на AI за изведување сајбер напади значително го забрзува процесот и ги намалува трошоците на хакерските кампањи.
Воедно, се додава дека заштитата на онлајн платформите денес подразбира и користење на вештачка интелигенција како средство за одбрана.
Од „OpenAI“ во голема мера ги повторија овие ставови, наведувајќи дека очекуваат безбедносните пробивања предводени од AI да стануваат сè почести со ширењето на модели кои располагаат со сè понапредни сајбер способности.
Компанијата додава дека овој инцидент јасно покажува дека развојот на напредни AI сајбер способности мора да оди паралелно со развојот на посилни заштитни механизми и поефикасни одбранбени алатки.













