Hoppa till innehållet
Activemind solutions Security by Heart

Hugging Face blev hackade av en AI men fick inte själva använda AI för att försvara sig .

Blev hackad av AI men fick inte själva använda AI för att försvara sig

Vi lever i en tid där AI blir mer och mer kompetent och ”kreativ” och det finns så klart fantastiska möjligheter med det. Men det finns också en baksida, en kamp mellan gott och ont som får sig en törn i samma AI-era.

Busarna som oftare använder AI i sina attacker har inga skrupler eller ”begränsningar”, medans den goda sidan kämpar för att ”få lov” att använda AI som skydd och fixa sårbarheter.

Men, förvisso av förklarliga skäl så har kommersiella AI-leverantörerna guard rails som ska skydda mot missbruk.

Just dessa guard rails blir den goda sidans akilleshäl, för just dessa guardrails gör att vi inte kan analysera skadlig kod, inte kan analysera hur någon tog sig in, eller till och med inte kan genomföra pentetrationstester på våra egna system, utan att allt för ofta bli blockerade av guard rails. I alla fall om man använder de kommersiell AI.

Det här är definitivt ingen kritik mot att modellerna har spärrar. De behövs och det finns kanske inte någon enkel lösning på det just nu. Men problemet kvarstår och konsekvensen blir just det som Hugging Face råkade ut för och som är en ständig kamp bland the good guys.

När de uppdagade attacken räknade de med att kunna använda AI för att assistera både i utredningen och ”stänga dörren”. Men, och här uppstår ironin. När de skulle använda kommersiella frontier AI-modeller så blev de stoppade av guard rails. Hugging Face uttrycker själva: spärrarna kan inte skilja en incident responder från en angripare.

Och ironiskt nog, troligen samma modeller som attackerade Hugging Face, hindrade dem från att analysera problemet pga guard rails. I tidslinjen för den här incidenten finns det så klart fler saker som spelar roll, men jag tror du förstår vad jag menar.

Så, för att lösa problemet tvingades Hugging Face ironiskt nog köra analyserna på öppna kinesiska modeller, på egen hårdvara. Så egentligen spelar det kanske mindre roll hur kapabel en modell är, utan det som spelar roll är i vilket sammanhang vi får lov att använda dem. Angriparen hade inga regler, försvararen behövde följa ”regler” och faktum är att genom använda lokalt hostade ai-modeller så kringgår vi guard rails ,en det kräver en del hårdvara.

En positiv sida av att Hugging Face tvingades köra en öppen modell lokalt på egen hårdvara är att inget data lämnade den lokala miljön. Det är värt att ta med sig att det finns för- och nackdelar med både kommersiella modeller och öppna modeller, men skyddandet av data ökar om datat stannar i huset.

Hur resonerar du kring utmaningarna med AI:s framfart när det kommer till att hänga med när det kommer till säkerhet?

Stay safe out there och tveka inte att höra av dig om du har funderingar eller behöver hjälp.

Vill du läsa om incidenten jag pratar om så hittar du det här:

https://huggingface.co/blog/security-incident-july-2026

https://openai.com/index/hugging-face-model-evaluation-security-incident