Hur AI-säkerhetsspärrar hindrar offensiva cybersäkerhetsforskare
Cybersäkerhetsforskare som arbetar med att hitta okända sårbarheter vittnar om hur AI-modellers säkerhetsspärrar från OpenAI och Anthropic försvårar deras legitima arbete. Trots att forskningen syftar till att stärka digital säkerhet blockeras många förfrågningar av AI-systemen. Situationen skapar en svår balansgång mellan att skydda mot missbruk och att stödja etisk säkerhetsforskning.
Offensiva cybersäkerhetsforskare, de som aktivt söker efter okända säkerhetshål och utvecklar verktyg för att utnyttja dem, befinner sig i en alltmer frustrerande sits. Enligt flera forskare som TechCrunch talat med har säkerhetsspärrarna i AI-modeller från OpenAI och Anthropic blivit ett betydande hinder i det dagliga arbetet. Förfrågningar som rör sårbarhetsforskning, exploitutveckling eller penetrationstestning blockeras regelbundet av systemen.
Problemet ligger i att AI-modellerna inte kan skilja på en legitim säkerhetsforskare och en illvillig aktör. Orden och koncepten är desamma, oavsett intention. Det innebär att forskare som arbetar för att göra internet säkrare hindras av samma filter som är tänkta att stoppa cyberkriminella. Många beskriver hur de tvingas omformulera sina frågor upprepade gånger eller helt enkelt avstå från att använda AI-verktyg i delar av sin forskning.
Anthropic och OpenAI har båda erkänt problematiken och säger att de arbetar med att förfina sina system för att bättre kunna tillgodose legitima användares behov. Men forskarna menar att förändringarna går för långsamt och att konkurrenter utan dessa begränsningar, inklusive modeller med färre etiska filter, redan används som alternativ inom branschen.
Frågan väcker en bredare debatt om vem som egentligen skadas av alltför strikta AI-säkerhetsspärrar. Cyberkriminella hittar alltid alternativa vägar, medan seriösa säkerhetsforskare bromsar upp i sitt viktiga arbete. Experter efterlyser mer nyanserade system som kan verifiera användarens syfte och anpassa sina svar därefter, utan att för den skull kompromissa med grundläggande säkerhetsprinciper.