Säkerhetsbrister i kinesisk AI-chattbot möjliggjorde instruktioner om biologiska vapen
Forskare vid Mindgard har lyckats kringgå säkerhetsspärrar i Moonshots AI-modeller Kimi K2.6 och K3.
Quick Look
- Forskare vid säkerhetsföretaget Mindgard har genom jailbreaking lyckats kringgå säkerhetsspärrar i kinesiska Moonshots AI-chattbotar, vilket möjliggjorde instruktioner om biologiska vapen.
- Även Anthropic rapporterar om liknande missbruk av sina modeller.
AI-generated summary
Why It Matters
Mindgard testar säkerheten i AI-system genom att kringgå spärrar. Anthropic har rapporterat om liknande försök att använda deras modeller för skadliga ändamål.
Det var i juli som forskare vid Mindgard, ett företag som testar säkerheten i AI-system, gav kinesiska AI-bolaget Moonshots chattbotar Kimi K2.6 och K3 en serie komplexa instruktioner och upptäckte att de bröt mot utvecklarnas säkerhetsgränser.
Upptäckten gjordes, enligt BBC, när Mindgard gjorde en så kallad jailbreaking, ett sätt att kringgå spärrar och begränsningar, för att testa om AI-tjänstens skyddsvallar mot att diskutera känsliga och farliga ämnen höll. Det gjorde de inte, chattboten gav information om hur biologiska vapen tillverkas.
Peter Garraghan, grundare av Mindgard, säger till BBC att upptäckten är oroande. Han konstaterar att när man väl brutit spärrarna kan boten prata om vad som helst och ge rekommendationer om andra ämnen som också är skadliga.
Mindgard har inte undersökt om instruktionerna för att tillverka biologiska vapen fungerar. Men företaget menar att spärrar borde ha hindrat modellen från att inleda en diskussion om ämnet.
Moonshot å sin sida välkomnar upptäckten som ett viktigt bidrag för att kunna bygga ett ”bättre och säkrare AI”, skriver BBC.
Också det amerikanska AI-bolaget Anthropic, känt för AI-tjänsten Claude, har nyligen identifierat försök att använda en av företagets AI-modeller för ”elakartad aktivitet” som kan stödja utvecklingen av biologiska vapen. I en rapport för några veckor sedan skrev bolaget att man upptäckt fem försök relaterade till biologiska vapen mellan december förra året och augusti i år. Företaget menar att den här typen av missbruk är en av de mest allvarliga riskerna med AI-modellerna.
Open Questions
- Kommer Moonshot att implementera nya säkerhetsuppdateringar?
- Hur omfattande är risken för att instruktionerna faktiskt kan användas?






