Breaking
ARThe American ambassador to Israel comments on the Fly Dubai flight incidentUSRed Sox's Roman Anthony exits Wild Card Game 1 with recurring hand injuryINTLPilot stabs co-pilot on flight from UAE to Israel, forcing emergency landing in Saudi ArabiaRUFormer Hungarian government minister Miklos Sestak arrested on suspicion of corruptionBRNews summary: Political incidents and events in BrazilDEFuel prices fall before the fuel discount comes into effectARWho is Fatima Zahraa Al Mansouri, the first woman to head the government of Morocco?RURussia sent a note to NATO about its readiness to use nuclear weapons over the Kaliningrad regionESThe Government faces a decisive vote in Congress on the housing decreesDEDebate about stumbling blocks in Saxony: City council decides on memorial cultureARThe American ambassador to Israel comments on the Fly Dubai flight incidentUSRed Sox's Roman Anthony exits Wild Card Game 1 with recurring hand injuryINTLPilot stabs co-pilot on flight from UAE to Israel, forcing emergency landing in Saudi ArabiaRUFormer Hungarian government minister Miklos Sestak arrested on suspicion of corruptionBRNews summary: Political incidents and events in BrazilDEFuel prices fall before the fuel discount comes into effectARWho is Fatima Zahraa Al Mansouri, the first woman to head the government of Morocco?RURussia sent a note to NATO about its readiness to use nuclear weapons over the Kaliningrad regionESThe Government faces a decisive vote in Congress on the housing decreesDEDebate about stumbling blocks in Saxony: City council decides on memorial culture
BackSäkerhetsbrister i kinesisk AI-chattbot möjliggjorde instruktioner om biologiska vapen
Säkerhetsbrister i kinesisk AI-chattbot möjliggjorde instruktioner om biologiska vapen
Tech
Dagens Nyheter2 hours agoTech1 min readView translation

Säkerhetsbrister i kinesisk AI-chattbot möjliggjorde instruktioner om biologiska vapen

Forskare vid Mindgard har lyckats kringgå säkerhetsspärrar i Moonshots AI-modeller Kimi K2.6 och K3.

Quick Look

  • Forskare vid säkerhetsföretaget Mindgard har genom jailbreaking lyckats kringgå säkerhetsspärrar i kinesiska Moonshots AI-chattbotar, vilket möjliggjorde instruktioner om biologiska vapen.
  • Även Anthropic rapporterar om liknande missbruk av sina modeller.

AI-generated summary

Why It Matters

Mindgard testar säkerheten i AI-system genom att kringgå spärrar. Anthropic har rapporterat om liknande försök att använda deras modeller för skadliga ändamål.

Font size

Det var i juli som forskare vid Mindgard, ett företag som testar säkerheten i AI-system, gav kinesiska AI-bolaget Moonshots chattbotar Kimi K2.6 och K3 en serie komplexa instruktioner och upptäckte att de bröt mot utvecklarnas säkerhetsgränser.

Upptäckten gjordes, enligt BBC, när Mindgard gjorde en så kallad jailbreaking, ett sätt att kringgå spärrar och begränsningar, för att testa om AI-tjänstens skyddsvallar mot att diskutera känsliga och farliga ämnen höll. Det gjorde de inte, chattboten gav information om hur biologiska vapen tillverkas.

Peter Garraghan, grundare av Mindgard, säger till BBC att upptäckten är oroande. Han konstaterar att när man väl brutit spärrarna kan boten prata om vad som helst och ge rekommendationer om andra ämnen som också är skadliga.

Mindgard har inte undersökt om instruktionerna för att tillverka biologiska vapen fungerar. Men företaget menar att spärrar borde ha hindrat modellen från att inleda en diskussion om ämnet.

Moonshot å sin sida välkomnar upptäckten som ett viktigt bidrag för att kunna bygga ett ”bättre och säkrare AI”, skriver BBC.

Också det amerikanska AI-bolaget Anthropic, känt för AI-tjänsten Claude, har nyligen identifierat försök att använda en av företagets AI-modeller för ”elakartad aktivitet” som kan stödja utvecklingen av biologiska vapen. I en rapport för några veckor sedan skrev bolaget att man upptäckt fem försök relaterade till biologiska vapen mellan december förra året och augusti i år. Företaget menar att den här typen av missbruk är en av de mest allvarliga riskerna med AI-modellerna.

Open Questions

  • Kommer Moonshot att implementera nya säkerhetsuppdateringar?
  • Hur omfattande är risken för att instruktionerna faktiskt kan användas?

Related Topics

This article was originally published by Dagens Nyheter.

Related Stories

Six out of ten Swedes now use AI services – an increase of 50 percent in one year
Developing·

Six out of ten Swedes now use AI services – an increase of 50 percent in one year

According to a survey by the Internet Foundation, six out of ten Swedes now use AI services, which is an increase of 50 percent compared to the previous year. Use has increased most among people born in the 60s, 70s and 80s, while younger people often use AI as a friend for advice, including in love relationships. Meanwhile, 25 percent of AI users rarely or never double-check answers against other sources.

SVT Nyheter
1 min read
More on this topicai