Onderwerpen
Home / Artikelen

Chinese chatbot gaf uitleg over biowapens: hoe veilig zijn jouw AI-apps

Een Chinese chatbot die na wat aandringen uitlegt hoe je een biologisch wapen maakt. Het klinkt als een scenario uit een thriller, maar het is wat beveiligingsbedrijf Mindgard aantrof bij twee modellen van Kimi, de chatbot van het Chinese Moonshot AI. Moonshot is daarom een intern onderzoek gestart. Voor wie zelf dagelijks een AI-app gebruikt roept dat een logische vraag op. Hoe goed werken die veiligheidsfilters eigenlijk, en verschilt dat per app?
Smartphone met een chatapp naast een laptop op een bureau
Foto: Dimitri Karastelev via Unsplash
Inhoudsopgave

Wat er bij Kimi aan de hand is

Volgens de BBC ontdekte Mindgard in juli 2026 dat de modellen Kimi K2.6 en K3 Swarm hun ingebouwde grenzen lieten varen. Dat gebeurde via jailbreaking, een techniek waarbij je een model met een reeks ingewikkelde instructies zo lang bewerkt tot het zijn eigen regels negeert. Daarna gaf Kimi uitleg over het maken van biologische wapens en het plegen van aanslagen. Mindgard-oprichter Peter Garraghan zei tegen de BBC dat het model na een geslaagde jailbreak over elk onderwerp praat en zelf nog andere kwalijke ideeën aandraagt.

Mindgard meldde het lek op 27 juli per mail bij Moonshot en stuurde een week later een herinnering. Volgens Mindgard kwam er pas reactie toen de BBC om commentaar vroeg. Moonshot laat weten dat het hulp van buitenaf verwelkomt en dat het model in eigen tests juist vaak weigerde. Of de antwoorden van Kimi in de praktijk zouden werken, heeft Mindgard niet getest. Fox News bracht het verhaal op 1 oktober opnieuw onder de aandacht in de Verenigde Staten, met de toevoeging dat Moonshot nu rechtstreeks met de onderzoeker praat.

Belangrijk detail uit hetzelfde interview is dat Garraghan zegt dat Amerikaanse modellen hetzelfde fundamentele probleem hebben. Dit is dus geen verhaal over één slechte Chinese app tegenover keurige westerse apps. Het is een verhaal over hoe dun de beschermlaag rond elk taalmodel is.

Hoe veiligheidsfilters werken, en waarom ze verschillen

Een chatbot weigert niet omdat hij iets niet weet. Het model heeft tijdens de training enorm veel tekst gezien, ook over chemie, wapens en virussen. De weigering is iets wat de maker er later overheen legt, via extra training en via aparte filters die vragen en antwoorden controleren voordat jij ze ziet. Hoe streng en hoe goed die laag is, verschilt per bedrijf en per model.

Daarbij speelt nog iets. Kimi is een zogeheten open-weight model, schrijft de BBC. Iedereen kan het downloaden en op eigen computers draaien. Dat heeft voordelen, zoals we eerder beschreven in ons stuk over open modellen die nu het meeste AI-werk doen, maar het betekent ook dat de filters van de officiële app niet mee hoeven te reizen. Wie het model zelf draait, kan de beschermlaag weglaten. Bij een gesloten model als dat achter ChatGPT of Claude kan dat niet, daar praat je altijd via de servers van de maker.

Dat maakt gesloten modellen niet onkwetsbaar. Ook Anthropic meldde onlangs dat het pogingen had verstoord om een van zijn modellen te gebruiken voor werk dat de ontwikkeling van biologische wapens kon helpen, aldus de BBC. Het verschil zit vooral in wie de controle houdt en hoe snel een maker reageert als er iets misgaat. Dat Moonshot volgens Mindgard maanden stil bleef, zegt daarover meer dan het lek zelf.

Wat betekent dit voor jou als gewone gebruiker

Eerlijk gezegd loop je als iemand die een recept of een sollicitatiebrief vraagt weinig gevaar door een jailbreak. Daar is lang en doelbewust werk voor nodig, en wie dat doet is zelf op zoek naar gevaarlijke informatie. Toch is het nieuws relevant, om twee andere redenen.

Ten eerste beschermen dezelfde filters jou tegen schadelijke antwoorden waar je niet om vroeg. Denk aan gevaarlijk medisch advies, het mengen van schoonmaakmiddelen of misleidende informatie over geld. Een app met een zwakke beschermlaag is op die punten ook minder voorzichtig. Hoe je een antwoord controleert, lees je in ons stuk over chatbots die in een verzonnen ziekte trapten.

Ten tweede gaat het bij gratis apps van onbekende makers vaak minder om wat de chatbot zegt en meer om wat er met jouw gegevens gebeurt. Bij de Chinese chatbot DeepSeek riep de Autoriteit Persoonsgegevens op 3 februari 2025 op tot grote voorzichtigheid, omdat gegevens van Nederlandse gebruikers in China worden opgeslagen. Die waarschuwing ging over DeepSeek, niet over Kimi, maar de vraag die de toezichthouder stelt geldt voor elke app. Wil je dit echt in deze app typen of uploaden?

Waar je op let bij een gratis chatbot-app

Een paar vragen helpen om in te schatten hoe veilig een app is, los van waar de maker vandaan komt.

  • Wie is de maker? Zoek de naam van het bedrijf op in de appwinkel en op de website. Een app die zich voordoet als een bekend merk maar van een andere ontwikkelaar komt, laat je staan.
  • Waar staan je gegevens? In de privacyverklaring staat meestal in welk land gesprekken worden opgeslagen en of ze voor training worden gebruikt. Staat dat er niet, dan is dat ook een antwoord.
  • Kun je je geschiedenis wissen? Een fatsoenlijke app laat je gesprekken verwijderen en training op je gegevens uitzetten.
  • Hoe reageert de maker op problemen? Een bedrijf dat beveiligingsmeldingen maanden laat liggen, is geen partij waar je je cv of medische vragen aan toevertrouwt.
  • Wat upload je? Haal namen, adressen en burgerservicenummers uit documenten voordat je ze deelt, bij welke chatbot dan ook. Zie ook ons stuk over een pdf laten samenvatten.

Onze nuchtere conclusie is dat de herkomst van een app minder zegt dan het gedrag van de maker. Een Chinese app is niet automatisch gevaarlijk en een Amerikaanse niet automatisch veilig. Wat wel telt is of een bedrijf transparant is over je gegevens en snel reageert als onderzoekers aan de bel trekken. Op dat laatste punt heeft Moonshot nog wat uit te leggen.

Redactie Zendis

Lees meer over onze redactie en werkwijze.