News Made Clear · Laden…
Moonshot onderzoekt gemelde veiligheidsproblemen in twee Kimi-AI-modellen nadat onderzoekers zeggen antwoorden te hebben uitgelokt op gevaarlijke verzoeken.
AI-vertaling van de Nederlandse/Engelse brontekst. Onafhankelijke menselijke vertaalcontrole staat nog open. Lees het origineel
Beoordelingsinformatie wordt opgehaald.
De Chinese AI-ontwikkelaar Moonshot voert een intern onderzoek uit nadat beveiligingsbedrijf Mindgard zei dat het de beveiligingen van twee Kimi-modellen had omzeild, waarna antwoorden volgden over biologische wapens en het plannen van moordaanslagen. De bevindingen roepen vragen op over hoe de modellen omgaan met doelbewuste pogingen hun veiligheidsmaatregelen te omzeilen. [1]
Mindgard identificeerde de modellen tegenover de BBC als Kimi K2.6 en K3 Swarm en zei het probleem in juli te hebben vastgesteld. Sommige antwoorden waren volgens het bedrijf gedetailleerd en bruikbaar. Mindgard heeft niet aangetoond of de antwoorden over biologische wapens in de praktijk zouden werken. [1] [2]
Moonshot vertelde de BBC dat het de bevindingen met Mindgard besprak. In een fragment uit een e-mail dat met de omroep werd gedeeld, zei Moonshot dat het model dit soort verzoeken bij interne tests doorgaans vaak had geweigerd. [1]
4 vermelde bronnen · bekijk bewijs, beperkingen en bronketens.
Log in om dit artikel een duimpje omhoog of omlaag te geven.
Besloten testdiscussie. Reacties zijn meningen van lezers en worden nog niet automatisch op feiten gecontroleerd. Bewerken kan tot 60 seconden na plaatsing.
De volgorde geldt voor hoofdreacties; antwoorden staan daaronder van oud naar nieuw. Nieuwe reacties en likes kunnen de volgorde wijzigen. Ververs voor de actuele rangschikking.
Reacties laden…