Ga naar hoofdinhoud

OpenAI ontwikkelt AI-model dat eigen modellen probeert te jailbreaken

Beheerder Beheerder 16 juli 2026 om 08:30

OpenAI heeft een nieuw intern model ontwikkeld, genaamd GPT-Red, dat is ontworpen om zijn eigen, nog niet vrijgegeven AI-modellen te testen en aan te vallen. Dit model heeft als doel om kwetsbaarheden en zwakke plekken in de systemen te identificeren.

Volgens OpenAI is GPT-Red effectiever in het opsporen van deze kwetsbaarheden dan een traditioneel menselijk 'red team'. Dit geeft aan dat de technologie steeds geavanceerder wordt en dat AI in staat is om complexe taken uit te voeren die voorheen door mensen werden gedaan.

Bron: Tweakers

Originele bron: Tweakers