OpenAI ontwikkelt AI-model dat eigen modellen probeert te jailbreaken
OpenAI heeft een nieuw intern model ontwikkeld, genaamd GPT-Red, dat is ontworpen om zijn eigen, nog niet vrijgegeven AI-modellen te testen en aan te vallen. Dit model heeft als doel om kwetsbaarheden en zwakke plekken in de systemen te identificeren.
Volgens OpenAI is GPT-Red effectiever in het opsporen van deze kwetsbaarheden dan een traditioneel menselijk 'red team'. Dit geeft aan dat de technologie steeds geavanceerder wordt en dat AI in staat is om complexe taken uit te voeren die voorheen door mensen werden gedaan.
Bron: Tweakers
Originele bron: Tweakers