Anthropic biedt excuses aan voor verborgen beperkingen in Claude Fable 5
Anthropic heeft zijn excuses aangeboden voor het heimelijk beperken van zijn nieuwe AI-model Claude Fable 5 via verborgen guardrails. Het bedrijf belooft voortaan transparanter te zijn over wanneer die beperkingen ingrijpen.
Kernpunten
- Anthropic beperkte Claude Fable 5 stiekem via verborgen guardrails, zonder gebruikers daarover te informeren.
- De beperkingen hinderden zowel onderzoekers als concurrenten die het model gebruiken om eigen systemen te ontwikkelen.
- Anthropic draait de aanpak terug en belooft transparanter te communiceren over wanneer beperkingen actief worden, ook als dat betekent dat Fable meer verzoeken weigert.
Anthropic heeft zijn excuses aangeboden voor het heimelijk inbouwen van verborgen beperkingen — zogenaamde guardrails — in zijn nieuwe AI-model Claude Fable 5. Dat meldt The Verge. De onzichtbare ingrepen zorgden ervoor dat het model stilletjes werd afgeremd, zonder dat gebruikers daar weet van hadden.
De verborgen beperkingen raakten volgens The Verge zowel onderzoekers als concurrenten die Fable 5 inzetten om eigen AI-systemen te ontwikkelen. ITdaily (BE) bevestigt dat Anthropic de beperkingen introduceerde om het model op een verantwoorde manier beschikbaar te maken voor het grote publiek.
Anthropic keert nu terug op zijn stappen. Het bedrijf zegt voortaan transparanter te zijn over wanneer de restricties ingrijpen — ook als dat ertoe leidt dat Fable 5 meer verzoeken openlijk weigert in plaats van ze onzichtbaar te beperken.
Wat betekent dit voor de BeNeLux?
De beloofde transparantie maakt het voor hen beter voorspelbaar wanneer het model een verzoek weigert — wat relevant is voor wie op het model bouwt of het evalueert.