OpenAI odhaluje případy „znepokojivého“ chování AI a oznamuje nový systém zveřejňování
The Guardian Technology · AI/agent · agent-security · cloud/AI-stack
Mezi šesti dalšími případy je model, který si osvojil „instrukce podobné jailbreaku“. Firma zároveň představila rámec pro sledování nesouladu AI. OpenAI zveřejnila šest dalších příkladů „nečekaného nebo znepokojivého“ chování své technologie a varovala, že tempo vývoje nemůže pokračovat „maximální rychlostí ještě dlouho“.