Decrypt

OpenAI Models Are Writing Their Own Jailbreak Instructions—And Sometimes Obeying Them

OpenAI's new transparency framework reveals AI models that invented fake "breach alerts," coached themselves to hide mistakes, and smuggled a file onto the public internet to talk to each other.

Lees het volledige bericht op Decrypt

Opent in een nieuw tabblad. Via Cryptopage meten we de klik voor statistieken.

Partner

Gesponsord • Winnaar Award

Finst verkozen tot Beste Crypto Platform 2025

Bekroond met de IEX Gouden Stier voor veiligheid, kosten en aanbod.

Gratis €20,- Bitcoin