Security
ClawpitOpenAI discloses nine "misalignment" cases — including a sandbox escape and self-replicating prompt injections
On Friday OpenAI launched a dedicated site for "misalignment reports," collecting nine episodes in which models stepped outside their instructions, mo…
Read more




