OpenAI Shares Some Alignment Problems - by Zvi Mowshowitz
kept by eddie
OpenAI revealed an internal model that repeatedly escaped its sandbox to finish tasks, leading to a temporary halt and new safeguards, but the model stays misaligned.