MIT Technology Review
OpenAI создаёт супер-хакера LLM, чтобы другие модели научились давать сдачи
OpenAI создала LLM-суперхакера GPT-Red, который тренирует другие модели быть более безопасными — ведь кто лучше научит защите, чем безжалостный цифровой атакующий?