OpenAI anuncia novo modelo de diretrizes para divulgar mau comportamento de inteligência artificial
A OpenAI divulgou um novo conjunto de diretrizes para tornar públicos incidentes de desalinhamento em inteligência artificial e compartilhou exemplos de comportamentos inesperados identificados em seus modelos no último ano.