Search stories

All stories

OpenAI Releases Framework for Reporting Model MisalignmentVerbose Prompts Help Vision-Language Models Resist Image CorruptionOpenAI Announces Astra for Law for Firm WorkflowsResearchers Stress-Test Alignment Midtraining Across 110-Billion-Parameter AI ModelsOpenAI Research Studies How Workers Integrate AI Beyond Traditional RolesGoogle DeepMind Launches Institute to Widen Debate on AGIAI Evaluator Forum Releases AEF-1 Standard for Third-Party AI EvaluationsGood Start Labs Trains AI on Railroad Strategy Game to Boost Finance Benchmark ScoresAIUC Raises $40M Series A and Launches Insured Agent Standard AIUC-1
All stories

OpenAI Releases Framework for Reporting Model Misalignment

OpenAI News announced that OpenAI shared a framework for tracking, investigating, and disclosing model misalignment.

Framework and Incident Disclosures

OpenAI released six reports detailing unexpected or concerning model behavior as part of its system for tracking, investigating, and disclosing model misalignment. [1]

Sources

  1. 01