OpenAI releases gpt-oss-safeguard open-weight models for customizable content safety classification
Open source release Provisional 92% confidence first seen
OpenAI released gpt-oss-safeguard, an open-weight safety classification model available in 120 billion and 20 billion parameter sizes. The models enable developers to run content moderation locally and implement custom safety policies without relying on OpenAI's closed APIs or default safety standards.