Open-weight AI models demonstrate improved capabilities but lag in safety measures compared to frontier models
Benchmark result Provisional 72% confidence first seen
China's GLM-5.2 open-weight model has significantly narrowed the performance gap with frontier closed-source models like GPT-5.5 and Claude Opus 4.7 on advanced tasks, but exhibits weaker safety guardrails and refuses fewer harmful requests. The development highlights a growing tension between open-weight accessibility and safety concerns, with major AI companies supporting open-weights approaches while safety trade-offs remain largely unresolved in governance frameworks.