-
장시간 실행 모델 시대의 안전성과 정렬
Safety and alignment in an era of long-horizon models
OpenAI shares lessons from deploying long-running AI models, highlighting new safety risks, observed failures, and improved safeguards through iterative deployment.
-
Claude를 위한 안전장치 구축
Building safeguards for Claude
-
Fable 5의 사이버 보안 세부 사항과 탈옥 방지 프레임워크
More details on Fable 5’s cyber safeguards and our jailbreak framework
-
선거 보호 메커니즘 업데이트
An update on our election safeguards