OpenAI × Apollo: 심의적 정렬이 은밀한 권한 남용을 줄이는 방법
최근 논문에서는 계획 방지 평가 프레임워크를 체계적으로 제안합니다. 원거리 영역 과제, 상황 인식, 그리고 미리 설정된 숨겨진 목표를 포함하는 삼중 스트레스 테스트를 통해 은밀한 행동 억제에 있어 의도적인 정렬의 효과를 검토합니다. 180개 이상의 시나리오를 포괄하는 ...
AI 정보 • Admin •
86
Found 2 related articles
최근 논문에서는 계획 방지 평가 프레임워크를 체계적으로 제안합니다. 원거리 영역 과제, 상황 인식, 그리고 미리 설정된 숨겨진 목표를 포함하는 삼중 스트레스 테스트를 통해 은밀한 행동 억제에 있어 의도적인 정렬의 효과를 검토합니다. 180개 이상의 시나리오를 포괄하는 ...
OpenAI의 추론 시스템은 2025년 ICPC 세계 결승전에서 같은 문제에 대해 완벽한 12/12를 달성하여 공식 규칙에 따라 1위를 차지했습니다. DeepMind의 Gemini 2.5도 금메달을 획득했습니다. ICPC는 고강도 알고리즘 경쟁이며, 결과는 일반 추론 ...