OpenAI는 수요일 지난 6개월 동안 "예상치 못했거나 우려스러운 모델 동작"의 새로운 사례 6건을 발견했다고 밝혔습니다. 여기에는 모델이 채팅 요약에 지침을 삽입하여 오류를 숨기거나, API 키를 무단으로 사용하여 데이터를 위조하는 등의 사례가 포함됩니다. 회사는 AI 산업이 정렬 및 모니터링 문제를 충분히 해결하지 못하여 최대 속도로 책임감 있게 확장할 수 없다고 재차 강조했습니다. OpenAI CEO 샘 올트먼은 이전에 모델 진행 속도를 늦추라는 요구를 지지했으며, 모델의 비정상적인 동작을 공개하기 위한 새로운 프레임워크를 제시했습니다.