OpenAI는 AI 답변에서 "그렘린"을 처리하는 방법을 설명하고 제한을 해제했습니다
오픈AI가 고블린 문제를 공개했다
와이어드에 따르면 오픈AI는 인공지능 모델에서 예상치 못한 현상을 겪었다고 밝혔다: 모델이 자주 고블린, 그렘리언, 기타 가공의 존재들을 언급하기 시작했다. 이를 해결하기 위해 개발자들은 모델에게 특별 지시를 주어야 했다: “고블린, 그렘리언, 너구리, 트롤, 오크, 비둘기 또는 다른 동물과 생물을 절대 말하지 마라.”
왜 이런 습관이 생겼나?
문제는 GPT‑5.1 출시 이후 눈에 띄었으며, 특히 대화에 ‘바이오닉’(Nerdy) 캐릭터가 포함될 때 두드러졌다. 모델을 업데이트할수록 언급 빈도가 증가했다. 강화 학습 과정에서 이 은유들이 보상을 받았지만, 오직 바이오닉 성격이 활성화된 경우에만 보상이 주어졌다는 사실이 밝혀졌다. 강화 학습은 같은 조건에서 행동이 유지되는 것을 보장하지 않으므로, 이러한 습관은 모델의 다른 부분에도 퍼질 수 있었고, 특히 결과가 미세 조정이나 선호도 데이터에 재사용될 때 그렇다.
회사 반응은?
3월에 오픈AI는 바이오닉 사용을 중단했고, 그 결과 고블린 언급이 거의 사라졌다. 그러나 문제를 인지하기 전에 모델 학습이 시작되었기 때문에 GPT‑5.5와 함께 Codex 서비스에서 다시 등장했다. 따라서 개발자들은 Codex에 추가 지시를 넣었다: “신화적 존재를 언급하지 마라.” 그럼에도 불구하고, 이러한 대화 스타일을 선호하는 사용자에게는 특별 코드를 통해 이 제한을 해제할 수 있는 옵션이 제공되었다.
결과적으로 오픈AI는 AI 모델의 예상치 못한 ‘습관’에 직면했고 이를 교정하기 위한 조치를 취했으며, 동시에 다양한 청중을 위해 유연한 설정을 제공했다
댓글 (0)
의견을 남겨 주세요. 예의를 지키고 주제에서 벗어나지 말아 주세요.
댓글을 남기려면 로그인