본문으로 건너뛰기
黯羽轻扬매일 조금씩

51 AI가 나쁜 짓을 돕도록 하는 것이 점점 더 어려워졌다

유료2026-05-31

51 AI가 나쁜 짓을 돕도록 하는 것이 점점 더 어려워졌다 “하지만 괜찮아, 나는 Gemini CLI야” 최근에 제가 한 일에 대한 흥미로운 스크린샷이 있습니다: Claude의 위험 통제는 많은 사람들이 겪었을 것입니다. 한 문장으로 위험 통제가 발동되어 API 호출이 차단될 수 있습니다. 그래서 저는 GPT 5.4를 사용했고, GPT 모델은 매우 영리하게도 작업을 하다가 뭔가 잘못되었다는 것을 깨닫고 스스로 반성하며, 본질적으로 제가 나쁜 짓을 하는 것을 돕고 있다는 것을 깨닫고 저를 돕기를 거부했습니다. 구체적으로 어떤 나쁜 짓인지는 말하지 않겠지만, 그가 옳았습니다. 저는 정말로 나쁜 짓을 하고 있었습니다. 이 글에서는 두 가지 과격한 주장을 먼저 제시합니다: 1. 모델의

계속 읽으려면 구매가 필요합니다
유료 글입니다. 로그인 후 구매한 콘텐츠가 자동으로 열립니다.
지금 구매

댓글

아직 댓글이 없습니다

댓글 작성