Anthropic 2026-05-09 Anthropic, Claude의 내부 생각을 글로 읽는 NLA 공개 Natural Language Autoencoder는 Claude의 내부 활성값을 자연어로 바꿔 모델이 평가 상황을 알아차리는 순간을 드러낸다. #Claude#AI 안전#AI 해석 가능성