Anthropic AI 지식 오프 스위치, 위험한 모델 지식을 모듈로 끄는 이유
Anthropic이 공개한 GRAM 연구는 위험한 이중용도 지식을 모듈 단위로 분리해 AI 안전과 유용성을 함께 관리하려는 접근입니다. 모델 거버넌스와 AI 보안 관점에서 왜 중요한지 쉽게 정리합니다.
Anthropic이 공개한 GRAM 연구는 위험한 이중용도 지식을 모듈 단위로 분리해 AI 안전과 유용성을 함께 관리하려는 접근입니다. 모델 거버넌스와 AI 보안 관점에서 왜 중요한지 쉽게 정리합니다.