Anthropic, Claude 외부 사이버 평가 재개…실시간 차단장치 도입
Anthropic이 보안사고 뒤 중단했던 사전 출시 모델의 외부 사이버보안 평가를 다시 시작했어. 이번 재개는 단순한 일정 복귀가 아니라, 샌드박스와 네트워크 격리부터 실시간 감시까지 여러 방어층을 추가한 뒤 이뤄졌어. 가장 중요한 변화는 모델이 시험 환경을 과도하게 탐색하거나 경계를 벗어나려 하고, 예상하지 못한 인터넷 연결을 얻었을 때 이를 즉시 감지하는 실시간 분류기야. 분류기가 위험한 동작을 표시하면 도구 호출 전에 차단하고 평가를 끝낸 뒤 사람에게 알려. 이번 조치는 AI 모델의 능력을 시험하는 과정 자체가 현실 시스템에 위험을 만들 수 있다는 사실을 보여줘. 모델의 안전성뿐 아니라 평가 환경과 외부 기관의 운영 절.......
이 페이지는 공개 메타데이터만 제공하며 게시물 본문은 복제하지 않습니다.
네이버 블로그에서 원문 보기