인공지능(AI) 안전을 핵심 경쟁력으로 내세운 앤트로픽이 자사 모델 클로드의 사이버보안 공격 사례를 추가 공개하며 정렬 실패 문제를 수면 위로 끌어올렸다. 실제 인터넷임을 보여주는 증거가 있었는데도 공격을 이어간 정황까지 스스로 밝히면서 모델 성능은 물론 위험 행동 통제·검증의 투명성까지 ...
자세한 내용은 원문에서 확인하세요.
아직 댓글이 없습니다.