클로드 추론 과정 증류, 알리바바·문샷AI 소형모델에 활용

앤트로픽은 위협 인텔리전스 보고서를 통해 중국발 5개 증류 공격 캠페인과 관련된 클로드 대화 약 2억건을 확인했다고 밝혔다. 관련 기업으로 알리바바와 문샷AI가 꼽혔으며, 공격은 클로드의 에이전틱 기능, 도구 사용, 코딩·데이터 분석, 논리적 추론 능력을 겨냥했다. 공격자는 번역 요청 등으로 질문을 위장해 클로드가 내부 사고 흔적을 드러내도록 유도한 뒤 이를 추출해 소형 모델 미세조정에 활용한 것으로 파악됐다. 알리바바 관련 캠페인은 5월부터 7월까지 3500개 계정으로 약 1억 5100만건의 대화가 확인돼 가장 규모가 컸고, 문샷AI 관련 캠페인에서는 CCTV 영상 속 이상행동 판단을 요구하는 등 중국군 요청으로 추정되는 내용도 발견됐다.
이 글에 나온 것
이 글은 원문을 요약한 큐레이션입니다. 제목은 요약에 맞춰 새로 붙였습니다. 수치와 단위는 원문 표기를 유지했습니다. 전체 내용은 원 매체에서 읽어 주세요.원문: ZDNet Korea 「앤트로픽 "알리바바·문샷AI, 클로드 핵심 능력 무단 추출"」
ZDNet Korea 원문 보기 ↗
