ALIBI: 이진 입력에 대한 LLM 악성코드 분석기 공격
LLM 기반 악성코드 분석기의 판단을 속이는 'semantic cover story attack'을 제안하고, 50개 악성 샘플 중 30개를 양성으로 분류하도록 유도하는 실험 결과를 보인다. Gemini 2.5 Pro에서 35개 기준 악성 샘플 중 30개가 양성으로 전환되었으며, GPT-5.5 Pro와 Claude Opus 4.7에서도 심각도가 감소했다.
LLM 악성코드 분석기의 판단 근거를 검증하는 'provenance check'가 필요하다는 점을 실증적으로 보여준다.