RESEARCH

연구·리포트 참고 자료

이번 주 연구최근 7200편 · 출처 5
737Updated 2일 전
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Abrar Alotaibi 외 3명

LLM 방어 계층의 실패 상관관계 측정 및 분석

LLM 방어 계층의 실패 상관관계를 측정하여, 방어 효과가 독립적으로 작동하지 않는다는 것을 보였다. 실험에서 7계층 방어 스택의 실패 상관관계는 0.30~0.75 범위였고, 잔여 공격 성공률이 예측보다 최대 0.172 높았다.

LLM 방어 스택의 효과는 단일 계층의 성능만으로 판단할 수 없으며, 전체 시스템에서 실패 상관관계를 측정해야 한다.

LLM 보안방어 스택실패 상관관계inference costPDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Gibran Gomez, Juan Caballero

TagZilla: 위협 리포트의 IoC에 대한 소유자 및 악용 타입 태깅 자동화

TagZilla는 위협 리포트에서 IoC를 자동으로 분석하고, 해당 IoC의 소유자와 악용 타입을 태깅하는 플랫폼이다. 평가 결과, 소유자 태깅에서 F1 점수 0.94, 악용 타입 태깅에서 0.93을 달성했다.

TagZilla는 위협 리포트의 IoC를 자동으로 분류하여 보안 분석의 효율성을 높일 수 있다.

TagZillaIoC 태깅LLM위협 리포트PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Animesh Shaw

LLM 생성 인프라 코드의 보안 벤치마크(GenIaC-SecBench)

LLM 생성 인프라 코드(IaC)의 보안성을 평가하기 위해 100개의 배포 시나리오를 기반으로 한 벤치마크(GenIaC-SecBench)를 제안하고, 12개 모델 구성에서 1,196개의 IaC 아티팩트를 생성하여 3개 정책 엔진으로 분석했다. 모델 생성 IaC의 취약점 밀도는 인공 생성 IaC에 비해 3.21~3.87배 높았으며, 작업 복잡도가 낮을수록 격차가 커졌다.

LLM 생성 인프라 코드의 보안성을 평가할 때 인공 생성 코드와의 비교가 필수적이며, 모델의 사고 과정에 따라 보안성 차이가 발생함을 실증했다.

LLM인프라 코드보안 벤치마크취약점 분석PDF 있음
arXiv시스템·하드웨어 · 프리프린트 · 2026년 8월 31일Ahmad Hazimeh 외 6명

마가(Magma): 근거가 명확한 퍼징 벤치마크의 영향

Magma는 퍼저 평가와 비교를 위한 근거가 명확한 퍼징 벤치마크를 제시한다. 기존 퍼징 벤치마크의 한계를 극복하여 퍼저 간 공정한 비교를 가능하게 했다.

이 연구는 퍼징 도구의 성능 평가를 표준화하여 향후 퍼징 기술 개발과 비교에 기여할 수 있다.

퍼징벤치마크Magma시스템 보안PDF 있음
arXiv악성코드·위협 · 프리프린트 · 2026년 8월 31일Xueying Zeng 외 9명

Moirae: 동적 안드로이드 악성코드 탐지를 위한 다중 모달 에이전트 협업 프레임워크

기존 머신러닝 탐지기는 개념 드리프트에 취약한 반면, 대형 언어 모델(LLM)은 단일 차원의 증거에 의존해 악성코드 분석에 한계가 있다. Moirae는 동적으로 다중 모달 런타임 증거를 수집하고 ReAct 기반 전용 에이전트를 사용해 90.06% 정확도를 달성했다.

Moirae는 개념 드리프트에 강한 동적 악성코드 탐지 기법으로, 안드로이드 보안 시스템 개선에 활용될 수 있다.

안드로이드악성코드LLM다중 모달PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Zi Liang 외 5명

CAITLYN: LLM 에이전트가 자율적으로 새로운 인젝션 공격 방어를 합성할 수 있는가?

LLM 에이전트에 대한 프롬프트 인젝션 공격을 방어하기 위해 CAITLYN이라는 방어 미들웨어를 제안한다. 기존 방어 기법 대비 토큰 오버헤드가 낮으면서도 정확도를 유지하는 것을 보인다.

LLM 에이전트 환경에서 새로운 인젝션 공격에 대응하기 위해 CAITLYN과 같은 자율 방어 시스템을 도입할 수 있다.

LLM 에이전트프롬프트 인젝션방어 기법CAITLYNPDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Varun Kohli 외 3명

AI 기반 반복 복구로 소스 코드 복원하기(CHISEL)

CHISEL은 테스트 스위트 없이 Ghidra에서 파생된 의사-C 코드에서 소스 코드를 반복적으로 복구하는 프레임워크를 제안한다. 120개 ExeBench 함수를 대상으로 96.1% 재컴파일 가능성과 79.8% 재실행 가능성, 2.1회 평균 반복 횟수를 달성했다.

CHISEL은 테스트 스위트 없이도 높은 정확도로 소스 코드를 복원할 수 있어, 바이너리 분석 및 복호화 작업에서 실용적 도구로 활용될 수 있다.

AI 기반 반복 복구소스 코드 복원CHISELGhidraPDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Fajar Wijitrisnanto (National Cyber and Crypto Agency 외 14명

DisCTI: 누가 언제 알아야 할까? 분야별 실시간 사이버 위협 정보 공유 자동화

사이버 위협 정보(CTI)를 적절한 시기에 올바른 분야에 전달하는 것이 중요하다. 연구팀은 CTI 이벤트를 분야별로 매핑하기 위해 BERT 모델을 적용하여 94.5%의 정확도를 달성했다.

이 연구는 CTI 자동화를 통해 조직이 빠르게 대응할 수 있도록 도와 실무에서 위협 대응 효율성을 높일 수 있다.

사이버 위협 정보BERT자동화분야별 매핑PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Cameron Wilding 외 2명

파괴가 아닌 증명: 프라이버시 보호 LLM 검증을 위한 적대적 프로브

대규모 언어 모델의 배포 후 변경 사항을 감지하기 위해 zk-SNARK 기반의 프라이버시 보호 감사 프레임워크를 제안한다. 토큰 기반 프로브가 블랙박스 환경에서 모델과 GPU 플랫폼을 가리지 않고 가장 높은 평균 감도를 보이며, 50개까지 확장해도 증명 시간은 1.78초, 검증 시간은 0.84초에 머무른다.

이 연구는 모델 배포 후 변경 사항을 비침투적으로 감지할 수 있는 프레임워크를 제시하여, AI 모델의 거버넌스와 보안을 강화할 수 있다.

zk-SNARK프라이버시 보호LLM 검증적대적 프로브PDF 있음
arXiv취약점·익스플로잇 · 프리프린트 · 2026년 8월 31일Omri Ram 외 4명

GraftyVul: 실제 취약점 이식을 통한 보안 취약 프로그램 합성

GraftyVul은 실제 취약점을 오픈소스 프로젝트에 이식하여 보안 취약 프로그램을 생성하는 시스템이다. 212개의 검증되고 공격 가능한 취약 프로그램을 5개 언어와 23개 CWE 범주에 걸쳐 생성하였다.

이 결과는 취약점 탐지 및 자동 수정 연구에 더 다양하고 현실적인 데이터셋을 제공할 수 있다.

취약점데이터셋GraftyVul보안PDF 있음
arXiv프라이버시 · 프리프린트 · 2026년 8월 31일Asmau Yetunde Adeniran 외 5명

사용자 중심의 컨텍스트 인식 권한 관리 프레임워크

기존 모바일 OS의 권한 모델은 앱 세션 단위로 권한을 부여해 사용자가 데이터 접근 시점을 알기 어렵다. 컨텍스트에 따라 권한을 제어하는 프레임워크를 제안하고, 104명의 설문과 8명의 테스트를 통해 초기 평가를 수행했다.

이 연구는 모바일 기본 앱의 권한 관리를 개선해 사용자 이해도를 높이는 방안을 제시한다.

모바일 보안권한 관리프라이버시사용자 인터페이스PDF 있음
arXiv프라이버시 · 프리프린트 · 2026년 8월 31일Haocheng Jiang, Hua Shen

FISGuard: 멤버십 추론 공격을 위한 고정 입력 부분공간 방어

FISGuard는 멤버십 추론 공격을 방어하기 위해 고정된 저차원 표현 부분공간을 구축하는 방식을 제안한다. 실험 결과, FISGuard는 ProjRes 공격의 AUC를 0.5 수준으로 낮추며, 다운스트림 작업 성능을 유지하고 계산 오버헤드가 적은 것을 보였다.

FISGuard는 멤버십 추론 공격에 효과적인 방어 기법으로, 분산 학습 환경에서 개인정보 보호를 강화할 수 있다.

FISGuard멤버십 추론(membership inference)프로젝션 잔차(ProjRes)저차원 표현 부분공간PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Yuqi Jia 외 5명

ContextLeak: 악성 도구를 통한 LLM 에이전트 컨텍스트 유출

LLM 에이전트의 런타임 컨텍스트를 유출하는 새로운 공격 기법인 ContextLeak을 제안한다. 강화 학습을 활용해 악성 도구의 이름과 설명을 생성하여 에이전트가 해당 도구를 선택하고 컨텍스트를 입력 인수로 전달하도록 유도한다.

LLM 에이전트가 악성 도구를 선택할 때 런타임 컨텍스트가 유출될 수 있으므로, 도구 선택 과정에서의 보안 검증이 필요하다.

LLM 에이전트컨텍스트 유출악성 도구강화 학습PDF 있음
arXiv프라이버시 · 프리프린트 · 2026년 8월 31일Xujun Che 외 2명

메모리화는 추출이 아니다: 엄밀한 차분 프라이버시 경계와 감사의 맹점

대규모 언어 모델에서 메모리화를 측정하는 다양한 정의가 있으며, 차분 프라이버시(DP)가 이들을 대체적으로 통제한다고 간주된다. 그러나 DP 상수를 정확히 정의하고, 메모리화와 추출 간의 관계를 분석하여 이들이 서로 통제하지 않는다는 것을 보인다.

이 연구는 차분 프라이버시가 메모리화와 추출을 모두 통제하지 못함을 보여, 보안 감사 및 프라이버시 보호 모델 개발 시 주의가 필요하다.

차분 프라이버시메모리화추출감사PDF 있음
arXiv프라이버시 · 프리프린트 · 2026년 8월 31일Yucheng Fu, Tianhao Wang

다중 당사자 차분 프라이버시에서 연속 소음 샘플링 재검토

다중 당사자 계산(MPC)과 차분 프라이버시(DP)를 결합한 시스템에서 사용되는 연속 소음 샘플링 프로토콜의 취약점을 분석하고 이를 개선한 새로운 방법을 제안한다. 기존 샘플링 방식의 취약점으로 인해 100% 공격 성공률을 보였으며, 새로운 샘플링 방식은 기존보다 4~612배 빠르고 효율적이다.

이 연구는 다중 당사자 차분 프라이버시 시스템에서 사용되는 소음 샘플링 방식의 취약점을 실증하고 이를 개선한 새로운 프로토콜을 제시하여, 실무에서 보다 안전하고 효율적인 프라이버시 보호를 가능하게 한다.

차분 프라이버시다중 당사자 계산소음 샘플링보안 취약점PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Abdulrahman Diaa 외 2명

서브문장 단위에서 의미 수표(mark)의 순서로 견고한 탐지

기존 의미 수표는 문장 의미에 묶어 토큰 선택보다 견고하지만, 공격자가 텍스트를 다시 표현하거나 재정렬하면 탐지가 실패한다. 이를 해결하기 위해 EDA 공격과 k-SwordStamp 방어 기법을 제안한다.

이 연구는 의미 수표 기반 보안 기법의 취약점을 분석하고, 공격에 더 강한 방어 기법을 제시하여 실무에서의 적용 가능성을 제고한다.

의미 수표공격 기법방어 기법순서 견고성PDF 있음
arXiv네트워크·프로토콜 · 프리프린트 · 2026년 8월 31일Wagner Comin Sonaglio 외 4명

FlyBlind: 5G 위성망을 통한 무인항공기 상황 인식에 대한 Cross-Slice Timeliness 공격

5G 독립형 네트워크에서 운영되는 시각 외 비행 무인 항공 시스템(UAS)은 명령 및 제어(C2) 데이터와 비디오 피드백을 위한 공유 사용자 평면을 사용한다. FlyBlind 공격은 인접 슬라이스에 있는 권한 있는 공유 사용자가 정당한 업링크 수요를 유지하면서 GCS 상태가 오래되도록 만드는 공격 기법이다.

이 연구는 5G 네트워크 슬라이싱 환경에서 권한 있는 공유 사용자가 정상적인 업링크 수요를 유지하면서도 GCS 상태를 오래되게 만들 수 있음을 보여주어, 실무에서는 상태 최신성 검증을 강화해야 한다.

5G 네트워크 슬라이싱무인 항공 시스템FlyBlind 공격상태 오래됨PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Benlei Cui 외 9명

메타적응형 다중모달 탈옥 공격(Meta-Adaptive Multimodal Jailbreaking)

시각-언어 모델(VLM)의 보안 취약점을 분석하기 위해 메타적응형 다중모달 탈옥 공격(MAMJ) 기법을 제안한다. MAMJ는 공격 전략 프롬프트(ASP)와 공격 효과성을 결정하는 가중치(φ)를 최적화하여, 기존 공격 기법보다 높은 공격 성공률(ASR)을 달성한다.

이 연구는 대규모 시각-언어 모델이 메타적응형 공격에 취약하다는 것을 보여주어, 해당 분야의 방어 기법 개발을 촉진시킬 수 있다.

AI 보안시각-언어 모델탈옥 공격메타적응형 공격PDF 있음
arXiv시스템·하드웨어 · 프리프린트 · 2026년 8월 31일Stamatios Kostopoulos 외 2명

eBPF 기반 사이버보안 메커니즘: 체계적 문헌 검토

eBPF 기반 사이버보안 메커니즘을 PRISMA 방법론을 통해 체계적으로 검토하고 분류했다. 54개 연구를 7개 분야로 분류하고, 평균 CPU 오버헤드 2.4% [1.1-8.6%], 탐지 정확도 94-99%를 기록했다.

eBPF는 클라우드 네이티브 환경에서 실시간 보안 강화에 효과적이지만, 내장 취약점 대응과 표준 평가 프레임워크 개발이 필요하다.

eBPF사이버보안문헌 검토시스템 보안PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Paria Mehrbod 외 4명

회로 탐지가 LLM 제한 해제 감지에 도움: 기계적 해석 연구

LLM이 제한 해제 공격에 어떻게 반응하는지 기계적 해석을 통해 분석하고, 특정 회로를 제거하여 공격 성공률을 최대 80%까지 줄였다. 80%까지 공격 성공률 감소.

LLM의 제한 해제 공격을 감지하고 방어하는 데 회로 탐지 기법을 활용할 수 있다.

LLM제한 해제 공격(jailbreaking)기계적 해석(mechanistic interpretability)회로 탐지PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 8월 31일Xinhang Ma 외 4명

ROPE: 간접 프롬프트 인젝션 공격에 대항하는 루트 원본 정책 집행

LLM 에이전트가 공격자의 지시를 따라 해로운 도구를 실행하는 간접 프롬프트 인젝션 공격을 방어하기 위해, 사용자로부터 유래한 값만이 상태 변경 도구에 도달할 수 있도록 하는 ROPE 방식을 제안한다. ROPE는 민감한 도구 매개변수에 대한 결정론적 원본 검사를 통해 공격 성공률을 1.6-2.6%로 유지하면서 82-100%의 정상 기능을 보존한다.

ROPE는 LLM 에이전트의 도구 실행을 보호하는 구조적 접근법으로, 실무에서 프롬프트 인젝션 공격에 대한 방어를 강화할 수 있다.

LLM 에이전트프롬프트 인젝션ROPEorigin policyPDF 있음

본 페이지의 연구 요약은 공개된 초록을 AI가 한국어로 정리한 것으로, 원문과 차이가 있을 수 있습니다. 정확한 내용은 반드시 원문을 확인하십시오. 본문과 PDF는 제공하지 않으며, 모든 저작권은 각 저자와 발행처에 있습니다.