RESEARCH

연구·리포트 참고 자료

이번 주 연구최근 7200편 · 출처 5
720Updated 2일 전
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Yuna Park 외 5명

운영 상태 변화에 따른 LLM 탈옥 안정성의 취약성

기존 탈옥 공격 평가가 단일 설정에서의 성공률만을 기준으로 하였으나, 실제 사용 환경에서의 다양한 운영 상태 변화가 공격 성공률에 큰 영향을 미친다는 점을 실증했다. 7개 정렬된 모델과 3가지 대표 탈옥 공격을 통해 평가 상태가 아닌 비평가 상태에서 공격 성공률이 최대 56%포인트 증가하는 현상을 관찰하였다.

LLM의 탈옥 공격에 대한 평가 시 단일 운영 상태만을 기준으로 하면 실제 보안 취약성을 과소평가할 수 있으므로, 다양한 운영 상태에서의 평가가 필요하다.

LLM탈옥 공격운영 상태보안 평가PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Sing Team

SingProbe 기술 보고서

대규모 언어 모델(LLM)의 런타임 가드를 위해 내재적 방법인 SingProbe를 제안하고, 토큰 수준에서 질의 의도, 응답 안전성, 환상 위험을 예측한다. SingProbe는 약 2M 파라미터와 0.5% 미만의 추가 오버헤드로 기존 가드레일보다 경쟁적 또는 우수한 성능을 보인다.

SingProbe는 LLM 생성 과정의 실시간 모니터링과 제어를 저비용으로 가능하게 하여, 보안 및 의료 분야에서의 안전한 사용을 촉진할 수 있다.

LLM런타임 가드SingProbe안전성 모니터링PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Fukang Zhu 외 5명

코딩 에이전트의 레포지토리 포이징 취약성에 영향을 미치는 사용자 인보케이션

코딩 에이전트가 타사 레포지토리에서 작업할 때 사용자의 인보케이션 선택이 취약성에 미치는 영향을 분석하고, CIPR이라는 벤치마크를 제안한다. CIPR은 20개 레포지토리, 4가지 작업 유형, 3가지 프롬프트 스타일, 3가지 스킬/규칙 조건을 포함하며, 공격 성공률(ASR)과 에이전트 경고률(AR)을 측정한다.

코딩 에이전트의 취약성은 사용자 설정에 따라 달라지므로, 개발자는 작업 유형과 프롬프트 표현 방식을 신중히 선택해야 한다.

코딩 에이전트(coding agent)레포지토리 포이징(repository poisoning)프롬프트 레벨 구성(PLC)CIPRPDF 있음
arXiv시스템·하드웨어 · 프리프린트 · 2026년 9월 1일Sebastian Watzinger 외 3명

Liezz: 적대적 증인 주입을 활용한 ZK DSL 툴체인 결함 탐지

Zero-knowledge domain-specific language(ZK DSL) 툴체인의 결함을 적대적 증인 주입을 통해 탐지하는 테스트 프레임워크인 Liezz를 제안한다. Liezz는 생성된 결정론적 프로그램에 대해 두 가지 공개 입력 할당을 실행하고 그 증인을 결합하여 툴체인의 결함을暴로한다. 13개의 결함을 발견했으며, 그 중 7개는 사운드니스에 영향을 미친다.

Liezz를 활용하면 기존의 유효 실행 테스트에서 발견되지 않는 ZK DSL 툴체인의 결함을 효과적으로 탐지할 수 있다.

Zero-knowledgeZK DSLLiezz적대적 증인 주입PDF 있음
arXiv시스템·하드웨어 · 프리프린트 · 2026년 9월 1일Dong Hyeok Kim 외 6명

5G 무선접속망에서 운영자 주도의 취약점 핫픽스 기법

5G 무선접속망(RAN)에서 임시 핫픽스를 배포하는 Buckler 프레임워크를 제안한다. 23개 논문에서 64개 공격을 분석하고, 20개 공격에 대해 DROP, MODIFY, RELEASE 3가지 방어 조치를 적용하여 실험적으로 검증하였다.

이 연구는 5G 네트워크 운영자가 표준 프로토콜 변경 없이 임시 방어 조치를 적용할 수 있는 실용적인 방법을 제시한다.

5G무선접속망(RAN)취약점 핫픽스BucklerPDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Shiqian Zhao 외 7명

ECLIPSE: 자가 진화하는 은밀한 프롬프트 인젝션 공격(ECLIPSE: Self-Evolving Stealthy Prompt Injection Attack against Long-Horizon Agentic Systems)

LLM 에이전트가 장기적 작업을 수행하는 시스템에 대해, 기존 프롬프트 인젝션 공격의 한계를 극복한 ECLIPSE 공격 기법을 제안하고, 이 기법이 기존 방어 기법을 우회하는 높은 공격 성공률을 보인다. ECLIPSE는 방어 없이 96.7%, 일반적인 안전 필터 하에서 69.2%의 공격 성공률을 달성한다.

이 연구는 LLM 에이전트 시스템의 보안 취약성을 드러내며, 기존 방어 기법의 한계를 보여주어 보다 효과적인 방어 기법 개발이 필요하다.

프롬프트 인젝션(prompt injection)LLM 에이전트ECLIPSE장기적 작업PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Yizhe Zeng 외 9명

LLM 백도어 방어가 분산된 이유: 희소 오토인코더를 활용한 특징 수준 분석

LLM 백도어 공격 방어 기법이 분산된 이유를 희소 오토인코더(SAE)를 사용한 특징 수준 분석을 통해 밝혔다. 실험 결과, SAE 기반 분석을 통해 정상 작업 성능을 유지하면서 ASR을 최대 10.8%까지 감소시켰다.

이 연구는 LLM 백도어 방어 기법의 분산 원인을 설명하고, 해석 가능한 방어 전략을 제시하여 실무에서 보안 설계에 활용할 수 있다.

LLM백도어희소 오토인코더방어 기법PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Lifei Liu, Haoran Yu

다중 에이전트 AI 시스템에서 출력물과 위임 계보 인증

다중 에이전트 시스템에서 독립적으로 운영되는 배포자 간의 작업 위임을 인증하기 위한 두 단계 인증 설계를 제안한다. Apple M1 Pro에서 계보 확인은 24.3-499.2us, AWS 클라우드에서 1,000개 경로가 검증되는 결과를 얻었다.

이 연구는 다중 에이전트 AI 시스템에서 위임 인증을 강화하는 기술로, 실무에서 위임 흐름의 보안성을 확보하는 데 활용될 수 있다.

AI 보안다중 에이전트 시스템인증동적 위임PDF 있음
arXiv악성코드·위협 · 프리프린트 · 2026년 9월 1일Istv\'an-Attila Cs\'asz\'ar 외 3명

Hyper-V 소켓을 활용한 악성코드 분석 샌드박스에서의 실시간 데이터 추출

Hyper-V 소켓을 악성코드 분석 샌드박스에서의 실시간 통신 채널로 활용할 수 있음을 보인다. WinSock TCP 소켓에 비해 TCP/IP 계층 차단을 받지 않고 일반 TCP 연결 열거 도구에서 나타나지 않는다.

악성코드 분석 샌드박스의 통신 채널로 Hyper-V 소켓을 사용하면 기존 TCP/IP 차단 기법을 우회할 수 있다.

Hyper-V악성코드 분석샌드박스소켓 통신PDF 있음
arXiv프라이버시 · 프리프린트 · 2026년 9월 1일Yijing Peng 외 7명

KORD: 딜러 없는 FSS에서 키 생성 병목 현상을 해결하는 프로토콜-하드웨어 공동 설계

이 연구는 딜러가 없는 기능 비밀 공유(FSS)에서 키 생성 과정의 병목 현상을 해결하기 위해 특수 목적 칩을 활용한 프로토콜-하드웨어 공동 설계인 KORD를 제안한다. KORD는 기존 프로토콜 대비 키 생성 통신량을 7,633~70,274배 감소시키고, ResNet-18 추론에서 키 생성에 소요되는 시간 비중을 96%에서 11.9%로 줄였다.

이 연구는 딜러 없는 FSS의 실용성을 높이기 위해 하드웨어와 프로토콜을 통합 설계한 사례로, 실무에서는 키 생성 과정의 효율성을 개선할 수 있다.

FSS프로토콜-하드웨어 공동 설계비밀 공유보안 계산PDF 있음
arXiv시스템·하드웨어 · 프리프린트 · 2026년 9월 1일Ebtesam J. Alqahtani, Mohammad Hammoudeh

ICS 보안 연구를 위한 데이터셋 및 테스트베드 가이드

ICS 보안 솔루션 개발과 테스트에 필요한 데이터셋과 테스트베드를 체계적으로 분류하고 분석하여, 표준화된 벤치마크 부족과 현대적 공격 시나리오 부재 등의 문제를 보인다. 분석 결과는 지속적인 문제점과 새로운 도구 개발 권장사항을 제시한다.

ICS 보안 연구자와 실무자는 이 가이드를 통해 기존 데이터셋과 테스트베드의 한계를 이해하고, 보다 효과적인 보안 솔루션 개발을 위한 방향을 설정할 수 있다.

ICS 보안데이터셋테스트베드디지털 트윈PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Chuanchao Zang 외 8명

LLM 에이전트에서 도구를 통한 지식 추출(ToolSiphon)

LLM 에이전트가 도구를 사용할 때 노출된 지식을 추출하는 공격 기법인 ToolSiphon을 제안한다. 평가 결과, 74.3%의 원본 기록을 복원할 수 있었다.

LLM 에이전트가 도구를 사용할 때 지식 유출 위험이 있으며, ToolSiphon을 통해 이를 확인할 수 있다.

LLM 에이전트지식 추출ToolSiphon보안 위험PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Chen Xiong 외 4명

SIR: 컴퓨트 사용 에이전트의 자기 개선형 레드팀 공격

컴퓨터 사용 에이전트(CUAs)는 인젝션 공격에 취약하다. SIR은 적응적 공격을 시뮬레이션하여 공격 성공률을 4%에서 24%, 0%에서 28%로 높였다.

CUAs를 사용하는 실무자는 SIR을 통해 보안 취약점을 사전에 확인하고 대응 전략을 수립해야 한다.

AI 보안프롬프트 인젝션레드팀 공격컴퓨터 사용 에이전트PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Chuanchao Zang 외 8명

LLM 에이전트 메모리의 단계별 유틸리티-위험 교환 이해

LLM 에이전트 메모리의 단계별 유틸리티-위험 교환을 이해하기 위해 MemGauge라는 제어 가능한 프레임워크를 제시한다. 11개 LLM과 두 개의 장기 메모리 벤치마크에서 단계별 평가를 통해 3가지 구별된 프로파일을 밝혀냈다.

이 결과는 LLM 에이전트 메모리의 단계별 평가와 제어가 필요하다는 것을 시사한다.

LLM 에이전트메모리유틸리티-위험 교환MemGaugePDF 있음
arXiv시스템·하드웨어 · 프리프린트 · 2026년 9월 1일Vikram Ramaswamy 외 2명

리두시오(Reducio): 기업 고객을 위한 최적화된 기밀 서버리스 클라우드 배포

서버리스 함수의 프라이버시 문제와 낮은 지연 시간을 해결하기 위해 기밀 가상 머신(CVM) 기반의 서버리스 플랫폼이 제안되었다. Reducio는 인프라 변경 없이 플랫폼 메모리 요구 사항을 크게 줄이는 새로운 서버리스 플랫폼 설계를 제안한다.

이 연구는 기업이 기밀성을 유지하면서 서버리스 클라우드를 효율적으로 배포할 수 있는 새로운 방법을 제시한다.

서버리스 클라우드기밀 가상 머신플랫폼 메모리 최적화함수 격리PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Dishu Yang 외 2명

프라이버시-유틸리티-안전성 균형 맞추기 위한 LLM 정렬의 선호도 최적화

대형 언어 모델(LLM)의 정렬 과정에서 프라이버시, 유틸리티, 안전성을 균형 있게 맞추기 위해 새로운 데이터 구성 프로토콜인 Privacy-Pressure Preference Mixing(P3M)을 제안하고 실험적으로 평가했다. P3M은 프라이버시-선호도 데이터 비율을 조정하여 기존 정렬 방식 대비 프라이버시 유출 가능성을 낮추는 효과를 보였다.

이 연구는 LLM 정렬 과정에서 프라이버시 보호를 강화하는 실용적인 방법을 제시하여, 모델 개발자들이 프라이버시-유틸리티-안전성 간의 균형을 고려하는 데 참고할 수 있다.

프라이버시LLM 정렬선호도 최적화P3MPDF 있음
arXiv취약점·익스플로잇 · 프리프린트 · 2026년 9월 1일Sriram Ramachandran 외 2명

Drishti: 5G 코어의 취약점 감사 프레임워크

5G 코어와 같은 중요 인프라 소프트웨어의 취약점 검증 및 영향 평가를 위한 Drishti 프레임워크를 제안한다. Open5GS와 free5GC에서 3개의 취약점을 발견했으며, 그 중 하나는 CVE가 요청된 NULL-dereference이며, 다른 하나는 2바이트 입력으로 AMF를 OOM-kills하는 메모리 증폭 취약점이다.

Drishti를 활용한 5G 코어 취약점 감사 결과는 5G 네트워크 보안 강화에 기여할 수 있다.

5G 코어취약점 감사DrishtiCVECVE-2025-69248PDF 있음
arXiv시스템·하드웨어 · 프리프린트 · 2026년 9월 1일Jimmy Gammell, Kaushik Roy

사이드채널 공격을 위한 트랜스포머 파이프라인

트랜스포머를 활용한 사이드채널 분석 방법을 제안하고, 자르지 않은 데이터셋에서의 전체 키 공격을 수행한다. ASCADv1f, ASCADv1r, CHES-CTF-2018 데이터셋에서 경쟁력 있는 성능을 보이며, 10GB 미만 VRAM과 최대 3.34시간의 훈련 시간을 요구한다.

이 연구는 사이드채널 분석에서 트랜스포머를 활용한 간단한 기반 모델을 제공하여, 실무에서 효율적인 공격 분석이 가능해진다.

트랜스포머사이드채널 공격딥러닝보안 분석PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Ashok Subbabhatta Gopalakrishna

AI 에이전트 간 제로지식 예측 증명: 측정된, 프로토콜 간 게이트웨이와 소스 무결성 간극

AI 에이전트 간 데이터 공유 시 민감 정보 누출을 방지하기 위해 제로지식 증명 기반의 게이트웨이를 구현하고, GDPR 데이터 최소화 원칙을 기술적 조치로 구현했다. 6.2ms의 증명 시간과 1.0ms의 검증 시간을 기록했다.

AI 에이전트 간 민감 정보 공유 시 제로지식 증명을 활용해 데이터 누출을 사전에 방지할 수 있다.

제로지식 증명AI 에이전트데이터 최소화GDPRPDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Wujie Xiong 외 4명

LLM 에이전트의 간접 프롬프트 인젝션 공격 대응을 위한 도달성 기반 능력 제한

LLM 에이전트가 외부 스킬의 출력을 실행 컨텍스트에 삽입하는 방식을 통해 공격자가 제어하는 데이터가 후속 권한 있는 작업에 영향을 미치는 문제를 해결하기 위해 SkillGuard라는 새로운 방어 기법을 제안한다. SkillGuard는 오염 발생 시 이진, 분수, 분수 흐름 전략을 사용하여 능력 제한을 계산하여 공격 성공률을 4.8%와 14.3%로 줄인다.

이 연구는 LLM 에이전트의 보안을 강화하기 위한 실용적인 방어 기법을 제시하여, AI 보안 분야의 실무자들에게 중요한 참고 자료가 될 수 있다.

LLM 에이전트프롬프트 인젝션SkillGuard도달성 기반 제한PDF 있음
arXivAI 보안 · 프리프린트 · 2026년 9월 1일Mingshuo Wang 외 5명

ActReal: 시스템 수준 모바일 에이전트가 모바일 자동화 탐지에 도전

시스템 수준 모바일 에이전트가 고정된 스크립트에서 벗어나 동적 UI를 탐색하고 복잡한 작업을 수행할 수 있도록 진화하고 있다. ActReal은 진짜 터치 궤적과 물리 기반 IMU 신호를 생성하여 기존 탐지 방식을 우회하는 공격 프레임워크이다.

ActReal을 통해 모바일 자동화 탐지 기술의 한계를 인식하고, 시스템 수준의 보안 강화가 필요하다.

모바일 에이전트자동화 탐지IMU 신호ActRealPDF 있음

본 페이지의 연구 요약은 공개된 초록을 AI가 한국어로 정리한 것으로, 원문과 차이가 있을 수 있습니다. 정확한 내용은 반드시 원문을 확인하십시오. 본문과 PDF는 제공하지 않으며, 모든 저작권은 각 저자와 발행처에 있습니다.