본문 바로가기

전체 글384

Understanding and Exploiting Initialization Anchoring Weakness in Feedback-Based Agent Planning 원문: arXiv 2609.29697저자: Chuanchao Zang, Jianing Wang, Wenyu Chen, Xiangtao Meng, Li Wang, Xinyu Gao, Peng Zhan, Zheng Li, Shanqing Guo공개일: 2026-09-25분야: Agent Security, Feedback-Based Planning, Indirect Prompt InjectionTags: InitAnchor, AgentPlanning, PromptInjection, Feedback, BlackBoxAttack본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 논문은 feedback-based agent가 여러 .. 2026. 9. 26.
LLM Agents Can Easily Tamper With Their Own Traces 원문: arXiv 2609.30266저자: Jeremy Qin, David Schmotz, Derck Prinzhorn, Luca Beurer-Kellner, Ameya Prabhu, Maksym Andriushchenko공개일: 2026-09-25프로젝트: perfect-crime.ai분야: Agent Security, Trace Integrity, Monitoring, AuditTags: AgentSecurity, TraceIntegrity, AuditLog, CodingAgent, Monitoring본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 논문은 local coding agent의 native sessio.. 2026. 9. 26.
Agent Approval Laundering: Transitive Effects Beyond the Approved Invocation 원문: arXiv 2609.28586저자: Jinqian Zhang, Haojun Xia, Shujiang Wu, Jingkun Yue, Xia Zhang, Zhangpei Cheng, Bibo Tu공개일: 2026-09-25분야: Agent Authorization, Approval Records, Coding Agents, MCPTags: Authorization, Approval, CodingAgent, MCP, TransitiveEffects본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 논문은 coding agent가 사용자에게 승인받은 command나 tool call 자체는 정확히 기록해도, 그 호출이 내.. 2026. 9. 26.
OllamaDrama: Designing and Deploying a Honeypot to Measure Attacks on Exposed LLM Infrastructure 원문: arXiv 2609.29757저자: Karina Elzer, Niklas Netterstrøm Johansen, Emmanouil Vasilomanolakis공개일: 2026-09-25공식 코드: k-elzer/Ollure공개 데이터: Zenodo 10.5281/zenodo.22918902분야: LLM Infrastructure, Honeypot, Ollama, Internet MeasurementTags: Ollure, Ollama, Honeypot, LLMInfrastructure, InternetMeasurement본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기OllamaDrama는 backend LLM 없.. 2026. 9. 26.
CONCURDEP: Event-Guided Analysis of Dependency Invalidation in CPython Concurrency 원문: arXiv 2609.28608저자: Baihong Chen, Hadley Westover, Wen Li공개일: 2026-09-25분야: CPython, Native Concurrency, Static Analysis, Memory SafetyTags: CPython, Concurrency, FreeThreading, MemorySafety, StaticAnalysis본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기CONCURDEP은 CPython의 C 구현에서 객체 수명, borrowed reference, 내부 저장소 포인터, 컨테이너 순회 상태, buffer lease가 동시 실행이나 재진입으로 무효화되는 경로.. 2026. 9. 26.
Divide and Doubt: Diverse Distributed Poisoning for Retrieval-Augmented Generation 원문: arXiv:2609.27090저자: Tianhao Chen, Yuhan Wei, Weifei Jin, Zhengyuan Jiang, Yuepeng Hu, Neil Zhenqiang Gong공개일: 2026-09-22분야: RAG Security, Corpus Poisoning, Retrieval DefenseTags: RAG, CorpusPoisoning, DistributedPoisoning, Retrieval, ClusteringDefense본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기DnD는 여러 독성 문서가 같은 거짓 주장을 비슷한 문체와 표현으로 반복하면 clustering·similarity·conf.. 2026. 9. 25.
Control-Token Injection Suppresses Chain-of-Thought and Defeats Reasoning-Based Oversight in Tool-Using Agents 원문: arXiv:2609.27542저자: Muhammad Usama, Khair Un Nisa, Summer Yeoreum Jung공개일: 2026-09-23분야: LLM Agent Security, Control-Token Injection, CoT Monitoring, Tool ParserTags: ControlTokenInjection, ChainOfThought, ToolAgent, OversightBypass, ParserLeniency본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 논문의 결론은 에이전트 안전성이 모델 가중치만의 속성이 아니라 chat template과 tokenizer, tool-call.. 2026. 9. 25.
Agent Name Collision Attacks in Multi-Agent Systems 원문: arXiv:2609.27624저자: Adithyan Arun Kumar공개일: 2026-09-23분야: Multi-Agent Security, A2A, Identity, RoutingTags: AgentNameCollision, A2A, MultiAgent, IdentityBinding, WrongPeerDispatch본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 연구는 A2A Agent Card의 사람이 읽는 name을 안정적인 보안 식별자처럼 사용하면, 서로 다른 두 에이전트가 같은 이름을 광고할 때 신뢰된 에이전트 A에게 보낼 요청이 공격자 에이전트 B의 클라이언트·도구·엔드포인트·브로커 경로로 전달될 .. 2026. 9. 25.
ChronosAttack: Adversarial Tool Scheduling Attacks on LLM Agents 원문: arXiv:2609.27857저자: Arash Vashagh공개일: 2026-08-20분야: LLM Agent Security, Asynchronous Systems, Tool SchedulingTags: ChronosAttack, ToolScheduling, TimingAttack, AsyncAgent, OrderSensitivity본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기ChronosAttack은 tool response의 내용·개수·진위를 바꾸지 않고 일부 응답을 짧게 지연시켜 도착 순서만 바꾸는 공격입니다. 세 개의 authentic observation으로 세 후보 중 하나를 고르는 두 contro.. 2026. 9. 25.