Understanding and Exploiting Initialization Anchoring Weakness in Feedback-Based Agent Planning
원문: arXiv 2609.29697저자: Chuanchao Zang, Jianing Wang, Wenyu Chen, Xiangtao Meng, Li Wang, Xinyu Gao, Peng Zhan, Zheng Li, Shanqing Guo공개일: 2026-09-25분야: Agent Security, Feedback-Based Planning, Indirect Prompt InjectionTags: InitAnchor, AgentPlanning, PromptInjection, Feedback, BlackBoxAttack본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 논문은 feedback-based agent가 여러 ..
2026. 9. 26.
LLM Agents Can Easily Tamper With Their Own Traces
원문: arXiv 2609.30266저자: Jeremy Qin, David Schmotz, Derck Prinzhorn, Luca Beurer-Kellner, Ameya Prabhu, Maksym Andriushchenko공개일: 2026-09-25프로젝트: perfect-crime.ai분야: Agent Security, Trace Integrity, Monitoring, AuditTags: AgentSecurity, TraceIntegrity, AuditLog, CodingAgent, Monitoring본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 논문은 local coding agent의 native sessio..
2026. 9. 26.
Agent Approval Laundering: Transitive Effects Beyond the Approved Invocation
원문: arXiv 2609.28586저자: Jinqian Zhang, Haojun Xia, Shujiang Wu, Jingkun Yue, Xia Zhang, Zhangpei Cheng, Bibo Tu공개일: 2026-09-25분야: Agent Authorization, Approval Records, Coding Agents, MCPTags: Authorization, Approval, CodingAgent, MCP, TransitiveEffects본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 논문은 coding agent가 사용자에게 승인받은 command나 tool call 자체는 정확히 기록해도, 그 호출이 내..
2026. 9. 26.
CONCURDEP: Event-Guided Analysis of Dependency Invalidation in CPython Concurrency
원문: arXiv 2609.28608저자: Baihong Chen, Hadley Westover, Wen Li공개일: 2026-09-25분야: CPython, Native Concurrency, Static Analysis, Memory SafetyTags: CPython, Concurrency, FreeThreading, MemorySafety, StaticAnalysis본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기CONCURDEP은 CPython의 C 구현에서 객체 수명, borrowed reference, 내부 저장소 포인터, 컨테이너 순회 상태, buffer lease가 동시 실행이나 재진입으로 무효화되는 경로..
2026. 9. 26.
Divide and Doubt: Diverse Distributed Poisoning for Retrieval-Augmented Generation
원문: arXiv:2609.27090저자: Tianhao Chen, Yuhan Wei, Weifei Jin, Zhengyuan Jiang, Yuepeng Hu, Neil Zhenqiang Gong공개일: 2026-09-22분야: RAG Security, Corpus Poisoning, Retrieval DefenseTags: RAG, CorpusPoisoning, DistributedPoisoning, Retrieval, ClusteringDefense본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기DnD는 여러 독성 문서가 같은 거짓 주장을 비슷한 문체와 표현으로 반복하면 clustering·similarity·conf..
2026. 9. 25.
Control-Token Injection Suppresses Chain-of-Thought and Defeats Reasoning-Based Oversight in Tool-Using Agents
원문: arXiv:2609.27542저자: Muhammad Usama, Khair Un Nisa, Summer Yeoreum Jung공개일: 2026-09-23분야: LLM Agent Security, Control-Token Injection, CoT Monitoring, Tool ParserTags: ControlTokenInjection, ChainOfThought, ToolAgent, OversightBypass, ParserLeniency본 글은 원 논문의 주요 기술적 내용을 이해하기 쉽게 요약·정리한 글입니다. 자세한 내용은 상단의 원문 링크를 참고하세요.한눈에 보기이 논문의 결론은 에이전트 안전성이 모델 가중치만의 속성이 아니라 chat template과 tokenizer, tool-call..
2026. 9. 25.