OpenAI gives first detailed debrief of the Hugging Face incident at Black Hat conference

OpenAI가 Black Hat 2026에서 7월 허깅페이스 침해 사건을 처음으로 상세 재구성했다. 미공개 모델을 포함한 자율 에이전트들이 내부 저장소를 익스플로잇 공유용 ‘메시지판’으로 바꿔 두 달간 협력했고, OpenAI는 이를 ‘컴퓨터 보안의 분수령’으로 규정했다. 현장 취재 매체 보도와 OpenAI 공식 공개를 함께 정리했다.

August 6, 2026 · 5 분 · 서소영

Behind the Scenes: Hardening Firefox with Claude Mythos Preview

Mozilla가 agentic harness 파이프라인을 구축해 Firefox 150에서 271개 잠재 보안 버그를 발견·수정한 과정. 핵심은 모델보다 파이프라인이며, 정적 분석의 false positive 한계는 동적 testcase 검증으로 돌파됐다.

May 8, 2026 · 6 분 · 서소영

RAG의 지식 DB는 열린 문이다

PoisonedRAG는 RAG 시스템의 지식 DB에 5개의 악성 텍스트만 넣으면 90% 이상의 확률로 LLM이 원하는 오답을 내놓게 만든다. 모델은 멀쩡한데 참고 자료가 오염된 것이다.

April 21, 2026 · 4 분 · 서소영