-
Claude를 속여 사용자의 가장 깊은 비밀을 유출시킨 방법
Claude를 속여 사용자의 가장 깊은 비밀을 유출시킨 방법 | GeekNews
<ul> <li>기본 활성화된 Claude 메모리와 웹 탐색을 결합하자, 평범한 커피숍 질문만으로 사용자의 <strong>이름·직장·고향</strong>을 외부 서버에 몰래 전송할 수 있었음</li> <li><code>web_fetch</code>는 임의 URL 접근을 막았지만 이전 페이지에 있는 링크는 따라갈 수 있어,…
-
GitLost: GitHub AI 에이전트를 속여 비공개 저장소 유출
GitLost: GitHub AI 에이전트를 속여 비공개 저장소 유출 | GeekNews
<ul> <li>Noma Labs는 GitHub Agentic Workflows에서 <strong>간접 프롬프트 인젝션</strong> 취약점 GitLost를 발견했으며, 공개 저장소 이슈만으로 같은 조직의 비공개 저장소 데이터를 공개 댓글에 노출시킬 수 있었음</li> <li>이 기능은 Markdown 워크플로를 YAM…
-
클로드 코드는 요청에 스테가노그래피 표시를 하고 있음
클로드 코드는 요청에 스테가노그래피 표시를 하고 있음 | GeekNews
<ul> <li>Claude Code 2.1.196 바이너리에는 시스템 프롬프트의 현재 날짜 문장을 바꿔 <strong>요청 안에 분류 신호</strong>를 숨기는 함수가 들어 있음</li> <li>트리거는 <code>ANTHROPIC_BASE_URL</code>이며, 공식 <code>api.anthropic.com</…
-
2천 명이 내 AI 어시스턴트를 해킹하려 한 뒤 벌어진 일
2천 명이 내 AI 어시스턴트를 해킹하려 한 뒤 벌어진 일 | GeekNews
<ul> <li>hackmyclaw.com은 이메일로 AI 어시스턴트 <strong>Fiu</strong>를 속여 <code>secrets.env</code>를 유출시키는 공개 실험이었고, Hacker News 1위 이후 2,000명 이상이 6,000건 넘게 시도했지만 비밀은 새지 않음</li> <li>방어는 VPS에서 …
-
Reddit을 이용해 AI 검색을 조작하는 일은 너무 쉽다
Reddit을 이용해 AI 검색을 조작하는 일은 너무 쉽다 | GeekNews
<ul> <li>단 <strong>13단어</strong> 분량의 짧은 텍스트만으로도 ChatGPT와 Google AI 검색을 구동하는 AI 에이전트의 출력을 일관되게 스팸·스캠 콘텐츠로 바꿀 수 있음</li> <li>Reddit, Wikipedia, Quora, Facebook 같은 <strong>사용자 생성 콘텐츠(U…
-
악성코드 개발자들이 스파이웨어에 핵·생물무기 문구를 추가함
악성코드 개발자들이 스파이웨어에 핵·생물무기 문구를 추가함 | GeekNews
<ul> <li>AI 보안 스캐너의 분석을 막기 위해 스파이웨어에 <strong>LLM 안전 거부</strong>를 유발하는 핵·생물무기 문구가 삽입됨</li> <li><strong>1차 안전 정렬</strong>에 과도하게 의존하면 실제 보안 분석에서 공격자가 악용할 수 있는 맹점이 생김</li> <li>폐쇄형 모델과 …