• Claude 애플리케이션을 구현하는 실전 가이드와 예제를 모아 에이전트 구축부터 RAG·도구 사용·멀티모달·평가까지 폭넓게 다룸
  • Claude Agent SDK·Managed Agents 예제에는 멀티에이전트 조율, 세션 관리, 배포, 장애 대응, 취약점 탐지, 사용자 기억 등 운영 패턴이 포함됨
  • 장기 실행 에이전트를 위한 메모리·컨텍스트 압축, 프로그래밍 방식 도구 호출, 임베딩 기반 도구 검색, 비동기 하위 에이전트 기법을 제공함
  • RAG, SQL 생성, 지식 그래프, 문서 요약, 이미지·음성 처리뿐 아니라 평가·비용·관측성·안전장치까지 구현 예제로 확인할 수 있음
  • Docker·Modal·Kubernetes 배포, 프롬프트 버전 관리와 롤백, 사람의 승인, 비용 분석을 아우르며 개발과 프로덕션 운영 전반에 활용할 수 있음

에이전트 평가와 안전장치

멀티에이전트와 워크플로 패턴

  • 비동기 멀티에이전트 조율: 공유 허브에서 동료 메시지를 주고받는 고정된 N개 에이전트 팀과 동적으로 생성되는 비동기 하위 에이전트의 메시징·수명주기 구조를 다룸
  • 멀티에이전트: 전문가 팀 조율: 조율자가 웹 검색 연구자·파일 열람 담당·규칙 기반 가격 담당을 이끌어 영업 제안서를 작성함
  • multiagent 필드, thread_created·thread_message_received 이벤트, 역할별 도구 범위 제한을 포함함
  • Outcomes: 자체 작업을 검증하는 에이전트: 작성자가 인용 연구 요약을 만들고 상태 없는 채점기가 URL과 인용문을 검사한 뒤, 통과할 때까지 수정하는 채점·개선 루프를 구축함
  • user.define_outcome, span.outcome_evaluation_* 이벤트와 채점기가 실행할 수 있는 평가 기준 작성법을 다룸
  • 기본 워크플로: 비용이나 지연 시간을 성능과 맞바꾸는 세 가지 멀티 LLM 패턴을 제공함
  • 평가자-최적화기: 한 LLM이 결과를 생성하고 다른 LLM이 평가 피드백을 제공하는 반복 구조임
  • 조율자-작업자: 중앙 LLM이 작업을 동적으로 위임하고 작업자 LLM의 결과를 종합함
  • Haiku를 하위 에이전트로 사용: Haiku 하위 에이전트가 금융 보고서를 추출하고 Opus가 결과를 종합

Claude Agent SDK

  • 한 줄짜리 연구 에이전트: Claude Code SDK와 WebSearch로 자율 연구 에이전트를 구축함
  • 비서실장 에이전트: 하위 에이전트, 훅(hook), 출력 스타일, 계획 모드로 멀티에이전트 시스템을 만듦
  • 관측성 에이전트: MCP 서버로 에이전트를 외부 시스템에 연결해 GitHub 모니터링과 CI 워크플로를 처리함
  • 사이트 신뢰성 에이전트: 읽기·쓰기 MCP 도구로 장애를 진단·복구하고 사후 보고서를 작성함
  • OpenAI Agents SDK에서 마이그레이션: 비용 승인 에이전트를 예로 들어 도구·가드레일·세션·핸드오프를 Claude Agent SDK 기본 요소에 대응시킴
  • 세션 브라우저 구축: 디스크의 Agent SDK 세션을 나열·열람하고 이름 변경·태그·포크해, 별도 대화 기록 파서 없이 사이드바를 만듦
  • 취약점 탐지 에이전트: C 대상을 위협 모델링하고 내장 파일 도구로 메모리 안전성 버그를 찾은 뒤 구조화된 보고서로 분류함
  • 에이전트 호스팅: 동일한 컨테이너 이미지와 HTTP 인터페이스를 유지하며 연구 에이전트를 Docker·Modal·Kubernetes 세 단계로 배포함

Claude Managed Agents

메모리와 컨텍스트 관리

도구 사용과 외부 연동

검색·RAG·지식 처리

멀티모달·음성·문서

응답·추론·프롬프트

Skills와 업무 애플리케이션

LlamaIndex 에이전트 패턴과 커뮤니티 기여

  • ReAct 에이전트: LlamaIndex로 도구 기반 추론과 행동 워크플로를 수행하는 ReAct 에이전트를 구축함
  • 새로운 Cookbook 아이디어를 위한 커뮤니티 기여를 받고 있으며, 기여 가이드를 제공함