AI Agent tools referenceofficial sources checked 2026-09-05 · updated 2026-09-23
// Tools

AI Agent Tools Cheat Sheet

AI 에이전트를 실제로 만들고 운영할 때 고르는 도구를 모델 액세스, 실행 하네스, 평가·관측성 세 층으로 정리했습니다. 코딩 에이전트뿐 아니라 여러 에이전트를 동시에 굴리는 오케스트레이션 도구, 워크플로·브라우저 자동화 에이전트까지 포함합니다. 개념이 아니라 지금 설치해서 쓰는 제품 이름 기준입니다. 헷갈리는 도구 이름(예: openrouter, ollama, n8n)을 검색해 언제 쓰는지 확인하면 됩니다. 에이전트 설계 개념은 AI Agent Cheat Sheet, Claude Code·LangGraph 세부 명령은 각각의 치트시트를 참고하세요.

Model AccessLocal RuntimeCoding AgentsOrchestrationAutomationFrameworksMCPEvalObservability최신 점검: 2026-09-23
AccessHarnessOperateSources
Access

Model Access

에이전트가 어떤 채널로 모델을 부르느냐가 비용, 지연, 폴백 전략을 먼저 결정합니다. 관리형 API로 시작해서, 여러 모델을 갈아 끼워 보는 시점과 로컬로 내리는 시점을 구분해 둡니다.

관리형 API

Frontier 직접 호출

  • anthropic_apiClaude 모델 직접 호출입니다. Extended Thinking, Computer Use, 프롬프트 캐싱 같은 최신 기능이 가장 먼저 들어옵니다.
  • openai_apiGPT 계열 직접 호출입니다. Assistants/Responses API와 함수 호출 생태계가 가장 넓게 퍼져 있습니다.
  • gemini_api_ai_studio구글 AI 스튜디오에서 카드 등록 없이 키를 발급받습니다. Flash 계열 무료 쿼터가 관대해 프로토타입 1순위입니다.

엔터프라이즈 클라우드

  • bedrockAWS 조달, VPC, 리전 요구가 있는 조직의 Claude/오픈모델 서빙 경로입니다.
  • vertex_aiGCP 데이터 거버넌스 안에서 Gemini와 오픈모델을 서빙할 때 씁니다.
  • azure_openaiMS 365, Entra ID 인증 체계 안에서 GPT 계열을 써야 할 때 씁니다.

게이트웨이 · 로컬 실행

멀티모델 게이트웨이

  • openrouterAPI 하나로 수백 개 오픈·상용 모델을 갈아 끼웁니다. 이름 뒤 :free 모델은 무과금 기준 분당 20회, 하루 50회, 크레딧을 한 번 구매하면 하루 1,000회까지 카드 없이 모델을 비교할 수 있습니다.
  • ai_gateway_pattern앱 코드에 provider를 하드코딩하지 않고, 비용·지연·폴백 라우팅 정책만 바꾸는 계층입니다. Vercel AI Gateway 같은 제품이 여기 속합니다.
  • byok자체 구독 없이 사용자가 직접 키를 물려 쓰는 방식입니다. Bring-Your-Own-Key. 오픈코드 같은 터미널 에이전트가 이 패턴으로 도구 자체를 0원에 운영합니다.

로컬 실행

  • ollama명령줄 한 줄로 모델을 내려받아 스크립트와 자동화에 바로 연결합니다. 계정도 한도도 없는 개인 자동화의 기본값입니다.
  • lm_studioGUI로 모델을 골라 바로 대화합니다. 코드 없이 로컬 모델 성능부터 가늠하고 싶을 때 1순위입니다.
  • quantization_sizing4비트 양자화 기준 파라미터 10억당 약 0.6GB 메모리가 필요합니다. 컴퓨터 사양에 맞는 모델 크기를 이 계산으로 먼저 가늠합니다.
  • when_local_wins외부로 못 보내는 자료, 반복 호출되는 자동화, 오프라인 요구가 있을 때만 로컬을 기본값으로 삼습니다.
Harness

Build & Run

에이전트를 실제로 실행하는 환경입니다. 코딩 에이전트는 사람 옆에서 코드를 대신 쓰고, 오케스트레이션·워크플로·브라우저 에이전트는 여러 에이전트 운영과 반복 업무·웹 작업을 대신하며, 프레임워크와 연결 표준은 그 위에서 상태·도구·메모리를 코드로 조립합니다.

코딩 에이전트 · 자동화

구독형

  • claude_code대화형 코딩 에이전트입니다. 서브에이전트, 훅, 스킬로 확장합니다. 세부 명령은 Claude Code Cheat Sheet를 참고하세요.
  • codex_cliOpenAI 코딩 에이전트 CLI입니다. GPT 계열 추론을 터미널 워크플로에 붙일 때 씁니다.

무료 · 실험형

  • antigravity_cli구글의 무료 터미널 코딩 에이전트입니다. 탭 완성과 명령 요청은 무제한이고, 에이전트 작업량은 비공개 주간 쿼터로 제한됩니다.
  • opencode자체 구독이 없는 오픈소스 터미널 에이전트입니다. BYOK 방식이라 로컬 모델이나 무료 키를 물리면 도구 자체가 0원이 됩니다.

에이전트 오케스트레이션

  • orcaClaude Code, Codex, OpenCode 같은 코딩 에이전트 여러 개를 격리된 git worktree에서 동시에 띄우고 관리하는 오픈소스 에이전트 개발 환경입니다. 에이전트 하나씩 쓰다가 여러 개를 병렬로 굴리고 싶을 때 씁니다.

워크플로 · 브라우저 에이전트

  • n8n코드 없이 여러 앱과 API를 잇는 워크플로 자동화 에이전트입니다. 2026년 v2.0부터 LangChain 네이티브 통합과 AI 노드 70개 이상을 갖춰, 반복 업무 전체를 에이전트화할 수 있습니다.
  • aside로그인된 사이트를 사람처럼 오가며 여러 단계 웹 작업을 대신하는 브라우저 에이전트입니다. 자격증명과 작업 기록을 로컬에 우선 저장합니다. 아직 초기 단계 제품이라 가격 정책도 공개 전입니다.

프레임워크 · 연결 표준

에이전트 프레임워크

  • langgraph상태, 체크포인트, interrupt로 신뢰 가능한 워크플로를 조립합니다. 세부 API는 LangGraph Cheatsheet를 참고하세요.
  • claude_agent_sdkClaude Code와 같은 하네스를 자체 애플리케이션에 임베드할 때 씁니다.
  • openai_agents_sdk핸드오프, 가드레일, 트레이싱이 내장된 OpenAI 공식 에이전트 SDK입니다.

연결 표준

  • mcp_server파일, DB, SaaS, 사내 API를 표준 방식으로 노출하는 연결 계층입니다. 새 도구를 붙일 때 첫 선택지입니다.
  • mcp_top10_owaspMCP 서버를 붙이기 전에 권한 스코프와 알려진 공격 표면을 먼저 확인합니다.
Operate

Eval & Observability

데모가 도는 것과 운영 가능한 것은 다릅니다. 아래는 개념이 아니라, 실제로 설치해서 회귀, 비용, 트레이스를 잡는 도구 이름입니다.

평가

회귀 · 채점

  • promptfooCLI 기반 프롬프트/모델 회귀 테스트입니다. CI 게이트에 넣기 좋은 오픈소스입니다.
  • ragasRAG의 faithfulness와 context precision을 자동으로 채점합니다.
  • deepevalpytest 스타일로 LLM 출력 단위 테스트를 작성합니다.

합성 데이터 주의

  • llm_as_judge_bias채점 모델이 특정 문체나 길이를 선호하는 편향이 있습니다. 확인 없이 그대로 쓰면 안 됩니다.
  • eval_contamination평가셋이 학습 데이터와 겹치면 점수가 과대평가됩니다. 자체 시나리오로 보강해야 합니다.

관측성 · 트레이싱

SaaS · 오픈소스

  • langsmithLangChain/LangGraph 트레이스를 저장하고 평가합니다. trace_id와 span을 그대로 시각화합니다.
  • langfuse오픈소스 관측성 플랫폼입니다. self-host가 가능해 비용·지연 대시보드가 필요할 때 씁니다.
  • arize_phoenix오픈소스 LLM 트레이싱·평가 도구입니다. 로컬 실행과 OTel 연동이 강점입니다.

운영 신호

  • cost_dashboard요청당 비용과 모델별 사용량을 팀 단위로 추적합니다.
  • trace_replay실패한 실행을 같은 입력으로 재현해 원인 후보를 좁힙니다.
Sources

출처

각 도구의 공식 문서를 기준으로 구조를 잡고, Habix 실무 관점의 설명을 붙였습니다. 요금제·한도는 자주 바뀌니 쓰기 전에 원문에서 한 번 더 확인하세요.

Next Playbooks

개념과 세부 명령은 나머지 치트시트에서 이어서 봅니다.

이 페이지가 “어떤 도구를 쓰는가”라면, AI Agent Cheat Sheet는 “어떻게 설계하는가”, Claude Code·LangGraph 치트시트는 “구체적으로 어떻게 실행하는가”를 다룹니다.