화면 모드
용어 색인
이 자료집에서 반복해서 나오는 용어, 모델, 회사·제품 이름을 모았다. 본문에서 처음 나오는 용어는 이 색인의 해당 항목으로 연결된다.
가나다
도메인 주도 설계
업무 규칙을 도메인별 모듈로 나누는 설계 방식이다. 이 자료집에서는 에이전트가 읽는 컨텍스트를 줄이는 방법으로 소개한다. https://ko.wikipedia.org/wiki/도메인_주도_설계
레이어드 아키텍처
화면, 처리, 데이터 접근을 층으로 나누는 구조다. 각 층이 자기 역할만 담당하므로 수정 범위가 좁아진다. https://en.wikipedia.org/wiki/Multilayered_architecture
룰
저장소마다 항상 적용되는 짧은 규칙이다. AGENTS.md, CLAUDE.md 같은 파일로 두고 커밋 여부, 배포 여부처럼 꼭 필요한 것만 적는다. https://code.claude.com/docs/en/memory · 자세히
메모리
런타임이 세션 사이에 스스로 남기는 개인 기억이다. 룰·스킬과 달리 저장소에 공유되지 않으므로, 모두에게 필요한 내용은 문서로 승격한다. 자세히
서브에이전트
별도 컨텍스트에서 실행되고 요약만 돌려주는 보조 에이전트다. 조사처럼 컨텍스트를 많이 쓰는 작업에 쓰며, 동시에 여러 개를 쓰면 토큰 비용이 늘어난다. 자세히
스킬
필요할 때만 불러오는 절차 문서다. 항상 로드되는 룰과 달리 사용 시점에 읽히므로 길어도 부담이 적다. https://code.claude.com/docs/en/skills · 자세히
스텔스 모델
원래 모델 이름이나 개발사를 숨긴 채 시험·평가 목적으로 무료 또는 저비용으로 공개되는 임시 모델이다. 유료 풀과 독립된 별도 사용량 한도로 제공되어 저위험 반복 작업에 유용하다. 자세히
에이전트
LLM에 컨텍스트, 도구, 파일, 셸, 권한, 검증이 붙은 시스템이다. 모델과 에이전트는 다르며, 같은 모델도 런타임과 하네스에 따라 결과가 달라진다. https://ko.wikipedia.org/wiki/인공지능_에이전트
오케스트레이션
여러 에이전트의 역할과 순서를 조율하는 일이다. 이 자료집에서는 Head와 Worker로 나누고 herdr로 런타임 단위에서 운영하는 방식을 다룬다. 자세히
컨텍스트
모델이 한 번에 읽는 입력 전체다. 컨텍스트가 커질수록 성능이 떨어지므로, 모듈화·스크립트화·문서 압축으로 읽는 양을 줄인다. 자세히
클린 아키텍처
의존 방향을 도메인 쪽으로 모으는 설계 방식이다. 바깥 기술이 바뀌어도 도메인 규칙이 흔들리지 않는다. 자세히
토큰
모델이 입력과 출력을 주고받는 단위이자 비용의 기준이다. 반복 작업의 스크립트화, 모듈 축소, 문서 압축으로 줄인다. 자세히
하네스
에이전트가 작업하는 환경 전체다. 룰, 스킬, 문서, 테스트를 묶어 두는 일을 하네스 엔지니어링이라고 한다. https://ko.wikipedia.org/wiki/에이전트_하네스
훅
편집, 턴 종료 같은 이벤트 시점에 자동으로 실행되는 스크립트다. 포맷·린트·로그에 쓰며, 잘못 만들면 루프나 보안 문제가 생긴다. https://docs.claude.com/en/docs/claude-code/hooks · 자세히
검증
테스트, 린트, 빌드처럼 다시 실행할 수 있는 기준으로 작업 결과를 확인하는 일이다. 자세히
알파벳
ADR
아키텍처 결정을 짧게 남기는 기록이다. 긴 작업 기록을 압축해 다음 작업이 읽을 양을 줄이는 데 쓴다. https://en.wikipedia.org/wiki/Architectural_decision
Anthropic
Claude 모델을 만드는 회사다. Opus와 Sonnet이 이 자료집의 Head·Worker 예시로 등장한다. https://www.anthropic.com/claude · https://www.anthropic.com/pricing
Antigravity
Google의 에이전트 개발 도구다. CLI 버전은 agy이며 Gemini 그룹 풀을 쓴다. https://antigravity.google/ · https://antigravity.google/docs
Astra
OpenAI의 최상위 모델이다. 이 자료집에서는 굳이 쓰지 않아도 되는 예로 언급된다. https://developers.openai.com/api/docs/models
Claude Code
Anthropic의 코딩 에이전트 런타임이다. 룰·스킬·훅·서브에이전트 기능이 이 자료집의 기준 예시로 자주 나온다. https://claude.com/claude-code
Codex
OpenAI의 코딩 에이전트 런타임이다. 승인 정책과 샌드박스 설정으로 권한을 나눈다. https://developers.openai.com/codex/
Cursor
AI 코드 에디터다. 에이전틱 코딩이 퍼진 대표 도구로 소개된다. https://cursor.com/
DeepSeek 4.1 Flash
오픈웨이트 계열의 저비용 모델이다. Worker·Reviewer로 쓰며 OpenCode Go 풀을 공유한다. https://www.deepseek.com/ · https://api-docs.deepseek.com/ · https://api-docs.deepseek.com/quick_start/pricing
Discord
팀과 커뮤니티가 쓰는 메신저다. 에이전트의 알림과 호출을 주고받는 통로로 쓸 수 있다. https://discord.com/
Chrome
Google의 웹 브라우저다. 브라우저 화면과 페이지 동작을 확인하는 도구 연결 예시에 나온다.
Fable
Anthropic의 최상위 모델이다. 이 자료집에서는 굳이 쓰지 않아도 되는 예로 언급된다. https://docs.claude.com/en/docs/about-claude/models/overview · https://www.anthropic.com/claude
Gemini Flash 3.8
Google의 빠른 모델이다. Worker·Reviewer로 쓰며 agy에서는 Gemini 그룹 풀을 쓴다. https://ai.google.dev/gemini-api/docs/models · https://ai.google.dev/pricing
GitHub
코드 저장소와 협업 서비스다. 이슈, 풀 리퀘스트, Actions로 작업과 검증을 자동화한다. https://github.com/
GLM 5.3
저비용 보조 모델이다. 여유가 있을 때 추가 Worker로 둔다. https://z.ai/
Google
Gemini 모델과 Antigravity를 만드는 회사다. 프리티어 사용량은 수업에 쓸 수준이 아니라는 평가가 이 자료집에 있다. https://about.google/ · https://ai.google.dev/
Groq
빠른 추론을 내세우는 API 제공자다. GPT OSS, Qwen 같은 모델을 제공한다. https://groq.com/ · https://groq.com/pricing
herdr
터미널 멀티플렉서이자 에이전트 오케스트레이션 도구다. 여러 런타임의 Head·Worker를 pane 단위로 운영한다. https://herdr.dev/ · 자세히
Hermes
Nous Research가 만든 오픈소스 자율 에이전트다. 서버에 두고 메신저로 연결해 쓴다. https://hermes-agent.nousresearch.com/ · https://hermes-agent.nousresearch.com/docs
Luna 6
OpenAI의 저비용 모델이다. Sol과 짝지어 Worker로 쓰는 예시가 있다. https://developers.openai.com/api/docs/models
Mac mini
Apple의 소형 데스크톱이다. 상시 켜 두는 개인 서버로 에이전트를 돌리는 예로 언급된다. https://www.apple.com/mac-mini/
Mermaid
텍스트로 관계와 흐름을 작성해 다이어그램으로 렌더링하는 도구다. https://mermaid.js.org/
MCP
외부 서비스를 에이전트의 도구로 연결하는 표준 방식이다. 컨텍스트 비용이 커질 수 있어 CLI·스크립트로 대체 가능하면 피한다. https://modelcontextprotocol.io/ · 자세히
Notion
문서와 자료를 페이지로 관리하는 서비스다. 공식 MCP로 에이전트와 연결할 수 있다. https://developers.notion.com/guides/mcp/overview · https://www.notion.com/pricing
OpenAI
Sol, Luna, Codex를 만드는 회사다. Codex 문서는 모델 선택과 요금제 기준을 확인하는 출처로 쓴다. https://developers.openai.com/ · https://developers.openai.com/api/docs/pricing
OpenClaw
에이전틱 코딩 도구다. 에이전틱 코딩이 퍼진 대표 도구로 소개된다. https://openclaw.ai/
OpenCode
오픈소스 코딩 에이전트 런타임이다. 무료 모델 활용과 OpenCode Go 요금제를 다룬다. https://opencode.ai/ · https://opencode.ai/docs/
Postman
API 요청과 컬렉션을 관리하는 도구다. 저장된 요청을 에이전트와 함께 확인하는 MCP 연결 예시로 나온다.
OpenCode Go
OpenCode의 월 구독형 요금제다. DeepSeek, GLM 같은 저비용 모델을 하나의 사용량 풀로 묶어 쓰며 월간 한도가 있다. https://opencode.ai/go/ · https://opencode.ai/docs/go/
OpenCode Zen
OpenCode 팀이 코딩 에이전트용으로 검증한 모델을 모아 제공하는 게이트웨이다. 크레딧을 충전해 모델별 사용량만큼 차감되는 종량제다. 무료 모델이 포함되며 모델마다 데이터 처리 조건이 다르다. https://opencode.ai/docs/zen/
OpenRouter
여러 모델을 한 API로 연결하는 제공자다. 크레딧을 충전하면 모델별 사용량만큼 차감되는 종량제로, 모델별 호출량과 가격 비교에 쓴다. https://openrouter.ai/ · https://openrouter.ai/pricing
Opus 5.5
Anthropic의 상위 모델이다. Head 역할과 effort 조정 예시로 등장한다. https://docs.claude.com/en/docs/about-claude/models/overview · https://www.anthropic.com/claude
RAG
검색으로 찾은 자료를 컨텍스트에 넣어 답을 만드는 방식이다. 직접 에이전트를 만드는 경우에 유용하다. https://ko.wikipedia.org/wiki/검색_증강_생성
Slidev
Markdown 원고로 발표 슬라이드를 만드는 도구다. 브라우저에서 발표하고 파일로 내보낼 수 있다. https://sli.dev/
Slack
팀 메시지와 알림을 주고받는 협업 서비스다. 작업 완료 알림을 보내는 통로 예시에 나온다.
Space Bunny
OpenCode Zen에서 무료로 제공하는 스텔스 모델이다. MiniMax 계열로 추정되나 공식 확인 전까지는 추정으로 표기한다. 별도 풀로 제공되어 유료 풀을 아끼는 저위험 Worker로 쓸 수 있다. https://opencode.ai/docs/zen/ · 자세히
Telegram
메시지를 주고받는 서비스다. 작업 완료 알림을 보내는 통로 예시에 나온다.
Sol 6.1
OpenAI의 상위 모델이다. Opus 5.5와 함께 Head 후보로 등장한다. https://developers.openai.com/api/docs/models
Sonnet 5.5
Anthropic의 중간 모델이다. 난도 높은 작성과 검토를 맡는 Worker·Reviewer 예시로 등장한다. https://docs.claude.com/en/docs/about-claude/models/overview · https://www.anthropic.com/claude
API 실습 모델과 제공자
모델 이름과 호출 ID는 구분한다. 같은 모델도 제공자마다 ID의 접두사가 다르므로 해당 제공자의 공식 문서를 기준으로 호출한다.
Google AI Studio
Gemini API 모델을 시험하고 프로젝트 사용량을 확인하는 Google의 서비스다. https://aistudio.google.com/ · https://ai.google.dev/gemini-api/docs/pricing
Cloudflare Workers AI
Workers에서 모델을 호출하는 서비스다. 이미지 생성과 임베딩 실습에 활용할 수 있다. https://developers.cloudflare.com/workers-ai/ · https://developers.cloudflare.com/workers-ai/platform/pricing/
Gemini 3.5 Flash-Lite
문서 처리와 반복 작업에 사용하는 경량 모델이다. ID는 gemini-3.5-flash-lite다. https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite
Gemini 3.1 Flash-Lite
가벼운 생성 작업의 후보로 사용하는 모델이다. ID는 gemini-3.1-flash-lite다. https://ai.google.dev/gemini-api/docs/models/gemini-3.1-flash-lite
Gemma 4 31B
Gemma 4의 31B 모델이다. Gemini API에서는 gemma-4-31b-it로 호출한다. https://ai.google.dev/gemma/docs/core/gemma_on_gemini_api
Gemma 4 26B A4B
Gemma 4의 26B 계열 모델이다. Gemini API ID는 gemma-4-26b-a4b-it다. https://ai.google.dev/gemma/docs/core/gemma_on_gemini_api
Gemini Embedding 1
텍스트를 검색용 수치 표현으로 바꾸는 모델이다. 호출 ID는 gemini-embedding-001이다. https://ai.google.dev/gemini-api/docs/embeddings
Gemini Embedding 2
텍스트·이미지 등 여러 입력을 검색용 수치 표현으로 연결한다. 안정 버전 ID는 gemini-embedding-2다. https://ai.google.dev/gemini-api/docs/embeddings
gpt-oss-120b
OpenAI의 오픈웨이트 모델이다. Groq ID는 openai/gpt-oss-120b다. https://console.groq.com/docs/model/openai/gpt-oss-120b
gpt-oss-20b
OpenAI의 작은 gpt-oss 모델이다. Groq ID는 openai/gpt-oss-20b다. https://console.groq.com/docs/model/openai/gpt-oss-20b
Qwen 3.8 27B
Groq가 Preview로 제공하는 Qwen 모델이다. ID는 qwen/qwen3.8-27b다. https://console.groq.com/docs/model/qwen/qwen3.8-27b
FLUX.1 schnell
텍스트로 이미지를 생성하는 모델이다. Workers AI ID는 @cf/black-forest-labs/flux-1-schnell이다. https://developers.cloudflare.com/workers-ai/models/flux-1-schnell/
BGE-M3
여러 언어의 검색에 사용하는 임베딩 모델이다. Workers AI ID는 @cf/baai/bge-m3다. https://developers.cloudflare.com/workers-ai/models/bge-m3/
BGE small en v1.5
영어 자료 검색용 임베딩 모델이다. Workers AI ID는 @cf/baai/bge-small-en-v1.5다. https://developers.cloudflare.com/workers-ai/models/bge-small-en-v1.5/