본문으로 건너뛰기

용어 색인 ​

이 자료집에서 반복해서 나오는 용어, 모델, 회사·제품 이름을 모았다. 본문에서 처음 나오는 용어는 이 색인의 해당 항목으로 연결된다.

가나다 ​

도메인 주도 설계 ​

업무 규칙을 도메인별 모듈로 나누는 설계 방식이다. 이 자료집에서는 에이전트가 읽는 컨텍스트를 줄이는 방법으로 소개한다. https://ko.wikipedia.org/wiki/도메인_주도_설계

레이어드 아키텍처 ​

화면, 처리, 데이터 접근을 층으로 나누는 구조다. 각 층이 자기 역할만 담당하므로 수정 범위가 좁아진다. https://en.wikipedia.org/wiki/Multilayered_architecture

룰 ​

저장소마다 항상 적용되는 짧은 규칙이다. AGENTS.md, CLAUDE.md 같은 파일로 두고 커밋 여부, 배포 여부처럼 꼭 필요한 것만 적는다. https://code.claude.com/docs/en/memory · 자세히

메모리 ​

런타임이 세션 사이에 스스로 남기는 개인 기억이다. 룰·스킬과 달리 저장소에 공유되지 않으므로, 모두에게 필요한 내용은 문서로 승격한다. 자세히

서브에이전트 ​

별도 컨텍스트에서 실행되고 요약만 돌려주는 보조 에이전트다. 조사처럼 컨텍스트를 많이 쓰는 작업에 쓰며, 동시에 여러 개를 쓰면 토큰 비용이 늘어난다. 자세히

스킬 ​

필요할 때만 불러오는 절차 문서다. 항상 로드되는 룰과 달리 사용 시점에 읽히므로 길어도 부담이 적다. https://code.claude.com/docs/en/skills · 자세히

스텔스 모델 ​

원래 모델 이름이나 개발사를 숨긴 채 시험·평가 목적으로 무료 또는 저비용으로 공개되는 임시 모델이다. 유료 풀과 독립된 별도 사용량 한도로 제공되어 저위험 반복 작업에 유용하다. 자세히

에이전트 ​

LLM에 컨텍스트, 도구, 파일, 셸, 권한, 검증이 붙은 시스템이다. 모델과 에이전트는 다르며, 같은 모델도 런타임과 하네스에 따라 결과가 달라진다. https://ko.wikipedia.org/wiki/인공지능_에이전트

오케스트레이션 ​

여러 에이전트의 역할과 순서를 조율하는 일이다. 이 자료집에서는 Head와 Worker로 나누고 herdr로 런타임 단위에서 운영하는 방식을 다룬다. 자세히

컨텍스트 ​

모델이 한 번에 읽는 입력 전체다. 컨텍스트가 커질수록 성능이 떨어지므로, 모듈화·스크립트화·문서 압축으로 읽는 양을 줄인다. 자세히

클린 아키텍처 ​

의존 방향을 도메인 쪽으로 모으는 설계 방식이다. 바깥 기술이 바뀌어도 도메인 규칙이 흔들리지 않는다. 자세히

토큰 ​

모델이 입력과 출력을 주고받는 단위이자 비용의 기준이다. 반복 작업의 스크립트화, 모듈 축소, 문서 압축으로 줄인다. 자세히

하네스 ​

에이전트가 작업하는 환경 전체다. 룰, 스킬, 문서, 테스트를 묶어 두는 일을 하네스 엔지니어링이라고 한다. https://ko.wikipedia.org/wiki/에이전트_하네스

훅 ​

편집, 턴 종료 같은 이벤트 시점에 자동으로 실행되는 스크립트다. 포맷·린트·로그에 쓰며, 잘못 만들면 루프나 보안 문제가 생긴다. https://docs.claude.com/en/docs/claude-code/hooks · 자세히

검증 ​

테스트, 린트, 빌드처럼 다시 실행할 수 있는 기준으로 작업 결과를 확인하는 일이다. 자세히

알파벳 ​

ADR ​

아키텍처 결정을 짧게 남기는 기록이다. 긴 작업 기록을 압축해 다음 작업이 읽을 양을 줄이는 데 쓴다. https://en.wikipedia.org/wiki/Architectural_decision

Anthropic ​

Claude 모델을 만드는 회사다. Opus와 Sonnet이 이 자료집의 Head·Worker 예시로 등장한다. https://www.anthropic.com/claude · https://www.anthropic.com/pricing

Antigravity ​

Google의 에이전트 개발 도구다. CLI 버전은 agy이며 Gemini 그룹 풀을 쓴다. https://antigravity.google/ · https://antigravity.google/docs

Astra ​

OpenAI의 최상위 모델이다. 이 자료집에서는 굳이 쓰지 않아도 되는 예로 언급된다. https://developers.openai.com/api/docs/models

Claude Code ​

Anthropic의 코딩 에이전트 런타임이다. 룰·스킬·훅·서브에이전트 기능이 이 자료집의 기준 예시로 자주 나온다. https://claude.com/claude-code

Codex ​

OpenAI의 코딩 에이전트 런타임이다. 승인 정책과 샌드박스 설정으로 권한을 나눈다. https://developers.openai.com/codex/

Cursor ​

AI 코드 에디터다. 에이전틱 코딩이 퍼진 대표 도구로 소개된다. https://cursor.com/

DeepSeek 4.1 Flash ​

오픈웨이트 계열의 저비용 모델이다. Worker·Reviewer로 쓰며 OpenCode Go 풀을 공유한다. https://www.deepseek.com/ · https://api-docs.deepseek.com/ · https://api-docs.deepseek.com/quick_start/pricing

Discord ​

팀과 커뮤니티가 쓰는 메신저다. 에이전트의 알림과 호출을 주고받는 통로로 쓸 수 있다. https://discord.com/

Chrome ​

Google의 웹 브라우저다. 브라우저 화면과 페이지 동작을 확인하는 도구 연결 예시에 나온다.

Fable ​

Anthropic의 최상위 모델이다. 이 자료집에서는 굳이 쓰지 않아도 되는 예로 언급된다. https://docs.claude.com/en/docs/about-claude/models/overview · https://www.anthropic.com/claude

Gemini Flash 3.8 ​

Google의 빠른 모델이다. Worker·Reviewer로 쓰며 agy에서는 Gemini 그룹 풀을 쓴다. https://ai.google.dev/gemini-api/docs/models · https://ai.google.dev/pricing

GitHub ​

코드 저장소와 협업 서비스다. 이슈, 풀 리퀘스트, Actions로 작업과 검증을 자동화한다. https://github.com/

GLM 5.3 ​

저비용 보조 모델이다. 여유가 있을 때 추가 Worker로 둔다. https://z.ai/

Google ​

Gemini 모델과 Antigravity를 만드는 회사다. 프리티어 사용량은 수업에 쓸 수준이 아니라는 평가가 이 자료집에 있다. https://about.google/ · https://ai.google.dev/

Groq ​

빠른 추론을 내세우는 API 제공자다. GPT OSS, Qwen 같은 모델을 제공한다. https://groq.com/ · https://groq.com/pricing

herdr ​

터미널 멀티플렉서이자 에이전트 오케스트레이션 도구다. 여러 런타임의 Head·Worker를 pane 단위로 운영한다. https://herdr.dev/ · 자세히

Hermes ​

Nous Research가 만든 오픈소스 자율 에이전트다. 서버에 두고 메신저로 연결해 쓴다. https://hermes-agent.nousresearch.com/ · https://hermes-agent.nousresearch.com/docs

Luna 6 ​

OpenAI의 저비용 모델이다. Sol과 짝지어 Worker로 쓰는 예시가 있다. https://developers.openai.com/api/docs/models

Mac mini ​

Apple의 소형 데스크톱이다. 상시 켜 두는 개인 서버로 에이전트를 돌리는 예로 언급된다. https://www.apple.com/mac-mini/

Mermaid ​

텍스트로 관계와 흐름을 작성해 다이어그램으로 렌더링하는 도구다. https://mermaid.js.org/

MCP ​

외부 서비스를 에이전트의 도구로 연결하는 표준 방식이다. 컨텍스트 비용이 커질 수 있어 CLI·스크립트로 대체 가능하면 피한다. https://modelcontextprotocol.io/ · 자세히

Notion ​

문서와 자료를 페이지로 관리하는 서비스다. 공식 MCP로 에이전트와 연결할 수 있다. https://developers.notion.com/guides/mcp/overview · https://www.notion.com/pricing

OpenAI ​

Sol, Luna, Codex를 만드는 회사다. Codex 문서는 모델 선택과 요금제 기준을 확인하는 출처로 쓴다. https://developers.openai.com/ · https://developers.openai.com/api/docs/pricing

OpenClaw ​

에이전틱 코딩 도구다. 에이전틱 코딩이 퍼진 대표 도구로 소개된다. https://openclaw.ai/

OpenCode ​

오픈소스 코딩 에이전트 런타임이다. 무료 모델 활용과 OpenCode Go 요금제를 다룬다. https://opencode.ai/ · https://opencode.ai/docs/

Postman ​

API 요청과 컬렉션을 관리하는 도구다. 저장된 요청을 에이전트와 함께 확인하는 MCP 연결 예시로 나온다.

OpenCode Go ​

OpenCode의 월 구독형 요금제다. DeepSeek, GLM 같은 저비용 모델을 하나의 사용량 풀로 묶어 쓰며 월간 한도가 있다. https://opencode.ai/go/ · https://opencode.ai/docs/go/

OpenCode Zen ​

OpenCode 팀이 코딩 에이전트용으로 검증한 모델을 모아 제공하는 게이트웨이다. 크레딧을 충전해 모델별 사용량만큼 차감되는 종량제다. 무료 모델이 포함되며 모델마다 데이터 처리 조건이 다르다. https://opencode.ai/docs/zen/

OpenRouter ​

여러 모델을 한 API로 연결하는 제공자다. 크레딧을 충전하면 모델별 사용량만큼 차감되는 종량제로, 모델별 호출량과 가격 비교에 쓴다. https://openrouter.ai/ · https://openrouter.ai/pricing

Opus 5.5 ​

Anthropic의 상위 모델이다. Head 역할과 effort 조정 예시로 등장한다. https://docs.claude.com/en/docs/about-claude/models/overview · https://www.anthropic.com/claude

RAG ​

검색으로 찾은 자료를 컨텍스트에 넣어 답을 만드는 방식이다. 직접 에이전트를 만드는 경우에 유용하다. https://ko.wikipedia.org/wiki/검색_증강_생성

Slidev ​

Markdown 원고로 발표 슬라이드를 만드는 도구다. 브라우저에서 발표하고 파일로 내보낼 수 있다. https://sli.dev/

Slack ​

팀 메시지와 알림을 주고받는 협업 서비스다. 작업 완료 알림을 보내는 통로 예시에 나온다.

Space Bunny ​

OpenCode Zen에서 무료로 제공하는 스텔스 모델이다. MiniMax 계열로 추정되나 공식 확인 전까지는 추정으로 표기한다. 별도 풀로 제공되어 유료 풀을 아끼는 저위험 Worker로 쓸 수 있다. https://opencode.ai/docs/zen/ · 자세히

Telegram ​

메시지를 주고받는 서비스다. 작업 완료 알림을 보내는 통로 예시에 나온다.

Sol 6.1 ​

OpenAI의 상위 모델이다. Opus 5.5와 함께 Head 후보로 등장한다. https://developers.openai.com/api/docs/models

Sonnet 5.5 ​

Anthropic의 중간 모델이다. 난도 높은 작성과 검토를 맡는 Worker·Reviewer 예시로 등장한다. https://docs.claude.com/en/docs/about-claude/models/overview · https://www.anthropic.com/claude

API 실습 모델과 제공자 ​

모델 이름과 호출 ID는 구분한다. 같은 모델도 제공자마다 ID의 접두사가 다르므로 해당 제공자의 공식 문서를 기준으로 호출한다.

Google AI Studio ​

Gemini API 모델을 시험하고 프로젝트 사용량을 확인하는 Google의 서비스다. https://aistudio.google.com/ · https://ai.google.dev/gemini-api/docs/pricing

Cloudflare Workers AI ​

Workers에서 모델을 호출하는 서비스다. 이미지 생성과 임베딩 실습에 활용할 수 있다. https://developers.cloudflare.com/workers-ai/ · https://developers.cloudflare.com/workers-ai/platform/pricing/

Gemini 3.5 Flash-Lite ​

문서 처리와 반복 작업에 사용하는 경량 모델이다. ID는 gemini-3.5-flash-lite다. https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite

Gemini 3.1 Flash-Lite ​

가벼운 생성 작업의 후보로 사용하는 모델이다. ID는 gemini-3.1-flash-lite다. https://ai.google.dev/gemini-api/docs/models/gemini-3.1-flash-lite

Gemma 4 31B ​

Gemma 4의 31B 모델이다. Gemini API에서는 gemma-4-31b-it로 호출한다. https://ai.google.dev/gemma/docs/core/gemma_on_gemini_api

Gemma 4 26B A4B ​

Gemma 4의 26B 계열 모델이다. Gemini API ID는 gemma-4-26b-a4b-it다. https://ai.google.dev/gemma/docs/core/gemma_on_gemini_api

Gemini Embedding 1 ​

텍스트를 검색용 수치 표현으로 바꾸는 모델이다. 호출 ID는 gemini-embedding-001이다. https://ai.google.dev/gemini-api/docs/embeddings

Gemini Embedding 2 ​

텍스트·이미지 등 여러 입력을 검색용 수치 표현으로 연결한다. 안정 버전 ID는 gemini-embedding-2다. https://ai.google.dev/gemini-api/docs/embeddings

gpt-oss-120b ​

OpenAI의 오픈웨이트 모델이다. Groq ID는 openai/gpt-oss-120b다. https://console.groq.com/docs/model/openai/gpt-oss-120b

gpt-oss-20b ​

OpenAI의 작은 gpt-oss 모델이다. Groq ID는 openai/gpt-oss-20b다. https://console.groq.com/docs/model/openai/gpt-oss-20b

Qwen 3.8 27B ​

Groq가 Preview로 제공하는 Qwen 모델이다. ID는 qwen/qwen3.8-27b다. https://console.groq.com/docs/model/qwen/qwen3.8-27b

FLUX.1 schnell ​

텍스트로 이미지를 생성하는 모델이다. Workers AI ID는 @cf/black-forest-labs/flux-1-schnell이다. https://developers.cloudflare.com/workers-ai/models/flux-1-schnell/

BGE-M3 ​

여러 언어의 검색에 사용하는 임베딩 모델이다. Workers AI ID는 @cf/baai/bge-m3다. https://developers.cloudflare.com/workers-ai/models/bge-m3/

BGE small en v1.5 ​

영어 자료 검색용 임베딩 모델이다. Workers AI ID는 @cf/baai/bge-small-en-v1.5다. https://developers.cloudflare.com/workers-ai/models/bge-small-en-v1.5/

최초 게시 · 최종 업데이트