# API 제공자

무료 티어와 가성비 높은 API 제공자의 활용 방안을 살펴봅니다.

원본 URL: https://abc.noco.kr/concepts/api-provider

[API](https://ko.wikipedia.org/wiki/API) 제공자는 프로그램이나 런타임에서 모델을 호출할 수 있게 연결하는 서비스다. 모델 이름만 고르지 말고, 호출 한도·비용·데이터 처리 조건까지 함께 확인한다.

기준일: 2026-09-30

## Google AI Studio

[Google AI Studio](/glossary#google-ai-studio)에서 Gemini·Gemma 모델과 임베딩을 사용할 수 있다. 임베딩은 입력을 수치 표현으로 바꿔 검색 등에 사용하는 기능이다. 가벼운 문서 처리에는 Flash-Lite, 자료 검색에는 임베딩을 활용 후보로 본다.

| 모델 | API 모델 ID | 용도 | 공식 문서 |
| --- | --- | --- | --- |
| [Gemini 3.5 Flash-Lite](/glossary#gemini-3-5-flash-lite) | `gemini-3.5-flash-lite` | 짧은 문서 처리·번역·반복 작업 | [모델 소개](https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite) |
| [Gemini 3.1 Flash-Lite](/glossary#gemini-3-1-flash-lite) | `gemini-3.1-flash-lite` | 가벼운 텍스트·멀티모달 입력 처리 | [모델 소개](https://ai.google.dev/gemini-api/docs/models/gemini-3.1-flash-lite) |
| [Gemma 4 31B](/glossary#gemma-4-31b) | `gemma-4-31b-it` | 질문 응답·요약·코드 생성 실습 | [Gemma API 문서](https://ai.google.dev/gemma/docs/core/gemma_on_gemini_api) |
| [Gemma 4 26B A4B](/glossary#gemma-4-26b-a4b) | `gemma-4-26b-a4b-it` | 26B 계열의 질문 응답·추론 실습 | [Gemma API 문서](https://ai.google.dev/gemma/docs/core/gemma_on_gemini_api) |
| [Gemini Embedding 1 계열](/glossary#gemini-embedding-1) | `gemini-embedding-001` | 텍스트 검색·유사도 비교 | [임베딩 문서](https://ai.google.dev/gemini-api/docs/embeddings) |
| [Gemini Embedding 2](/glossary#gemini-embedding-2) | `gemini-embedding-2` | 텍스트·이미지 등 여러 입력을 같은 검색 공간에 연결 | [임베딩 문서](https://ai.google.dev/gemini-api/docs/embeddings) |

Gemma 4 26B는 공식 명칭의 `A4B`를 함께 적어 모델을 구분한다. 임베딩 1 계열의 호출 ID는 `gemini-embedding-1`이 아니라 `gemini-embedding-001`이다.

::: details 보충: Google 모델별 가격과 무료 이용 조건
기준일: 2026-09-30. 아래는 [공식 가격표](https://ai.google.dev/gemini-api/docs/pricing)의 일반 요청(Standard) 기준이다. 금액은 미국 달러이며, 별도 검색 도구·캐싱·배치 요금은 포함하지 않는다.

| 모델 | 무료 제공·한도 | 유료 API 단가 |
| --- | --- | --- |
| Gemini 3.5 Flash-Lite | 무료 입력·출력 제공; 프로젝트별 호출 한도 확인 | 입력 100만 토큰당 $0.30, 출력 $2.50 |
| Gemini 3.1 Flash-Lite | 무료 입력·출력 제공; 프로젝트별 호출 한도 확인 | 입력 100만 토큰당 $0.25(텍스트·이미지·영상), $0.50(음성); 출력 $1.50 |
| Gemma 4 31B | 무료 입력·출력 제공; 프로젝트별 호출 한도 확인 | 가격표의 Gemma 4 유료 티어는 제공되지 않음 |
| Gemma 4 26B A4B | 무료 입력·출력 제공; 프로젝트별 호출 한도 확인 | 가격표의 Gemma 4 유료 티어는 제공되지 않음 |
| Gemini Embedding 1 계열 | 무료 제공·한도 확인 필요 | 해당 모델의 직접 API 단가는 공식 가격표에서 확인 필요 |
| Gemini Embedding 2 | 무료 입력 제공; 프로젝트별 호출 한도 확인 | 텍스트 $0.20, 이미지 $0.45, 음성 $6.50, 영상 $12.00 / 입력 100만 토큰 |

무료 요청 수는 고정된 공통 숫자로 적지 않는다. [공식 사용 한도 안내](https://ai.google.dev/gemini-api/docs/rate-limits)를 보고 실제 프로젝트의 RPM·TPM·RPD를 AI Studio에서 확인한다. 같은 프로젝트에서 키를 더 만든다고 한도가 늘지 않는다.

무료·유료 티어의 데이터 처리 조건도 다르므로 공개할 수 없는 자료를 넣기 전에 확인한다. File Search의 임베딩 요금을 Embedding 1 직접 호출 요금으로 대체하지 않는다.
:::

## Groq

[Groq](/glossary#groq)는 Grok과 다른 서비스다. 텍스트 생성과 코드 작업을 빠르게 비교할 때 다음 모델을 활용 후보로 살펴본다. 공식 제공 목록은 [모델 카탈로그](https://console.groq.com/docs/models)에서 확인한다.

| 모델 | Groq 모델 ID | 용도 | 공식 문서 |
| --- | --- | --- | --- |
| [gpt-oss-120b](/glossary#gpt-oss-120b) | `openai/gpt-oss-120b` | 추론과 코드 작업을 포함한 일반 텍스트 생성 | [모델 소개](https://console.groq.com/docs/model/openai/gpt-oss-120b) |
| [gpt-oss-20b](/glossary#gpt-oss-20b) | `openai/gpt-oss-20b` | 낮은 지연이 필요한 짧은 생성·반복 실습 | [모델 소개](https://console.groq.com/docs/model/openai/gpt-oss-20b) |
| [Qwen 3.8 27B](/glossary#qwen-3-8-27b) | `qwen/qwen3.8-27b` | 코드 작업·추론·멀티모달 입력 실습 | [모델 소개](https://console.groq.com/docs/model/qwen/qwen3.8-27b) |

Qwen 3.8 27B는 공식 목록에서 Preview 모델로 분류된다. 평가용으로 먼저 확인하며 장기간 같은 ID가 유지된다고 가정하지 않는다.

::: details 보충: Groq 모델별 가격과 무료 한도
기준일: 2026-09-30. 가격은 [공식 모델 목록](https://console.groq.com/docs/models)의 일반 토큰 단가, 무료 한도는 [공식 사용 한도](https://console.groq.com/docs/rate-limits)의 Free Plan 표 기준이다. 금액은 미국 달러다.

| 모델 | 무료 한도(RPM / RPD / TPM / TPD) | 유료 입력 / 출력(100만 토큰당) |
| --- | --- | --- |
| gpt-oss-120b | 30 / 1,000 / 8,000 / 200,000 | $0.15 / $0.60 |
| gpt-oss-20b | 30 / 1,000 / 8,000 / 200,000 | $0.075 / $0.30 |
| Qwen 3.8 27B | 30 / 1,000 / 8,000 / 200,000 | $0.80 / $4.00 |

RPM·RPD는 분당·일일 요청 수, TPM·TPD는 분당·일일 토큰 수다. 하나의 제한에 먼저 도달해도 요청이 막힐 수 있다. 조직별 실제 한도와 예외는 계정의 Limits 화면에서 확인한다.
:::

## Cloudflare Workers AI

[Cloudflare Workers AI](/glossary#cloudflare-workers-ai)는 이미지 생성과 임베딩 실습의 활용 후보로 살펴본다. 직접 써 보면 그 밖의 작업은 무료 티어 안에서 원활하게 쓰기 어렵다. 이는 사용 경험에 따른 판단이며, 다른 모델이나 작업에 그대로 적용되는 제한은 아니다.

저렴한 이미지 생성과 자료 검색부터 시작할 때는 다음 세 모델을 비교할 수 있다. 제공 모델은 [공식 카탈로그](https://developers.cloudflare.com/workers-ai/models/)에서 확인한다.

| 모델 | Workers AI 모델 ID | 용도 | 공식 문서 |
| --- | --- | --- | --- |
| [FLUX.1 schnell](/glossary#flux-1-schnell) | `@cf/black-forest-labs/flux-1-schnell` | 짧은 텍스트 설명으로 실습용 이미지 생성 | [모델 문서](https://developers.cloudflare.com/workers-ai/models/flux-1-schnell/) |
| [BGE-M3](/glossary#bge-m3) | `@cf/baai/bge-m3` | 여러 언어의 수업 자료 검색용 임베딩 | [모델 문서](https://developers.cloudflare.com/workers-ai/models/bge-m3/) |
| [BGE small en v1.5](/glossary#bge-small-en-v1-5) | `@cf/baai/bge-small-en-v1.5` | 영어 자료의 소규모 검색 실습 | [모델 문서](https://developers.cloudflare.com/workers-ai/models/bge-small-en-v1.5/) |

::: details 보충: Workers AI 모델별 가격과 무료 할당량
기준일: 2026-09-30. 아래 금액은 미국 달러이며 [공식 가격표](https://developers.cloudflare.com/workers-ai/platform/pricing/)를 기준으로 적었다.

| 모델 | 모델별 연산 단가 | 무료 범위 |
| --- | --- | --- |
| FLUX.1 schnell | 512×512 타일당 $0.0000528 + 스텝당 $0.0001056 | Workers AI의 하루 10,000 Neurons 할당량을 함께 사용 |
| BGE-M3 | 입력 100만 토큰당 $0.012 | 같은 하루 할당량을 함께 사용 |
| BGE small en v1.5 | 입력 100만 토큰당 $0.020 | 같은 하루 할당량을 함께 사용 |

Neurons는 연산 사용량의 단위다. 모델별 무료 호출 횟수가 아니며 이미지 비용은 해상도와 스텝 수에 따라 달라진다. 모델 문서의 반올림된 단가보다 가격표를 먼저 확인한다.

할당량은 00:00 UTC에 초기화된다. 무료 플랜에서 초과하면 오류가 나며, 추가 사용에는 Workers Paid가 필요하다. 유료 플랜도 하루 10,000 Neurons가 포함되고 초과분은 1,000 Neurons당 $0.011이다. Workers 플랜 비용은 모델 연산 단가와 구분한다.
:::

## NVIDIA NIM과 OpenRouter

[NVIDIA NIM](https://build.nvidia.com/)과 [OpenRouter](https://openrouter.ai/)도 후보지만, 직접 써 본 경험으로는 원활한 활용에 한계가 있었다. 모델·계정·시점에 따라 조건이 달라지므로 일반적인 가용성으로 단정하지 않는다. [NIM 비용·라이선스 안내](https://docs.api.nvidia.com/nim/docs/product#what-is-the-pricing-model-for-nim), [OpenRouter 가격](https://openrouter.ai/pricing)

::: details 보충: 다른 제공자를 검토할 때
기준일: 2026-09-30. OpenRouter의 무료 모델에도 요청 한도와 조건이 있다. 사용할 모델의 조건을 [공식 사용 한도](https://openrouter.ai/docs/api_reference/limits)에서 확인한다. NVIDIA NIM은 [공식 문서](https://docs.nvidia.com/nim/)에서 사용할 서비스와 실행 방식을 확인한다. 확인하지 않은 무료 한도나 지속적인 가용성을 약속하지 않는다.
:::

## 수업 연결 전 확인 사항

수강생이 각자 가입해 개인 API 키와 본인의 사용량을 관리할 수 있는지 먼저 확인한다. 실습 전에 다음 조건을 실제 계정과 제공자 문서에서 대조한다.

- 사용할 모델의 무료 할당량과 분당·일일 제한
- 예산·사용 한도를 설정할 수 있는지와 초과 시 처리
- 가입이나 유료 전환에 카드가 필요한지
- 입력·출력의 저장과 학습 활용 조건
- 개인정보·기업정보를 입력해도 되는 조건인지

키는 개인별로 관리하며, 수업 자료나 저장소에 옮기지 않는다. 가입 → 개인 API 키 발급 → 한도 확인·설정 → 개인 사용량 확인의 흐름을 실습에 포함한다. 구독 요금과 API 사용 비용의 관계는 [요금제](/concepts/pricing)에서 확인한다.
