화면 모드
API 제공자
API 제공자는 프로그램이나 런타임에서 모델을 호출할 수 있게 연결하는 서비스다. 모델 이름만 고르지 말고, 호출 한도·비용·데이터 처리 조건까지 함께 확인한다.
기준일: 2026-09-30
Google AI Studio
Google AI Studio에서 Gemini·Gemma 모델과 임베딩을 사용할 수 있다. 임베딩은 입력을 수치 표현으로 바꿔 검색 등에 사용하는 기능이다. 가벼운 문서 처리에는 Flash-Lite, 자료 검색에는 임베딩을 활용 후보로 본다.
| 모델 | API 모델 ID | 용도 | 공식 문서 |
|---|---|---|---|
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite | 짧은 문서 처리·번역·반복 작업 | 모델 소개 |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite | 가벼운 텍스트·멀티모달 입력 처리 | 모델 소개 |
| Gemma 4 31B | gemma-4-31b-it | 질문 응답·요약·코드 생성 실습 | Gemma API 문서 |
| Gemma 4 26B A4B | gemma-4-26b-a4b-it | 26B 계열의 질문 응답·추론 실습 | Gemma API 문서 |
| Gemini Embedding 1 계열 | gemini-embedding-001 | 텍스트 검색·유사도 비교 | 임베딩 문서 |
| Gemini Embedding 2 | gemini-embedding-2 | 텍스트·이미지 등 여러 입력을 같은 검색 공간에 연결 | 임베딩 문서 |
Gemma 4 26B는 공식 명칭의 A4B를 함께 적어 모델을 구분한다. 임베딩 1 계열의 호출 ID는 gemini-embedding-1이 아니라 gemini-embedding-001이다.
보충: Google 모델별 가격과 무료 이용 조건
기준일: 2026-09-30. 아래는 공식 가격표의 일반 요청(Standard) 기준이다. 금액은 미국 달러이며, 별도 검색 도구·캐싱·배치 요금은 포함하지 않는다.
| 모델 | 무료 제공·한도 | 유료 API 단가 |
|---|---|---|
| Gemini 3.5 Flash-Lite | 무료 입력·출력 제공; 프로젝트별 호출 한도 확인 | 입력 100만 토큰당 $0.30, 출력 $2.50 |
| Gemini 3.1 Flash-Lite | 무료 입력·출력 제공; 프로젝트별 호출 한도 확인 | 입력 100만 토큰당 $0.25(텍스트·이미지·영상), $0.50(음성); 출력 $1.50 |
| Gemma 4 31B | 무료 입력·출력 제공; 프로젝트별 호출 한도 확인 | 가격표의 Gemma 4 유료 티어는 제공되지 않음 |
| Gemma 4 26B A4B | 무료 입력·출력 제공; 프로젝트별 호출 한도 확인 | 가격표의 Gemma 4 유료 티어는 제공되지 않음 |
| Gemini Embedding 1 계열 | 무료 제공·한도 확인 필요 | 해당 모델의 직접 API 단가는 공식 가격표에서 확인 필요 |
| Gemini Embedding 2 | 무료 입력 제공; 프로젝트별 호출 한도 확인 | 텍스트 $0.20, 이미지 $0.45, 음성 $6.50, 영상 $12.00 / 입력 100만 토큰 |
무료 요청 수는 고정된 공통 숫자로 적지 않는다. 공식 사용 한도 안내를 보고 실제 프로젝트의 RPM·TPM·RPD를 AI Studio에서 확인한다. 같은 프로젝트에서 키를 더 만든다고 한도가 늘지 않는다.
무료·유료 티어의 데이터 처리 조건도 다르므로 공개할 수 없는 자료를 넣기 전에 확인한다. File Search의 임베딩 요금을 Embedding 1 직접 호출 요금으로 대체하지 않는다.
Groq
Groq는 Grok과 다른 서비스다. 텍스트 생성과 코드 작업을 빠르게 비교할 때 다음 모델을 활용 후보로 살펴본다. 공식 제공 목록은 모델 카탈로그에서 확인한다.
| 모델 | Groq 모델 ID | 용도 | 공식 문서 |
|---|---|---|---|
| gpt-oss-120b | openai/gpt-oss-120b | 추론과 코드 작업을 포함한 일반 텍스트 생성 | 모델 소개 |
| gpt-oss-20b | openai/gpt-oss-20b | 낮은 지연이 필요한 짧은 생성·반복 실습 | 모델 소개 |
| Qwen 3.8 27B | qwen/qwen3.8-27b | 코드 작업·추론·멀티모달 입력 실습 | 모델 소개 |
Qwen 3.8 27B는 공식 목록에서 Preview 모델로 분류된다. 평가용으로 먼저 확인하며 장기간 같은 ID가 유지된다고 가정하지 않는다.
보충: Groq 모델별 가격과 무료 한도
기준일: 2026-09-30. 가격은 공식 모델 목록의 일반 토큰 단가, 무료 한도는 공식 사용 한도의 Free Plan 표 기준이다. 금액은 미국 달러다.
| 모델 | 무료 한도(RPM / RPD / TPM / TPD) | 유료 입력 / 출력(100만 토큰당) |
|---|---|---|
| gpt-oss-120b | 30 / 1,000 / 8,000 / 200,000 | $0.15 / $0.60 |
| gpt-oss-20b | 30 / 1,000 / 8,000 / 200,000 | $0.075 / $0.30 |
| Qwen 3.8 27B | 30 / 1,000 / 8,000 / 200,000 | $0.80 / $4.00 |
RPM·RPD는 분당·일일 요청 수, TPM·TPD는 분당·일일 토큰 수다. 하나의 제한에 먼저 도달해도 요청이 막힐 수 있다. 조직별 실제 한도와 예외는 계정의 Limits 화면에서 확인한다.
Cloudflare Workers AI
Cloudflare Workers AI는 이미지 생성과 임베딩 실습의 활용 후보로 살펴본다. 직접 써 보면 그 밖의 작업은 무료 티어 안에서 원활하게 쓰기 어렵다. 이는 사용 경험에 따른 판단이며, 다른 모델이나 작업에 그대로 적용되는 제한은 아니다.
저렴한 이미지 생성과 자료 검색부터 시작할 때는 다음 세 모델을 비교할 수 있다. 제공 모델은 공식 카탈로그에서 확인한다.
| 모델 | Workers AI 모델 ID | 용도 | 공식 문서 |
|---|---|---|---|
| FLUX.1 schnell | @cf/black-forest-labs/flux-1-schnell | 짧은 텍스트 설명으로 실습용 이미지 생성 | 모델 문서 |
| BGE-M3 | @cf/baai/bge-m3 | 여러 언어의 수업 자료 검색용 임베딩 | 모델 문서 |
| BGE small en v1.5 | @cf/baai/bge-small-en-v1.5 | 영어 자료의 소규모 검색 실습 | 모델 문서 |
보충: Workers AI 모델별 가격과 무료 할당량
기준일: 2026-09-30. 아래 금액은 미국 달러이며 공식 가격표를 기준으로 적었다.
| 모델 | 모델별 연산 단가 | 무료 범위 |
|---|---|---|
| FLUX.1 schnell | 512×512 타일당 $0.0000528 + 스텝당 $0.0001056 | Workers AI의 하루 10,000 Neurons 할당량을 함께 사용 |
| BGE-M3 | 입력 100만 토큰당 $0.012 | 같은 하루 할당량을 함께 사용 |
| BGE small en v1.5 | 입력 100만 토큰당 $0.020 | 같은 하루 할당량을 함께 사용 |
Neurons는 연산 사용량의 단위다. 모델별 무료 호출 횟수가 아니며 이미지 비용은 해상도와 스텝 수에 따라 달라진다. 모델 문서의 반올림된 단가보다 가격표를 먼저 확인한다.
할당량은 00:00 UTC에 초기화된다. 무료 플랜에서 초과하면 오류가 나며, 추가 사용에는 Workers Paid가 필요하다. 유료 플랜도 하루 10,000 Neurons가 포함되고 초과분은 1,000 Neurons당 $0.011이다. Workers 플랜 비용은 모델 연산 단가와 구분한다.
NVIDIA NIM과 OpenRouter
NVIDIA NIM과 OpenRouter도 후보지만, 직접 써 본 경험으로는 원활한 활용에 한계가 있었다. 모델·계정·시점에 따라 조건이 달라지므로 일반적인 가용성으로 단정하지 않는다. NIM 비용·라이선스 안내, OpenRouter 가격
보충: 다른 제공자를 검토할 때
기준일: 2026-09-30. OpenRouter의 무료 모델에도 요청 한도와 조건이 있다. 사용할 모델의 조건을 공식 사용 한도에서 확인한다. NVIDIA NIM은 공식 문서에서 사용할 서비스와 실행 방식을 확인한다. 확인하지 않은 무료 한도나 지속적인 가용성을 약속하지 않는다.
수업 연결 전 확인 사항
수강생이 각자 가입해 개인 API 키와 본인의 사용량을 관리할 수 있는지 먼저 확인한다. 실습 전에 다음 조건을 실제 계정과 제공자 문서에서 대조한다.
- 사용할 모델의 무료 할당량과 분당·일일 제한
- 예산·사용 한도를 설정할 수 있는지와 초과 시 처리
- 가입이나 유료 전환에 카드가 필요한지
- 입력·출력의 저장과 학습 활용 조건
- 개인정보·기업정보를 입력해도 되는 조건인지
키는 개인별로 관리하며, 수업 자료나 저장소에 옮기지 않는다. 가입 → 개인 API 키 발급 → 한도 확인·설정 → 개인 사용량 확인의 흐름을 실습에 포함한다. 구독 요금과 API 사용 비용의 관계는 요금제에서 확인한다.