OpenRouter 무료 모델을 API로 사용하기
온프레미스 서비스로 오픈웨이트 모델을 사용하려 할 때 GPU 인프라가 충분하지 않으면 여러가지 모델을 하기 어렵다. 이렇게 LLM 모델별 API로 테스트해보고 싶은데 비용이 부담될 때 OpenRouter의 무료 모델을 쓸 수 있다. 여러 프로바이더의 모델을 하나의 OpenAI 호환 API로 호출할 수 있고, 모델 ID에 :free가 붙은 모델은 과금 없이 사용할 수 있다.
OpenRouter란
OpenRouter는 OpenAI, Anthropic, Google, Meta 등 여러 프로바이더의 모델을 하나의 API 엔드포인트로 중계해주는 서비스다. OpenAI SDK와 호환되기 때문에 base URL과 API 키만 바꾸면 기존 코드를 그대로 쓸 수 있다.
API 키 발급
- openrouter.ai 가입
- 우측 상단 프로필 > Keys 메뉴에서 Create Key
- 발급된
sk-or-v1-...키를 환경변수로 저장
# PowerShell
[System.Environment]::SetEnvironmentVariable("OPENROUTER_API_KEY", "<발급받은 키>", "User")
# bash
export OPENROUTER_API_KEY="<발급받은 키>"
무료 모델 찾기
모델 목록 페이지에서 가격 필터를 FREE로 설정하면 무료 모델만 볼 수 있다. 아래처럼 API로도 확인할 수 있는데, 모델 ID가 :free로 끝나는 것들이다.
curl -s https://openrouter.ai/api/v1/models | \
jq -r '.data[].id | select(endswith(":free"))'
이 글을 쓰는 시점(2026-07-15) 기준으로 사용할 수 있는 무료 모델은 20개다. Llama 3.3 70B, Qwen3 Coder 480B, NVIDIA Nemotron 3 Ultra 550B 같은 대형 모델도 무료로 테스트할 수 있다.

API 호출
API의 모델명에 “openrouter/free”로 적으면 프리 모델중에 인풋에 알맞는 모델을 선택해서 응답을 해준다. ( 어떤 모델이 선택됐는지 알 수는 없다 )
curl
curl https://openrouter.ai/api/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-d '{
"model": "meta-llama/llama-3.3-70b-instruct:free",
"messages": [
{"role": "user", "content": "안녕하세요. 자기소개 해주세요."}
]
}'
Python (OpenAI SDK)
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key=os.environ["OPENROUTER_API_KEY"],
)
resp = client.chat.completions.create(
model="qwen/qwen3-coder:free",
messages=[{"role": "user", "content": "파이썬으로 퀵정렬 구현해줘"}],
)
print(resp.choices[0].message.content)
무료 모델 사용 한도
무료 모델에는 요청 횟수 제한이 있다 (2026년 7월 기준).
| 구분 | 분당 요청 | 일일 요청 |
|---|---|---|
| 기본 | 20회 | 50회 |
| 크레딧 $10 이상 구매 이력 | 20회 | 1,000회 |
$10만 한 번 충전해두면 하루 1,000회까지 늘어나므로, 본격적으로 테스트할 계획이라면 최소 크레딧을 넣어두는 것이 편하다. 무료 모델은 프로바이더 사정에 따라 목록이 자주 바뀌고, 입력한 데이터가 학습에 사용될 수 있다는 점도 유의해야 한다.
마무리
VSCode AI TOOLS 플러그인에 커스텀 모델로 오픈라우터 프리모델을 등록하고 플레이그라운에서 여러모델을 비교하며 가장 적합한 모델을 찾을 수 있다.
참고
관련글 목록
- 오케스트레이션이란 무엇인가 — 루프에서 그래프로, 에이전트 협업의 구조 이해하기
- 시맨틱 하이라이트란? — RAG 초보자를 위한 5분 요약
- RAG의 숨은 병목 — 시맨틱 하이라이트(의미 강조)로 검색과 설명의 불일치 해결
- 에이전트는 어떻게 '배우고' 고치는가 — 기억·스킬·피드백 루프의 실제 구조
- Hermes 파이프라인에 OKF 지식 번들 올리기
- Hermes Agent 설치부터 설정까지 - Windows에서 시작하기
- 오픈소스 가드레일 모델과 온프레미스 에이전트 파이프라인 구성
- 구글 OKF(Open Knowledge Format)는 RAG를 대체하나?
- Claude Code로 제안서 작성 파이프라인 만들기
- RAG & AI 에이전트 주간 연구 동향 (2026-07-12 ~ 07-19)
- 나디르 위성영상 캡셔닝을 위한 오픈웨이트 멀티모달 모델 비교
- 위성 영상 처리: 멀티모달 LLM vs 이미지 임베딩 모델
- Caller/Executor 패턴으로 멀티 에이전트 구성하기
- OpenRouter 무료 모델을 API로 사용하기
- PaperBanana - 문장으로 아키텍처 다이어그램 그리기
- AI TOOLS