태그 보관물: CLOVA Studio

무료 LLM API 리스트 (Last updated 2026.09)

어디까지가 진짜 공짜인가

돈 안 쓰고 LLM API를 붙여 보고 싶은 사람용 목록이다. “무료”라는 말에 끝까지 공짜인 것크레딧 다 쓰면 청구되는 것이 섞여 있어서 표를 아예 둘로 갈랐다. 급하면 이것만 — 끝까지 공짜로 굴릴 거면 Google Gemini나 OpenRouter, 임베딩·검색이면 Cohere. Cerebras 와 Together AI 는 무료로 적혀 있어도 아니다.

기준은 뭐 개인 사이드 프로젝트 수준이다.

마지막 확인: 2026-09-07 — 아래 값은 전부 이 날짜에 각 제공사 공식 문서에서 다시 확인했습니다.

1. 항상 무료

한도를 넘으면 요청이 거절될 뿐, 청구서는 오지 않는다. 여기서 시작하면 돈 나갈 일이 없다.

# 제공사 키 받는 곳 무료로 할 수 있는 것
1 Google Gemini AI Studio Flash 계열부터 2.5 Pro까지 무료 티어가 붙는다. 공짜로 만질 수 있는 모델 폭이 가장 넓어 주력으로 삼을 만하다
2 OpenRouter API Keys 무료 모델 20 RPM, 하루 50건. 크레딧 10달러면 하루 1,000건. 키 하나로 여러 모델을 갈아 끼운다
3 Cloudflare Workers AI 시작 가이드 하루 10,000 Neurons, 매일 00:00 UTC 리셋. 일부 모델은 결제수단을 요구
4 Cohere Dashboard 평가용 키로 월 1,000콜. 임베딩 분당 2,000 inputs라 검색·리랭크에 좋다
5 Groq Console 무료 티어에서 그대로 빠른 응답을 쓴다. 한도는 문서가 어긋나 있어 응답 헤더로 확인한다

2. 항상 무료가 아닌 곳 — 부분 유료

영어권 목록이 위 표와 이 표를 한 덩어리로 묶어 놓는 경우가 많다.

# 제공사 무료의 종류 키 받는 곳 알고 가야 할 것
6 Mistral 월 갱신 크레딧 Quickstart Free 플랜에 월 10달러 크레딧. 카드 불필요라고 문서가 명시한다
7 Hugging Face 월 갱신 크레딧 Tokens 무료 계정 월 0.10달러. 리셋되지만 실용 한도는 거의 없다
8 SambaNova 확인 필요 Cloud 공식 문서와 요금제 페이지가 서로 어긋난다
9 Cerebras 1회성 체험 크레딧 Cloud 카드를 등록해야 5달러가 나오고 30일 뒤 소멸. 영구 무료 티어는 없다고 FAQ가 답한다
10 Together AI 무료 아님 API Keys 무료 체험 자체가 없다. 최소 5달러 선불
11 NVIDIA NIM 미검증 build.nvidia.com 사이트가 자바스크립트로만 그려져 무료 조건을 못 읽었다
12 GitHub Models 종료됨 종료 공지 2026년 7월 30일 완전 종료. 지금 호출하면 410이 온다

무료라고 다 같은 무료가 아님.

무료 LLM API의 세 가지 종류를 항상 무료, 월 갱신 크레딧, 1회성 체험 크레딧으로 나눈 판단 흐름도. 각 갈래마다 카드 요구 여부와 소진 후 결과, 대표 제공사가 적혀 있다.

갈림길은 하나다. 소진된 뒤에 청구서가 오는가. 공짜라는 말만 보고 줄을 세우면 맨 오른쪽 갈래가 섞여 들어온다. 영어권 목록 상당수가 Cerebras를 “free tier”로 묶어 놓는 게 딱 그 경우다.

한국에서 막히는 곳은 없었다

한국 가정용 회선(LG U+, 고양시)에서 위 제공사 엔드포인트에 키 없이 요청을 던져 봤다. 지역 차단으로 막힌 곳은 하나도 없었다. 오히려 한국이 유리하다. Gemini 약관은 유럽경제지역·스위스·영국 사용자에게 API를 제공할 때 유료 서비스만 쓰라고 못박아 뒀는데, 한국은 지원 지역 목록에 그냥 들어 있어 이 제약에 안 걸린다.

다만 호출이 도달한다고 가입까지 된다는 뜻은 아니다. 지역 제한은 보통 가입·결제 단계에 걸리는데, 나는 계정이 없어 SMS 인증이나 해외 카드 요구 여부는 확인하지 못했다.

국산 모델은 지금 어디까지 ?

영어권 목록에는 아예 없는 칸이다. 키만 받아서 바로 부를 수 있는 국산 LLM은 두 곳뿐이고, 둘 다 항상 무료가 아니다.

# 제공사 지금 키 받나 무료인가 바로가기 메모
1 CLOVA Studio (HyperCLOVA X) 가능 아니오 (종량제) 콘솔 신청만으로 이용, 토큰 사용량만큼 과금. 한국어와 국내 리전이 강점
2 Upstage Solar 가능 미확인 API Keys solar-mini부터 solar-pro-4까지. 무료 크레딧 유무는 미확인
3 FriendliAI 가능 아니오 Suite 서버리스 7개 전부 종량제, 0원짜리 0개
4 LG EXAONE 불가 오픈웨이트만 모델 받기 한 달 한시 무료가 2026년 1월 28일에 끝났다
5 KT 믿:음 (Mi:dm) 불가 오픈웨이트만 모델 받기 믿:음 K 2.0은 MIT 라이선스라 상업 이용까지 된다
6 SKT A.X 불가 제공 방식 심사로 대상을 선정하는 방식이라 개인 창구가 아니다
7 Kakao Kanana 불가 API 문서 초청제 베타 신청 페이지가 닫혔다

행을 하나도 안 비웠다. “안 된다”도 답이기 때문이다.

국내 요금을 확인하려다 한 번 제대로 막혔다. 네이버 클라우드 가이드 문서는 브라우저로는 멀쩡히 열리는데 curl에는 문을 안 열어 준다. 우회해도 요금표가 자바스크립트로 채워지는 구조라 로그인 없이는 숫자 자체가 없었다. Upstage도 똑같았다. 그래서 “미확인”으로 뒀다.

언제까지 쓸수있을까?

무료 티어는 반드시 죽는다. 다시 올 때 이 다섯 가지만 의심하면 된다.

  1. 무료 티어에 카드 등록이 붙는다 (Cerebras 형)
  2. 무료 체험이 사라지고 최소 선불이 생긴다 (Together AI 형)
  3. 특정 모델만 조용히 유료로 빠진다 (Cloudflare 형)
  4. 서비스가 아예 종료된다 — GitHub Models가 2026년 7월 30일에 이렇게 사라졌다
  5. 한시 무료가 기한이 되면 닫힌다 — K-EXAONE이 2026년 1월 28일에 이렇게 끝났다. “출시 기념 무료”는 무료 티어가 아니다

그래서 판정 기준 하나. 아직 GitHub Models를 무료로 올려둔 목록이라면 최소 한 달 이상 묵은 것이다.

한도가 모자라거나 공짜로 쓰겠다면 선택지는 내 GPU다. 그쪽은 로컬 LLM 환경 구축에 정리해 뒀다. 아직 무료 한도로 버틸 만하다면, 아래에 네 곳만 골라 예제 코드까지 붙여 뒀다.

무료 LLM API 추천

위 표에서 항상 무료 + 한국에서 도달 확인 둘을 다 만족하는 곳만 남기고, 용도별로 하나씩 골랐다.

  • Google Gemini — 범용 대화. 무료 티어가 붙는 모델 폭이 제일 넓어서 공짜로 굴릴 수 있는 범위가 가장 크다. 하나만 고르라면 여기다.
  • OpenRouter — 모델 갈아 끼우기. 키 하나로 여러 회사 모델을 돌려 볼 수 있어서, 어느 모델이 내 작업에 맞는지 아직 모를 때 가장 싸게 헤맬 수 있다.
  • Groq — 응답이 빨라야 할 때. 대화형 UI처럼 첫 토큰이 늦으면 티가 나는 쪽에 붙인다.
  • Cohere — 임베딩·검색. 채팅용으로 고른 게 아니다. RAG 인덱스를 만들어 보려는데 임베딩 비용이 부담될 때 쓴다.

아래 코드는 전부 각 제공사 공식 문서의 현행 예제를 근거로 썼다. 앞에서 밝혔듯 나는 어느 제공사에도 계정이 없어서 직접 실행해 보지는 못했다. 그래서 응답 예시를 지어내지 않고, 참고한 문서를 항목마다 링크로 달아 뒀다.

예제는 전부 파이썬이다. 키는 코드에 적지 말고 터미널에서 이렇게 넣어 둔다.

export GEMINI_API_KEY="여기에_발급받은_키"

다른 곳도 이름만 다르고 방식은 같다. 어떤 이름을 읽는지는 아래 예제마다 코드에 그대로 적혀 있다. 네 예제 모두 골격이 같다 — 키 읽기 → 클라이언트 만들기 → 물어보기 → 출력.

범용 대화라면 Google Gemini

공식 SDK를 쓴다. genai.Client()GEMINI_API_KEY 환경변수를 알아서 읽으므로 인자로 키를 넘길 필요가 없다.

# pip install google-genai
from google import genai

client = genai.Client()  # GEMINI_API_KEY 를 알아서 읽는다
answer = client.interactions.create(
    model="gemini-3.8-flash", input="좀비 프로세스가 왜 생기지?")
print(answer.output_text)

문서의 REST 예제에는 Api-Revision: 2026-05-20 헤더가 붙는다. API 동작을 그 날짜 버전에 고정하는 헤더라, 없으면 늘 최신 동작을 따라가서 구글이 응답 형식을 바꾸는 날 코드가 조용히 깨진다. 다만 파이썬 SDK 에서 이걸 어떻게 넘기는지는 문서에서 확인하지 못했다 — 문서의 파이썬 예제도 genai.Client() 만 쓰고 리비전을 따로 지정하지 않는다. 버전을 못 박아야 하는 상황이라면 REST 로 직접 부르는 쪽이 확실하다.

근거: Gemini API 퀵스타트

여러 모델을 갈아 끼우려면 OpenRouter

여기는 모델 id를 먼저 골라야 한다. 무료 모델 목록은 수시로 바뀌니 지금 살아 있는 것부터 뽑는다. 이 코드는 키가 없어도 돈다.

# pip install requests
import requests

models = requests.get("https://openrouter.ai/api/v1/models").json()["data"]
for model in models:
    if model["id"].endswith(":free"):
        print(model["id"])

거기서 나온 id 하나를 그대로 끼우면 된다. 호출은 OpenAI SDK를 그대로 쓰고 base_url 만 갈아 끼운다.

# pip install openai
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key=os.environ["OPENROUTER_API_KEY"])
answer = client.chat.completions.create(
    model="google/gemma-4-31b-it:free",
    messages=[{"role": "user", "content": "한 줄로 자기소개 해줘"}])
print(answer.choices[0].message.content)

근거: OpenRouter 퀵스타트

속도가 필요하면 Groq

엔드포인트 경로부터 OpenAI 호환이라 전용 SDK든 OpenAI SDK든 둘 다 붙는다. 문서 예제대로 전용 SDK를 썼다.

# pip install groq
import os
from groq import Groq

client = Groq(api_key=os.environ["GROQ_API_KEY"])
answer = client.chat.completions.create(
    model="llama-3.3-70b-versatile",
    messages=[{"role": "user", "content": "빠른 모델이 왜 중요한지 짧게"}])
print(answer.choices[0].message.content)

내 한도는 응답 헤더x-ratelimit- 로 시작해서 실려 온다. 문서의 한도 표보다 이쪽이 정확하다.

근거: Groq 퀵스타트

임베딩·검색이면 Cohere

문장을 벡터로 바꿔 준다. 검색·중복 제거·RAG 인덱스를 붙여 볼 때 쓴다.

# pip install cohere
import os
import cohere

client = cohere.ClientV2(api_key=os.environ["CO_API_KEY"])
answer = client.embed(
    texts=["좀비 프로세스가 왜 생기지?"], model="embed-v4.0",
    input_type="search_document", embedding_types=["float"])
print(answer)

근거: Cohere Embed 레퍼런스

실제로 제일 쓸모 있는 건 base_url 하나

고른 네 곳이 전부 OpenAI 호환 엔드포인트를 준다. 그러니까 파이썬 코드는 하나만 짜 두고 base_url 과 모델명만 갈아 끼우면 제공사를 갈아탈 수 있다. 한 곳이 무료 티어를 닫아도 두 줄만 고치면 된다는 뜻이다.

제공사 base_url 예제 모델 환경변수
Google Gemini https://generativelanguage.googleapis.com/v1beta/openai/ gemini-3.8-flash GEMINI_API_KEY
Groq https://api.groq.com/openai/v1 llama-3.3-70b-versatile GROQ_API_KEY
OpenRouter https://openrouter.ai/api/v1 위 목록에서 고른 :free 모델 OPENROUTER_API_KEY
Cohere https://api.cohere.ai/compatibility/v1 command-a-plus-05-2026 CO_API_KEY
# pip install openai
import os
from openai import OpenAI

# base_url 과 model 을 위 표의 다른 줄로 바꾸면 제공사가 바뀐다
client = OpenAI(
    base_url="https://generativelanguage.googleapis.com/v1beta/openai/",
                api_key=os.environ["GEMINI_API_KEY"])
answer = client.chat.completions.create(
    model="gemini-3.8-flash",
    messages=[{"role": "user", "content": "한 줄로 인사해줘"}])
print(answer.choices[0].message.content)

Cohere 는 자체 스키마(/v2/embed)와 호환 계층 둘 다 있다. 호환 쪽은 채팅·임베딩·오디오 전사를 받는다. 그런데도 앞의 임베딩 예제를 자체 스키마로 쓴 이유가 있다. 문서가 호환 계층에서 못 쓰는 것을 따로 열거해 두기 때문이다connectors·documents·citation_options 같은 Cohere 고유 파라미터는 호환 쪽에 없다. 그러니 갈아 끼우기용으로는 호환 base_url 을, 고유 기능이 필요하면 자체 API 를 쓰면 된다.

근거: Gemini의 OpenAI 호환 엔드포인트 · Cohere 호환 API

목록 만들다 나한테 되물었던 것들

무료라고 적혀 있는데 왜 돈이 나가지?

그건 항상 무료가 아니라 1회성 체험 크레딧이기 때문입니다. 크레딧이 소진되거나 기한이 지나면 그때부터는 그냥 유료 API입니다. 시작 단계에서 결제수단부터 요구한다면 그게 구분 신호이니, 위 두 번째 표를 먼저 확인하세요.

국산 모델은 왜 무료로 못 쓰지?

넷 다 이유가 다릅니다. 위 표의 메모 열에 하나씩 적어 뒀는데, 공통점은 키만 받아서 바로 부를 창구가 없다는 겁니다. 가중치를 받아 로컬에서 돌리는 쪽이 현실적입니다.

참고 자료