짧게 답하면, Gemini Developer API에는 무료 티어에서 표준 입력과 출력이 무료로 표시된 모델이 여러 개 있다. 범용 개발은 gemini-3.7-flash, gemini-3.6-flash, gemini-3.5-flash, gemini-2.5-flash 같은 Flash 계열부터 검토할 수 있고, 더 복잡한 작업은 gemini-2.5-pro, 가벼운 대량 처리는 Flash Lite 계열, 임베딩은 gemini-embedding-001이 후보가 된다.
하지만 가격표의 “무료”와 내 프로젝트에서 지금 호출 가능한 무료 할당량은 같은 말이 아니다. 모델별 도구와 처리 모드에는 별도 예외가 있을 수 있고, 실제 RPM·TPM·RPD는 프로젝트와 시점에 따라 달라진다. 따라서 올바른 선택은 다음 두 가지를 모두 확인하는 것이다.
- 공식 가격표에서 정확한 endpoint의 무료 입력·출력 여부를 확인한다.
- 같은 프로젝트를 선택한 Google AI Studio에서 현재 적용 중인 한도를 확인한다.
이 글의 목록은 2026년 8월 31일에 확인한 상태다. 복사해 두고 오래 쓰는 고정 목록이 아니라, 오늘의 선택을 빠르게 좁히기 위한 출발점으로 사용해야 한다.
먼저 고를 수 있는 무료 모델 후보
아래 표는 무료 티어의 표준 입력·출력이 무료로 표시된 endpoint를 작업별로 좁힌 것이다. “추천 후보”는 무조건적인 우선순위가 아니라, 각 작업에서 먼저 가격·수명 주기·프로젝트 활성 상태를 대조할 대상이다.
| 하려는 일 | 먼저 확인할 endpoint | 선택할 때 함께 볼 것 |
|---|---|---|
| 일반적인 텍스트·멀티모달 앱 프로토타입 | gemini-3.7-flash, gemini-3.6-flash, gemini-3.5-flash, gemini-2.5-flash | stable·preview 등 수명 주기, 필요한 도구 지원, 실제 TPM |
| 더 복잡한 추론이 필요한 테스트 | gemini-2.5-pro | 지연 시간과 프로젝트별 요청 한도 |
| 비용과 처리량을 우선한 가벼운 작업 | gemini-3.5-flash-lite, gemini-3.1-flash-lite, gemini-2.5-flash-lite | 품질 기준을 통과하는지 실제 입력으로 비교 |
| 실시간 음성·번역·전사 실험 | gemini-3.5-live-translate-preview, gemini-3.5-transcribe-live, gemini-3.5-transcribe, gemini-3.1-flash-live-preview | preview 변경 가능성, 세션·기능별 별도 제한 |
| 음성 합성 실험 | gemini-3.1-flash-tts-preview, gemini-2.5-flash-preview-tts | 표준 토큰 외 기능 과금과 수명 주기 |
| 검색·RAG용 벡터 생성 | gemini-embedding-001 | 입력 데이터 정책과 호출량 |
| 로보틱스 연구·프로토타입 | gemini-robotics-er-2-preview, gemini-robotics-er-2-streaming-preview, gemini-robotics-er-1.6-preview | preview 안정성, 계정별 제공 여부 |
그 밖에 gemini-3-flash-preview, gemini-2.5-flash-native-audio-preview-12-2025도 같은 날짜의 가격표에서 표준 입력·출력이 무료로 표시됐다. 이름에 preview가 붙은 endpoint는 더 빨리 변경되거나 종료될 수 있고 한도가 더 엄격할 수 있으므로, 장기 운영의 기본값으로 정하기 전에 모델 수명 주기 설명을 반드시 확인하자.

전체 무료 후보 목록
2026년 8월 31일 기준으로 표준 입력과 출력이 무료로 표시된 endpoint는 다음과 같다.
gemini-3.7-flashgemini-3.6-flashgemini-3.5-flashgemini-3.5-live-translate-previewgemini-3.5-transcribe-livegemini-3.5-transcribegemini-3.5-flash-litegemini-3.1-flash-litegemini-3.1-flash-live-previewgemini-3.1-flash-tts-previewgemini-3-flash-previewgemini-2.5-progemini-2.5-flashgemini-2.5-flash-litegemini-2.5-flash-native-audio-preview-12-2025gemini-2.5-flash-preview-ttsgemini-embedding-001gemini-robotics-er-2-previewgemini-robotics-er-2-streaming-previewgemini-robotics-er-1.6-preview
가격표에는 Gemini Embedding 2도 무료 제공 항목으로 나타났지만, 확인 당시 가격표와 모델 카탈로그에서 호출용 endpoint 문자열을 일관되게 대조할 수 없었다. 따라서 추측한 모델명을 코드에 넣지 말고, 현재 모델 목록 또는 Models API에서 실제 식별자를 다시 확인해야 한다. gemini-embedding-001은 별도로 무료 입력이 문서화된 endpoint다.
무료가 아닌 모델도 먼저 걸러내자
같은 날짜의 Standard 가격표에서 무료 티어 입력·출력이 제공되지 않는 것으로 표시된 endpoint도 있다.
gemini-omni-1.1-flashgemini-omni-flash-previewgemini-3.1-pro-previewgemini-3.1-pro-preview-customtoolsgemini-3.1-flash-imagegemini-3.1-flash-lite-imagegemini-3-pro-imagegemini-2.5-flash-imagegemini-2.5-pro-preview-ttsgemini-2.5-computer-use-preview-10-2025
이 중 일부가 AI Studio 화면에서 시험 가능하더라도, 그것만으로 Gemini API의 무료 할당량이 생겼다고 판단하면 안 된다. 특히 이미지, 컴퓨터 사용, TTS처럼 별도 처리 방식이 있는 기능은 “기본 토큰이 무료인가”와 “원하는 기능 전체가 무료인가”를 나눠 확인해야 한다.
5분 안에 내 프로젝트의 실제 무료 한도 확인하기
정확한 RPM, TPM, RPD 숫자를 이 글에 고정해서 적지 않은 데는 이유가 있다. Google은 한도가 프로젝트별로 적용되며, 문서에 표시된 한도도 보장된 용량이 아니고 실제 가용 용량이 달라질 수 있다고 안내한다. 정답은 독자의 프로젝트 화면에 있다.
1. 호출에 사용할 프로젝트를 먼저 고른다
AI Studio에서 API 키를 만든 프로젝트와 한도를 확인하는 프로젝트가 같은지 확인한다. 새 Gemini API 계정은 선택된 모델에 제한적으로 접근하는 Free Tier에서 시작하지만, 실제 사용 tier는 선택한 프로젝트와 결제 상태에 의해 결정된다.
API 키를 여러 개 만들어도 같은 프로젝트 안에서는 별도 할당량 풀이 생기지 않는다. 키 분리는 권한 관리에는 도움이 될 수 있지만, 무료 한도를 늘리는 방법은 아니다.
2. endpoint별 활성 한도를 읽는다
공식 비율 제한 안내를 열고 AI Studio의 Rate Limits 화면으로 이동한다. 사용할 endpoint를 선택한 뒤 최소한 다음 값을 기록한다.
- RPM (requests per minute): 1분 동안 허용되는 요청 수
- TPM (input tokens per minute): 1분 동안 허용되는 입력 토큰 수
- RPD (requests per day): 하루 동안 허용되는 요청 수
일부 모델에는 TPD, 이미지/분 같은 추가 차원이 있을 수 있다. 여러 제한 중 하나라도 먼저 닿으면 요청이 제한될 수 있으므로, RPM 하나만 보고 처리량을 계산하지 않는다. 일일 요청 할당량은 태평양 시간 자정에 초기화되며, 한국 시각의 고정된 자정과 일치하지 않는다.
3. 예상 트래픽을 한도와 같은 단위로 바꾼다
예를 들어 사용자가 분당 20번 요청하고, 요청당 평균 입력이 3,000토큰이라면 필요한 최소 입력 처리량은 분당 약 60,000토큰이다. 여기에 재시도, 동시 사용자 집중, 긴 문서 입력을 더해 여유를 둔다. 이 숫자가 화면의 RPM 또는 TPM을 넘는다면 무료 모델명 자체가 맞더라도 해당 운영 계획은 맞지 않는다.
4. 작은 부하 테스트로 실패 방식을 확인한다
개발용 데이터로 짧은 요청부터 시작해 정상 응답, 지연 시간, 429 발생 시점과 재시도 동작을 관찰한다. preview endpoint라면 같은 테스트를 배포 전에도 다시 실행한다. 지정된 한도는 보장 용량이 아니므로, 운영 코드는 지수 백오프와 요청 큐를 갖추는 편이 안전하다.

가장 짧은 호출로 endpoint를 검증하는 방법
아래 예시는 gemini-2.5-flash가 현재 프로젝트에서 호출되는지 확인하는 최소 요청이다. API 키는 소스 코드에 직접 적거나 Git에 커밋하지 말고 환경 변수로 전달한다.
bashcurl "https://generativelanguage.googleapis.com/v1beta/models/gemini-2.5-flash:generateContent" \ -H "x-goog-api-key: ${GEMINI_API_KEY}" \ -H "Content-Type: application/json" \ -X POST \ -d '{ "contents": [{ "parts": [{"text": "응답은 확인 완료라는 네 글자로만 작성해 주세요."}] }] }'
성공 응답은 endpoint 접근 가능성을 보여 주지만, 지속 가능한 무료 처리량까지 증명하지는 않는다. 반대로 모델을 찾을 수 없거나 권한 오류가 난다면 모델명, 프로젝트, 지역, API 활성화 상태를 먼저 대조한다. 429라면 응답 헤더와 오류 본문을 보존하고 AI Studio의 현재 한도와 비교한다.
한국에서 무료 티어를 쓸 때 놓치기 쉬운 경계
한국은 공식 제공 지역 목록에 포함되어 있고 이용자는 만 18세 이상이어야 한다. 다만 국가가 지원된다는 사실은 모든 모델과 무료 할당량이 모든 계정에 동일하게 활성화된다는 보장이 아니다. 회사 계정, 조직 정책, 프로젝트 결제 상태와 rollout 상태에 따라 실제 화면이 달라질 수 있다.
더 중요한 차이는 데이터 이용 조건이다. Gemini API 추가 약관상 Unpaid Services에 제출한 콘텐츠와 생성 응답은 Google 제품 및 머신러닝 기술의 제공·개선·개발에 사용될 수 있고, 사람이 입력과 출력을 검토·주석 처리할 수 있다. Google은 무료 서비스에 민감 정보, 기밀 정보, 개인 정보를 제출하지 말라고 안내한다.
반면 Paid Services의 프롬프트와 응답은 제품 개선에 사용하지 않는다고 명시되어 있다. 유럽경제지역(EEA), 스위스, 영국에서는 조건을 충족하는 무료 접근에도 Paid Services의 데이터 이용 처리가 적용될 수 있지만, 이는 한국에서 무료 티어를 사용하는 경우의 기본 전제로 삼을 수 없다. 개인정보나 고객 데이터가 포함되는 서비스라면 현재 추가 약관을 직접 검토하고, 필요하면 유료 서비스 또는 별도의 데이터 처리 경로를 선택해야 한다. 이는 법률 자문이 아니다.
무료 티어에 머물지, 유료로 갈지 결정하는 기준
무료 티어가 잘 맞는 경우는 명확하다.
- 개인 학습, 기능 검증, 프롬프트 실험처럼 트래픽이 작고 중단을 감수할 수 있다.
- 실제 프로젝트 한도가 예상 요청량을 충분히 덮는다.
- 입력에 민감 정보나 기밀 정보를 넣지 않는다.
- preview 변경과 모델 교체를 감당할 수 있다.
다음 조건 중 하나라도 해당하면 결제 활성화 또는 다른 운영 방식을 검토할 시점이다.
- 사용자 트래픽 때문에 RPM·TPM·RPD 초과가 반복된다.
- 예측 가능한 용량과 더 높은 안정성이 필요하다.
- 데이터 이용 조건상 Unpaid Services를 사용할 수 없다.
- 필요한 이미지·컴퓨터 사용·특정 TTS 기능이 무료 티어에 없다.
- preview endpoint의 변경이나 종료 위험을 제품이 감당할 수 없다.
유료 전환 전에 결제 안내와 가격표를 다시 읽고, 개발·스테이징·운영 프로젝트를 구분해 예산 알림과 사용량 관찰을 설정하자. 무료에서 유료로 바꾸는 행위는 단순한 한도 확장이 아니라 데이터 처리와 운영 책임까지 달라지는 결정이다.
자주 묻는 질문
Gemini API 키를 여러 개 만들면 무료 한도가 늘어나나요?
아니다. 한도는 API 키가 아니라 프로젝트 단위로 적용된다. 같은 프로젝트의 키를 여러 개 만들어도 무료 할당량이 분리되지 않는다.
가격표에 무료라고 나오면 바로 프로덕션에 써도 되나요?
무료 표시는 표준 입력·출력 과금 상태를 알려 줄 뿐이다. 내 프로젝트의 endpoint 활성 여부, 실제 한도, 필요한 도구의 별도 과금, 모델 수명 주기, 데이터 이용 조건을 확인한 뒤 결정해야 한다.
Gemini 3.1 Pro Preview는 무료 티어인가요?
2026년 8월 31일에 확인한 Standard 가격표에서는 gemini-3.1-pro-preview와 gemini-3.1-pro-preview-customtools의 무료 티어 입력·출력이 제공되지 않는 것으로 표시됐다. 상태는 바뀔 수 있으므로 실제 사용 직전에 가격표를 다시 확인하자.
무료 한도는 한국 시간 자정에 초기화되나요?
아니다. 공식 문서는 일일 요청 할당량이 태평양 시간 자정에 초기화된다고 설명한다. 서머타임에 따라 한국 시각 환산이 달라질 수 있으므로 운영 대시보드에서는 지역 시간을 명시하는 편이 안전하다.
가장 안전한 기본 선택은 무엇인가요?
모든 프로젝트에 통하는 단일 정답은 없다. 범용 프로토타입이라면 무료로 표시된 Flash 후보 중에서 현재 가격표와 모델 카탈로그에 함께 존재하고, AI Studio에서 내 프로젝트 한도가 확인되는 특정 endpoint를 고른다. 프로덕션에서는 가능하면 stable 수명 주기의 구체적인 모델명을 사용하고, 품질·지연 시간·한도를 실제 데이터로 검증한다.
지금 할 일: 모델명 하나가 아니라 확인 기록 하나를 남긴다
먼저 원하는 작업에 맞는 후보를 하나 고른다. 그다음 가격표, 모델 카탈로그, AI Studio Rate Limits를 같은 날 대조해 다음 다섯 항목을 기록한다.
- 정확한 endpoint 문자열
- 무료 입력·출력 여부와 기능별 예외
- stable·preview 등 수명 주기
- 내 프로젝트의 RPM·TPM·RPD와 추가 제한
- 데이터 이용 조건과 민감 정보 제외 여부
이 기록이 모두 맞으면 작은 테스트를 실행한다. 하나라도 확인되지 않으면 “무료 모델”이라는 이름만 믿고 배포하지 않는다. Gemini API 무료 티어는 충분히 좋은 실험 출발점이지만, 실제 선택의 기준은 목록의 길이가 아니라 내 워크로드가 현재 프로젝트의 한도와 조건 안에서 끝까지 동작하는가다.



