2026년 7월 21일 Google은 Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite를 공식 문서에 공개했다. 이 글은 Google 릴리스 노트와 최신 모델 가이드를 기준으로 두 모델의 용도와 API 공개 가격을 자동화 운영 관점에서 정리한다. 아래 가격은 API 기준이며 실제 비용은 캐시, 도구 호출, 재시도, 지역과 계약 조건에 따라 달라질 수 있다.

무엇이 바뀌었나
Google Gemini API 릴리스 노트 기준으로 Gemini 3.6 Flash는 gemini-3.6-flash, Gemini 3.5 Flash-Lite는 gemini-3.5-flash-lite라는 모델 ID로 GA 상태가 됐다. GA 표기는 정식 제공 상태를 뜻하지만, 실제 이용 가능 범위와 운영 조건은 AI Studio·Vertex AI·계약 환경별로 다시 확인해야 한다.
Google은 Gemini 3.6 Flash를 복잡한 에이전트 작업, 코드 생성, 멀티모달 처리에 맞춘 모델로 소개한다. Gemini 3.5 Flash-Lite는 대량 문서 처리, 분류, 추출처럼 처리량과 비용이 중요한 작업을 위한 저비용 모델로 설명한다.
왜 중요한가
AI 자동화 비용은 모델 가격표만으로 결정되지 않는다. 같은 작업도 입력·출력 토큰, 도구 호출, 재시도 횟수, 캐시 사용에 따라 비용이 달라진다. 두 모델을 비교할 때는 공개 단가와 함께 실제 완료율과 재시도 횟수를 확인해야 한다.
Gemini 3.6 Flash
- 주요 용도: 코딩, 멀티모달, 다단계 에이전트
- 기본 사고 수준: medium
- API 공개 가격: 입력 100만 토큰 1.50달러, 출력 7.50달러
- 확인할 점: 단순 작업에서는 탐색 단계와 출력량을 실제 업무 기준으로 점검
Gemini 3.5 Flash-Lite
- 주요 용도: 대량 문서 추출, 분류, 반복 자동화
- 기본 사고 수준: minimal
- API 공개 가격: 입력 100만 토큰 0.30달러, 출력 2.50달러
- 확인할 점: 복잡한 계획이 필요한 작업은 지원 범위와 사고 수준을 별도 점검
같은 업무 10건을 비교할 때는 모델별 입력 토큰, 출력 토큰, 도구 호출 수, 재시도 횟수, 완료 건수를 함께 기록해야 한다. 실제 측정값이 없다면 어느 모델이 더 싸다고 단정할 수 없다.

누구에게 유용한가
개발자에게는 모델 ID와 API 호환성 점검이 먼저다. SDK와 모델 버전에 따라 지원 범위가 다를 수 있으므로, 사용 중인 API 버전의 공식 참조에서 sampling parameter와 prefilled response 지원 범위를 먼저 확인해야 한다. 필요한 출력 형식은 system instruction이나 structured output으로 관리할 수 있다.
1인 사업자나 콘텐츠 운영자에게는 “무슨 모델이 더 똑똑한가”보다 “어떤 자동화에 어떤 모델을 붙일 것인가”가 더 현실적인 질문이다. 예를 들어 긴 자료를 요약하고 표로 정리하는 반복 작업은 Flash-Lite 후보가 될 수 있고, 웹 화면을 읽고 판단한 뒤 여러 단계를 수행하는 에이전트 작업은 3.6 Flash가 더 맞을 수 있다.
실제로 무엇을 해볼 수 있나
- 기존 Gemini API 호출에서 모델 ID를 쓰는 위치를 확인한다.
- 자동화 작업을 복잡한 에이전트형과 대량 반복형으로 나눈다.
- temperature, top_p, top_k를 사용하는 코드가 있는지 검색한다.
- 한 작업당 입력 토큰, 출력 토큰, 재시도 횟수를 따로 기록한다.
- 단순 벤치마크보다 실제 업무 10건을 같은 기준으로 비교한다.
예를 들어 블로그 운영 자동화라면 뉴스 조사, 공식 출처 확인, 초안 작성, 이미지 삽입, 시트 업데이트가 한 흐름 안에 있다. 이 전체를 하나의 고성능 모델로만 처리하기보다, 자료 추출은 저비용 모델, 판단과 편집은 상위 Flash 모델로 나누는 식의 설계가 가능하다.

한계와 주의점
첫째, 이번 발표는 Google 공식 문서 기준으로 확인한 내용이며 국내 서비스별 적용 여부는 별도 확인이 필요하다. Gemini 앱, AI Studio, Vertex AI, 서드파티 도구가 같은 날짜에 같은 방식으로 반영된다고 단정하면 안 된다.
둘째, 가격은 API 기준이다. 기업 계약, 지역, 플랫폼, 캐시·검색 도구 사용 여부에 따라 실제 비용은 달라질 수 있다. AI타임스 기사는 이번 업데이트를 비용과 에이전트 전략의 변화로 해석하지만, 최종 판단은 Google 공식 문서와 사용 중인 콘솔의 현재 가격·지원 범위를 기준으로 해야 한다.
핵심 요약
Gemini 3.6 Flash는 복잡한 에이전트·코딩·멀티모달 작업을 위한 후보이고, Gemini 3.5 Flash-Lite는 대량 반복 처리에서 비용을 낮추기 위한 후보이다. 선택 전에는 공개 단가만 비교하지 말고 같은 업무 10건의 토큰, 재시도, 완료율을 함께 측정하는 편이 안전하다.
FAQ
Gemini 3.6 Flash는 언제 발표됐나?
Google Gemini API 릴리스 노트 기준 공식 업데이트 날짜는 2026년 7월 21일이다. 이 글의 확인일은 2026년 7월 22일이다.
Gemini 3.5 Flash-Lite는 무엇에 맞나?
대량 문서 추출, 분류, 구조화 JSON 생성처럼 빠르게 많이 처리해야 하는 작업에 맞다. 복잡한 계획이 필요한 작업은 thinking 수준 조정이 필요할 수 있다.
기존 Gemini API 코드를 바로 바꿔도 되나?
바로 교체하기보다 사용 중인 SDK·API 버전에서 sampling parameter, prefilled response, 모델 ID 지원 범위를 확인하고 비용 로그를 남기는 편이 안전하다. 작은 테스트 워크로드에서 비교한 뒤 운영에 반영하는 것이 좋다.
국내 사용자에게 직접 영향이 있나?
일반 사용자의 Gemini 앱보다 개발자와 자동화 운영자에게 먼저 영향이 크다. 국내 서비스에서 실제 사용 가능 여부와 요금 반영은 각 플랫폼 공지나 콘솔에서 다시 확인해야 한다.
출처
- Google AI for Developers - Gemini API Release notes
- Google AI for Developers - Using the latest Gemini models
- AI타임스 - 구글, 제미나이 3.6 플래시 공개
Google 및 Gemini는 Google LLC의 상표입니다. 이 글은 Google의 후원·제휴·승인을 받은 글이 아닙니다.
'정보 > 아무튼 AI🤖' 카테고리의 다른 글
| Anthropic 희귀질환 AI 연구 지원: 6개월 최대 5만 달러 Claude 크레딧 (0) | 2026.07.22 |
|---|---|
| 2026년 7월 Claude for Teachers 발표, 교사용 AI가 달라지는 점 (1) | 2026.07.21 |
| AI 비용 성과 측정법, 토큰 가격보다 중요한 4가지 기준 (1) | 2026.07.20 |
| 2026년 7월 GPT-5.6 발표, AI 업무 도구가 바뀌는 지점 (0) | 2026.07.20 |
| 2026년 7월 LiteRT.js 발표, 브라우저 안에서 AI를 돌린다는 뜻 (0) | 2026.07.16 |




