세상의 모든 정보
EN
AI · 6분 읽기

구글 제미나이 신모델 3종 공개, 3.5 Pro는 왜 빠졌나

구글이 7월 21일 Gemini 3.6 Flash·3.5 Flash-Lite·Flash Cyber 3종을 공개했다. 최상위 3.5 Pro는 파트너 테스트 중이라 제외됐고, 이번 라인은 속도와 비용에 초점을 맞췄다.

스마트폰에서 구글을 사용하는 모습
사진은 이해를 돕기 위한 이미지입니다.
목차
  1. 이번에 나온 3종은 뭐가 다른가?
  2. 언제, 어디서 쓸 수 있나?
  3. 왜 정작 3.5 Pro는 빠졌나?
  4. GPT·클로드 사이에서 지금 위치는?

구글이 7월 21일 제미나이(Gemini) 신모델 3종을 한꺼번에 내놨다. Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, 그리고 보안 특화 Gemini 3.5 Flash Cyber다. 셋 다 공통점이 하나 있다. ‘싸고 빠른’ 라인이라는 것. 개발자와 기업이 기다린 최상위 플래그십 Gemini 3.5 Pro는 이번에 빠졌다. 구글은 출시 시점을 못 박지 않았다 (TechCrunch).

이번에 나온 3종은 뭐가 다른가?

가장 중심은 Gemini 3.6 Flash다. 구글이 “워크호스(workhorse)“라고 부르는 주력 실무용 모델이다. 핵심 개선은 효율이다. 같은 답을 내는 데 출력 토큰을 3.5 Flash보다 17% 덜 쓴다고 밝혔다. 값도 내렸다. 출력 가격이 100만 토큰당 9.00달러에서 7.50달러로 떨어졌고, 입력은 1.50달러로 유지됐다 (9to5Google). 벤치마크로는 코드 생성(DeepSWE) 37%→49%, 지식 업무(GDPval-AA) 1349→1421, 컴퓨터 조작(OSWorld-Verified) 78.4%→83%로 올랐고, 지식 컷오프는 2026년 3월까지 당겨졌다 (9to5Google).

Gemini 3.5 Flash-Lite는 더 아래, 대량·고속 처리용이다. 문서 처리처럼 양이 많고 판단은 가벼운 작업을 노린다. 가격이 결정적이다. 100만 토큰당 입력 0.30달러, 출력 2.50달러. 구글은 “동급에서 가장 비용 효율적”이라며, 코딩 벤치마크에서는 구형 3 Flash를 앞선다고 했다 (9to5Google).

세 번째 Gemini 3.5 Flash Cyber는 성격이 다르다. 소프트웨어 취약점을 찾아 고치도록 튜닝한 보안 전용 모델이고, 일반 공개가 아니다. 정부와 신뢰할 수 있는 파트너에게만 제한적 파일럿으로 연다 (TechCrunch).

모델 성격 가격(100만 토큰, 입력/출력) 접근
Gemini 3.6 Flash 주력 실무(워크호스) $1.50 / $7.50 앱·검색·API
Gemini 3.5 Flash-Lite 대량·고속 처리 $0.30 / $2.50 앱·검색·API
Gemini 3.5 Flash Cyber 보안 특화 미공개 정부·파트너 폐쇄 파일럿

언제, 어디서 쓸 수 있나?

Gemini 3.6 Flash와 3.5 Flash-Lite는 제미나이 앱과 구글 검색에 순차 적용되고, 개발자는 Google AI Studio와 Gemini API로 바로 붙일 수 있다 (Google DeepMind, 9to5Google 종합). Flash Cyber는 앞서 말한 대로 폐쇄 파일럿이라 일반 사용자·개발자는 당장 접근할 수 없다.

용도로 나누면 이렇게 읽으면 된다. 챗봇·요약·코드 보조 같은 일상 실무는 3.6 Flash, 수만 건 문서 파싱·분류처럼 단가가 곧 총비용이 되는 대량 작업은 Flash-Lite. 최고난도 추론이 필요한 곳은 아직 이 3종이 답이 아니다. 그건 3.5 Pro의 자리인데, 그 자리가 지금 비어 있다.

왜 정작 3.5 Pro는 빠졌나?

구글의 플래그십 Pro는 2026년 2월 이후 갱신이 없었다. DeepMind의 로건 킬패트릭(Logan Kilpatrick)은 “3.5 Pro를 파트너들과 테스트 중이며 곧 안착(land soon)하길 바란다”고 했다 (TechCrunch). 블룸버그는 구글이 내부 성능 목표를 맞추지 못해 3.5 Pro 출시가 지연되고 있다고 보도했다 (TechCrunch 인용). 동시에 구글은 “가장 야심 찬 사전학습(pre-training)“인 Gemini 4 훈련을 이미 시작했다고 흘렸다 (9to5Google). 정상급 카드를 미루면서 차차기 세대를 먼저 예고한 셈이다.

GPT·클로드 사이에서 지금 위치는?

경쟁사들의 최상위 라인은 이미 굴러가고 있다. OpenAI는 GPT-5.5/5.6, 앤트로픽은 Claude Opus 4.8·Claude Sonnet 5, 그리고 Fable 5까지 나온 상태다 (TechCrunch). (관련: 중국 오픈 LLM vs 미국 클라우드 LLM) 이 판에서 구글이 이번에 던진 건 ’더 똑똑한 최고급’이 아니라 ’더 싸고 빠른 중하위 라인’이다. 대량 트래픽을 저단가로 처리하는 영역에서 점유율을 지키겠다는 신호로 읽힌다.

운영자 시점에서 한 줄. 실서비스 원가를 깎아야 하는 팀이라면 Flash-Lite의 0.30/2.50달러 단가는 지금 당장 계산기를 다시 두드릴 이유가 된다. 반대 관점도 있다. 최상위 추론 성능에서 정면승부를 원했던 개발자에게 이번 발표는 ’알맹이(3.5 Pro)가 빠진 발표’이고, 곧 나온다는 말만으론 로드맵 불안을 지우기 어렵다. 다만 여기서 서술한 수치·날짜는 발표·1차 보도 기준이며, 실제 체감 성능과 지역별 롤아웃 속도는 확인되지 않았다.

자주 묻는 질문

Gemini 3.6 Flash와 3.5 Flash-Lite는 어디서 쓸 수 있나?
제미나이 앱과 구글 검색에 순차 적용되고, 개발자는 Google AI Studio와 Gemini API로 접근할 수 있다. Flash Cyber는 정부·신뢰 파트너 대상 폐쇄 파일럿이라 일반 사용은 불가하다.
왜 최상위 3.5 Pro는 이번에 안 나왔나?
구글 DeepMind는 3.5 Pro를 파트너들과 테스트 중이며 곧 내놓기를 바란다고 밝혔다. 블룸버그는 내부 성능 목표를 맞추지 못해 지연됐다고 보도했다. 정확한 출시일은 확정되지 않았다.
세 모델 중 뭘 골라야 하나?
일상 실무·코드 보조·요약은 3.6 Flash, 수만 건 문서 파싱 같은 대량·저단가 작업은 Flash-Lite가 맞다. 최고난도 추론은 아직 3종의 자리가 아니라 3.5 Pro를 기다려야 한다.
GPT나 클로드와 비교하면 어떤 위치인가?
경쟁사는 GPT-5.5/5.6, Claude Opus 4.8·Sonnet 5 등 최상위 라인을 이미 운영 중이다. 이번 구글 발표는 최고급이 아니라 '싸고 빠른' 중하위 라인 강화에 가깝다.