제미나이 3.6 플래시 출시가 보여준 구글 AI 전략 변화

Photo of author

By 2Pro

핵심 브리핑

  • Q. 제미나이 3.6 플래시는 무엇이 달라졌나? → 출력 토큰을 전작보다 최대 17% 줄여, 같은 일을 더 적은 비용으로 처리합니다.
  • Q. 구글은 왜 플래시 계열 모델을 먼저 강화했나? → AI 에이전트를 오래 돌릴수록 쌓이는 비용·대기 시간이 실사용의 관건이기 때문입니다.
  • 핵심 결론: 구글은 제미나이의 실사용 효율을 강화하는 동시에, 지연된 프로 모델과 차세대 제미나이 4로 최고 성능 경쟁을 준비하고 있다.

구글이 새 제미나이 경량 모델 3종을 내놓았지만, 시장의 시선은 함께 나오지 않은 최상위 모델에 더 오래 머뭅니다. 3.6 플래시는 출력 토큰 사용량을 전작보다 최대 17% 줄였고, 3.5 플래시-라이트는 초당 350개 출력 토큰을 내세웠습니다. 이번 발표는 최고 성능을 한 번에 끌어올리는 승부라기보다, AI 에이전트를 오래 돌릴 때 쌓이는 비용과 대기 시간을 줄이는 전략에 가깝습니다.

제미나이 관련 이미지 1

※ AI로 생성한 이미지입니다

제미나이 3종은 성능 경쟁보다 운영 비용을 겨냥합니다

보도 자료들은 같은 발표를 서로 다르게 읽습니다. 한쪽은 코딩, 지식 업무, 이미지·음성 처리까지 넓힌 3.6 플래시의 개선을 중심에 놓습니다. 다른 쪽은 3.5 프로가 다시 빠졌다는 점을 더 크게 봅니다. 둘 다 사실입니다. 다만 전자는 현장에서 바로 쓸 도구를, 후자는 구글의 최상위 경쟁력을 기준으로 평가합니다.

3.6 플래시는 입력 토큰 100만개당 1.5달러, 출력 토큰 100만개당 7.5달러로 가격을 낮췄습니다. 에이전트가 검색하고, 문서를 읽고, 도구를 여러 번 호출하는 작업에서는 답변 한 번의 품질만큼 총 토큰량이 중요합니다. 수도꼭지를 조금만 덜 열어도 하루 종일 물을 쓰면 차이가 커지는 것과 같습니다. 이 수치는 대형 모델을 대체한다는 선언보다, 반복 업무의 부담을 낮추겠다는 신호로 읽힙니다.

제미나이 3.5 플래시-라이트는 더 분명합니다. 초당 350개 출력 토큰은 빠른 응답이 필요한 에이전틱 검색과 대용량 문서 처리처럼, 기다림 자체가 비용이 되는 업무를 겨냥합니다. 구글 검색에도 순차 적용될 예정이라는 설명은 모델 성능을 연구실 수치에만 두지 않겠다는 뜻으로 보입니다.

속도와 보안의 확대, 공개 범위는 다르게 갈립니다

제미나이 관련 이미지 2

※ AI로 생성한 이미지입니다

두 번째 대조는 접근성입니다. 3.6 플래시와 3.5 플래시-라이트는 구글 AI 스튜디오, 제미나이 API, 제미나이 엔터프라이즈에서 즉시 이용할 수 있습니다. 반면 제미나이 3.5 플래시 사이버는 정부 기관과 신뢰할 수 있는 파트너를 위한 제한된 파일럿으로 먼저 제공됩니다.

사이버 모델은 기존 3.5 플래시를 보안 취약점 탐지, 검증, 수정에 맞게 미세조정했습니다. 코드멘더와 결합하면 여러 AI 에이전트가 코드 경로를 분석하고 하나의 보고서로 모읍니다. 여러 사람이 긴 배선도를 나눠 살핀 뒤 한 장의 점검표로 합치는 모습에 가깝습니다. 보안 기능은 강할수록 누구에게나 즉시 열기 어렵다는 점도 함께 드러납니다.

금융, 브라우저, 대학생 활용처럼 제미나이의 적용 범위를 넓게 묻는 독자도 있겠지만, 이번 자료가 직접 확인해 주는 중심은 기업과 개발자의 에이전트 운영입니다. 보안 모델의 일반 공개 시점이나 각 분야별 실제 성과는 아직 확인되지 않았습니다. 제한 공개가 신중함을 뜻하는 동시에, 일반 사용자가 체감할 변화와는 거리가 있다는 점은 아쉬움으로 남습니다.

빠른 모델의 확장은 곧바로 가장 어려운 문제의 해결을 뜻하지는 않습니다.

제미나이 3.5 프로의 지연은 별도 과제로 남습니다

제미나이 관련 이미지 3

※ AI로 생성한 이미지입니다

이번 발표의 가장 큰 공백은 3.5 프로입니다. 순다르 피차이 구글 최고경영자(CEO)는 5월 연례 개발자회의 I/O에서 6월 출시를 예고했지만, 7월 하순에도 새 일정은 제시되지 않았습니다. 구글은 현재 파트너와 시험 중이며 준비되는 대로 폭넓게 공개하겠다고 밝혔습니다.

일부 매체는 이 상황을 경쟁 심화와 연결합니다. 블룸버그통신 보도를 인용한 기사들은 코딩 등 성능 목표 미달이 지연의 배경일 수 있다고 전했습니다. 반대로 구글은 제미나이 4를 위한 가장 야심 찬 사전학습에 착수했다고 설명합니다. 전자는 현재의 빈자리를, 후자는 다음 세대 준비를 바라보는 관점입니다. 어느 쪽만으로 결론 내리기에는 공식 출시 일정과 성능 검증 결과가 아직 부족하죠.

경량화 전략의 성패는 현장 사용과 프로 공개가 가릅니다

입문자라면 모델 이름의 숫자보다 작업 조건부터 보면 됩니다. 빠른 요약, 검색, 반복 호출처럼 처리량이 중요한 일에는 플래시-라이트의 방향이 이해하기 쉽습니다. 코딩과 지식 업무, 멀티모달 처리를 함께 다뤄야 한다면 3.6 플래시의 토큰 효율 개선이 판단 재료가 됩니다. 고난도 추론과 복잡한 코딩의 최상위 성능은 아직 3.5 프로의 실제 공개와 검증을 기다려야 합니다.

구글의 전략 변화는 경량 모델을 많이 내놓았다는 사실만으로 판가름 나지 않습니다. 3.5 프로가 언제 어떤 성능으로 공개되는지, 3.6 플래시의 비용 절감이 실제 에이전트 운영에서 얼마나 이어지는지가 확인되면 이번 3종의 의미도 더 선명해질 것입니다.

모델 제공 범위와 가격, 성능 수치는 작성 시점 기준이며 구글의 정책과 서비스 업데이트에 따라 달라질 수 있습니다.

댓글 남기기