구글, Gemini 3.6 Flash 등 신모델 3종 공개

센티먼트 +58
영향도 72

AI 요약

  • 구글이 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 등 신모델 3종을 발표하며 성능과 비용 효율을 동시에 개선했다.
  • 주력 3.6 Flash는 출력 토큰 17% 절감과 가격 인하(인풋 $1, 아웃풋 $7.5)로 에이전틱 작업당 비용을 낮췄다.
  • 차세대 Gemini 4를 위한 역대 최대 규모 사전학습도 이미 시작돼 AI 경쟁이 한층 가속되고 있다.

뉴스 기사

구글이 자사 경량 AI 라인업을 대폭 강화한 신모델 3종을 공식 발표했다. 이번 라인업은 주력 모델인 Gemini 3.6 Flash를 중심으로, 초경량 모델 3.5 Flash-Lite, 그리고 보안 특화 모델 3.5 Flash Cyber로 구성된다. 주력인 3.6 Flash는 코딩과 지식 작업, 멀티모달 성능을 끌어올린 것이 특징이다. 기존 3.5 Flash 대비 출력 토큰 사용량을 17% 줄였으며, 더 적은 추론 단계와 도구 호출만으로 멀티스텝 작업을 처리한다. 가격은 인풋 100만 토큰당 1달러, 아웃풋 7.5달러로 이전 세대(1.5달러·9달러)보다 인하됐다. 토큰 효율과 가격을 동시에 개선해 에이전틱 작업 단위당 비용을 크게 낮춘 점이 핵심이다. 문서 파싱과 차트·데이터 분석, 보고서 작성 등 멀티모달 지식 작업이 강화됐고, 컴퓨터 사용 기능이 Gemini API 및 엔터프라이즈의 기본 도구로 탑재됐다. 초경량 모델인 3.5 Flash-Lite는 낮은 지연시간과 대규모 처리량이 요구되는 프로덕션 워크로드를 겨냥한다. 초당 350개의 출력 토큰을 생성하며 인풋 0.3달러, 아웃풋 2.5달러의 낮은 단가를 책정했다. 사고 수준을 조절해 대량 작업에서는 저지연·저비용을, 복잡한 서브에이전트 작업에서는 높은 추론 수준을 적용할 수 있다. 보안 특화 모델인 3.5 Flash Cyber는 취약점 탐지와 수정을 위해 미세조정됐으며, 여러 에이전트가 CodeMender 내에서 협업해 통합 보고서를 생성한다. 다만 이중용도 위험을 고려해 일반 공개 대신 정부기관과 신뢰 파트너에게만 제한적으로 제공된다. 3.6 Flash와 3.5 Flash-Lite는 Google AI Studio, Gemini API, 엔터프라이즈 등에서 즉시 이용 가능하다. 구글은 여기에 그치지 않고 차세대 Gemini 4를 위한 역대 최대 규모의 사전학습을 이미 시작했다고 밝혀, 빅테크 간 AI 모델 경쟁이 한층 격화될 전망이다.

AI 투자 인사이트

가격 인하와 토큰 효율 개선은 AI 추론 원가 하락 추세를 재확인하며, 알파벳의 API·클라우드 수익화 및 에이전틱 AI 생태계 점유율 확대에 긍정적이다.