인프라와 비용 혁신: 에이전트 워크플로우를 겨냥한 신규 모델 라인업
구글이 개발자 및 엔터프라이즈 시장을 겨냥해 비용 효율성과 작업 정밀도를 크게 강화한 차세대 모델들을 일제히 공개했습니다. 핵심은 에이전트 구축과 멀티모달 처리 비용을 대폭 낮춘 Gemini 3.7 Flash의 출시입니다. 이전 버전인 3.6 Flash 출시 후 불과 3주 만에 공개된 이 모델은 소프트웨어 엔지니어링, 지식 노동, 웹 개발 워크플로우에서 향상된 성능을 제공하면서도 1백만 토큰당 가격을 기존 3.6 Flash 출시 초기 가격의 절반 수준으로 인하했습니다.
동시에 음성과 비디오 영역의 전문 모델도 함께 강화되었습니다. 실시간 음성-텍스트 변환 모델인 Gemini 3.5 Transcribe는 소음과 전문 용어가 섞인 원시 오디오 데이터를 문맥 기반의 정제된 텍스트로 즉각 변환하도록 설계되었습니다. 이는 고객 통화 분석 및 음성 에이전트 구축 환경을 직접적으로 지원합니다. 비디오 생성 분야에서는 Gemini Omni 1.1 Flash가 추가되어 장면 확장(Scene extension), 첫 프레임-마지막 프레임 보간(First-and-last-frame interpolation), 4K 업스케일링 제어 기능을 제공합니다.
| 모델명 | 주요 용도 | 핵심 특징 및 제어 기능 |
|---|---|---|
| Gemini 3.7 Flash | 코딩 및 에이전트 워크플로우 | 3.6 Flash 대비 50% 토큰 비용 인하, 개발 생산성 향상 |
| Gemini 3.5 Transcribe | 실시간 음성 인식(STT) | 소음·전문용어 환경 맥락 파악, 통화 후 분석 최적화 |
| Gemini Omni 1.1 Flash | 스튜디오급 비디오 생성 | 프레임 보간, 4K 업스케일링, 장면 확장 제어 |
한편 오픈소스 모델인 Gemma는 글로벌 누적 다운로드 수 10억 회를 돌파하며 모바일 기기, 엣지 인프라, 우주 및 수중 연구 환경까지 오프라인 구동 범위를 확장하고 있습니다.
---
온디바이스와 개인화: 10억 사용자 기반의 Pixel 11 및 Gemini Live
구글은 하드웨어와 소프트웨어의 결합을 통해 개인화된 인텔리전스를 기기 전반에 내장하고 있습니다. 'Made by Google 2026' 행사에서 공개된 Pixel 11 시리즈(Pixel 11, Pixel 11 Pro, Pixel 11 Pro XL, Pixel 11 Pro Fold)는 차세대 칩셋인 Google Tensor G6를 탑재하여 온디바이스 모델인 Gemini Nano를 로컬 환경에서 구동합니다.
구글 발표에 따르면 Gemini 앱의 월간 활성 사용자(MAU)는 공식적으로 10억 명을 넘어섰습니다. 사용자 행동 분석 결과 음성 인터페이스로의 전환이 뚜렷하게 관찰되고 있습니다.
- 전체 사용자의 63%가 음성을 통해 Gemini와 직접 상호작용하고 있으며 '음성 전용' 사용자 층이 확대되었습니다.
- 자녀가 있는 부모 사용자의 경우 일상 업무 처리를 위해 Gemini를 활용할 확률이 일반 사용자 대비 43% 높게 나타났습니다.
- Gemini 플랫폼 내에서 매일 생성되는 이미지는 1억 5,000만 장을 초과했습니다.
대화형 에이전트인 Gemini Live에는 'Personal Intelligence', 'Daily Brief', 'Spark', 핸즈프리 받은편지함 관리 기능이 도입되어 단순 질의응답을 넘어 사용자의 일정과 업무를 자율적으로 대행하는 에이전트 구조로 전환되고 있습니다.
---
업무 생산성 도구의 내재화: 이미지 제작 솔루션 'Google Pics'
구글 워크스페이스(Google Workspace) 생태계에는 생성형 AI 기반의 신규 이미지 제작·편집 도구인 Google Pics가 도입되었습니다. 전용 이미지 모델인 Nano Banana를 기반으로 구동되는 Google Pics는 독립 웹 서비스(`pics.new`)뿐만 아니라 Google Slides, Google Docs, Google Drive 내에 직접 내장되는 방식으로 배포됩니다.
- 텍스트 프롬프트 입력
- 다중 시안 생성
- 객체 분할·영역 지정
- 인-이미지 텍스트 수정 및 번역
- 슬라이드·문서 즉각 반영
Google Pics의 주요 기능 구성은 다음과 같습니다:
- 객체 분할(Object Segmentation): 이미지 전체를 다시 생성할 필요 없이 특정 객체만 선택해 수정하거나, 특정 영역에 텍스트 코멘트를 입력하여 다중 수정을 일괄 적용합니다.
- 이미지 내 텍스트 편집 및 번역(In-image text editing and translation): 기존 그래픽 디자인 레이아웃과 폰트를 유지하면서 이미지 속 문자열을 직접 수정하거나 타 언어로 번역합니다.
- 실시간 협업 및 다중 생성: 단일 프롬프트에서 여러 시안을 도출하며, 워크스페이스 팀원들과 단일 캔버스에서 동시 편집을 수행합니다.
- 드라이브 자산 연동: Google Drive에서 에셋을 직접 드래그 앤 드롭하여 브랜드 콘셉트 아트를 제작할 수 있습니다.
해당 기능은 Google AI Pro 및 Ultra 구독자와 대부분의 워크스페이스 비즈니스 고객에게 순차적으로 배포되고 있습니다.
---
대화형 검색의 상거래 확장: AI Mode 기반 여행 예약 시스템
구글 검색의 AI Mode는 정보 탐색을 넘어 항공권 가격 추적, 마일리지 조회, 호텔 결제에 이르는 전체 트랜잭션을 단일 대화창 안으로 통합했습니다.
- 자연어 여행 조건 입력
- 300+ 파트너 실시간 가격·마일리지 비교
- Google Pay 호텔 직접 결제
- 예약 확인 및 가격 변동 알림
항공권 분야에서는 Google Flights의 가격 추적 기술이 통합되어 전 세계 180개 이상 국가 및 지역에서 대화 도중 가격 변동 알림을 설정할 수 있습니다. 시스템은 300개 이상의 파트너 항공사 및 여행 사이트 데이터를 실시간으로 대조합니다. 또한 전 세계 사용자를 대상으로 아메리칸항공, 알래스카/하와이안 항공, 힐튼, 윈덤 등 제휴 프로그램의 포인트 및 마일리지 요구량을 AI 대화창 내에서 직접 계산해 주는 기능이 활성화되었습니다.
호텔 예약의 경우 미국 내 영어 사용자부터 시작하여 검색 대화창 내에서 'Continue on Google' 옵션을 선택하고 Google Pay를 통해 방 유형 선택부터 결제까지 직접 완료하는 기능이 추가되었습니다. 이 과정에서 Booking.com, Expedia, Marriott, IHG, Trip.com 등 연동 파트너가 판매 기록 상인(Merchant of Record)으로 기능하며 고객 서비스를 처리합니다.
---
과학 연구 오픈소스화와 글로벌 스포츠 파트너십
AI의 사회적 영향력 확장 측면에서는 기후 과학 연구와 대규모 스포츠 파트너십이 동시에 추진되었습니다. 네이처(Nature) 논문을 통해 발표된 열대성 저기압 예측 모델 WeatherNext 2는 사이클론의 이동 경로, 강도, 풍속 구조를 정밀하게 예측하며, 구글은 기후 복원력 연구를 지원하기 위해 이 모델을 연구 커뮤니티에 오픈소스로 공개했습니다. 항공 분야에서는 영국 정부 및 항공사들과 협력하여 비행운(Contrail) 형성을 억제하는 항로 예측 AI 프로젝트 'Operation Blue Skies'를 북대서양 노선으로 확대 적용했습니다.
문화 및 소비자 접점 확대를 위해 구글은 유럽 5대 축구 구단과의 장기 파트너십을 체결했습니다.
"우리는 유럽 최고 리그를 대표하는 아스널 FC, FC 바르셀로나, FC 바이에른 뮌헨, 리버풀 FC, 파리 생제르맹과 협력하여 서포터들에게 독점적인 비하인드 콘텐츠와 경기 분석, 새로운 AI 기반 팬 경험을 제공합니다."
구글은 아스널, 바르셀로나, 바이에른 뮌헨, 리버풀, 파리 생제르맹의 공식 소비자 AI 및 스마트폰 파트너로 참여하며, Gemini를 통한 경기 데이터 분석과 Pixel 카메라를 활용한 남녀 축구팀 비하인드 콘텐츠 제작('Shot on Pixel')을 전개하고 있습니다.