이론적 AI에서 일상 현실로: 전방위적 생태계 확장
구글이 2026년 8월 발표를 통해 하드웨어 인프라부터 클라우드 개발 모델, 업무 협업 툴, 검색 엔진, 감성적 스토리텔링에 이르는 포괄적인 AI 업데이트를 단행했습니다. 이번 업데이트의 핵심은 AI를 단순한 연산 모델에 머무르게 하지 않고 사용자가 일하고 소통하는 실제 환경 속에 직접 녹여내는 데 있습니다.
월간 활성 사용자 수(MAU) 10억 명을 돌파한 Gemini 앱을 필두로, 개발자용 경량화 모델과 기업용 협업 소프트웨어, 온디바이스 하드웨어가 하나의 유기적 파이프라인으로 연결되는 구조를 구축했습니다.
---
인프라 및 디바이스: 개발 비용 절감과 온디바이스 인텔리전스
구글은 개발자와 엔지니어가 에이전트 워크플로우를 경제적으로 구축할 수 있도록 개발 모델의 비용 효율성을 대폭 개선했습니다.
1. 코딩 및 에이전트 최적화 모델 출시
- Gemini 3.7 Flash: 3.6 Flash 출시 3주 만에 공개된 모델로, 소프트웨어 엔지니어링, 지식 작업, 웹 개발 워크플로우 전반의 성능을 크게 높였습니다. 특히 100만 토큰당 도입 가격을 이전 3.6 Flash 대비 50% 수준(절반)으로 낮췄습니다.
- Gemini 3.5 Transcribe: 소음과 전문 용어가 섞인 원시 오디오를 실시간 맥락을 반영해 텍스트로 변환하는 음성 인식 모델로, 보이스 에이전트 및 통화 분석 워크플로우에 최적화되었습니다.
- Gemini Omni 1.1 Flash: 장면 확장, 첫 프레임과 마지막 프레임 간 보간, 4K 업스케일링 기능을 지원하며 Google Flow, Google AI Studio, Gemini Enterprise Agent Platform에 배포되었습니다.
2. 하드웨어 및 온디바이스 에코시스템
Made by Google 2026 행사에서는 최신 Google Tensor G6 칩셋과 온디바이스 모델인 최신 Gemini Nano를 탑재한 Pixel 11 시리즈(Pixel 11, Pro, Pro XL, Pro Fold)가 공개되었습니다. 이와 함께 오픈 가중치 모델 제품군인 Gemma는 누적 다운로드 수 10억 건을 돌파하여 에지 인프라와 우주 연구 환경까지 지원 범위를 넓혔습니다.
| 제품 및 모델 | 주요 특징 및 사양 | 적용 영역 |
|---|---|---|
| Gemini 3.7 Flash | 3.6 Flash 대비 토큰당 단가 50% 인하 | 코딩, 소프트웨어 엔지니어링, 에이전트 구축 |
| Pixel 11 시리즈 | Google Tensor G6 칩, 최신 Gemini Nano 탑재 | 모바일 온디바이스 퍼스널 인텔리전스 |
| Gemini 3.5 Transcribe | 실시간 맥락 인지 STT 모델 | 음성 에이전트, 실시간 자막, 통화 분석 |
| Gemma 모델군 | 누적 다운로드 10억 회 돌파 | 모바일, 에지 디바이스, 연구 기관 연구 환경 |
---
업무 환경의 시각화: Google Pics와 워크스페이스 통합
구글은 워크스페이스 생태계 내에서 탭 이동 없이 즉시 이미지를 제작하고 정밀 편집할 수 있는 AI 도구 Google Pics를 공개했습니다.
"수백만 명의 사용자가 매달 워크스페이스 제품 전반에서 수십억 개의 이미지와 상호작용합니다. 시각 자료를 제작하고 공유하기 위해 애플리케이션 사이를 오갈 필요가 없어야 합니다."
Google Pics는 'Nano Banana' 이미지 생성 및 편집 모델을 기반으로 구동되며, Google AI Pro 및 Ultra 구독자와 대부분의 워크스페이스 비즈니스 고객을 대상으로 순차 배포됩니다.
- 객체 분할(Object Segmentation): 이미지 내 특정 객체만 선택하여 배경 손상 없이 변형하거나 영역별 텍스트 수정을 지원합니다.
- 인-이미지 텍스트 편집 및 번역: 기존 디자인 레이아웃과 폰트를 유지하면서 이미지 속 텍스트를 직접 수정하거나 다국어로 번역합니다.
- 실시간 협업 및 다중 시안 생성: 단일 프롬프트에서 여러 시안을 도출하며, 팀원이 슬라이드(Google Slides)나 문서(Google Docs) 내에서 하나의 이미지를 동시에 공동 편집할 수 있습니다.
- 드라이브 연동: Google Drive에서 파일을 끌어다 놓아 브랜드 콘셉트를 디자인할 수 있도록 확장을 준비 중입니다.
---
대화형 검색의 상거래 확장: AI Mode 여행 계획 및 다이렉트 예약
검색 부문에서는 대화형 AI Mode에 항공권 가격 추적, 로열티 프로그램 포인트 조회, 호텔 직접 예약 기능이 결합되었습니다.
1. 항공권 가격 변동 추적 및 마일리지 조회
- 180개국 이상 지원: 300개 이상의 제휴 항공사 및 여행 사이트 가격 데이터를 기반으로 대화 도중 가격 변동 알림(Price Alert)을 설정할 수 있습니다.
- 포인트/마일리지 실시간 환산: 알래스카/하와이안 항공, 아메리칸 항공(AA), 초이스 호텔, 힐튼, 윈덤 등의 리워드 프로그램 마일리지 차감액을 검색 화면에서 바로 비교할 수 있으며 향후 아코르, 하얏트, 루프트한자 등으로 확장될 예정입니다.
2. 검색창 내 엔드투엔드 호텔 예약
미국 내 영어 사용자를 대상으로 시작된 호텔 예약 기능은 Booking.com, 익스피디아, IHG, 메리어트 등과 연동되어 검색창에서 이탈하지 않고 결제까지 완료할 수 있는 구조를 제공합니다.
- 사용자가 조건을 제시하면 AI Mode가 옵션과 리뷰를 정렬합니다.
- 'Continue on Google' 옵션을 선택한 뒤 객실 타입을 지정합니다.
- Google Pay를 통해 즉시 안전하게 예약을 확정합니다.
---
멀티모달 기술의 감성적 복원과 과학적 기후 대응
기술의 효용성은 엔터프라이즈와 개인의 정서적 영역, 그리고 지구 환경 문제 해결로도 이어졌습니다.
- 흑백 과거 사진 generative 복원
- 현재 미세 표정 모델링
- 청년기 외형에 표정 특성 매핑
- 다큐멘터리 영상 렌더링
1. 딥마인드와 영화 제작진의 기억 복원 프로젝트
구글 딥마인드는 영화감독 리즈 가버스(Liz Garbus), 대런 애러노프스키(Darren Aronofsky)의 제작사 Primordial Soup와 협력하여 단편 다큐멘터리 'Love, Rendered'를 제작했습니다. 70년간 결혼 생활을 이어왔으나 인지 기능 저하를 겪고 있는 버트(Burt)와 에델(Ethelle) 부부의 미기록 첫 만남 순간을 복원하기 위해 두 단계 기술이 적용되었습니다.
1. 이미지 복원: 부부의 젊은 시절 흑백 사진을 생성 모델로 복원하여 외형적 기준점을 확보했습니다. 2. 모션 및 퍼포먼스 제어: 고령이 된 버트의 고개 각도, 말할 때의 망설임, 눈가 주름의 미세한 움직임을 캡처하여 젊은 시절 모습에 매핑함으로써 실제에 가까운 기억 영상을 완성했습니다.
이 기술은 현재 일반 사용자도 Gemini 앱에 오래된 사진을 업로드하여 복원 및 채색을 요청하는 형태로 직접 사용할 수 있습니다.
2. 대기 환경 및 사이클론 예측 모델
- Operation Blue Skies: 비행운(Contrail) 형성을 방지하기 위해 영국 정부 및 항공 업계와 협력하여 북대서양 항로 전반으로 비행경로 최적화 기술을 확대 적용하고 있습니다.
- WeatherNext 2: 사이클론의 이동 경로, 강도, 풍속 구조를 정밀하게 예측하는 기후 모델로, 네이처(Nature) 논문 게재와 함께 연구 커뮤니티에 오픈소스로 완전 공개되었습니다.