초경량·고효율 파운데이션 모델과 에이전트 인프라의 도약
구글이 실무 엔지니어링과 에이전트 워크플로우에 최적화된 Gemini 3.7 Flash를 전격 공개했습니다. 이전 버전인 3.6 Flash 출시 후 불과 3주 만에 등장한 이번 모델은 소프트웨어 엔지니어링, 지식 작업, 웹 개발 전반의 성능을 크게 개선하면서도 백만 토큰당 가격을 기존 3.6 Flash의 절반 수준으로 낮췄습니다.
동시에 구글은 음성 및 멀티미디어 처리 파이프라인을 대폭 고도화했습니다. 잡음과 전문 용어가 섞인 오디오를 실시간으로 정확하게 변환하는 음성 인식 모델 Gemini 3.5 Transcribe를 출시해 보이스 에이전트 및 통화 분석 인프라를 강화했습니다. 또한 비디오 생성 및 편집 모델인 Gemini Omni 1.1 Flash를 통해 씬 확장(Scene Extension), 프레임 보간(First-and-last-frame Interpolation), 4K 업스케일링 기능을 Google Flow, Google AI Studio, Gemini Enterprise Agent Platform에 공급하기 시작했습니다. 오픈 모델 제품군인 Gemma 역시 누적 다운로드 10억 건을 돌파하며 엣지부터 우주 연구에 이르는 다양한 환경으로 배포가 확대되었습니다.
| 모델명 | 주요 특화 영역 | 핵심 기능 및 개선점 |
|---|---|---|
| Gemini 3.7 Flash | 코딩 및 에이전트 워크플로우 | 3.6 Flash 대비 토큰당 비용 50% 절감, SW 개발 성능 강화 |
| Gemini 3.5 Transcribe | 음성-텍스트 변환 (STT) | 소음·전문용어 환경 실시간 문맥 인식 전사 |
| Gemini Omni 1.1 Flash | 스튜디오급 영상 생성 | 씬 확장, 프레임 보간, 4K 업스케일링 지원 |
| Gemini 3.8 Flash Cyber | 사이버 보안 및 코드 수정 | CodeMender 결합을 통한 취약점 자동 패치 생성 |
자율형 사이버 방어의 상용화: Fairwind 프로그램
기업과 정부 기관의 보안 대응 속도를 획기적으로 개선하기 위해 구글은 제한적 접근 프로그램인 Fairwind Program을 가동했습니다. 기존 보안팀은 운영 비용이 높고 제어가 어려운 대형 프론티어 모델과 복잡한 취약점 수정 능력이 부족한 소형 오픈 모델 사이에서 딜레마를 겪어왔습니다. 구글은 전용 보안 추론 모델인 Gemini 3.8 Flash Cyber와 코드 패치 검증 하네스인 CodeMender를 결합하여 해결책을 제시했습니다.
- 보안 취약점 실시간 탐지
- Gemini 3.8 Flash Cyber 추론
- CodeMender 패치 코드 검증
- 안전한 클라우드 환경 즉각 배포
이 시스템은 보안 취약점을 발견하는 데 그치지 않고 자율적으로 패치 코드를 작성 및 검증하여 배포 준비 상태의 코드를 수 분 내에 완성합니다. 수주가 걸리던 수작업 보안 패치 기간을 단축함으로써 방어자 우위(Defender's Edge)를 확보할 수 있습니다. 현재 정부 기관, 핵심 인프라 운영사, 플랫폼 기업 등 전 세계 650개 이상의 파트너가 해당 프로그램에 참여하고 있습니다. 아울러 Google.org를 통해 총 1억 달러 이상의 사이버 보안 기금을 지원하고 있으며, 이 중 3,600만 달러를 투입해 미국 내 1,250개 이상의 병원, 공립학교, 공공 유틸리티를 지원하는 35개 사이버 클리닉을 구축했습니다.
워크스페이스 네이티브 생산성 도구: Google Pics
문서 작업 환경 내에서 직접 비주얼 에셋을 제작·편집할 수 있는 Google Pics가 공개되었습니다. 자체 이미지 생성 및 편집 모델인 Nano Banana를 기반으로 구축된 Google Pics는 별도의 그래픽 소프트웨어나 브라우저 탭 전환 없이 Google Docs와 Slides 내에서 즉각 동작하며, 향후 Google Drive로 확장될 예정입니다.
- 객체 분할(Object Segmentation): 전체 이미지를 훼손하지 않고 특정 객체만 선택하여 변형하거나 텍스트 프롬프트로 국소 영역을 정밀 수정합니다.
- 인-이미지 텍스트 편집 및 번역: 기존 폰트와 레이아웃 디자인을 유지하면서 이미지 내부의 문구를 직접 수정하거나 타 언어로 번역합니다.
- 실시간 협업(Co-creation): 동료와 단일 이미지 작업 링크를 공유하여 워크스페이스 환경에서 실시간으로 공동 편집을 수행합니다.
- 다중 시안 생성: 단일 프롬프트 입력으로 여러 버전의 디자인 시안을 동시 생성하여 최적의 결과물을 선택할 수 있습니다.
Google Pics는 Google AI Pro, Ultra 구독자 및 워크스페이스 비즈니스 고객을 대상으로 순차 배포되고 있습니다.
일상 속 에이전트 전환: 검색 여행 예약과 음성 인터페이스 대중화
대화형 검색 인터페이스인 AI Mode in Search는 단순 정보 탐색을 넘어 실제 거래와 실행을 지원하는 에이전트로 진화했습니다. 구글 플라이트의 가격 추적 기술이 통합되어 전 세계 180개 이상의 국가 및 지역, 300개 이상의 파트너 항공사 및 여행사 데이터를 기반으로 실시간 가격 변동 알림을 제공합니다. 또한 American Airlines, Alaska Airlines, Hilton 등 주요 파트너사의 항공 마일리지 및 호텔 포인트 차감량을 실시간 비교 조회하는 기능이 전 세계에 적용되었습니다.
미국 내 영어 사용자를 대상으로 시작된 호텔 직접 예약 기능은 사용자가 AI Mode 대화창 내에서 객실 유형과 취소 정책을 확인한 후 Google Pay를 통해 결제를 완료할 수 있도록 지원합니다. 예약 및 고객 서비스의 주체(Merchant of Record)는 Booking.com, Expedia, Marriott 등 제휴사가 담당하는 구조입니다.
"Gemini 앱의 월간 활성 사용자(MAU)가 공식적으로 10억 명을 넘어섰으며, 이는 구글 역사상 가장 빠른 성장 속도입니다."
Gemini 앱의 월간 활성 사용자가 10억 명을 돌파한 가운데, 전체 이용자의 63%가 음성으로 직접 상호작용하고 있는 것으로 나타났습니다. 특히 일상 업무를 처리하는 학부모 사용자의 음성 활용 비중은 일반 사용자 대비 43% 높았으며, 매일 생성되는 이미지는 1억 5천만 개를 상회하고 있습니다.
하드웨어 통합과 과학·스포츠 생태계 연계
구글은 하드웨어 단에서 최신 온디바이스 모델인 Gemini Nano를 구동하는 Google Tensor G6 칩셋 기반의 Pixel 11 시리즈(Pixel 11, Pro, Pro XL, Pro Fold)를 발표했습니다. 하드웨어와 AI의 결합을 알리기 위해 아스널, FC 바르셀로나, 바이에른 뮌헨, 리버풀, 파리 생제르맹 등 유럽 5대 축구 클럽과 장기 파트너십을 체결하고 전술 분석 인사이트 및 경기 백스테이지 콘텐츠 제작을 지원하기로 했습니다.
연구 및 기후 대응 분야에서도 성과가 공개되었습니다. 사이클론의 이동 경로와 강도를 정밀 예측하는 기상 예측 모델 WeatherNext 2 관련 논문이 네이처(Nature)에 게재되었으며 해당 모델은 오픈소스로 공개되었습니다. 항공기 비행운 생성을 방지해 기후 영향을 줄이는 Operation Blue Skies 프로젝트 역시 영국 정부 및 항공 업계와 협력하여 북대서양 항로로 적용 범위를 확장하고 있습니다.