구글 제미나이 3.8과 옴니 라인업 총정리

구글 딥마인드가 추론, 실시간 음성, 멀티모달 제어에 특화된 제미나이 3.8 및 옴니 1.1 라인업을 공개했습니다. 제미나이 3.8 Flash는 3.7 Flash와 동일한 비용으로 코딩과 에이전트 성능을 개선했으며, 사이버 보안 전용 모델인 3.8 Flash Cyber를 함께 선보였습니다. 또한 제미나이 3.8 Live 제품군은 실시간 음성 대화와 백그라운드 병렬 추론을 지원하며, 제미나이 옴니 1.1 Flash와 에이전틱 비디오 분석을 통해 영상 생성 및 분석의 비용 효율성을 대폭 끌어올렸습니다.

제미나이 3.8 Flash와 사이버 방어 특화 모델의 등장

구글 딥마인드가 제미나이 3.7 Flash 출시 이후 3주 만에 신규 모델인 제미나이 3.8 Flash와 제미나이 3.8 Flash Cyber를 공개했습니다. 6주 동안 3번째 Flash 모델을 선보인 구글은 이전 세대와 동일한 가격 정책을 유지하면서도 엔지니어링 및 복합 추론 성능을 강화했습니다.

제미나이 3.8 Flash는 $0.75(입력 100만 토큰당) 및 $3.75(출력 100만 토큰당)의 요금으로 제공됩니다. 소프트웨어 엔지니어링 벤치마크인 DeepSWE v1.1에서 대형 프론티어 모델들을 능가하는 성과를 거두었으며, STEM 및 인문학 등 다단계 추론 능력을 측정하는 HLE-Verified 벤치마크에서 54.9%를 기록했습니다. 복잡한 작업 환경에서 모델은 반복적인 도구 호출과 추가 추론 단계를 수행하며, 효율성이 우선인 워크로드를 위해 3.7 Flash 모델도 병행 지원됩니다.

함께 공개된 제미나이 3.8 Flash Cyber는 페어윈드 프로그램(Fairwind Program)을 통해 공인된 방어자들에게 제공되는 사이버 보안 특화 모델입니다. 취약점 패치 벤치마크인 CWE-Bench에서 pass@1 47.2%를 달성해 프론티어 모델(47.8%)에 근접한 성능을 낮은 비용으로 구현했습니다.

모델명입력 가격 (1M 토큰)출력 가격 (1M 토큰)주요 벤치마크 지표
Gemini 3.8 Flash$0.75$3.75HLE-Verified 54.9%
Gemini 3.8 Flash CyberFairwind 프로그램 제공Fairwind 프로그램 제공CWE-Bench pass@1 47.2%

구글 내부 적용 사례에서도 구체적인 수치가 확인되었습니다:

음성 인터랙션과 병렬 추론: 제미나이 3.8 Live 라인업

실시간 대화형 인터페이스를 지원하는 제미나이 3.8 Live와 제미나이 3.8 Live Extended Thinking도 함께 도입되었습니다. 사용자의 말을 끊지 않고 백그라운드에서 복합 작업을 처리하는 능력이 핵심입니다.

제미나이 3.8 Live Extended Thinking은 다단계 음성 에이전트 작업에 최적화되어 있습니다. 음성-음성 품질 지수인 Artificial Analysis Speech to Speech Quality Index에서 82.6점으로 1위를 기록했으며, 금융권 에이전트 벤치마크인 Sierra τ-Voice-banking에서 35.1%, τ-Voice에서 68.6%를 기록했습니다. Big Bench Audio 평가에서는 97.7%의 점수를 획득했습니다.

Gemini 3.8 Live Extended Thinking82.6
τ-Voice68.6
Big Bench Audio97.7

제미나이 3.8 Live 시리즈의 핵심 기능은 다음과 같습니다:

독립 개발자 생태계에서도 웹소켓(WebSocket) 엔드포인트(`GenerativeService.BidiGenerateContent`)와 Web Audio API를 활용해 외부 라이브러리 없이 양방향 음성 대화 인터페이스를 직접 구축하는 사례가 확인되었습니다. 개발자 플랫폼으로는 Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel 등이 연동을 지원합니다.

제어력과 해상도를 높인 영상 생성: 제미나이 옴니 1.1 Flash

영상 제작 파이프라인을 겨냥한 제미나이 옴니 1.1 Flash는 세밀한 카메라 워크와 장면 확장에 중점을 두었습니다. 기존 모델이 직전 1초만 참조하던 것과 달리, 최대 10초의 이전 컨텍스트를 분석하여 10초 단위로 최대 40초까지 일관된 영상을 연장할 수 있습니다.

  1. 360p 고속 프리뷰 검토
  2. 시작 및 종료 키프레임 보간
  3. 최대 40초 장면 연장
  4. 4K 고해상도 업스케일링

옴니 1.1 Flash의 주요 기능 및 특징은 다음과 같습니다:

현재 어도비 파이어플라이(Adobe Firefly), 피그마 위브(Figma Weave), 런웨이(Runway), GMI 클라우드(GMI Cloud) 등이 옴니 1.1 Flash 엔진을 제품에 통합했습니다.

에이전틱 비디오 분석을 통한 토큰 절감과 정확도 개선

영상 분석 영역에서는 제미나이 3.7 Flash, 3.6 Flash, 3.5 Flash-Lite 모델을 대상으로 에이전틱 비디오 이해(Agentic video understanding) 기능이 추가되었습니다. 기본 1 FPS 등의 고정 프레임으로 전체 영상을 읽던 정적 방식에서 벗어나, 모델이 능동적으로 필요한 구간을 탐색하는 구조로 전환되었습니다.

"고정 프레임 방식으로 미디어를 소비하는 대신, 모델이 에이전트 루프를 통해 프레임·오디오·스크립트 중 필요한 신호와 시점만 선택적으로 조회합니다."

이 기능을 적용할 경우 토큰 소비량은 최대 88% 감소하고, 분석 비용은 최대 66% 절감되며, 정확도는 최대 7% 향상됩니다. 10분 이상의 튜토리얼부터 90분 강의 등 장편 영상에서 초 단위 미만(Sub-second)의 상태 변화 포착, 이상 감지, 반복 행동 계수가 가능해집니다. 해당 기능은 추가 요금 없이 표준 토큰 단가로 구글 AI 스튜디오 및 제미나이 엔터프라이즈에서 활성화할 수 있으며, 향후 유튜브의 'Ask YouTube' 기능에도 적용될 예정입니다.

Chiffres vérifiés

Notre avis

구글이 모델 크기 경쟁에서 벗어나 단가 동결과 도메인 특화(보안·영상·음성)로 명확한 실용성 중심 전략을 취하고 있습니다. 특히 백그라운드 병렬 처리와 선택적 영상 스캔 같은 에이전틱 접근법은 멀티모달 서비스의 실질 운영 비용을 크게 낮출 것으로 기대됩니다.

Questions ouvertes

Modèles mentionnés

FournisseurEntréeSortieFenêtre de contexte
Google: Gemini 3.8 Flash · Google$0.75$3.751,048,576

Source

Retour au catalogue