Google은 수요일에 Gemini 3.8 Flash Cyber라는 새로운 사이버 보안 중심 변형과 함께 Gemini 3.8 Flash를 출시하여 6주 만에 세 번째 Flash 모델을 출시했습니다. Google의 공식 블로그에 게시된 이 발표는 회사가 출시를 준비하고 있다는 보고가 나온 지 며칠 후에 도착했으며 예산 모델을 토큰당 몇 배 더 많은 비용이 드는 경쟁사보다 눈에 띄는 거리에 두는 벤치마크 주장이 포함되어 있습니다.

빠른 속도는 이야기 속의 이야기입니다. Google은 약 3주 전에 Gemini 3.7 Flash를 출시했으며 이제 3.8 Flash가 회사의 기본 주력 모델로 이를 대체합니다. 한편, 구글은 2026년 초부터 최전방 수준의 Gemini Pro 모델을 출시하지 않았으며 오랫동안 약속되었던 Gemini 3.5 Pro는 눈에 띄게 부재한 상태입니다. 이 이야기에 대한 자세한 내용은 최신 AI 개발 보도를 참조하세요.

두 가지 모델, 하나의 파운데이션

Gemini 3.8 Flash는 두 가지 버전으로 제공됩니다. 표준 모델은 에이전트 작업, 소프트웨어 개발 및 대용량 애플리케이션을 위한 범용 추론 및 코딩 시스템으로 자리잡고 있습니다. Gemini 3.8 Flash Cyber는 동일한 기반에서 실행되지만 취약점 탐지 및 완화를 위해 특별히 조정되어 이전 3.5 Flash Cyber를 대체합니다.

Google이 발표한 수치에 따르면 Gemini 3.8 Flash는 장기적인 소프트웨어 엔지니어링 작업을 측정하는 벤치마크인 DeepSWE v1.1에서 73.7%를 기록했습니다. 이는 Claude Opus 5 바로 아래인 74.0%, OpenAI의 GPT-5.6 Sol(72.7%), Claude Sonnet 5(53.8%)보다 앞서 있습니다. 이전 Gemini 3.7 Flash는 동일한 벤치마크에서 65.3%를 기록했습니다. 이는 이번 릴리스의 이점 중 대부분이 코딩에 집중되어 있음을 의미합니다.

독립적인 벤치마킹 플랫폼 인공 분석(Artificial Analysis)은 새 모델에 이전 모델의 56점보다 3포인트 높은 59점의 지능 지수 점수를 부여합니다. 이는 플랫폼 데이터에 따르면 높은 추론 노력에서는 GPT-5.6 Sol, 중간 추론에서는 Grok 4.6과 동일하며 도구 사용 및 코딩과 같은 에이전트 벤치마크에 의해 주로 향상됩니다.

공격적인 가격, 문제점

Google은 연말까지 3.7 Flash 가격과 일치하는 백만 입력 토큰당 $0.75 및 백만 출력 토큰당 $3.75의 출시 가격으로 모델을 출시할 예정입니다. 2027년 1월부터 정가는 각각 1.50달러와 7.50달러로 두 배가 됩니다. 라이벌과의 비교는 그때에도 여전히 뚜렷합니다. Claude Opus 5의 가격은 백만 입력 토큰당 $5.00, 백만 출력 토큰당 $25.00인 반면 GPT-5.6 Sol은 $4.00와 $20.00입니다.

비용에 민감한 팀이라면 주목할 만한 문제가 있습니다. Google은 성능 향상의 일부를 복잡한 작업에 대한 추가 추론 단계를 실행하고 도구를 반복적으로 호출하는 모델에 기인합니다. 회사에 따르면 이 모델은 "더 열심히 일합니다". 이는 더 높은 토큰 소비로 해석됩니다. 인공 분석은 완료된 작업당 비용을 0.58달러로 추정합니다. 이는 토큰당 가격이 변하지 않음에도 불구하고 3.7 Flash의 0.40달러보다 약 40% 증가한 수치입니다. Google 자체에서는 컴퓨팅 예산이 부족한 개발자에게 추론 수준을 낮추거나 계속 지원되는 3.7 Flash를 유지할 것을 권장합니다.

플래시 사이버(Flash Cyber)는 보안 운영을 목표로 합니다.

사이버 변형은 릴리스의 더 특이한 절반입니다. Google에 따르면 내부 테스트에 따르면 Gemini 3.8 Flash Cyber는 이전 버전보다 더 많은 취약점을 식별하고 작동 패치를 더 자주 생성하는 것으로 나타났습니다. Google의 Chrome 보안 팀은 내부 사용 중 패치 정확도가 2.6배 증가했다고 보고했으며, Google의 클라우드 팀은 이 모델을 사용하여 2시간 이내에 심각한 취약점을 발견했다고 밝혔습니다. Google은 또한 보안 파트너인 Wiz와 Palo Alto Networks의 증언을 인용했습니다.

그러나 접근이 제한되어 있습니다. 표준 3.8 Flash는 오늘부터 광범위하게 사용할 수 있지만 Flash Cyber는 현재 신뢰할 수 있는 테스터와 정부로 제한되어 있습니다.

누락된 프론티어 모델 질문

이번 출시로 인해 Google의 출시 전략이 불편한 주목을 받게 되었습니다. Ars Technica는 Google이 2026년 초부터 최상급 Gemini Pro 모델을 출시하지 않았으며 올해 초 보고에 따르면 Gemini 3.5 Pro의 코딩 성능이 경쟁사와 일치하지 못해 출시가 지연된 것으로 나타났습니다. 출시에 대한 Decoder의 보도는 누구에게 물어보느냐에 따라 빠른 Flash 흐름을 엔지니어링 모멘텀의 신호 또는 아직 누락된 플래그십에 대한 방해로 구성했습니다.

Google DeepMind의 수장을 맡은 Koray Kavukcuoglu는 출시 자료의 구성을 뒤로 미루면서 Google이 가격 대비 성능만을 추구하는 것이 아니라 여전히 기본 역량을 주도할 계획이라고 밝혔습니다. 벤치마크 수치가 Google의 자체 평가 범위를 벗어나는 경우 회사는 시간을 벌었을 수 있습니다. 심지어 예산 플래시 계층도 이제 기업이 현재 가장 관심을 갖고 있는 기능인 코딩 분야에서 시장 리더와 경쟁하고 있습니다.

모든 것이 개선된 것은 아닙니다. Google 자체 차트에 따르면 에이전트적 컴퓨터 사용의 벤치마크인 OSWorld-2.0에서 3.8 Flash는 이전 버전보다 우수하지만 여전히 Claude Opus보다 큰 차이로 뒤지고 있습니다.

가용성

Gemini 3.8 Flash는 Antigravity 에이전트 코딩 도구인 Google AI Studio와 개발자용 Android Studio를 통해 즉시 사용할 수 있으며, 기업에서는 Gemini Enterprise를 통해 액세스할 수 있습니다. 소비자는 Pro 또는 Ultra 구독이 필요한 Gemini 앱, Google 검색의 AI 모드, 유료 구독자의 경우 Google Sheets 내에서 사용할 수 있습니다. AI Studio를 통해 계속해서 무료 실험이 가능합니다.

Google은 또한 모델의 개선된 3D 생성을 강조하여 회사의 Nano Banana 이미지 모델로 생성된 텍스처를 사용하여 Antigravity의 단일 프롬프트로 구축된 것으로 알려진 3D 게임을 보여주었습니다.

경쟁 수학은 간단합니다. 세 개의 주요 연구소는 이제 서로 몇 주 만에 최고 수준의 코딩 모델을 출시했으며, Google의 진입으로 경쟁사보다 가격이 5~7배 저렴하면서도 비슷한 코딩 성능을 주장하고 있습니다. 실제 개발자 경험이 벤치마크와 일치하는지 여부에 따라 이번 릴리스가 Google의 누락된 주력 제품에 대한 비판을 잠재울지 아니면 단순히 연기할지 여부가 결정됩니다.

---

AI보다 앞서 나가세요

최신 AI 뉴스, 분석, 획기적인 소식을 모두 한 곳에서 받아보세요.

AI 뉴스 자세히 보기 →