Google은 2026년 7월 21일에 세 가지 새로운 Gemini 모델을 출시하여 개발자가 대규모 프로덕션 AI 에이전트를 구축하는 데 필요한 효율성과 비용 효율성을 두 배로 높였습니다. 회사는 Gemini 3.6 Flash, Gemini 3.5 Flash-Lite 및 Gemini 3.5 Flash Cyber를 공개했으며, 각각은 점점 더 경쟁이 치열해지는 AI 모델 환경의 다양한 부문을 대상으로 합니다. AI 속보의 최신 개발 내용을 포괄적으로 보도하기 위해 이번 릴리스는 비용에 민감한 개발자 시장에서 승리하려는 Google의 가장 공격적인 추진을 의미합니다.

이번 발표는 검색 업계의 중추적인 순간에 이루어졌습니다. OpenAI 및 Anthropic과 같은 경쟁업체가 주력 모델로 주목을 받은 반면, Google의 Flash 시리즈는 AI 에이전트를 경제적이고 안정적으로 실행해야 하는 개발자를 위한 틈새 시장을 개척했습니다. 새로운 모델은 에이전트 워크플로우 전반에 걸쳐 품질과 효율성 모두에서 중요한 단계를 나타냅니다.

Gemini 3.6 플래시: 새로운 주력 모델

Gemini 3.6 Flash는 이전 3.5 Flash를 사용하는 개발자의 피드백을 직접 바탕으로 구축된 Google의 주력 모델로 자리잡고 있습니다. 제품 관리 수석 이사 Tulsee Doshi가 작성한 Google의 발표에 따르면 이 모델은 향상된 코딩, 지식 작업 및 다중 모드 성능을 제공하는 동시에 토큰 소비를 의미 있게 줄입니다.

인공 분석 지수에서 Gemini 3.6 Flash는 이전 버전보다 17% 적은 출력 토큰을 소비합니다. Datacurve의 DeepSWE와 같은 일부 벤치마크에서는 감소가 최대 65%에 이릅니다. 또한 이 모델은 다단계 워크플로우를 달성하기 위해 필요한 추론 단계와 도구 호출이 더 적습니다.

가격은 입력 토큰 백만 개당 1.50달러, 출력 토큰 백만 개당 7.50달러로 설정되어 이전 세대보다 저렴합니다. 이를 통해 에이전트를 대규모로 구축하고 실행하는 데 더 비용 효율적이게 됩니다. 이는 수천 개의 동시 작업에 AI를 배포하는 기업의 중요한 요소입니다.

벤치마크 개선

Google은 3.5 Flash에 비해 몇 가지 주목할 만한 성능 향상을 보고했습니다.

  • DeepSWE: 49% 대 37%, 원치 않는 편집 횟수 감소 및 실행 루프 감소로 코드 편집의 정밀도가 높아졌음을 반영합니다.
  • MLE 벤치: 63.9% 대 49.7%, 머신러닝 연구 역량이 크게 향상되었습니다.
  • OSWorld 검증: 83.0% vs 78.4%, 향상된 컴퓨터 사용 능력을 보여줌
  • GDPval-AA v2: 1421 대 1349, 지식 작업 작업의 이득을 반영

이제 컴퓨터 사용이 Gemini API 및 Gemini Enterprise를 통해 내장된 클라이언트 측 도구로 제공되므로 타사 오케스트레이션 레이어가 필요하지 않습니다.

Gemini 3.5 Flash-Lite: 속도와 확장성을 위해 제작됨

Flash 업그레이드와 함께 Google은 에이전트 검색 및 문서 처리와 같은 대기 시간이 짧은 작업과 처리량이 높은 워크로드를 위해 설계된 Gemini 3.5 Flash-Lite를 출시했습니다. 인공 분석으로 측정한 결과 초당 350개의 출력 토큰으로 실행되는 3.5 시리즈에서 가장 빠른 모델입니다.

입력 토큰 백만 개당 0.30달러, 출력 토큰 백만 개당 2.50달러라는 공격적인 가격으로 책정된 Flash-Lite는 프로덕션 트래픽을 대규모로 실행하는 개발자에게 강력한 가격 대비 성능 비율을 제공합니다. Google은 많은 에이전트 및 코딩 평가에서 이 모델이 SWE-Bench Pro(54.2% 대 49.6%) 및 OSWorld 검증(74.0% 대 65.1%)을 포함하여 더 큰 Gemini 3 Flash보다 성능이 더 뛰어나다고 지적했습니다.

이 모델은 구성 가능한 사고 수준을 지원하므로 개발자는 대용량 작업에 대해 지연 시간이 짧은 실행에 우선 순위를 두거나 복잡한 다단계 하위 에이전트 워크로드에 대해 더 높은 사고 수준을 사용할 수 있습니다.

Gemini 3.5 Flash Cyber: 코드 보안을 위한 AI

세 번째 릴리스인 Gemini 3.5 Flash Cyber는 사이버 보안 취약성을 찾아 수정하기 위해 미세 조정된 전문 모델입니다. 3.5 Flash를 기반으로 구축된 이 제품은 여러 Flash Cyber ​​에이전트를 사용하여 결합된 보안 보고서를 생성하는 Google의 CodeMender 에이전트와 쌍을 이룹니다.

CyberGym 벤치마크에서 모델은 최전선에서 경쟁력 있는 성능에 도달했습니다. 그러나 이 기술의 이중 용도 특성을 고려하여 Google은 배포에 대해 의도적으로 신중한 접근 방식을 취하고 있습니다. 이 모델은 제한된 액세스 파일럿 프로그램의 일환으로 CodeMender를 통해 정부 및 신뢰할 수 있는 파트너에게 독점적으로 제공됩니다.

이를 통해 일선 방어자들은 심각한 취약점이 악용되기 전에 이를 찾아 수정하는 동시에 광범위한 오용의 위험을 완화할 수 있습니다.

Gemini 3.5 Pro는 아직 테스트 중입니다.

Google은 지연이 면밀히 관찰되고 있는 주력 모델인 Gemini 3.5 Pro가 현재 파트너와 테스트 중이며 준비되는 대로 광범위하게 출시될 것이라고 확인했습니다. 회사는 이전에 내부 성과 목표와 연구원 이탈의 물결로 인해 Pro 출시를 연기했습니다.

아마도 가장 주목할만한 점은 Google이 팀이 이미 Gemini 4에 대한 가장 야심찬 사전 훈련 실행을 시작했다고 공개하여 차세대 모델이 이미 진행 중임을 나타냅니다.

강화된 안전 보호 장치

Gemini 3.6 Flash는 화학, 생물학, 방사선 및 핵(CBRN) 위협 및 사이버 공격 오용 분야에서 향상된 Frontier Safety 보호 기능을 제공합니다. Google은 이러한 보호 장치를 통해 모델이 탈옥에 대한 저항력을 훨씬 더 강화하는 동시에 유익한 사용에 대한 거부를 최소화한다고 말합니다.

이번 출시는 워싱턴에서 AI 모델 안전성에 대한 조사가 강화되는 가운데 이루어졌으며, 트럼프 행정부는 기업들이 공개 출시 전에 미공개 모델을 정부 테스터와 공유하도록 압력을 가하고 있습니다. Google DeepMind와 Microsoft는 2026년 5월 정부의 AI 표준 및 혁신 센터와 국가 안보 테스트를 위한 개척 모델을 공유하는 계약을 체결했습니다.

가용성

Gemini 3.6 Flash 및 3.5 Flash-Lite는 Gemini API, Google AI Studio 및 Android Studio를 통해 개발자가 즉시 사용할 수 있습니다. 기업 고객은 Gemini Enterprise Agent Platform을 통해 액세스할 수 있습니다. Gemini 앱은 소비자 사용을 위해 두 모델을 모두 지원하며 3.5 Flash-Lite가 Google 검색에서 출시됩니다.

AI보다 앞서 나가세요

인공 지능의 세계에서 더 많은 것을 원하시나요? 신뢰할 수 있는 최신 AI 산업 보도를 보려면 AI Buzz Wire를 즐겨찾기에 추가하세요.

AI 뉴스 자세히 보기 →