Google은 코딩 및 에이전트 작업 흐름을 위한 가장 지능적인 도구로 모델을 설명하는 Gemini 3.7 Flash를 출시했습니다. 이번 출시는 Gemini 3.6 Flash 출시 3주 만에 이루어졌으며 소프트웨어 엔지니어링, 지식 작업 및 웹 개발 전반에 걸쳐 상당한 개선을 제공합니다. 더 많은 AI 속보와 업계 분석을 보려면 AI Buzz Wire를 방문하세요.
Gemini 3.7 플래시의 새로운 기능
Google의 공식 발표에 따르면 3.7 Flash 릴리스는 개발자 피드백과 회사가 향후 모델에 도입할 계획인 새로운 알고리즘 혁신의 직접적인 결과입니다. 이 모델은 디버깅 및 문제 해결을 포함한 코딩 작업에서 이전 모델에 비해 강력한 이점을 보여주며, 1차 통과 코드 정확도가 높아지고 생산 준비 코드 생성 성능이 향상되었습니다.
FrontierCode 1.1 Main 벤치마크에서 3.7 Flash는 3.6 Flash의 34.4%에서 43.6%로 증가했습니다. 실제 소프트웨어 엔지니어링 작업을 평가하는 DeepSWE v1.1에서는 모델이 49.0%에서 65.3%로 향상됩니다.
웹 개발 및 지식 작업
웹 개발의 경우 Google은 3.7 Flash가 더 적은 프롬프트로 더 많은 기능 레이아웃과 기능을 갖춘 애플리케이션을 생성한다고 말합니다. 이 모델은 스크린샷, 이미지 또는 전체 디자인 시스템과 같은 참조 입력과 UI 출력을 일치시킬 때 높은 디자인 준수를 보여줍니다. Arena.ai의 WebDev Arena에서 3.7 Flash는 이전 버전의 1538에 비해 1588의 Elo 점수를 달성했습니다.
금융, 법률, 생명과학 등 지식 집약적 분야에서 이 모델은 향상된 추론과 정확성을 제공합니다. 복잡한 문서를 처리하는 모델의 능력을 테스트하는 GDP.pdf 벤치마크에서 3.7 Flash의 점수는 34.0%이고 3.6 Flash의 점수는 22.0%입니다. 실제 비즈니스 워크플로 완료를 측정하는 AutomationBench에서는 17.0%에서 30.4%로 향상됩니다.
가격 전략: 절반의 비용
이번 출시에서 가장 주목할만한 측면 중 하나는 가격입니다. Gemini 3.7 Flash는 입력 토큰 백만 개당 0.75달러, 출력 토큰 백만 개당 3.75달러의 출시 가격으로 제공됩니다. 이는 원래 3.6 Flash 가격의 정확히 절반입니다. 이 가격은 2026년 말까지 적용되며, 이후에는 2027년 1월 1일부터 입력 토큰 백만 개당 1.50달러, 출력 토큰 백만 개당 7.50달러의 표준 요율이 적용됩니다.
Google은 개발자와 고객이 향상된 성능과 저렴한 비용을 결합하여 프로덕션 지원 에이전트를 비용 효율적으로 확장할 수 있도록 지원한다고 포지셔닝합니다.
향상된 개발자 경험
원시 벤치마크 외에도 Google은 개발자 경험의 의미 있는 개선을 강조합니다. 모델은 장애물에 더 잘 적응하고, 필요할 때 의도를 명확히 하며, 지침을 더 충실하게 따릅니다. 더욱 부지런히 생각하고 다단계 계획 및 도구 호출에 더 많은 노력을 투자하여 엔지니어링 워크플로우 전반에 걸쳐 수동 감독과 재시도 횟수를 줄여 더욱 체계적인 실행을 실현합니다.
제미니 스파크 업그레이드
160개 이상의 국가에서 Google AI Pro 및 Ultra 구독자가 사용할 수 있는 Google의 개인 AI 에이전트인 Gemini Spark가 이제 Gemini 3.7 Flash에서 실행됩니다. Google은 Spark를 사용자의 지시에 따라 사용자를 대신하여 조치를 취하는 연중무휴 에이전트로 설명합니다. 모델 업데이트를 통해 Google Workspace 애플리케이션의 도구 사용이 개선되고 복잡한 다중 기술 워크플로의 정확성이 향상되어 Spark의 지식 작업 효율성이 더욱 높아졌습니다.
안전 및 보호 조치
Gemini 3.7 Flash는 CBRN(화학, 생물학, 방사능, 핵) 위협 및 사이버 공격과 관련된 도메인의 오용을 방지하는 업데이트된 보호 기능을 제공하는 동시에 유익한 사용 사례도 지원합니다. Google은 이러한 보호가 생체 탄력성과 사이버 프로그램에 대한 접근 방식과 일치한다고 말합니다.
더 넓은 경쟁 상황
이번 출시는 AI 개발 시장을 두고 치열한 경쟁이 벌어지는 가운데 이뤄졌다. 개척 수준의 코딩과 에이전트 성능을 공격적인 가격과 결합하는 것에 대한 Google의 강조는 Anthropic, OpenAI 및 xAI와 같은 경쟁업체에 압력을 가하고 있습니다. DeepSeek가 V4 Pro 모델을 출시하고 xAI가 Grok 4.6을 출시하면서 Google은 모델 개발자가 예산을 초과하지 않고 유능한 코딩 및 에이전트 성능이 필요할 때 도달해야 하는 모델로 3.7 Flash를 확실히 포지셔닝하고 있습니다.
3.6 Flash와 3.7 Flash 사이의 3주 간의 급속한 흐름은 중간 계층 라인업에 대한 반복적이고 빠른 속도의 모델 개선에 대한 Google의 의지를 나타냅니다.
AI보다 앞서 나가세요
최신 AI 개발, 모델 출시, 업계 분석을 보려면 AI 버즈와이어를 즐겨찾기에 추가하세요.
AI 뉴스 자세히 보기 →