KirinNews

구글, 추론 및 에이전트 성능 극대화한 '제미나이 3.8 플래시' 및 보안 특화 '사이버' 전격 출시

구글, 추론 및 에이전트 성능 극대화한 '제미나이 3.8 플래시' 및 보안 특화 '사이버' 전격 출시

Key Points

  • 1구글이 소프트웨어 엔지니어링과 에이전트 작업에 최적화된 '제미나이 3.8 플래시'와 보안 전용 '3.8 플래시 사이버' 모델을 출시했습니다.
  • 2제미나이 3.8 플래시는 DeepSWE v1.1 등 주요 벤치마크에서 고비용 프론티어 모델을 능가하는 자율 코딩 및 복합 추론 성능을 기록했습니다.
  • 3이전 버전(3.7 플래시)과 동일한 토큰당 비용(입력 100만 토큰당 0.75달러)으로 제공되어 개발자들의 도입 부담을 최소화했습니다.
  • 4사이버 보안 특화 모델은 취약점 자율 탐지 및 자동 패치(CWE-Bench 47.2%)에서 세계 최고 수준의 성능을 입증했습니다.
  • 5범용 모델은 Google AI Studio 등을 통해 즉시 사용 가능하며, 사이버 모델은 보안 검증을 거친 '페어윈드 프로그램' 파트너에게만 제한적으로 제공됩니다.
구글이 전작 대비 소프트웨어 엔지니어링 및 복합 추론 역량을 크게 향상시킨 '제미나이 3.8 플래시'와 사이버 보안 전용 모델 '3.8 플래시 사이버'를 전격 공개했습니다. 3.8 플래시 모델은 이전 버전과 동일한 가격을 유지하면서 자율형 에이전트 작업에서 프론티어급 성능을 제공합니다.

구글(Google)이 이전 버전 출시 불과 6주 만에 소프트웨어 엔지니어링과 에이전트 워크플로우에 최적화된 새로운 AI 모델 '제미나이 3.8 플래시(Gemini 3.8 Flash)'와 사이버 보안 전용 모델 '제미나이 3.8 플래시 사이버(Gemini 3.8 Flash Cyber)'를 전격 출시했습니다. 이번 업데이트는 복합적인 추론 능력을 대폭 강화하면서도 기존 3.7 플래시와 동일한 비용과 속도를 유지한 것이 가장 큰 특징입니다.

주력 모델인 '제미나이 3.8 플래시'는 복잡한 소프트웨어 엔지니어링 문제를 자율적으로 해결하는 능력을 평가하는 DeepSWE v1.1 벤치마크에서 고비용의 프론티어 모델들을 능가하는 성과를 보였습니다. 구글에 따르면 이 모델은 복잡한 과제가 주어질 경우 더 많은 추론 단계를 거치고 도구를 반복적으로 호출하는 등 이른바 '더 열심히 일하는(works harder)' 구조로 설계되었습니다. 그럼에도 불구하고 토큰당 가격은 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러로 3.7 플래시의 출시 가격과 동일하게 책정되어 비용 효율성을 극대화했습니다.

함께 공개된 '제미나이 3.8 플래시 사이버'는 자율적인 취약점 탐지 및 패치 생성에 특화된 모델입니다. CyberGym 벤치마크와 다국어 코드베이스 환경에서 프론티어급 취약점 발견 성공률(70% 이상)을 기록했으며, CWE-Bench 기반 자동화 패치 평가에서도 47.2%의 높은 성공률을 달성했습니다. 이미 구글 내부 크롬 보안팀과 클라우드 취약점 연구팀 등에 도입되어 일반 모델 대비 2.6배 높은 패치 정확도를 입증했으며, 파트너사인 위즈(Wiz)의 내부 테스트에서도 선도 모델 대비 2.3~5.2배 낮은 비용으로 높은 탐지율을 기록했습니다.

제미나이 3.8 플래시는 현재 Google AI Studio, Gemini API, Google Antigravity 등을 통해 개발자들에게 즉각 제공되며, 보안 특화 모델인 사이버 버전은 검증된 인프라 운영자 및 보안 전문가들을 대상으로 하는 '페어윈드 프로그램(Fairwind Program)'을 통해서만 제한적으로 접근할 수 있습니다. 프론티어급 지능을 저비용으로 제공하는 이번 신규 모델 출시는 엔터프라이즈 환경에서의 AI 에이전트 도입과 사이버 방어 자동화를 더욱 가속화할 전망입니다.