구글이 ‘제미나이 3.6 플래시(Flash)’, ‘3.5 플래시-라이트(Flash-Lite)’, 그리고 ‘3.5 플래시 사이버(Flash Cyber)’를 소개합니다
AI 에이전트를 실제 서비스 환경에 구축하는 개발자와 고객에게는 더욱 높은 토큰 효율성과 낮은 지연 시간, 그리고 안정적인 성능이 중요합니다. 구글의 플래시(Flash) 모델 시리즈는 이러한 요구를 충족할 수 있도록 최적의 효율성과 성능의 균형을 바탕으로 에이전틱 워크플로우를 대규모로 확장할 수 있도록 설계되었습니다. 구글은 제미나이 3.5 플래시(Gemini 3.5 Flash)를 기반으로 다음과 같은 새로운 제미나이 모델들을 선보입니다.
- 3.6 플래시(3.6 Flash): 코딩, 지식 기반 작업(knowledge work), 멀티모달 성능을 향상시킨 주력 모델입니다. 아티피셜 애널리시스 인덱스(Artificial Analysis Index)에 따르면, 제미나이 3.5 플래시 대비 출력 토큰 사용량을 17% 줄였으며, 데이터커브(Datacurve)의 DeepSWE와 같은 일부 벤치마크에서는 최대 65%까지 출력 토큰 사용량을 절감하는 동시에, 출력 토큰당 비용도 낮췄습니다.
- 3.5 플래시-라이트(3.5 Flash-Lite): 제미나이 3.5 모델 중 가장 빠르고 비용 효율적인 모델입니다. 아티피셜 애널리시스 인덱스 기준 초당 350개의 출력 토큰을 생성하며 에이전틱 워크플로우에서 이전 플래시-라이트 버전보다 뛰어난 성능을 제공합니다.
- 코드멘더 내 3.5 플래시 사이버(3.5 Flash Cyber in CodeMender): 효과적인 사이버 보안 애플리케이션을 구현하려면 모델과 에이전트 인프라가 긴밀하게 연동되어야 합니다. 이를 위해 구글은 사이버 보안에 특화된 새로운 모델과 코드 보안 에이전트인 ‘코드멘더(CodeMender)’를 결합해 최첨단 수준의 경쟁력 있는 성능을 제공합니다.
오늘 발표한 모델 외에도, 구글은 현재 파트너들과 함께 제미나이 3.5 프로의 테스트를 진행 중에 있으며ㅡ 준비가 완료되는 대로 정식 출시할 예정입니다. 이와 동시에 구글 팀은 이미 차세대 모델 개발에 집중하고 있습니다. 구글은 역대 가장 야심 찬 사전 학습 작업을 시작하며 제미나이 4(Gemini 4) 개발에 박차를 가하고 있으며, 앞으로의 발전을 기대하고 있습니다.
3.6 플래시(3.6 Flash): 제미나이 3.5 플래시 대비 더 높은 효율성과 향상된 품질
제미나이 3.6 플래시는 3.5 플래시에 대한 개발자와 고객의 피드백을 바탕으로 개발됐습니다. 3.6 플래시는 코딩 및 지식 기반 작업 성능을 한 단계 끌어올렸을 뿐만 아니라, 토큰 효율성을 유의미하게 개선했습니다. 예를 들어 아티피셜 애널리시스 인덱스에 따르면, 3.6 플래시는 3.5 플래시보다 출력 토큰 사용량을 17% 줄였습니다. 또한 다단계 워크플로우를 수행하는 데 필요한 추론 단계와 툴 호출(tool calls) 횟수도 줄었습니다.
이러한 효율성 향상은 더 낮아진 가격과 함께 더 큰 가치를 제공합니다. 3.6 플래시는 입력 토큰 100만 개당 1.50 달러, 출력 토큰 100만 개당 7.50 달러의 가격으로 제공되며, 에이전틱 작업의 전체 비용을 낮춰 에이전트 구축 및 운영의 비용 효율성을 크게 높여줍니다.
3.6 플래시는 OS월드(OSWorld) 검증 작업(API)에서 3.5 플래시 대비 더 높은 토큰 효율성과 더욱 간결한 출력 결과를 제공합니다.
3.6 플래시는 효율성을 높이는 동시에 다양한 활용 사례 전반에서 3.5 플래시를 능가하는 성능을 제공합니다.
- 코딩 정확도와 머신러닝 연구 성능 향상: DeepSWE(49% vs. 37%)에서 확인할 수 있듯이 불필요한 코드 수정과 반복 실행 루프를 줄여 더 높은 정확도를 구현하며, MLE Bench(63.9% 대 49.7%)에서도 머신러닝 연구(ML Research) 연구 성능이 크게 향상되었습니다.
- 컴퓨터 활용(Computer Use) 기능 향상: OS월드 검증(OSWorld-Verified)(83.0% vs.대 78.4%) 결과에서 확인할 수 있듯이 컴퓨터 활용 기능이 향상되었습니다. 또한 컴퓨터 활용 기능은 이제 제미나이 API(Gemini API) 및 제미나이 엔터프라이즈(Gemini Enterprise)에서 클라이언트 사이드 기본 제공 툴로 사용할 수 있습니다.
- 지식 기반 작업 및 멀티모달 성능 향상: GDPval-AA v2(1421 vs. 1349)와 같은 벤치마크에서 보여주었듯이,지식 기반 작업에서 3.5 플래시보다 우수한 성능을 보였습니다. 또한 헤비아(Hebbia) 및 하비(Harvey)와 같은 고객사들은 문서 파싱(document parsing), 차트 및 데이터 분석, 보고서 작성과 같은 멀티모달 작업에서 3.6 플래시가 특히 뛰어난 성능을 발휘했다고 평가했습니다.
AIS의 관리형 에이전트(Managed Agents)를 활용한 3.6 플래시(AIS)는 3.5 플래시 대비 금융 데이터 및 녹취록을 더욱 정확하고 효율적으로 분석하도록 지원합니다.
3.6 플래시는 AGY의 멀티 에이전트 오케스트레이션을 활용하여 3.5 플래시(AGY)보다 더 낮은 지연 시간과 높은 품질로 코드 마이그레이션을 실행합니다.
3.6 플래시는 제미나이 앱인 캔버스를 활용해 3D 워크플로우를 위한 사진 기반 텍스처 추출기(photographic texture extractor) 개발을 지원합니다.
3.6 플래시는 뛰어난 시각적 이해 능력(AGY)을 바탕으로 AGY와 tldraw 오프라인 에디터를 활용해 대화형 테마 스튜디오를 구축합니다.
고객들은 3.6 플래시가 복잡한 워크플로우와 지식 기반 작업에서도 토큰 효율성, 정확도, 속도의 균형을 유지하며, 비용과 품질 모두에서 한 단계 발전했다고 평가합니다.
안전성을 고려한 설계
3.6 플래시는 화학, 생물학, 방사능, 핵(CBRN) 및 사이버 공격 악용 분야에 대해 강화된 프론티어 세이프티(Frontier Safety) 보호 체계를 적용해 출시됩니다. 이를 통해 해당 모델의 탈옥(jailbreak)시도에 훨씬 더 잘 견딜수 있으며, 동시에정당한 목적의 사용에 대해서는 불필요한 응답 거부를 최소화하도록 학습되었습니다.
보다 더 자세한 내용은 3.6 플래시 모델 카드에서 확인하실 수 있습니다.
3.5 플래시-라이트: 에이전틱 워크플로우 확장을 위한 설계
구글은 플래시 모델과 함께 제미나이 3.5 플래시-라이트도 새롭게 선보입니다. 제미나이 3.5 플래시-라이트는 에이전틱 검색 및 문서 처리와 같이 낮은 지연 시간과 높은 처리량이 중요한 개발자 워크플로우를 위해 설계되었습니다. .
3.5 플래시-라이트는 3.5 시리즈 중 가장 빠른 모델입니다. 아티피셜 애널리시스 측정 기준 초당 350개의 출력 토큰을 생성하며, 입력 토큰 100만 개당 0.3 달러, 출력 토큰 100만 개당 2.5 달러의 가격으로 제공됩니다. 또한 3.1 플래시-라이트보다 품질이 크게 향상돼, 고처리량 프로덕션 트래픽을 운영하는 개발자와 고객에게 뛰어난 가성비(price-to-performance ratio)를 제공합니다.
3.5 플래시-라이트는 3.5 플래시보다 더 낮은 지연 시간으로 대용량 작업을 실행합니다.
3.5 플래시-라이트는 에이전틱 시스템을 더욱 효율적으로 확장하도록 지원합니다. 다양한 사고 수준(thinking levels) 전반에 걸쳐 3.1 플래시-라이트를 크게 능가하는 성능을 제공합니다. 개발자는 워크로드에 따라 '최소(minimal)' 또는 '낮음(low)' 사고 수준을 설정해 대용량 작업을 낮은 지연 시간과 비용으로 처리하거나, 더 높은 사고 수준을 활성화해 여러 단계로 이루어진 서브에이전트(subagent) 워크로드를 처리하도록 모델을 구성할 수 있습니다. 또한 이제 컴퓨터 활용 기능이 내장 되어 다양한 영역에서 이러한 에이전틱 작업을 더안정적으로 지원합니다.
3.5 플래시-라이트는 터미널-벤치 2.1(Terminal-Bench 2.1)(54% vs. 31%)에서 확인할 수 있듯이, 코딩과 에이전틱 작업 성능을 크게 향상시켰으며, GDM-MRCR v2(72.2% vs. 60.1%)에서는 긴 문맥(long context) 처리 능력이, GDPval-AA v2(1140 vs. 642)에서는 실제 작업 수행 능력이 크게 개선되었습니다.
실제로 3.5 플래시-라이트는 SWE-벤치 프로(SWE-Bench Pro)(54.2% vs. 49.6%) 및 OS월드 인증(OSWorld-Verified)(74.0% vs. 65.1%)를 비롯한 여러 에이전틱 및 코딩 벤치마크에서 3 플래시보다 뛰어난 성능을 기록했습니다. 이를 통해 2.5 및 3 플래시 기반 워크로드 모두에 비해 더 빠르고 강력한 선택지를 제공합니다.
3.5 플래시-라이트는 방대한 이커머스 데이터세트에서 제품 특성을 추출하고 이를 종합합니다.
마스터 에이전트인 3.6 플래시와 함께 작동하는 3.5 플래시-라이트는 즉시 탐색 가능한 25개의 고유한 웹 디자인 콘셉트를 즉시 생성합니다.
3.5 플래시-라이트는 멀티모달 이해 능력을 바탕으로 영수증 번역과 요약 작업을 대규모로 처리하도록 지원합니다.
3.5 플래시-라이트는 여러 게임 아이디어를 즉시 생성하고 반복적으로 개선하여 게임 제작을 지원합니다.
3.5 플래시-라이트를 초기 도입한 고객들은 에이전틱 워크플로우 및 데이터 처리 작업을 확장하는 데 있어, 속도와 성능, 비용 효율성을 두루 갖춘 점을 높이 평가하고 있습니다.
모델에 대한 더 자세한 내용은 3.5 플래시-라이트 모델 카드에서 확인하실 수 있습니다.
코드멘더의 3.5 플래시 사이버: 취약점을 더욱 빠르고 효율적으로 탐지 및 수정
AI 모델은 이제 기존 시스템이 보안 취약점을 수정하는 속도보다 더 빠르게 취약점을 찾아낼 수 있는 수준에 도달했습니다. 이러한 위협에 효과적으로 대응하려면, 뛰어난 성능과 높은 효율성을 갖춘 소프트웨어 보안 접근 방식이 필요합니다.
플래시의 성능과 효율성은 코드 보안 취약점을 대규모로 탐지하고 검증하며 패치하는데 최적의 기반을 제공합니다. 제미나이 3.5 플래시 사이버는 3.5 플래시를 기반으로 사이버 보안 취약점 탐지와 수정에 특화되도록 미세 조정 되었으며, 대형 모델보다 더 낮은 토큰당 비용으로 해당 작업을 수행할 수 있습니다.
여러 개의 3.5 플래시 사이버 에이전트가 함께 협력하여 하나의 통합 보고서를 작성하는 코드 멘더 내에서, 3.5 플래시 사이버는 최첨단 AI 벤치마크인 사이버짐(CyberGym)에서 최고 수준(Frontier)에 필적하는 경쟁력 있는 성능을 달성했습니다.
이 기술이 지닌 이중 용도(dual-use)적 특성을 고려해 구글은 3.5 플래시 사이버를 신중하게 배포하고 있습니다. 이 모델은 제한된 접근 권한으로 운영되는 파일럿 프로그램의 일환으로, 곧 코드멘더를 통해 정부 기관과 신뢰할 수 있는 파트너에게만 독점 제공될 예정입니다. 이를 통해 광범위한 악용 가능성을 줄이는 동시에, 중요한 취약점이 악용되기 전에 보안 담당자들이 이를 먼저 발견하고 수정할 수 있는 우위를 확보하도록 지원합니다.
3.6 플래시 및 3.5 플래시-라이트: 지금 바로 시작해 보세요
3.6 플래시 및 3.5 플래시-라이트는 오늘부터 사용하실 수 있습니다.
- 개발자 대상: 구글 AI 스튜디오(Google AI Studio)와 안드로이드 스튜디오(Android Studio)에서 제미나이 API(Gemini API)를 통해 이용하실 수 있습니다. 또한 제미나이 3.6 플래시는 구글 안티그래비티(Google Antigravity)에서도 사용 가능합니다. 자세한 내용은 개발자 가이드를 참고해 주세요.
- 기업 고객 대상: 제미나이 엔터프라이즈 에이전트 플랫폼(Gemini Enterprise Agent Platform)에서 이용하실 수 있습니다. 제미나이 3.6 플래시는 제미나이 엔터프라이즈(Gemini Enterprise) 앱에서도 사용할 수 있습니다.
- 모든 이용자 대상: 제미나이 앱을 통해 이용하실 수 있습니다. 또한 제미나이 3.5 플래시-라이트는 구글 검색에도 순차적으로 적용되고 있습니다.
제미나이 3.6 플래시 및 3.5 플래시-라이트를 활용해 새로운 프로젝트를 시작해 보시기 바라며, 향후 제미나이 모델 개선을 위해 여러분의 소중한 피드백을 기다리겠습니다. 곧 공개될 제미나이 3.5 프로(Gemini 3.5 Pro)에도 많은 관심 부탁드립니다.