Gemini 3.8 Flash: 코딩과 AI 에이전트의 새로운 기능
Google의 가장 빠르게 출시되는 핵심 모델이 코딩, 에이전트 추론, 사이버보안 기능을 업그레이드했습니다 — 실제로 무엇이 달라졌는지 알아보세요.

Google이 Gemini 3.8 Flash를 출시했습니다. 약 6주 만에 세 번째 Flash 릴리스이자 "가장 지능적인 핵심 워크호스 모델"입니다. 핵심 메시지는 간단합니다. 소프트웨어 엔지니어링, 에이전트 작업, 다단계 추론에서 의미 있는 성능 향상을 이루면서도 3.7 Flash와 동일한 속도와 저렴한 가격을 유지한다는 것입니다. 별도의 Gemini 3.8 Flash Cyber 변형 모델은 취약점 발견 및 패치를 목표로 합니다. 이 가이드에서는 무엇이 변경되었는지, Google이 공개한 벤치마크, 비용, 그리고 AI 에이전트를 구축하는 경우 어디에 적합한지 다룹니다.
Gemini 3.8 Flash란 무엇인가?
Gemini 3.8 Flash는 Google의 Flash 라인에 속하는 경량 멀티모달 모델로, 장기적인 코딩과 자율 에이전트에 최적화되어 있습니다. Google은 이를 "가장 지능적인 핵심 워크호스 모델"로 소개하며, 엔지니어링, 에이전트 작업, 전문 도메인 추론에서 3.7 Flash 대비 향상된 성능을 제공한다고 밝혔습니다 (Google).
2026년 9월 2일에 출시된 이 모델은 3.7 Flash 이후 3주 만에 등장했으며, Google이 7월 말 Gemini 3.6 Flash 이후 약 3주마다 새로운 Flash 모델을 출시하는 주기의 일환입니다 (Thurrott).
이번 릴리스에는 동일한 기반 지능 위에 구축된 두 가지 변형 모델이 포함됩니다:
- Gemini 3.8 Flash — 코딩, 에이전트, 엔터프라이즈 워크플로우를 위한 범용 핵심 모델.
- Gemini 3.8 Flash Cyber — 취약점 탐지 및 자동화된 패치를 위한 사이버보안 특화 모델로, 새로운 Fairwind Program을 통해 신뢰할 수 있는 방어자에게만 제공됩니다.
Gemini 3.7 Flash 대비 새로운 점
핵심은 3.8 Flash가 3.7 Flash 대비 "상당한 성능 향상"을 제공하면서도 "가격을 올리지 않고 고비용 프론티어 모델의 성능에 근접하는 경우가 많다"는 것입니다 (9to5Google).
Google은 이 도약을 하나의 설계 선택에서 비롯된 것으로 설명합니다. 모델이 더 열심히 작동한다는 것입니다. 복잡한 작업에서 더 많은 추론 단계를 수행하고 도구를 반복적으로 호출하는데, 이는 높은 노력 수준에서 더 많은 토큰을 사용할 수 있음을 의미합니다. 컴퓨팅 비용이 주요 제약 조건이라면, Google은 노력 수준을 낮추거나 효율성 우선 워크로드에 계속 지원되는 3.7 Flash를 유지할 것을 권장합니다.
이 트레이드오프는 에이전트 개발자에게 중요합니다. 더 철저한 작업 수행과 반복적인 도구 호출은 장기 실행 에이전트 루프에 필요한 바로 그것이지만, 대용량 저복잡도 작업에서는 토큰 지출을 주의해야 한다는 의미이기도 합니다.
Gemini 3.8 Flash 벤치마크
Google은 코딩, 금융, 법률, 일반 추론 분야에 걸친 결과를 공개했습니다. 아래의 모든 수치는 Google의 출시 자료에서 가져온 것이므로, 독립적인 테스트가 아닌 벤더 벤치마크로 이해하시기 바랍니다.
- DeepSWE v1.1 (장기 소프트웨어 엔지니어링): 3.8 Flash는 복잡한 엔지니어링 문제를 처음부터 끝까지 자율적으로 해결하는 데 있어 훨씬 저렴한 비용으로 대부분의 대형 프론티어 모델을 능가합니다 (Google).
- Vals Finance Agent V2 및 Harvey의 Legal Agent Benchmark: 3.8 Flash는 이러한 전문 도메인에서 3.7 Flash 및 다른 프론티어 모델을 능가합니다.
- HLE-Verified (Humanity's Last Exam): 54.9%로, Google은 이를 STEM, 인문학, 전문 분야에 걸친 다단계 추론의 증거로 제시합니다 (9to5Google).
공통적인 특징은 단순히 하나의 프롬프트에 답하는 것이 아니라, 계획을 세우고 도구를 사용하며 여러 단계에 걸쳐 작업을 유지해야 하는 도메인에서의 에이전트 역량입니다.
한 가지 주의할 점: 이전 모델과 마찬가지로 Gemini 3.8 Flash의 지식 컷오프는 일부 도메인에서 2026년 3월이며, 다른 도메인에서는 2025년 1월로 제한될 수 있습니다 (9to5Google). 최신 정보가 필요한 경우 최신 컨텍스트나 도구를 제공할 계획을 세우세요.
Gemini 3.8 Flash 가격
Google은 3.7 Flash와 동일한 도입 가격을 유지했습니다:
- 입력 토큰 100만 개당 $0.75
- 출력 토큰 100만 개당 $3.75
이 도입 가격은 2026년 12월 31일까지 적용되며, 이후 표준 가격은 입력 토큰 100만 개당 $1.50, 출력 토큰 100만 개당 $7.50으로 인상됩니다 (Google). 이 모델을 기반으로 구축하는 경우, 장기 비용 모델에 1월 가격 변경을 반영하세요. 또한 "더 열심히 작동"하는 특성으로 인해 복잡한 작업에서 출력 토큰 수가 증가할 수 있다는 점도 기억하세요.
Gemini 3.8 Flash 사용처
Google은 출시 첫날부터 소비자, 개발자, 엔터프라이즈 환경 전반에 걸쳐 제공합니다:
- 소비자: Gemini 앱, Google 검색의 AI Mode, Google AI Pro 및 Ultra 구독자를 위한 Google Sheets의 Gemini (Search Engine Journal).
- 개발자: Google Antigravity, AI Studio, Android Studio, Gemini API.
- 엔터프라이즈: Gemini Enterprise.
에이전트 개발자에게는 API 액세스가 가장 중요합니다. Google의 앱이 아닌 자체 오케스트레이션에 3.8 Flash를 통합할 수 있기 때문입니다.
Gemini 3.8 Flash Cyber: 보안 특화 변형 모델
Cyber 변형 모델은 이번 출시에서 가장 새로운 부분입니다. 방어자를 대상으로 하며 공격적 역량보다 취약점 수정을 우선시합니다. Google은 자율 취약점 발견의 표준 벤치마크인 CyberGym에서 프론티어 수준의 성능을 보고하며, 20개 프로그래밍 언어를 아우르는 내부 벤치마크에서 70% 이상의 성공률을 기록했습니다 (Google).
Google이 자체 보안팀에서 인용한 실제 결과:
- Chrome 보안팀은 3.8 Flash Cyber가 훨씬 큰 상용 모델보다 Chrome 취약점에 대해 2.6배 더 많은 정확한 패치를 생성했다고 밝혔습니다 (9to5Google).
- 보안 벤더 Wiz는 내부 침투 테스트 벤치마크에서 다른 주요 프론티어 모델 대비 2.3~5.2배 낮은 비용으로 7.5~9.7% 높은 재현율을 측정했습니다.
- Google의 Cloud Vulnerability Research 팀은 이를 활용해 일반적으로 수개월이 걸리는 작업인 중요한 기반 취약점을 2시간 이내에 발견했습니다.
단, 3.8 Flash Cyber는 신뢰할 수 있는 정부, 핵심 인프라 운영자, 소프트웨어 유지 관리자를 위한 Fairwind Program을 통해서만 제공됩니다. 일반 API로는 출시되지 않습니다.
3.7 Flash에서 전환해야 할까?
Google이 공개한 내용을 바탕으로 한 빠른 의사결정 가이드:
- 코딩 또는 다단계 에이전트를 구축 중인가? 3.8 Flash로 업그레이드하세요 — 더 나은 장기 엔지니어링과 도구 사용이 핵심입니다.
- 비용이 주요 고려사항인 대용량 단순 작업을 실행 중인가? 3.7 Flash를 유지하거나 낮은 노력 수준을 사용하세요. "더 열심히 작동"하는 특성이 토큰 비용을 높일 수 있습니다.
- 방어적 보안 작업을 수행하며 Fairwind 자격이 있는가? 3.8 Flash Cyber를 신청하세요.
- 최신 지식이 필요한가? 검색 또는 실시간 도구를 연결하세요 — 지식 컷오프로 인해 모델이 최근 이벤트를 자체적으로 알 수 없습니다.
나만의 AI 워크포스로 실현하기
Gemini 3.8 Flash는 Eigent가 실행되는 패턴, 즉 하나의 프롬프트에 답하는 것이 아니라 실제 작업을 계획하고 실행하는 장기적인 도구 호출 에이전트를 위해 설계되었습니다. Eigent는 오픈소스 "Cowork" 데스크톱 앱으로, 로컬에서 워크플로우를 자동화하는 멀티 에이전트 워크포스입니다. 코딩, 리서치, 문서 작업에 유능한 모델을 활용하면서 데이터를 내 컴퓨터에 보관할 수 있습니다. 3.8 Flash의 에이전트 성능 향상에 관심이 있다면, 에이전트 워크포스로 GitHub PR 검토하는 방법을 확인하거나, 최고의 오픈소스 AI 코딩 에이전트 비교 분석을 참고하세요. Eigent 다운로드하여 나만의 AI 워크포스를 구축해 보세요.
Recent Posts

Claude Fable 5.1과 Mythos 5.1: 새로운 기능 완벽 정리
Claude Fable 5.1과 Mythos 5.1 완벽 해설: 두 가지 안전장치 티어로 제공되는 동일한 모델, 새로운 벤치마크 결과, 약 25~45% 비용 절감, 그리고 접근 방법 안내.

GPT-6 Astra: OpenAI의 새 모델이 실제로 하는 일
GPT-6 Astra는 OpenAI의 새 플래그십 모델입니다. 주요 기능, 벤치마크 성능, 가격 정책, 그리고 AGI 헤드라인 뒤에 숨겨진 주의사항을 정리했습니다.

Muse Spark 1.3: Meta의 최전선 코딩 및 에이전트 모델 완전 해설
Muse Spark 1.3은 코딩과 에이전트 작업을 위한 Meta의 새로운 최전선 모델입니다. 벤치마크, 가격, xhigh vs max 변형, 변경 사항, 그리고 GPT 및 Claude와의 비교를 확인하세요.