Google, 신규 Gemini Flash 2종 동시 공개
Google은 2025년 AI 모델인 「Gemini 3.8 Flash」와 사이버보안 특화판 「Gemini 3.8 Flash Cyber」 2가지 모델을 동시에 발표했다. 범용 버전은 에이전트 처리와 다단계 추론을 강화했으며, Cyber 버전은 취약점 발견과 패치 적용에 특화되어 있다. Gemini 3.8 Flash는 Gemini Enterprise 및 일부 개발자용 도구에서 즉시 사용 가능하게 되었다.

Google은 AI 모델 「Gemini」 시리즈의 새로운 버전으로 「Gemini 3.8 Flash」와 「Gemini 3.8 Flash Cyber」 2가지 모델을 발표했다. 전자는 AI 에이전트(인간 대신 여러 작업을 자율적으로 수행하는 AI)와 복잡한 추론 작업을 주요 용도로 설계되었으며, 후자는 사이버보안 분야의 취약점 발견과 수정에 특화되어 있다.
Gemini 3.8 Flash는 6주 동안 Google이 투입한 3번째 Flash 모델에 해당하며, 이전 버전인 3.7 Flash 이후 곧바로 출시되었다. Google의 최고경영자는 코딩, 에이전트 처리, 다단계 추론 분야에서 이전 버전 대비 크게 개선되었다고 밝혔다. 예를 들어, 코딩 성능을 측정하는 DeepSWE 벤치마크에서는 많은 대규모 첨단 모델을 능가하는 결과를 더 낮은 비용으로 달성했다고 한다.
가격은 입력 토큰 100만 개당 0.75달러, 출력 토큰 100만 개당 3.75달러로 3.7 Flash 도입 시점과 동일 수준으로 책정되었다. 컨텍스트(한 번에 처리할 수 있는 정보량)는 입력 100만 토큰, 출력 6만 4,000 토큰까지 지원하며, 텍스트 외에도 이미지, 음성, 동영상, PDF를 입력으로 받아들인다. 사용자는 품질, 비용, 처리 속도의 우선순위에 맞춰 모델의 처리량을 조정할 수 있다. Google의 블로그에 따르면, 계산 효율을 중시하는 경우 3.7 Flash를 계속 사용할 수도 있으며, 두 모델은 용도에 맞춰 선택하여 사용할 것을 전제로 한다.
성능 면에서는 금융 에이전트를 평가하는 「Vals Finance Agent V2」와 법률 작업을 평가하는 「Harvey's Legal Agent Benchmark」에서 이전 모델이나 다른 기업의 첨단 모델을 능가했다. 또한 다양한 학문 분야에 걸친 난제를 모은 「Humanity's Last Exam(HLE)」의 검증 버전에서는 54.9%의 점수를 기록했다. Google은 이를 수학, 과학, 인문학에 걸친 다단계 추론이 필요한 문제에 대한 대응 능력으로 평가하고 있다.
사이버보안 특화 버전인 Flash Cyber에 대해 Google의 최고경영자는 「동사의 사이버보안 모델 중 가장 높은 능력을 갖춘 모델」이라고 밝혔다. 취약점 발견과 대규모 패치 적용에서는 최첨단 수준의 성능에 도달한 것으로 알려졌으며, 사이버보안 벤치마크 「CyberGym」에서 86.2%, AI의 패치 적용 능력을 평가하는 「CWE-Bench」에서 47.2%를 달성했다. 더불어 Google 사내 벤치마크에서는 20종류의 프로그래밍 언어에 걸친 취약점 발견에서 70% 이상의 성공률을 보였다고 한다.
Gemini 3.8 Flash는 Gemini Enterprise 대상으로 이미 제공이 시작되었으며, 개발자는 Google AI Studio, Google Antigravity, Android Studio, UI 디자인 도구인 Stitch를 통해 Gemini API로 시도할 수 있다. AI 에이전트의 실용화가 진행되는 가운데, 범용 추론 능력과 사이버보안이라는 전문 분야를 별도 모델로 나누어 제공하는 접근 방식은 용도에 맞는 최적의 모델을 선택하여 사용하는 기업용 구현 스타일을 의도한 것으로 볼 수 있다.
본 기사는 AI issue 편집부가 사실(fact)을 바탕으로 독자적으로 작성·편집한 저작물입니다. 저작권은 AI issue에 있으며, 무단 전재·재배포 및 AI 학습·활용을 금합니다.