344 읽음
구글, 제미나이 3.8 플래시 공개, 에이전트 및 보안 강화
스타트업엔
1
구글이 에이전트 기반 업무와 소프트웨어 개발, 사이버 보안에 특화된 차세대 생성형 AI 모델 ‘제미나이 3.8 플래시(Gemini 3.8 Flash)’를 공개했다. 빠른 응답 속도와 비용 효율성을 유지하면서 복잡한 추론과 장시간 코딩 작업을 수행하는 데 초점을 맞춘 것이 특징이다.

구글은 2일(현지시간) 제미나이 3.8 플래시와 함께 사이버 보안 분야에 특화한 ‘제미나이 3.8 플래시 사이버(Gemini 3.8 Flash Cyber)’를 선보였다고 밝혔다.

제미나이 3.8 플래시는 이전 모델인 3.7 플래시와 동일한 속도와 가격대를 유지하면서 추론 및 코딩 성능을 높인 주력 모델이다. 구글에 따르면 이용 가격은 100만 입력 토큰당 0.75달러, 100만 출력 토큰당 3.75달러다.

구글은 제미나이 3.7 플래시를 발표한 이후 약 3주 만에 3.8 플래시를 공개했다. 최근 6주 사이 세 번째 플래시 모델을 내놓으면서 경량·고효율 AI 모델 경쟁에서 개발 속도를 높이는 모습이다.

◇ 장시간 자율 작업에 초점…코딩·추론 능력 강화

제미나이 3.8 플래시의 핵심 변화는 장시간 자율 실행이 가능한 에이전트형 작업 능력이다.

구글은 모델이 복잡한 작업을 처리할 때 추가적인 추론 단계를 거치고 필요한 도구를 반복적으로 호출하도록 설계했다. 단순히 한 번의 질문에 답하는 방식에서 벗어나 문제를 여러 단계로 나누고 결과를 확인하면서 작업을 이어가는 방식이다.

특히 높은 노력 수준을 설정하면 문제 해결 과정에서 더 많은 토큰을 사용해 성능을 높일 수 있도록 했다. 반대로 연산 비용과 토큰 사용량을 줄여야 하는 서비스에서는 낮은 노력 수준을 선택할 수 있다.

복잡한 소프트웨어 엔지니어링 작업을 평가하는 DeepSWE v1.1에서 제미나이 3.8 플래시는 대규모 프론티어 모델과 비교해 경쟁력 있는 성능을 기록했다고 구글은 설명했다.

금융 및 법률 분야 에이전트 벤치마크에서도 이전 모델인 3.7 플래시와 다른 프론티어 모델을 앞서는 결과를 제시했다. HLE-Verified에서는 54.9%를 기록해 STEM, 인문학, 전문 업무를 포함한 다단계 추론 능력을 강조했다.

다만 벤치마크 결과는 평가 방식과 데이터셋에 따라 달라질 수 있는 만큼, 실제 기업 업무에서 동일한 성능이 구현되는지는 별도의 검증이 필요하다.

◇ 한 번의 프롬프트로 게임·지도·3D 도구 제작

구글은 제미나이 3.8 플래시의 에이전트형 개발 능력을 보여주는 사례도 공개했다.

구글 안티그래비티(Google Antigravity)에서는 간단한 프롬프트와 반복 명령을 활용해 사용자가 성 내부를 탐험하는 3D 게임을 제작했다. 퍼즐과 스토리텔링 요소를 포함하고 나노 바나나(Nano Banana)로 생성한 텍스처를 활용했다.

또 하나의 사례로는 단일 프롬프트를 이용해 DOS 버전의 구글 지도를 구현했다. 위치 탐색과 길찾기, 스트리트 뷰 기능을 포함해 실제 조작이 가능한 형태로 제작했다.

미국 지질조사국(USGS)의 실제 데이터셋을 활용해 지형도를 만들거나, 구글 AI 스튜디오에서 하드웨어 기기를 여러 층으로 분해해 보여주는 대화형 3D 시각화 도구도 구현했다.

AI 모델이 코드를 작성하는 수준을 넘어 필요한 도구를 활용하고 결과물을 반복적으로 개선하는 방향으로 발전하고 있다는 점을 보여주는 사례다.

◇ 사이버 보안 특화 모델도 출시…취약점 탐지·패치에 집중

구글은 일반적인 개발 및 업무용 모델과 별도로 사이버 보안에 특화한 제미나이 3.8 플래시 사이버도 공개했다.

해당 모델은 취약점 탐지와 자동 패치 등 방어 목적의 사이버 보안 작업에 초점을 맞췄다. 구글의 ‘페어윈드 프로그램(Fairwind Program)’을 통해 신뢰할 수 있는 보안 기관과 전문가 등에 우선 제공된다.

취약점 탐지 분야에서는 CyberGym 벤치마크에서 프론티어급 성능을 기록했다고 구글은 밝혔다. C/C++ 중심의 평가를 보완하기 위해 20개 프로그래밍 언어로 작성된 코드베이스를 대상으로 진행한 내부 평가에서도 70% 이상의 취약점 탐지 성공률을 기록했다.

취약점 자동 패치 성능을 평가하는 CWE-Bench에서는 47.2%의 pass@1을 기록했다. 구글은 현존 최고 모델의 47.8%에 근접하면서도 더 낮은 비용으로 제공할 수 있어 비용 대비 성능 측면에서 경쟁력이 있다고 설명했다.

◇ 크롬·위즈 등 실제 보안 환경에서 검증

구글은 제미나이 3.8 플래시 사이버를 자사 코드 보안에도 활용하고 있다고 밝혔다.

크롬 보안팀의 취약점 패치 테스트에서는 기존 최고 수준의 상용 모델보다 정확한 패치 코드를 2.6배 더 많이 생성했다고 설명했다.

보안 기업 위즈(Wiz)의 침투 테스트 벤치마크에서는 주요 프론티어 모델 대비 2.3~5.2배 낮은 비용으로 7.5~9.7% 높은 재현율(recall)을 기록했다.

구글 클라우드 취약점 연구팀은 해당 모델을 활용해 2시간 이내에 중대한 핵심 기반 취약점을 발견한 사례도 공개했다.

다만 사이버 보안 AI는 방어와 공격 양쪽에서 활용될 가능성이 있다는 점에서 안전성 문제가 중요하다. 구글은 제미나이 3.8 플래시에 프론티어 안전 프레임워크를 적용하고, CBRN 및 사이버 공격 영역에서의 오용을 방지하기 위한 안전장치를 마련했다고 밝혔다.

제미나이 3.8 플래시 사이버에는 사이버 보안 업무를 위한 보다 유연한 안전 완화 정책을 적용하되, 신뢰할 수 있는 보안 전문가를 중심으로 접근을 제한한다는 방침이다.

◇ 프롬프트 인젝션 방어력도 강화

구글은 두 모델의 공통 기반 역량 가운데 프롬프트 인젝션 공격에 대한 방어력도 개선했다고 밝혔다.

프롬프트 인젝션은 외부 콘텐츠나 악의적인 지시를 통해 AI 모델의 원래 작업 지침을 우회하거나 변경하려는 공격 방식이다. AI 에이전트가 웹사이트, 문서, 코드 등 외부 정보를 직접 읽고 도구를 호출하는 환경에서는 중요한 보안 위험으로 꼽힌다.

구글은 그레이 스완(Gray Swan)의 측정 기준에서 제미나이 3.8 모델의 프롬프트 인젝션 방어력이 이전 모델보다 크게 향상됐다고 설명했다.

◇ 개발자부터 기업·일반 이용자까지 적용 확대

제미나이 3.8 플래시는 개발자와 기업, 일반 이용자를 대상으로 서비스 영역을 확대한다.

개발자는 구글 안티그래비티와 구글 AI 스튜디오, 안드로이드 스튜디오 등을 통해 제미나이 API를 활용할 수 있다. 기업 고객은 제미나이 엔터프라이즈에서 모델을 사용할 수 있다.

일반 이용자는 구글 AI 프로 및 울트라 구독자를 대상으로 제미나이 앱과 구글 검색의 AI 모드, 구글 스프레드시트의 제미나이 등에서 제미나이 3.8 플래시를 이용할 수 있다.

사이버 보안 특화 모델은 페어윈드 프로그램을 통해 정부 기관과 주요 인프라 운영기관, 소프트웨어 유지관리 담당자 등 신뢰할 수 있는 보안 전문가를 중심으로 접근 권한을 제공한다.

이번 제미나이 3.8 플래시 출시는 생성형 AI 경쟁의 무게중심이 단순한 모델의 지식량이나 응답 품질에서 자율적으로 작업을 수행하는 에이전트 능력과 비용 효율성, 전문 분야별 성능으로 이동하고 있음을 보여준다.

특히 일반 업무용 3.8 플래시와 사이버 보안 특화 모델을 동시에 내놓으면서 구글은 하나의 범용 모델을 모든 작업에 적용하기보다 사용 목적과 위험 수준에 따라 AI 모델을 세분화하는 전략을 강화하고 있다.

AI 에이전트가 실제 업무 시스템과 연결되는 사례가 늘어날수록 성능뿐 아니라 권한 관리와 안전성, 비용 통제까지 함께 고려해야 한다는 점에서 향후 기업의 AI 도입 경쟁 역시 모델 선택을 넘어 운영 체계 구축으로 확대될 전망이다.
0 / 300