제155호

Gemini 3.6 Flash, 작업당 비용을 비교해야 하는 이유

모델 경쟁의 단위가 토큰 단가에서 '작업 하나당 비용'으로 바뀌고 있어요

비즈니스Gemini 3.6 Flash, 작업당 비용을 비교해야 하는 이유

출력 단가 17% 인하에 토큰 소비 17% 감소가 겹쳤어요

7월 21일(현지시간) 구글이 Gemini 3.6 Flash를 발표했어요. 정확히는 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 세 가지예요. 정규 발행 리듬과 별개로, 시의성이 있는 소식이라 특집으로 빠르게 전해드려요.

가격은 입력 토큰 100만 개당 1.50달러, 출력 토큰 100만 개당 7.50달러예요. 대부분의 보도는 벤치마크 점수에 집중하고 있는데요. 저는 발표문에서 다른 한 줄에 눈이 갔어요.

“이전 모델보다 출력 토큰을 17% 덜 소비한다.”

토큰 단가와 함께 ‘같은 일을 얼마나 적은 토큰으로 처리하는가’도 경쟁 기준이 되고 있어요.


무슨 일이 있었나

구글이 이번에 내놓은 건 세 가지예요. 주력 모델 Gemini 3.6 Flash, 초경량 3.5 Flash-Lite, 그리고 보안 특화 3.5 Flash Cyber예요.

가격표

3.6 Flash의 출력 단가는 100만 토큰당 7.50달러로, 직전 모델 3.5 Flash의 9.00달러에서 약 17% 내려갔어요. 입력 단가는 1.50달러로 동결이에요. 성능은 장기 코딩 작업 벤치마크인 DeepSWE에서 37%에서 49%로, 머신러닝 엔지니어링 벤치마크 MLE-Bench에서 49.7%에서 63.9%로, 컴퓨터 화면을 직접 조작하는 OSWorld-Verified에서 78.4%에서 83.0%로 올랐어요.

구글은 효율 개선도 강조했어요. Artificial Analysis 인덱스1 기준으로 출력 토큰 소비가 17% 줄었고, DeepSWE 같은 일부 작업에서는 최대 65%까지 줄었다고 해요. 추론 단계와 도구 호출 횟수 자체가 줄었다는 거예요.

함께 나온 3.5 Flash-Lite도 재미있어요. 입력 0.30달러, 출력 2.50달러로 초당 350토큰을 뽑아내는데, 코딩 벤치마크 SWE-Bench Pro에서 54.2%를 기록하며 이전 세대의 상위 제품인 3 Flash(49.6%)를 앞질렀어요. 하위 라인업 모델이 한 세대 전 상위 모델을 앞선 결과예요.

발표 말미에 구글은 Gemini 4의 사전 학습을 시작했다는 사실도 언급했어요. 3.5 Pro는 파트너 테스트 중이고요.


여러분의 생각이 다음 호를 만듭니다

이번 호에서 가장 공감했거나, 다른 경험을 한 지점은 무엇인가요?

댓글은 무료 회원이면 누구나 남길 수 있어요.

SEND A COFFEE

이 관점이 좋았다면, 다음 글에 커피 한 잔

오스왈드에게 커피와 함께 짧은 쪽지를 보내주세요. 응원은 다음 취재와 집필에 보탭니다.

FOR OSWARLD

커피와 쪽지 보내기

“Gemini 3.6 Flash, 작업당 비용을 비교해야 하는 이유”을 읽고 떠오른 말을 남겨주세요. 메뉴 이름만큼의 응원금과 함께 전달됩니다.