Google은 지난 5월 I/O에서 Gemini 3.5 Flash 출시와 함께 AI 모델의 획기적인 발전을 발표했으며 속도는 줄어들지 않고 있습니다. 회사는 오늘 사이버 보안을 위한 첫 번째 Gemini 버전을 포함하여 세 가지 새로운 AI 모델을 공개했습니다. 그러나 새 모델 중 6월 출시 예정이었던 지연된 Gemini 3.5 Pro는 없습니다.
I/O 쇼의 스타였던 Gemini 3.5 Flash는 이미 더 이상 사용되지 않습니다. 그 자리에서 개발자와 사용자는 Gemini 3.6 Flash를 찾을 수 있습니다. Google은 이 모델에 대해 일반적인 주장을 합니다. 이 모델은 약간 더 유능하고 코딩 능력이 더 뛰어나며 뛰어난 다중 모드 기능을 갖추고 있습니다.
Google은 3.5 릴리스에 대한 사용자 피드백을 반영하여 3.6 Flash에 대한 변경이 이루어졌다고 밝혔습니다. 일반적으로 Gemini 3.5 Flash는 코드 생성에 대한 Google의 약속을 지키지 못한 것으로 보입니다. 아마도 이는 기업들이 AI 토큰 비용에 대해 걱정하기 시작하면서 효율성에 대한 Google의 집중적인 노력의 결과일 것입니다.

코딩에 대한 DeepSWE 테스트에서 3.6 Flash는 49%, 3.5 Flash는 37%로 뛰어납니다. 새 모델은 이제 Gemini API의 표준 기능으로 컴퓨터 사용도 지원합니다. 컴퓨터 사용에 대한 OSWorld 테스트에서는 3.5의 78.4% 점수에서 83%로 소폭 증가한 것으로 나타났습니다. 효율성은 Gemini 3.5 Flash의 큰 초점이었으며 Google은 3.6에서 이러한 노력이 더욱 강화되었다고 말합니다. 작은 벤치마크 이득에도 불구하고 Gemini 3.6 Flash는 약 17% 더 적은 토큰을 사용합니다.
에이전트 워크플로우(아래와 같은)에서 Gemini 3.6 Flash는 더 적은 단계와 더 적은 토큰을 사용하여 더 정확하게 작업을 완료해야 합니다. 이는 개발자(및 Google)에게 많은 비용을 절약할 수 있습니다. 새 모델은 $1.50/1M 입력 토큰 및 $7.50/1M 출력 토큰으로 API 비용이 더 낮습니다. 3.5 플래시의 가격은 각각 1.50달러와 9달러였습니다.
Gemini 3.6 Flash의 토큰 효율성.
하지만 Google은 아직 3.5 브랜치를 완료하지 않았습니다. 또한 Gemini 3.5 Flash Lite 및 3.5 Flash Cyber도 출시했습니다. 새로운 Flash Lite는 초당 350개의 토큰을 처리하는 Google의 가장 효율적인 최신 AI입니다. 회사는 이 모델이 큰 비용을 들이지 않고 에이전트 시스템을 확장하는 데 이상적이라고 주장합니다. 벤치마크 수치에 따르면 새로운 Flash Lite는 약 1년 전의 프론티어 모델과 거의 비슷하지만 가격이 저렴합니다. 가격은 $0.30/1M 입력 토큰 및 $2.50/1M 출력 토큰으로 설정되어 있지만 이는 이전 3.1 Flash Lite($0.25 및 $1.50)보다 약간 높습니다.
관련 정보는 아래 링크에서 확인하세요