지금 바로 Gemini 3.5 Flash-Lite 만나보세요
Gemini 3.5 Flash Lite: 낮은 지연 시간과 높은 처리량에 최적화
Gemini 3 제품군에 경량급 부문 최강 경쟁자, Gemini 3.5 Flash-Lite가 새롭게 합류했습니다. 고성능 네이티브 멀티모달 추론 모델인 Gemini 3 제품군의 최신 걸작인 이 엔진은 차세대 AI 배포를 위해 세심하게 설계되었습니다.
Gemini 3.5 Flash-Lite는 예산을 초과하지 않으면서 대용량, 저지연 작업을 처리하도록 최적화되어 탁월한 비용 효율성과 함께 매우 빠른 성능을 제공합니다. 단순한 속도 경쟁을 넘어 복잡한 에이전트 워크플로우를 기본적으로 지원하므로 신속한 실시간 의사 결정이 필요한 자율 AI 에이전트를 위한 이상적인 기반이 됩니다.
제미니 3.5 플래시라이트의 주요 사양과 성능
| 사양 | 제미니 3.5 플래시라이트 |
| 컨텍스트 창 | 100만 토큰 |
| 입력 형태(모달리티) | 텍스트, 이미지, 오디오, 비디오, PDF |
| 출력 형태 | 텍스트 |
| 추론 | 지원 (강도 설정: 최소, 낮음, 중간, 높음) |
| 최적 활용 분야 | 대용량 및 지연 시간에 민감한 추론 작업 |
제미니 3.5 플래시라이트의 주요 특징
유연한 사고 수준: Gemini 3.5 Flash-Lite는 최소, 낮음, 중간, 높음의 네 가지 모드를 제공하여 작업 복잡성에 따라 추론 깊이를 동적으로 조절할 수 있습니다.
낮은 지연 시간 : 3.5 Flash-Lite는 3.5 시리즈 중 가장 빠른 모델입니다. Artificial Analysis에서 측정한 결과, 초당 350개의 출력 토큰을 처리합니다.
내장 컴퓨터 사용 기능: Gemini 3.5 플래시라이트는 다양한 플랫폼에서 소프트웨어 및 디지털 인터페이스와 직접 상호 작용하여 에이전트 작업을 안정적으로 실행할 수 있습니다.
비용 효율성: 입력 토큰 백만 개당 0.30달러, 출력 토큰 백만 개당 2.50달러의 가격으로 제공되는 Gemini 3.5 Flash-Lite는 3.1 Flash-Lite보다 훨씬 높은 품질을 제공합니다.
제미니 3.5 플래시라이트가 적합한 작업
대용량 문서 처리 : 방대한 양의 텍스트, 이미지 및 PDF 파일을 입력받아 구조화된 정보와 요약을 매우 효율적인 비용으로 즉시 추출합니다.
실시간 검색 및 분류: 실시간 의미 검색, 콘텐츠 검토 및 대규모 데이터 분류를 포함한 고처리량 엔터프라이즈 파이프라인에 대해 1초 미만의 응답 시간을 제공합니다.
코딩 작업: 즉각적인 코드 생성, 일상적인 디버깅 지원, 그리고 지연 시간이 중요한 상황에서 빠른 자동 완성 제안 기능을 제공하여 개발 파이프라인을 가속화합니다.
제미니 3.5 플래시라이트와 다른 AI 모델 비교
| 비교 항목 | 제미니 3.5 플래시라이트 | 제미니 3.6 플래시 | 제미니 3.5 플래시 | 제미니 3.1 프로 |
| 핵심 포커스 | 저지연 및 고처리량 에이전트 작업. 대규모 환경에서 최고의 속도와 비용 효율성을 제공하도록 설계됨. | 차세대 밸런스형 추론. 빠른 속도와 스마트한 실행 능력이 요구되는 주류 프로덕션 파이프라인용으로 설계됨. | 표준 고속 추론. 주류 엔터프라이즈 앱 및 툴 오케스트레이션을 위한 기존 기본 모델. | 대용량 컨텍스트 처리. 대형 컨텍스트 윈도우와 안정적인 기업용 추론을 위한 레거시 벤치마크 표준. |
| 입력 요금(100만 토큰당) | 0.30달러 | 0.75달러 ~ 1.50달러 | 1.50달러 | 7.00달러 |
| 생성 속도 | 초당 약 350개 토큰 | 초당 약 140개 토큰 | 초당 약 136개 토큰 | 초당 약 60~70개 토큰 |
| 컴퓨터 사용 능력 | 기본 지원 | 기본 지원 | 기본 지원 | 제한적 지원 |
| 추론 강도 지원 | 최소, 낮음, 중간, 높음 | 최소, 낮음, 중간, 높음 | 최소, 낮음, 중간, 높음 | 낮음, 중간, 높음 |

다른 모델들도 살펴보세요
HIX AI에서 대화할 수 있는 다른 최첨단 모델들을 살펴보세요.




