1M 토큰 대용량 컨텍스트
기술 매뉴얼이나 법률 아카이브 전체를 한 번에 처리할 수 있습니다. 특유의 1M 컨텍스트 창은 대규모 RAG와 심층 문서 분석을 대형 모델보다 훨씬 저렴한 비용으로 지원합니다.

대용량 메모리부터 업계 선도적인 속도까지, 고효율 엔터프라이즈 배포를 위해 특별히 설계된 Gemini 3.5 Flash Lite API의 핵심 기술 강점을 살펴보세요.
기술 매뉴얼이나 법률 아카이브 전체를 한 번에 처리할 수 있습니다. 특유의 1M 컨텍스트 창은 대규모 RAG와 심층 문서 분석을 대형 모델보다 훨씬 저렴한 비용으로 지원합니다.

이미지, 최대 1시간 분량의 동영상, 오디오, PDF를 기본적으로 처리합니다. Gemini 3.5 Flash-Lite는 MMMU 벤치마크에서 68.2% 점수를 달성하며, 텍스트 전용 라이트 경쟁 모델 대부분을 크게 능가합니다.

스키마 준수를 위해 최적화된 내부 헤드를 갖추어 복잡한 중첩 추출에서 98% 성공률을 제공합니다. 비정형 데이터를 실행 가능한 인사이트로 변환하는 데 적합합니다.

즉각적인 반응을 위해 최적화된 이 모델은 표준 버전보다 약 30~40% 빠른 첫 번째 토큰 생성 시간을 제공하여 채팅 및 실시간 도구에서 매끄러운 사용자 경험을 보장합니다.

gemini-3.5-flash-lite API 키 발급은 네 단계로 몇 분이면 끝나요. 무료 GPTProto 계정을 만들고, 크레딧을 추가하고, 키를 생성한 다음 첫 호출까지 해보세요. $0.18 / $1.5이면 직접 발급하는 것보다 저렴한 gemini-3.5-flash-lite API 키를 이용할 수 있고, 플랫폼의 모든 모델에서 하나의 키로 작동해요. 전체 gemini-3.5-flash-lite 문서는 docs에서 확인할 수 있어요.

회원가입

충전

API 키 생성

첫 API 호출
Gemini 3.5 Flash Lite API에 대한 자세한 정보를 확인하세요. 지연 시간, 1M 컨텍스트 창, 가격, 그리고 반응성 높은 AI 애플리케이션 구축을 위해 이 모델이 3.5 제품군의 다른 모델과 어떻게 비교되는지 알아보세요.