GPT Proto

GPTProto

  • 대시보드
  • LLM

    • deepseek
      DeepSeek Flash신규
    • z-ai
      GLM 5.3
    • claude
      Claude Fable 5
    • deepseek
      DeepSeek v4 Pro
    • google
      Gemini 3.7 Flash
    • grok
      Grok 4.6
    모델 둘러보기 >

    이미지

    • openai
      GPT Image 2.5 Sunburst신규
    • openai
      GPT Image 2
    • google
      Nano Banana Pro (Gemini 3 Pro Image)
    • google
      Nano Banana 2 (Gemini 3.1 Flash Image)
    • midjourney
      Midjourney
    • openai
      GPT Image 2.5 Flare
    모델 둘러보기 >

    영상

    • minimax
      Minimax H3신규
    • bytedance
      Seedance 2.5 (Build 260628)
    • bytedance
      Seedance 2.0 (Build 260128)
    • bytedance
      Seedance 2.0 Mini (Build 260615)
    • kling
      Kling v3.0 4k
    • vidu
      Vidu Q3 Turbo
    모델 둘러보기 >
    232+ 모델 둘러보기 >
  • 생성기

    • 이미지 만들기
    • 영상 만들기
    • 캔버스에서 편집
    • 채팅

    기능

    • AI 고양이 댄스 동영상 생성기신규
    • 무제한 AI 비디오 생성기
    • AI 패키징 디자인 생성기
    • 애니메이션 AI 아트 생성기
    • AI 객체 제거기
    • AI 이미지 편집기
    • AI 모션 트랜스퍼
    • AI 워터마크 제거기
    • 온라인 AI 이미지 향상 도구
    • 온라인 배경 제거 도구
    모두 둘러보기 >

    프롬프트

    • Seedance 2.0 프롬프트신규
    • GPT Image 2 프롬프트
    • Nano Banana Pro 프롬프트
    • Seedream 5.0 Pro 프롬프트
    • Midjourney 프롬프트
  • AI 블로그

    • OpenRouter와 GPTProto 비교: 가격, 모델, 라우팅 및 2026년에 어느 API가 더 나은가?
    • AI 제품 광고 워크플로: 세탁 세제 이미지에서 25초 광고 영상까지
    • DeepSeek V4 Pro vs GLM 5.2: 2026년에는 어느 쪽이 더 나을까요?
    • 2026년 API, 일괄 편집 및 제품 사진을 위한 최고의 이미지 편집 AI 모델 7가지
    • DeepSeek V4 Pro vs Kimi K3: 0813 업데이트 후 무엇이 바뀌었나?
    모두 둘러보기 >

    AI 인사이트

    • DeepSeek 피크 요금제가 이제 적용됩니다: API 비용이 더 비싸지는 때는?
    • GLM-5.3이란? Z.ai의 조용한 코딩 플랜 출시, 가격 및 확인된 업그레이드
    • OpenAI의 최신 모델 Astra란? 출시일, 벤치마크 및 비교 (2026)
    • MiniMax H3가 출시되었습니다: 동영상 편집 업그레이드로 실제로 달라지는 점
    • Emochi AI란 무엇이며, 왜 이렇게 빠르게 성장하고 있을까? (2026)
    모두 둘러보기 >

    AI 문서

    • gpt-image-2
    • gpt-5.4
    • kimi-k2.5
    • claude-opus-4-6
    • kling-v3.0-pro
    모두 둘러보기 >

    AI 스킬

    • browser-use
    • claude-to-im
    • competitive-ads-extractor
    • content-creator
    • data-storytelling
    모두 둘러보기 >
요금제+7% 보너스
English繁體中文한국어日本語EspañolРусский
지금 시작하기
  1. 홈
  2. /모델
  3. /Google
  4. /gemini-3.5-flash-lite
Google
Gemini 3.5 Flash Lite
$ 
Gemini 3.5 Flash는 Google의 비용 최적화된 초저지연 모델입니다. 1M 토큰 컨텍스트 창과 텍스트, 비디오, 오디오 작업을 대규모로 지원하는 네이티브 멀티모달 기능을 갖추고 있습니다.

모달리티

입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트

/

컨텍스트

API 사용 예제
$ 
curl --request POST "https://gptproto.com/v1/chat/completions" \
  --header "Authorization: Bearer $GPTPROTO_API_KEY" \
  --header "Content-Type: application/json" \
  --data '{
    "model": "gemini-3.5-flash-lite",
    "messages": [
      {
        "role": "user",
        "content": "Hello"
      }
    ]
  }'
Gemini 3.5 Flash Lite pricing

Chat, coding agents & document work. Priced per 1M tokens — input, cached input and output are billed separately. GPTProto is 40% below official rates.

사용량

Google · ≈ 148M tokens/mo (48M cached)

OpenRouter
정가 + 5.5% 크레딧 수수료
$64.40
월
Input (non-cached)$10.1279
Cache read$1.5191
Output$52.75
Google
Google 직접 (정가)
$61.04
월
Input (non-cached)$9.6
Cache read$1.44
Output$50
최고 가성비
GPTProto
공식가 40% off
$36.62
월
할인 후$36.62
Effective$36.62
출처별 월 비용
OpenRouter
$64.40
Google
$61.04
GPTProto
$36.62
월 $24.42 절약
GPTProto가 Google 대비 −40%
연간 절약 ≈ $292.99 · 사용한 만큼 결제

OpenRouter costs include its ~5.5% credit purchase fee. GPTProto applies a per-model discount (10–30% off) and your bonus credits are also spent at discounted rates — savings compound. Estimates assume a 60% cache hit rate.

관련 모델
전체 모델
Gemini 3.5 Flash Lite
현재
$ 
byGoogle1.05M context$0.18/M input$1.5/M output
DeepSeek Flash
$ 
byDeepSeek$0.3/M input$1.2/M output
Hy4 Preview
$ 
byHunyuan1.05M context$0.7923/M input$2.376/M output
GPT 6 Astra
$ 
byOpenAI1.05M context$8/M input$40/M output
Gemini 3.8 Flash
$ 
byGoogle1.05M context$0.9/M input$4.5/M output
Claude Fable 5.1
$ 
byClaude1M context$9/M input$45/M output
Qwen3.8 Max 0902
$ 
byQwen1M context$1.8/M input$5.4/M output
GLM 5.3 Flash
$ 
byZ-AI1.31M context$0.15/M input$0.5/M output
DeepSeek v4 Flash Vision Exp
$ 
byDeepSeek1.05M context$0.3/M input$1.2/M output
GLM 5.3
$ 
byZ-AI1.31M context$1.26/M input$3.96/M output
Gemini 3.7 Flash
$ 
byGoogle1.05M context$0.9/M input$4.5/M output
Grok 4.6
$ 
byGrok500K context$1.2/M input$3.6/M output
Qwen3.8 Max
$ 
byQwen1M context$1.8/M input$5.4/M output
Claude Opus 5
$ 
byClaude1M context$4.5/M input$22.5/M output
Gemini 3.6 Flash
$ 
byGoogle1.05M context$0.9/M input$4.5/M output
Kimi K3
$ 
byMoonshotAI1.05M context$2.7/M input$13.5/M output
GPT 5.6 Luna
$ 
byOpenAI1.05M context$0.16/M input$0.96/M output
GPT 5.6 Terra
$ 
byOpenAI1.05M context$1.6/M input$9.6/M output
Grok 4.5
$ 
byGrok500K context$1.2/M input$3.6/M output
Claude Sonnet 5
$ 
byClaude1M context$1.8/M input$9/M output
Minimax M3
$ 
byMiniMax1.05M context$0.48/M input$0.96/M output
GLM 5.2
$ 
byZ-AI1.05M context$1.26/M input$3.96/M output
Qwen3.7 Max
$ 
byQwen1M context$0.36/M input$1.44/M output
Gemini 3.5 Flash
$ 
byGoogle1.05M context$0.9/M input$5.4/M output
DeepSeek v4 Flash
$ 
byDeepSeek1.05M context$0.3/M input$1.2/M output
Grok 4.3
$ 
byGrok1M context$0.75/M input$1.5/M output
Kimi K2.6
$ 
byMoonshotAI262K context$0.855/M input$3.6/M output
Gemini 3.1 Flash Lite Preview
$ 
byGoogle1.05M context$0.15/M input$0.9/M output
Minimax M2.5
$ 
byMiniMax205K context$0.24/M input$0.96/M output
Gemini 3.1 Pro Preview
$ 
byGoogle1.05M context$1.2/M input$7.2/M output
Kimi K2.5
$ 
byMoonshotAI262K context$0.54/M input$2.7/M output
Doubao Seed 1.6 Thinking (Build 250715)
$ 
byBytedance262K context$0.0971/M input$0.9714/M output
Doubao Seed 1.6 Thinking (Build 250615)
$ 
byBytedance262K context$0.0971/M input$0.9714/M output
Doubao Seed 1.6 Flash (Build 250615)
$ 
byBytedance262K context$0.0182/M input$0.1821/M output
모델입력 → 출력
Gemini 3.5 Flash Lite현재
$ 
1.05M$0.18 / $1.50 per 1M$0.60 / $0.02 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
DeepSeek Flash
$ 
——$0.30 / $1.20 per 1M— / $0.006 per 1M
입력: 텍스트입력: 이미지
출력: 텍스트
Hy4 Preview
$ 
1.05M$0.79 / $2.38 per 1M— / $0.04 per 1M
입력: 텍스트
출력: 텍스트
GPT 6 Astra
$ 
1.05M$8.00 / $40.00 per 1M$10.00 / $0.80 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Gemini 3.8 Flash
$ 
1.05M$0.90 / $4.50 per 1M$0.60 / $0.09 per 1M
입력: 텍스트입력: 이미지입력: 비디오입력: 문서입력: 오디오
출력: 텍스트
Claude Fable 5.1
$ 
1M$9.00 / $45.00 per 1M$11.25 / $0.23 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Qwen3.8 Max 0902
$ 
1M$1.80 / $5.40 per 1M$2.25 / $0.23 per 1M
입력: 텍스트입력: 이미지입력: 비디오입력: 문서입력: 오디오
출력: 텍스트
GLM 5.3 Flash
$ 
—1.31M$0.15 / $0.50 per 1M— / $0.03 per 1M
입력: 텍스트입력: 이미지입력: 비디오입력: 문서
출력: 텍스트
DeepSeek v4 Flash Vision Exp
$ 
—1.05M$0.30 / $1.20 per 1M— / $0.006 per 1M
입력: 텍스트입력: 이미지
출력: 텍스트
GLM 5.3
$ 
1.31M$1.26 / $3.96 per 1M— / $0.23 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Gemini 3.7 Flash
$ 
1.05M$0.90 / $4.50 per 1M$0.60 / $0.09 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Grok 4.6
$ 
500K$1.20 / $3.60 per 1M— / $0.30 per 1M
입력: 텍스트입력: 이미지
출력: 텍스트
Qwen3.8 Max
$ 
1M$1.80 / $5.40 per 1M$2.25 / $0.23 per 1M
입력: 텍스트입력: 이미지입력: 비디오입력: 문서
출력: 텍스트
Claude Opus 5
$ 
1M$4.50 / $22.50 per 1M$5.63 / $0.45 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Gemini 3.6 Flash
$ 
1.05M$0.90 / $4.50 per 1M$0.60 / $0.09 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Kimi K3
$ 
1.05M$2.70 / $13.50 per 1M$0.27 / $0.27 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
GPT 5.6 Luna
$ 
1.05M$0.16 / $0.96 per 1M$0.20 / $0.02 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
GPT 5.6 Terra
$ 
1.05M$1.60 / $9.60 per 1M$2.00 / $0.16 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Grok 4.5
$ 
500K$1.20 / $3.60 per 1M$0.30 / $0.30 per 1M
입력: 텍스트입력: 이미지
출력: 텍스트
Claude Sonnet 5
$ 
1M$1.80 / $9.00 per 1M$2.25 / $0.18 per 1M
입력: 텍스트입력: 문서
출력: 텍스트
Minimax M3
$ 
1.05M$0.48 / $0.96 per 1M$0.10 / $0.10 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
GLM 5.2
$ 
1.05M$1.26 / $3.96 per 1M$0.23 / $0.23 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Qwen3.7 Max
$ 
1M$0.36 / $1.44 per 1M$0.07 / $0.07 per 1M
입력: 텍스트입력: 문서
출력: 텍스트
Gemini 3.5 Flash
$ 
1.05M$0.90 / $5.40 per 1M$0.60 / $0.09 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
DeepSeek v4 Flash
$ 
—1.05M$0.30 / $1.20 per 1M— / $0.006 per 1M
입력: 텍스트
출력: 텍스트
Grok 4.3
$ 
1M$0.75 / $1.50 per 1M$0.12 / $0.12 per 1M
입력: 텍스트입력: 이미지
출력: 텍스트
Kimi K2.6
$ 
262K$0.85 / $3.60 per 1M$0.14 / $0.14 per 1M
입력: 텍스트입력: 문서
출력: 텍스트
Gemini 3.1 Flash Lite Preview
$ 
1.05M$0.15 / $0.90 per 1M$0.60 / $0.01 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Minimax M2.5
$ 
205K$0.24 / $0.96 per 1M$0.30 / $0.02 per 1M
입력: 텍스트입력: 문서
출력: 텍스트
Gemini 3.1 Pro Preview
$ 
1.05M$1.20 / $7.20 per 1M$2.70 / $0.12 per 1M
입력: 텍스트입력: 이미지입력: 문서
출력: 텍스트
Kimi K2.5
$ 
262K$0.54 / $2.70 per 1M$0.09 / $0.09 per 1M
입력: 텍스트입력: 문서
출력: 텍스트
Doubao Seed 1.6 Thinking (Build 250715)
$ 
262K$0.10 / $0.97 per 1M—
입력: 텍스트입력: 이미지
출력: 텍스트
Doubao Seed 1.6 Thinking (Build 250615)
$ 
262K$0.10 / $0.97 per 1M—
입력: 텍스트입력: 이미지
출력: 텍스트
Doubao Seed 1.6 Flash (Build 250615)
$ 
262K$0.02 / $0.18 per 1M—
입력: 텍스트입력: 이미지
출력: 텍스트

Gemini 3.5 Flash-Lite API

GPTProto에서 Google의 가장 빠르고 비용 효율적인 Gemini 3.5 모델을 이용하세요. 입력 토큰 100만 개당 $0.18, 출력 토큰 100만 개당 $1.50으로 Google 표준 API 요금보다 40% 저렴합니다. 하나의 GPTProto 키로 200개 이상의 텍스트, 이미지, 비디오, 오디오 모델에 걸쳐 사용량을 분산하세요.

1M 토큰 컨텍스트 창

최대 1,048,576개의 입력 토큰을 처리하고 최대 65,536개의 출력 토큰을 생성할 수 있습니다. 이 용량은 대규모 문서 세트, 긴 대본, 보고서, 저장소, 상세한 하위 에이전트 핸드오프를 지원합니다.

초당 350개 출력 토큰

Google은 Artificial Analysis 테스트 기준으로 초당 약 350개의 출력 토큰을 보고합니다. Flash-Lite는 최대 추론 깊이보다 처리량과 응답 시간이 더 중요한 워크로드를 위해 설계되었습니다.

멀티모달 입력, 텍스트 출력

텍스트, 이미지, 비디오, 오디오, PDF 파일을 보낼 수 있습니다. 모델은 텍스트를 반환하므로 문서 파싱, 미디어 이해, 전사 분석, 요약, 멀티모달 데이터 추출에 적합합니다.

구조화된 출력 및 도구 사용

추출, 라우팅, 도구 기반 에이전트를 위해 스키마 제약 출력과 함수 호출을 사용하세요. 배포 전에 코드 실행, 파일 검색, URL 컨텍스트, 검색 근거의 경로별 가용성을 확인하세요.

Gemini 3.5 Flash-Lite란?

Gemini 3.5 Flash-Lite는 Google의 일반 공급(GA) 효율성 모델로, 대규모 에이전트 작업, 번역, 문서 처리, 분류, 구조화된 추출에 사용됩니다. 2026년 7월 21일에 출시된 이 모델은 Gemini 3.5 시리즈 중 가장 빠른 모델이며, 지연 시간, 처리량, API 비용이 최대 추론 깊이보다 더 중요한 제약 조건인 애플리케이션에 적합합니다.

Google Gemini 3.5 Flash-Lite API는 1,048,576토큰 입력 창 내에서 텍스트, 이미지, 비디오, 오디오, PDF 파일을 허용합니다. 최대 65,536토큰의 텍스트 응답을 생성하며, Google 네이티브 API에서 thinking(추론), 구조화된 출력, 함수 호출, 캐싱, 코드 실행, 파일 검색, URL 컨텍스트, 검색 근거 제공을 지원합니다. 이미지나 오디오는 생성하지 않으며 Live API도 지원하지 않습니다. 공급업체별 도구의 사용 가능 여부는 OpenAI 호환 게이트웨이를 통해 달라질 수 있으므로, Google 네이티브 확장 기능에 의존하기 전에 GPTProto 문서를 확인하세요.

사양 Gemini 3.5 Flash-Lite
공급업체 Google
안정적인 모델 ID gemini-3.5-flash-lite
출시 단계 일반 공급(GA)
출시일 2026년 7월 21일
입력 한도 1,048,576토큰
최대 출력 65,536토큰
허용되는 입력 텍스트, 이미지, 비디오, 오디오, PDF
출력 텍스트
핵심 기능 thinking(추론), 구조화된 출력, 함수 호출, 캐싱
지원되지 않는 기능 이미지 생성, 오디오 생성, Live API, 튜닝

Gemini 3.5 Flash-Lite의 주요 사용 사례

Flash-Lite는 애플리케이션이 집중된 작업을 대량으로 반복할 때 가장 유용합니다. 더 뛰어난 오케스트레이터 아래에서 저비용 워커 모델로 사용하거나, 결정 범위가 좁고 검증하기 쉬운 전체 워크플로를 처리할 수 있습니다.

  • 분류 및 라우팅: 지원 티켓에 라벨을 지정하고, 의도를 감지하고, 문서를 분류하거나, 모든 요청에 프론티어 모델 비용을 지불하지 않고 다음 도구를 선택하세요.

  • 문서 파싱 및 JSON 추출: PDF, 인보이스, 영수증, 보고서, 제품 기록을 읽고 정의된 스키마에 맞는 필드를 반환합니다.

  • 번역 및 요약: 단가가 총 운영 비용에 영향을 미치는 대량의 다국어 텍스트, 회의 기록, 리뷰, 카탈로그 콘텐츠를 처리합니다.

  • 멀티모달 검토: 이미지, 녹음된 오디오, 비디오, PDF에서 텍스트와 사실을 추출하면서 출력을 텍스트 기반 다운스트림 워크플로에 유지합니다.

  • 특화 서브에이전트: 검색, 정보 검색(retrieval), 코드 편집, 검증, 도구 호출을 전문화된 워커에 위임하고, 더 강력한 모델은 계획이나 최종 검토를 위해 남겨 둡니다.

이 모델은 하나의 어려운 요청에 최고 수준의 코딩 정확도, 장기 계획, 또는 도구 오류로부터의 반복적인 복구가 필요할 때는 덜 적합합니다. 이러한 워크로드에서는 토큰 가격만으로 선택하기 전에 동일한 평가 세트로 Gemini 3.5 Flash 또는 Gemini 3.6 Flash를 테스트하세요.

작업 복잡도에 따른 Thinking 수준 선택

Gemini 3.5 Flash-Lite는 Google 네이티브 API에서 구성 가능한 thinking(추론)을 지원합니다. Google은 지연 시간에 민감한 분류, 라우팅, JSON 추출에 MINIMAL을 권장합니다. 이 설정은 기본값이며 예측 가능한 작업에서 불필요한 추론 토큰을 제한합니다.

코드를 작성하거나, 터미널 명령을 실행하거나, 여러 API를 호출하거나, 중간 오류에서 복구해야 하는 서브에이전트에는 MEDIUM 또는 HIGH를 사용하세요. thinking 수준을 높이면 다단계 실행이 개선될 수 있지만 출력 토큰 사용량과 응답 시간도 늘어납니다. GPTProto의 OpenAI 호환 엔드포인트를 통해 모델을 호출하는 경우, 공급업체별 필드를 보내기 전에 매핑된 thinking 매개변수에 대한 최신 문서를 확인하세요.

Gemini 3.5 Flash-Lite와 Gemini 3.5 Flash 비교

Gemini 3.5 Flash-Lite와 Gemini 3.5 Flash는 1,048,576토큰 컨텍스트 창과 65,536토큰 최대 출력을 공유하지만, 서로 다른 워크로드 경제성을 위해 설계되었습니다. Flash-Lite는 처리량과 낮은 단가를 우선시하고, Flash는 더 복잡한 코딩, 에이전트 계획, 지식 작업을 대상으로 합니다.

비교 Gemini 3.5 Flash-Lite Gemini 3.5 Flash
최적 용도 대규모 서브에이전트, 추출, 번역, 문서 파싱 복잡한 코딩, 에이전트 계획, 심층 지식 작업
모델 포지셔닝 3.5 시리즈 중 가장 빠르고 비용이 가장 낮은 모델 더 강력한 Flash 등급 모델
입력 컨텍스트 1,048,576토큰 1,048,576토큰
최대 출력 65,536토큰 65,536토큰
Google 표준 입력 가격 1M 토큰당 $0.30 1M 토큰당 $1.50
Google 표준 출력 가격 1M 토큰당 $2.50 1M 토큰당 $9.00
GPTProto Flash-Lite 가격 1M 토큰당 입력 $0.18 / 출력 $1.50 Gemini 3.5 Flash 모델 페이지 참조

Google 표준 요금 기준으로 Flash-Lite는 Gemini 3.5 Flash보다 입력 비용이 80%, 출력 비용이 약 72% 저렴합니다. 요청량과 응답 시간이 간헐적인 재시도 비용보다 중요할 때 Flash-Lite를 선택하세요. 더 적은 수의 어려운 작업에서 최저 토큰 요금보다 첫 시도 품질이 더 중요할 때는 Flash를 선택하세요.

GPTProto를 통한 Gemini 3.5 Flash-Lite 사용

GPTProto 는 200개 모델 이상에 사용하는 동일한 계정, API 키, 잔액으로 Gemini 3.5 Flash-Lite API에 액세스할 수 있게 해 줍니다. 이렇게 하면 애플리케이션이 단순 추출은 Flash-Lite로, 복잡한 추론은 Gemini 3.5 Flash 또는 Gemini 3.6 Flash로, 미디어 작업은 별도의 이미지, 비디오, 오디오 모델로 라우팅할 때 계정 및 결제가 분산되는 문제를 줄일 수 있습니다.

기존 OpenAI 호환 애플리케이션의 경우 주변 클라이언트 구조를 유지하고 GPTProto 문서에 표시된 엔드포인트, 인증 방법, 모델 문자열을 사용하세요. 모든 Google 네이티브 필드가 일대일로 매핑된다고 가정하지 마세요. 프로덕션 트래픽을 전환하기 전에 thinking 제어, 캐싱, 근거 제공(grounding), 파일 처리, 도구 스키마, 스트리밍 동작을 테스트하세요.

기존 Gemini 워크로드의 마이그레이션 참고 사항

Google은 이전 Gemini 모델에서 마이그레이션할 때 영향을 줄 수 있는 여러 가지 호환성 차이점을 문서화하고 있습니다. 사용자 지정 temperature, top-K, top-P 값은 무시될 수 있습니다. 사용자 지정 frequency 및 presence 페널티는 오류를 반환할 수 있습니다. 마지막 대화 턴이 model 역할을 가진 요청도 지원되지 않습니다.

대규모 워크플로를 전환하기 전에 대표적인 테스트 세트를 재실행하고 JSON 스키마 준수, 도구 호출 완료, 토큰 사용량, 지연 시간, 재시도 빈도를 확인하세요. 비용 효율적인 Gemini 3.5 Flash-Lite API 배포는 토큰당 비용만이 아니라 성공한 작업당 비용으로 평가해야 합니다. 이는 특히 다단계 에이전트에서 중요합니다. thinking 수준이 너무 낮으면 도구 시퀀스가 너무 일찍 중단될 수 있기 때문입니다.

자주 묻는 질문

GPTProto에서 Gemini 3.5 Flash-Lite API 비용은 얼마인가요?

GPTProto는 Gemini 3.5 Flash-Lite를 입력 토큰 1M개당 $0.18, 출력 토큰 1M개당 $1.50에 제공합니다. Google의 표준 API 요금은 각각 $0.30 및 $2.50이므로 GPTProto 요금은 40% 더 낮습니다. 입력 토큰 10,000개와 출력 토큰 2,000개를 사용하는 요청은 약 $0.0048의 비용이 듭니다.

별도의 Google Gemini 3.5 Flash-Lite API 키가 필요한가요?

아니요. GPTProto의 Gemini 3.5 Flash-Lite API 액세스는 GPTProto API 키와 공유 계정 잔액을 사용합니다. 동일한 키로 200개 이상의 지원 모델을 호출할 수 있으므로 모델별로 별도의 공급업체 계정이나 크레딧 잔액이 필요하지 않습니다.

Gemini 3.5 Flash-Lite의 컨텍스트 제한은 어떻게 되나요?

이 모델은 최대 1,048,576개의 입력 토큰을 허용하며 최대 65,536개의 출력 토큰을 반환할 수 있습니다. 이 제한은 토큰화 후 결합된 프롬프트와 멀티모달 입력 전체에 적용되므로, 대용량 PDF, 오디오, 비디오는 일반 텍스트와 다르게 컨텍스트를 소비할 수 있습니다.

Gemini 3.5 Flash-Lite가 이미지, 비디오, 오디오, PDF를 처리할 수 있나요?

네. 텍스트, 이미지, 비디오, 오디오, PDF 입력을 받아 텍스트를 반환합니다. 이러한 미디어 유형에서 정보를 분석하거나 추출할 수 있지만, 이미지 생성, 비디오 생성, 텍스트 음성 변환, 실시간 음성 모델은 아닙니다.

Gemini 3.5 Flash-Lite는 JSON 모드와 함수 호출을 지원하나요?

Google은 구조화된 출력과 함수 호출을 지원되는 기능으로 명시합니다. 이는 스키마 기반 추출과 도구 기반 에이전트에 유용합니다. 게이트웨이 파라미터 매핑이 다를 수 있으므로 중요한 워크플로를 배포하기 전에 GPTProto를 통해 정확한 요청 스키마와 도구 동작을 검증하세요.

Gemini 3.5 Flash-Lite와 Gemini 3.5 Flash 중 무엇을 사용해야 하나요?

분류, 추출, 번역, 문서 처리, 집중적인 하위 에이전트에는 Flash-Lite를 사용하세요. 복잡한 코딩, 더 깊은 계획, 더 강력한 1차 추론이 더 높은 토큰 비용을 정당화하는 경우 Gemini 3.5 Flash를 사용하세요. 실패 또는 재시도 비용이 중요한 경우 대표적인 작업에서 둘 다 테스트하세요.

Gemini 3.5 Flash-Lite는 안정적인 모델인가요?

네. Google은 gemini-3.5-flash-lite를 2026년 7월 21일에 출시된 일반 공급(GA) 모델로 명시합니다. 이는 변경이 더 잦거나 사용량 제한이 더 엄격할 수 있는 미리보기 모델 ID와 구별됩니다.

관련 글

이 모델과 관련된 가이드, 비교, 업데이트입니다.

모든 글
2026년 무제한 AI 이미지 생성기 베스트 7 (비교)

2026년 무제한 AI 이미지 생성기 베스트 7 (비교)

안전 제한에 막히는 데 지치셨나요? 창작의 자유를 되찾을 최고의 무제한 AI 이미지 생성기를 찾아보세요. 주요 도구를 비교하고 지금 바로 창작을 시작하세요.

Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite 완벽 설명: 어떤 것을 사용해야 할까요?

Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite 완벽 설명: 어떤 것을 사용해야 할까요?

Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite의 가격, 속도, 벤치마크 및 사용 사례를 비교하세요. 어떤 새로운 Google 모델이 AI 워크로드에 적합한지 알아보세요.

Qwen 3.8 Max vs GLM 5.2: 2026년 코딩에 더 좋은 모델은?

Qwen 3.8 Max vs GLM 5.2: 2026년 코딩에 더 좋은 모델은?

코딩, API 액세스, 컨텍스트, 가격, 오픈 가중치 측면에서 Qwen 3.8 Max와 GLM 5.2를 비교하세요. 2026년 프로덕션 환경에서 어떤 모델이 더 안전한지 알아보세요.

Kimi K3란 무엇일까요? 정말 GPT-5.6과 Fable 5에 가까운 모델일까요?

Kimi K3란 무엇일까요? 정말 GPT-5.6과 Fable 5에 가까운 모델일까요?

Kimi K3는 오픈소스인가요? 정말 GPT-5.6과 Fable 5에 근접한 모델인가요? 1M 컨텍스트, API 가격, 독립 벤치마크, Reddit 반응을 살펴보세요.

GPT Proto

글로벌 규모와 안정성으로 추진하는 AI 혁신:

대표 제품인 GPT Proto를 통해 세계 최고의 AI 제공업체 API에 접근하고 이를 결합할 수 있는 통합 인터페이스를 제공해요. 텍스트, 비전, 음성 등 다양한 분야를 아우르며, 개발자와 기업이 통합을 간소화하고 제약 없이 혁신을 가속화할 수 있도록 지원해요.

글로벌 인프라, 현지 규정 준수:

기업 수준의 안정성과 규정 준수를 보장하기 위해, Talent Tech Global Limited가 글로벌 결제 및 계약 법인으로 운영돼요. 또한 핵심 기술 인프라와 R&D 팀은 실리콘밸리, 싱가포르, 홍콩 등 글로벌 혁신 허브에 전략적으로 분산되어 있어요.

확장을 위한 설계:

안정성이 가장 중요하다는 것을 잘 알고 있어요. 저희 플랫폼은 동적 자동 확장(Auto-scaling)을 지원하는 강력한 분산 아키텍처를 기반으로 구축되었어요. 파일럿을 실행하든 수백만 건의 동시 요청을 처리하든, 시스템은 수요에 맞춰 즉시 확장되므로 비즈니스가 인프라의 한계에 부딪히는 일이 없어요.

탐색

  • 대시보드
  • 모델
  • 이미지 만들기
  • AI 이미지 업스케일
  • AI 배경 제거
  • 영상 만들기
  • 캔버스에서 편집
  • 채팅
  • 기능
  • 요금제
  • AI 문서
  • AI 블로그
  • AI 인사이트
  • AI 스킬

기능

  • AI 고양이 댄스 동영상 생성기
  • 무제한 AI 비디오 생성기
  • AI 패키징 디자인 생성기
  • 애니메이션 AI 아트 생성기
  • AI 객체 제거기
  • AI 이미지 편집기
  • AI 모션 트랜스퍼
  • AI 워터마크 제거기
  • 온라인 AI 이미지 향상 도구
  • 온라인 배경 제거 도구
  • AI Face Swap Image
  • AI 여권 사진 메이커
  • MS Paint AI 생성기
  • AI Clothes Remover
  • 무제한 AI 이미지 생성기
  • AI 프렌치 키스 생성기
  • AI 영화 포스터 생성기
  • Artlist IO 스튜디오
  • 온라인 매직 지우개
  • Luma Dream Machine
Explore all features >

LLM

  • DeepSeek Flash
  • GLM 5.3
  • Claude Fable 5
  • DeepSeek v4 Pro
  • Gemini 3.7 Flash
  • Grok 4.6
  • Hy4 Preview
  • GPT 6 Astra
  • Gemini 3.8 Flash
  • Claude Fable 5.1
  • Qwen3.8 Max 0902
  • GLM 5.3 Flash
  • DeepSeek v4 Flash Vision Exp
  • Qwen3.8 Max
  • Claude Opus 5
  • Gemini 3.6 Flash
  • Gemini 3.5 Flash Lite
  • Kimi K3
  • GPT 5.6 Luna
  • GPT 5.6 Terra
모든 모델 둘러보기 >

이미지

  • GPT Image 2.5 Sunburst
  • GPT Image 2
  • Nano Banana Pro (Gemini 3 Pro Image)
  • Nano Banana 2 (Gemini 3.1 Flash Image)
  • Midjourney
  • GPT Image 2.5 Flare
  • Grok Imagine Image 2.0
  • Seedream 5.0 Pro (Build 260628)
  • Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image)
  • Nano Banana 2 (Gemini 3.1 Flash Image)
  • Seedream 5.0 (Build 260128)
  • Doubao Seedream 5.0 (Build 260128)
  • Vidu Q2
  • Grok Imagine Image
  • Kling Image O1
  • GPT Image 1.5
  • Seedream 4.5 (Build 251128)
  • Doubao Seedream 4.5 (Build 251128)
  • Grok Imagine 0.9
  • Qwen Image Lora
모든 모델 둘러보기 >

영상

  • Minimax H3
  • Seedance 2.5 (Build 260628)
  • Seedance 2.0 (Build 260128)
  • Seedance 2.0 Mini (Build 260615)
  • Kling v3.0 4k
  • Vidu Q3 Turbo
  • Wan 3.0
  • Kling v3 Omni 4k
  • Seedance 2.0 Fast (Build 260128)
  • Vidu 2.0
  • Doubao Seedance 2.0 (Build 260128)
  • Doubao Seedance 2.0 Fast (Build 260128)
  • Kling v3 Omni Pro
  • Kling v3 Omni Std
  • Kling v3.0 Pro
  • Kling v3.0 Std
  • Vidu Q3 Pro
  • Kling v2.6 Std
  • Vidu Q2 Pro
  • Vidu Q2 Turbo
모든 모델 둘러보기 >

문의하기

질문이나 피드백이 있으신가요? 아래 채널을 통해 문의해 주세요.

TelegramWhatsApp

© 2026 Talent Tech Global Limited (홍콩) / Talent Tech Global LLC (미국). 모든 권리 보유.

등록 주소: Unit 1022a, Beverley Commercial Centre, 87-105 Chatham Road South, Tsim Sha Tsui, Hong KongCertificate No.: 79462435-000-12-25-0
  • 회사 소개
  • 개인정보 처리방침
  • 서비스 이용약관
  • 사이트맵
제휴 사이트logoto.videotopostudio.cc