Gemini 3.1 Flash-Lite 지능, 성능 및 가격 분석
모델 요약
지능
속도
가격
캐시 적중 가격
장황성
가격이 비슷한 다른 모델과 비교하면 Gemini 3.1 Flash-Lite의 지능은 평균보다 높고, 가격은 합리적인 수준입니다. 또한 속도는 눈에 띄게 빠르고, 답변은 상당히 간결합니다. 이 모델의 지원 입력은 텍스트, 이미지, 음성 및 동영상, 출력은 텍스트이며, 컨텍스트 창은 1M토큰이고 학습 데이터 기준일은 2025년 1월입니다.
Gemini 3.1 Flash-Lite의 Artificial Analysis Intelligence Index 점수는 25점으로, 비교 가능한 모델 중 평균 이상입니다(중앙값: 17). Intelligence Index 평가에서는 55M토큰을 생성해, 중앙값 61M와 비교할 때 상당히 간결한 편입니다.
Gemini 3.1 Flash-Lite의 입력 토큰 100만 개당 가격은 $0.25(보통 수준의 가격, 중앙값: $0.25)이며, 출력 토큰 100만 개당 가격은 $1.50(다소 비싼 가격, 중앙값: $0.89)입니다. Intelligence Index에서 Gemini 3.1 Flash-Lite을 평가하는 데 든 총비용은 $93.72입니다.
Gemini 3.1 Flash-Lite의 속도는 초당 312토큰으로 눈에 띄게 빠릅니다(108).
| 추론 | 예 이 페이지에는 모델의 추론 버전이 표시됩니다. 비추론 버전도 있을 수 있습니다. |
|---|---|
| 입력 모달리티 | 지원: 텍스트, 이미지, 음성 및 동영상 |
| 출력 모달리티 | 지원: 텍스트 |
| 학습 데이터 기준일 | 2025. 1. 1. |
| 컨텍스트 창 | 1M Arial 12포인트 기준 A4 약 1500페이지 |
동일한 등급의 모델과 지표를 비교합니다.
- 비추론 모델 → 다른 비추론 모델과만 비교
- 추론 모델 → 추론 및 비추론 모델 모두와 비교
- 오픈 웨이트 모델 → 같은 크기 등급의 다른 오픈 웨이트 모델과만 비교:
- 초소형: 파라미터 ≤4B
- 소형: 파라미터 4B~40B
- 중형: 파라미터 40B~150B
- 대형: 파라미터 >150B
- 독점 모델 → 입력/출력 가격을 3:1로 혼합해 같은 가격대의 독점 모델 및 오픈 웨이트 모델과 비교:
- 100만 토큰당 <$0.15
- 100만 토큰당 $0.15~$1
- 100만 토큰당 >$1
주요 내용
지능
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
AA-Briefcase
AA-Briefcase Elo
AA-Omniscience
AA-Omniscience Index
Intelligence Index 비교
Intelligence Index vs. Cost per Intelligence Index Task
토큰 사용량
Output Tokens per Intelligence Index Task
비용
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
컨텍스트 창
Context Window
속도
출력 속도(초당 토큰 수)로 측정
Output Speed
Time per Intelligence Index Task
지연 시간
첫 토큰까지 걸린 시간(초)으로 측정
Latency: Time To First Answer Token
종단 간 응답 시간
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
End-to-End Response Time
자주 묻는 질문
Gemini 3.1 Flash-Lite에 관한 일반적인 질문
Gemini 3.1 Flash-Lite 모델은 2026년 3월 3일에 출시되었습니다.
Gemini 3.1 Flash-Lite 모델은 Google에서 개발했습니다.
Gemini 3.1 Flash-Lite의 Artificial Analysis Intelligence Index 점수는 25점으로, 가격대가 비슷한 다른 추론 모델 중 평균 이상입니다(중앙값: 17).
Gemini 3.1 Flash-Lite 모델은 초당 312.0개의 출력 토큰을 생성하며(Google API 기준), 가격대가 비슷한 다른 추론 모델과 비교하면 평균을 크게 웃돕니다(중앙값: 107.9 t/s).
Gemini 3.1 Flash-Lite의 첫 토큰까지 걸린 시간(TTFT)은 6.24초이며(Google API 기준), 가격대가 비슷한 다른 추론 모델과 비교하면 상위 구간입니다(중앙값: 1.88초).
Gemini 3.1 Flash-Lite의 입력 토큰 100만 개당 가격은 $0.25(평균보다 낮음, 중앙값: $0.25)이며, 출력 토큰 100만 개당 가격은 $1.50(평균보다 다소 높음, 중앙값: $0.89)입니다(Google API 기준).
Gemini 3.1 Flash-Lite의 입력 토큰 100만 개당 가격은 $0.25, 출력 토큰 100만 개당 가격은 $1.50입니다(Google API 기준). 캐시 적중/입력/출력 비율을 7:2:1로 가정한 혼합 가격은 100만 토큰당 $0.22입니다. 가격은 제공업체마다 다를 수 있습니다. 제공업체 가격 비교
Intelligence Index 평가에서 Gemini 3.1 Flash-Lite 모델은 출력 토큰 55M개를 생성했으며, 가격대가 비슷한 다른 추론 모델과 비교하면 평균보다 적습니다(중앙값: 61M).
예. Gemini 3.1 Flash-Lite 모델은 추론 모델입니다. 답변하기 전에 확장 사고 또는 연쇄적 사고 추론으로 복잡한 문제를 해결합니다.
Gemini 3.1 Flash-Lite 모델은 텍스트, 이미지, 음성 및 동영상 입력을 지원합니다.
Gemini 3.1 Flash-Lite 모델은 텍스트 출력을 지원합니다.
예. Gemini 3.1 Flash-Lite 모델은 이미지 입력을 지원하며 이미지를 분석하고 설명하고 이미지에 관한 질문에 답할 수 있습니다.
예. Gemini 3.1 Flash-Lite 모델은 멀티모달 모델로, 텍스트, 이미지, 음성 및 동영상 입력을 처리하고 텍스트 출력을 생성할 수 있습니다.
Gemini 3.1 Flash-Lite의 컨텍스트 창은 1.0M토큰입니다. 모델이 단일 요청에서 처리할 수 있는 텍스트와 대화 기록의 양을 결정합니다.
아니요. Gemini 3.1 Flash-Lite 모델은 독점 모델이며 모델 웨이트가 공개되어 있지 않습니다.
Gemini 3.1 Flash-Lite 모델은 독점 모델이며 Google에서 모델 크기나 파라미터 수를 공개하지 않았습니다.
Gemini 3.1 Flash-Lite의 Artificial Analysis Intelligence Index 점수는 25점입니다. 이 종합 벤치마크는 추론, 지식, 수학, 코딩 전반에서 모델을 평가합니다.
Gemini 3.1 Flash-Lite의 학습 데이터 기준일은 2025년 1월입니다. 모델의 학습 데이터에는 이 날짜까지의 정보가 포함됩니다.
예. Gemini 3.1 Flash-Lite 모델은 API 제공업체 1곳을 통해 제공됩니다. API 제공업체 비교
Gemini 3.1 Flash-Lite 모델은 API 제공업체 1곳을 통해 제공됩니다. 제공업체 비교