Gemini 2.5 Flash
everyais/gemini-2-5-flash
Google 의 Gemini 계열 멀티모달 모델이다. 텍스트와 이미지를 입력받아 텍스트를 생성하며 Google 검색 그라운딩과 도구 호출을 지원한다. pro 는 정확도, flash 와 flash-lite 는 속도·비용 중심 등급이다.
시리즈 gemini입력 텍스트 · 이미지출력 텍스트
현재 사용 가능
방법
공개 카탈로그의 현재 모델 메타와 기준 원가를 표시하고, 운영 지표는 충분한 실측 표본이 있을 때만 별도 API에서 보강합니다.
출처·업데이트
GET /models/catalog업데이트
- 모델 유형
- 채팅
- 출시일
- 2025-06-17
- 컨텍스트 윈도우
- 1.0M
- 가격 단위
- 1M 토큰당
- 최대 출력
- 65,536
- 모델 기준 단가 (USD)
표준(≤200K)
- 입력 / 1M 토큰
- $0.15
- 출력 / 1M 토큰
- $0.6
- 캐시 읽기 / 1M 토큰
- $0.037
장문(>200K, 요청 전체 적용)
- 입력 / 1M 토큰
- $0.3
- 출력 / 1M 토큰
- $2.5
- 캐시 읽기 / 1M 토큰
- $0.03
지원 기능
- ✓ 스트리밍
- ✓ 도구 호출
- ✓ 비전
- ✓ JSON
- ✓ 추론
- ✓ 샘플링 제어
- ✓ 구조화 출력
지원 엔드포인트
- /v1/chat/completions
벤치마크
외부 소스가 공개한 평가 결과입니다. 사람·관리자가 승인한 매핑만 표시합니다.
| 벤치마크 | 점수 | 출처 |
|---|---|---|
| frontiermath | 4.8% | Epoch AI Benchmarking HubCC-BY측정 대상 표기: gemini-2.5-flash |
| terminal-bench | 17.1% | Epoch AI Benchmarking HubCC-BY측정 대상 표기: gemini-2.5-flash |
점수는 각 소스가 발표한 값을 그대로 옮긴 것이며 everyais가 다시 측정하지 않습니다. 단위가 다른 점수끼리는 비교할 수 없습니다. 소스별 라이선스와 수집 주기는 벤치마크 출처에 있습니다.
사용량·가용성 추이
일별 토큰입력출력
최근 8일 · 2026-09-03 입력 1,071 · 출력 140 토큰.
일별 가용성 (성공률 %)
표본 부족 — 성공률을 공개할 만큼 요청이 쌓이지 않았습니다.
코드 예제
OpenAI SDK의 base_url 만 바꾸면 그대로 호출됩니다.
from openai import OpenAI
client = OpenAI(
api_key="everyais_...",
base_url="https://api.everyais.com/v1",
)
response = client.chat.completions.create(
model="everyais/gemini-2-5-flash",
messages=[{"role": "user", "content": "안녕하세요"}],
)
print(response.choices[0].message.content)전체 API 문서같은 시리즈의 다른 모델
다른 모델과 나란히 비교하세요
지원 기능, 컨텍스트와 기준 단가를 비교해 용도에 맞는 모델을 선택하세요. 실제 청구가는 계정 요율에 따라 다를 수 있습니다.