Zhipu/glm-5.3-flashx
GLM-5.3 FlashX
텍스트
컨텍스트: 1000K입출력: text→image→video text
모델 소개
GLM-5.3 FlashX는 Z.AI의 고속 멀티모달 추론 모델로, GLM-5.3 Flash와 같은 100만 토큰 컨텍스트·멀티모달 입력을 제공하면서 약 200 tokens/s의 추론 속도를 더합니다. 1M 토큰당 입력 $0.37·캐시 $0.075·출력 $1.25입니다.
공식 출처
- Pricing — GLM-5.3-FlashXZ.AI · 확인 2026-09-21
- GLM-5.3-Flash / FlashX guideZ.AI · 확인 2026-09-21
입력 가격
₩516/ 1M
출력 가격
₩1,742/ 1M
컨텍스트
1000K토큰
최대 출력
131.1K토큰
제공자
이 모델은 Zhipu GLM가 서빙합니다.
| 제공자 | 입력 /1M | 출력 /1M | 캐시읽기 /1M | 지연 | 처리량 | 업타임 | 컨텍스트 |
|---|---|---|---|---|---|---|---|
| Zhipu GLM | ₩516 | ₩1,742 | ₩105 | — | — | — | 1000K |
Zhipu GLM
- 입력 /1M
- ₩516
- 출력 /1M
- ₩1,742
- 캐시읽기 /1M
- ₩105
- 지연
- —
- 처리량
- —
- 업타임
- —
- 컨텍스트
- 1000K
실질 단가
캐시 적용 후 지난 30일 평균 — 우리 트래픽 기준
입력 평균
—/ 1M
출력 평균
—/ 1M
캐시 적중률
—
활동
데이터 축적 중
빠른 시작
quickstart.py
from openai import OpenAI
client = OpenAI(
api_key="plm_xxxxxxxxxxxxxxxx",
base_url="https://apirouter.pleum.ai/v1",
)
response = client.chat.completions.create(
model="glm-5.3-flashx",
messages=[{"role": "user", "content": "Hello"}],
)