Skip to content
모델 목록
ZhipuZhipu/glm-5.3-flashx

GLM-5.3 FlashX

텍스트
컨텍스트: 1000K입출력: text→image→video text

모델 소개

GLM-5.3 FlashX는 Z.AI의 고속 멀티모달 추론 모델로, GLM-5.3 Flash와 같은 100만 토큰 컨텍스트·멀티모달 입력을 제공하면서 약 200 tokens/s의 추론 속도를 더합니다. 1M 토큰당 입력 $0.37·캐시 $0.075·출력 $1.25입니다.

공식 출처

입력 가격

₩516/ 1M

출력 가격

₩1,742/ 1M

컨텍스트

1000K토큰

최대 출력

131.1K토큰

제공자

이 모델은 Zhipu GLM가 서빙합니다.

Zhipu

Zhipu GLM

입력 /1M
₩516
출력 /1M
₩1,742
캐시읽기 /1M
₩105
지연
처리량
업타임
컨텍스트
1000K

실질 단가

캐시 적용 후 지난 30일 평균 — 우리 트래픽 기준

입력 평균

/ 1M

출력 평균

/ 1M

캐시 적중률

활동

데이터 축적 중

빠른 시작

quickstart.py
from openai import OpenAI

client = OpenAI(
    api_key="plm_xxxxxxxxxxxxxxxx",
    base_url="https://apirouter.pleum.ai/v1",
)

response = client.chat.completions.create(
    model="glm-5.3-flashx",
    messages=[{"role": "user", "content": "Hello"}],
)

Zhipu GLM의 다른 모델