Qwen/qwen3.8-flash-next
Qwen3.8 Flash Next (vultr)
텍스트
컨텍스트: 262K입출력: text text
모델 소개
Qwen3.8 Flash Next는 Qwen3.8 Flash의 후속 개선 체크포인트로 NVFP4 양자화로 서빙되는 경량 고속 모델입니다.
공식 출처
- Vultr Serverless Inference model catalog (authenticated /v1/models)Vultr · 확인 2026-09-16
입력 가격
₩153/ 1M
출력 가격
₩307/ 1M
컨텍스트
262K토큰
최대 출력
262.1K토큰
제공자
이 모델은 Vultr가 서빙합니다.
| 제공자 | 입력 /1M | 출력 /1M | 캐시읽기 /1M | 지연 | 처리량 | 업타임 | 컨텍스트 |
|---|---|---|---|---|---|---|---|
| Vultr | ₩153 | ₩307 | — | — | — | — | 262K |
Vultr
- 입력 /1M
- ₩153
- 출력 /1M
- ₩307
- 캐시읽기 /1M
- —
- 지연
- —
- 처리량
- —
- 업타임
- —
- 컨텍스트
- 262K
실질 단가
캐시 적용 후 지난 30일 평균 — 우리 트래픽 기준
입력 평균
—/ 1M
출력 평균
—/ 1M
캐시 적중률
—
활동
데이터 축적 중
빠른 시작
quickstart.py
from openai import OpenAI
client = OpenAI(
api_key="plm_xxxxxxxxxxxxxxxx",
base_url="https://apirouter.pleum.ai/v1",
)
response = client.chat.completions.create(
model="qwen3.8-flash-next",
messages=[{"role": "user", "content": "Hello"}],
)