Skip to content
모델 목록
QwenQwen/qwen3.8-flash-next

Qwen3.8 Flash Next (vultr)

텍스트
컨텍스트: 262K입출력: text text

모델 소개

Qwen3.8 Flash Next는 Qwen3.8 Flash의 후속 개선 체크포인트로 NVFP4 양자화로 서빙되는 경량 고속 모델입니다.

입력 가격

₩153/ 1M

출력 가격

₩307/ 1M

컨텍스트

262K토큰

최대 출력

262.1K토큰

제공자

이 모델은 Vultr가 서빙합니다.

VU

Vultr

입력 /1M
₩153
출력 /1M
₩307
캐시읽기 /1M
지연
처리량
업타임
컨텍스트
262K

실질 단가

캐시 적용 후 지난 30일 평균 — 우리 트래픽 기준

입력 평균

/ 1M

출력 평균

/ 1M

캐시 적중률

활동

데이터 축적 중

빠른 시작

quickstart.py
from openai import OpenAI

client = OpenAI(
    api_key="plm_xxxxxxxxxxxxxxxx",
    base_url="https://apirouter.pleum.ai/v1",
)

response = client.chat.completions.create(
    model="qwen3.8-flash-next",
    messages=[{"role": "user", "content": "Hello"}],
)

Vultr의 다른 모델

Qwen3.8 Flash Next (vultr) — PleumRouter