Qwen/qwen3.8-omni-flash
Qwen3.8 Omni Flash
텍스트
컨텍스트: 1000K입출력: text→image→video→audio text
모델 소개
Qwen3.8 Omni Flash는 텍스트·이미지·오디오·동영상 입력을 이해하고 텍스트로 답하는 Qwen 멀티모달 모델로, 최대 100만 토큰 컨텍스트와 Chat Completions·Responses API를 지원합니다.
공식 출처
- Qwen3.8-Omni-Flash model documentationAlibaba Cloud Model Studio · 확인 2026-09-18
- Qwen-Omni usage guideAlibaba Cloud Model Studio · 확인 2026-09-18
- Model inference pricingAlibaba Cloud Model Studio · 확인 2026-09-18
입력 가격
₩230/ 1M
출력 가격
₩720/ 1M
컨텍스트
1000K토큰
최대 출력
131.1K토큰
제공자
이 모델은 Qwen가 서빙합니다.
| 제공자 | 입력 /1M | 출력 /1M | 캐시읽기 /1M | 지연 | 처리량 | 업타임 | 컨텍스트 |
|---|---|---|---|---|---|---|---|
| Qwen | ₩230 | ₩720 | ₩25 | — | — | — | 1000K |
Qwen
- 입력 /1M
- ₩230
- 출력 /1M
- ₩720
- 캐시읽기 /1M
- ₩25
- 지연
- —
- 처리량
- —
- 업타임
- —
- 컨텍스트
- 1000K
실질 단가
캐시 적용 후 지난 30일 평균 — 우리 트래픽 기준
입력 평균
—/ 1M
출력 평균
—/ 1M
캐시 적중률
—
활동
데이터 축적 중
빠른 시작
quickstart.py
from openai import OpenAI
client = OpenAI(
api_key="plm_xxxxxxxxxxxxxxxx",
base_url="https://apirouter.pleum.ai/v1",
)
response = client.chat.completions.create(
model="qwen3.8-omni-flash",
messages=[{"role": "user", "content": "Hello"}],
)