NVIDIA/nemotron-3-nano-omni-30b-a3b-reasoning
Nemotron 3 Nano Omni 30B A3B Reasoning (vultr)
텍스트
컨텍스트: 262K입출력: text text
모델 소개
Nemotron 3 Nano Omni 30B A3B Reasoning은 NVIDIA의 경량 멀티모달 추론 모델(bf16)을 Vultr 서버리스 추론에서 bare id로 다시 제공하는 것입니다. 컨텍스트와 출력 한도는 각각 262,144토큰입니다.
공식 출처
- Vultr Serverless Inference models APIVultr · 확인 2026-09-26
입력 가격
₩137/ 1M
출력 가격
₩341/ 1M
컨텍스트
262K토큰
최대 출력
262.1K토큰
제공자
이 모델은 Vultr가 서빙합니다.
| 제공자 | 입력 /1M | 출력 /1M | 캐시읽기 /1M | 지연 | 처리량 | 업타임 | 컨텍스트 |
|---|---|---|---|---|---|---|---|
| Vultr | ₩137 | ₩341 | — | — | — | — | 262K |
Vultr
- 입력 /1M
- ₩137
- 출력 /1M
- ₩341
- 캐시읽기 /1M
- —
- 지연
- —
- 처리량
- —
- 업타임
- —
- 컨텍스트
- 262K
실질 단가
캐시 적용 후 지난 30일 평균 — 우리 트래픽 기준
입력 평균
—/ 1M
출력 평균
—/ 1M
캐시 적중률
—
활동
빠른 시작
quickstart.py
from openai import OpenAI
client = OpenAI(
api_key="plm_xxxxxxxxxxxxxxxx",
base_url="https://apirouter.pleum.ai/v1",
)
response = client.chat.completions.create(
model="nemotron-3-nano-omni-30b-a3b-reasoning",
messages=[{"role": "user", "content": "Hello"}],
)