Skip to content
모델 목록
NvidiaNVIDIA/nemotron-3-nano-omni-30b-a3b-reasoning

Nemotron 3 Nano Omni 30B A3B Reasoning (vultr)

텍스트
컨텍스트: 262K입출력: text text

모델 소개

Nemotron 3 Nano Omni 30B A3B Reasoning은 NVIDIA의 경량 멀티모달 추론 모델(bf16)을 Vultr 서버리스 추론에서 bare id로 다시 제공하는 것입니다. 컨텍스트와 출력 한도는 각각 262,144토큰입니다.

공식 출처

입력 가격

₩137/ 1M

출력 가격

₩341/ 1M

컨텍스트

262K토큰

최대 출력

262.1K토큰

제공자

이 모델은 Vultr가 서빙합니다.

VU

Vultr

입력 /1M
₩137
출력 /1M
₩341
캐시읽기 /1M
—
지연
—
처리량
—
업타임
—
컨텍스트
262K

실질 단가

캐시 적용 후 지난 30일 평균 — 우리 트래픽 기준

입력 평균

—/ 1M

출력 평균

—/ 1M

캐시 적중률

—

활동

빠른 시작

quickstart.py
from openai import OpenAI

client = OpenAI(
    api_key="plm_xxxxxxxxxxxxxxxx",
    base_url="https://apirouter.pleum.ai/v1",
)

response = client.chat.completions.create(
    model="nemotron-3-nano-omni-30b-a3b-reasoning",
    messages=[{"role": "user", "content": "Hello"}],
)

Vultr의 다른 모델