All models

NVIDIA: Nemotron 3.5 ASR Streaming 0.6B

nvidia/nemotron-3.5-asr-streaming-multilingual-0.6b
transcription

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice agents, and multilingual transcription.

Pricing

Audio minute

Parameters

fileaudio file (multipart)

How to use via API

from openai import OpenAI
client = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")
tr = client.audio.transcriptions.create(
model="nvidia/nemotron-3.5-asr-streaming-multilingual-0.6b",
file=open("audio.mp3", "rb"),
)
print(tr.text)
Try in the botAPI docs