← All models
NVIDIA: Nemotron 3.5 ASR Streaming 0.6B
nvidia/nemotron-3.5-asr-streaming-multilingual-0.6btranscription
Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice agents, and multilingual transcription.
Pricing
Audio minute
Parameters
fileaudio file (multipart)How to use via API
from openai import OpenAIclient = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")tr = client.audio.transcriptions.create(model="nvidia/nemotron-3.5-asr-streaming-multilingual-0.6b",file=open("audio.mp3", "rb"),)print(tr.text)

