← Все модели

Google: Gemini 3.5 TranscribeNEW

google/gemini-3.5-transcribe
транскрипцияАудио

Речь в текст от Google: синхронная транскрипция с пословными таймкодами и диаризацией спикеров — до восьми голосов в одной дорожке. Аудио до часа (до 30 минут с таймкодами/диаризацией). Через /v1/audio/transcriptions; оплата по факту — за входные аудио-токены.

Цена
Релиз
25 сент. 2026 г.

Параметры

fileаудиофайл (multipart)

Как использовать через API

from openai import OpenAI

client = OpenAI(base_url="https://api.mixen.ai/v1", api_key="mxn-...")
tr = client.audio.transcriptions.create(
    model="google/gemini-3.5-transcribe",
    file=open("audio.mp3", "rb"),
)
print(tr.text)