Все модели

Microsoft

MAI-Voice-2 Flash

Быстрый отклик, четыре голоса, много языков

Отвечает голосом
Текст
Голосов: 4
Тип
Синтез речи
Русский язык
высокий
Голосов
4
Цена
1 200 ₽ / 1M символов
Дата выхода
Июль 2026
audio/speech
import OpenAI from "openai"
const client = new OpenAI({
baseURL: "https://api.yenisei.ru/v1",
apiKey: process.env.YENISEI_API_KEY,
})
const speech = await client.audio.speech.create({
model: "mai-voice-flash",
input: "Здравствуйте! Это пример синтеза речи.",
voice: VOICE_ID, // идентификатор из списка голосов модели
response_format: "mp3",
})
const buffer = Buffer.from(await speech.arrayBuffer())
await writeFile("speech.mp3", buffer)

О модели

MAI-Voice-2 Flash — речевая модель с коротким временем отклика: звук начинает идти почти сразу, поэтому её берут в живые сценарии. Четыре голоса, тон и подача настраиваются; по словам издателя, модель говорит на 15 языках в 18 региональных вариантах. Подходит голосовым помощникам, колл-центрам и всему, где собеседник ждёт ответа сейчас.

Сильные стороны

  • Короткое время отклика
  • Четыре голоса, настройка тона и подачи
  • По словам издателя — 15 языков, 18 региональных вариантов
  • Оплата за символы

Где применить

  • Голосовые помощники
  • Колл-центры
  • Интерактивные сценарии в реальном времени