Все модели
Microsoft
MAI-Voice-2 Flash
Быстрый отклик, четыре голоса, много языков
Отвечает голосом
Текст
Голосов: 4
- Тип
- Синтез речи
- Русский язык
- высокий
- Голосов
- 4
- Цена
- 1 200 ₽ / 1M символов
- Дата выхода
- Июль 2026
audio/speech
import OpenAI from "openai"const client = new OpenAI({ baseURL: "https://api.yenisei.ru/v1", apiKey: process.env.YENISEI_API_KEY,})const speech = await client.audio.speech.create({ model: "mai-voice-flash", input: "Здравствуйте! Это пример синтеза речи.", voice: VOICE_ID, // идентификатор из списка голосов модели response_format: "mp3",})const buffer = Buffer.from(await speech.arrayBuffer())await writeFile("speech.mp3", buffer)О модели
MAI-Voice-2 Flash — речевая модель с коротким временем отклика: звук начинает идти почти сразу, поэтому её берут в живые сценарии. Четыре голоса, тон и подача настраиваются; по словам издателя, модель говорит на 15 языках в 18 региональных вариантах. Подходит голосовым помощникам, колл-центрам и всему, где собеседник ждёт ответа сейчас.
Сильные стороны
- Короткое время отклика
- Четыре голоса, настройка тона и подачи
- По словам издателя — 15 языков, 18 региональных вариантов
- Оплата за символы
Где применить
- Голосовые помощники
- Колл-центры
- Интерактивные сценарии в реальном времени