Все модели
Microsoft
MAI-Voice-2
Выразительная речь для длинных текстов
Отвечает голосом
Текст
Голосов: 4
- Тип
- Синтез речи
- Русский язык
- высокий
- Голосов
- 4
- Цена
- 1 760 ₽ / 1M символов
- Дата выхода
- Июнь 2026
audio/speech
import OpenAI from "openai"const client = new OpenAI({ baseURL: "https://api.yenisei.ru/v1", apiKey: process.env.YENISEI_API_KEY,})const speech = await client.audio.speech.create({ model: "mai-voice", input: "Здравствуйте! Это пример синтеза речи.", voice: VOICE_ID, // идентификатор из списка голосов модели response_format: "mp3",})const buffer = Buffer.from(await speech.arrayBuffer())await writeFile("speech.mp3", buffer)О модели
MAI-Voice-2 рассчитана на длинные формы: повествование, обучающие материалы, озвучку, где важна естественность интонации, а не скорость выдачи. Умеет вести нескольких говорящих в одном тексте и управлять подачей; по словам издателя, поддерживает 15 языков в 18 региональных вариантах.
Сильные стороны
- Естественная интонация на длинных текстах
- Несколько говорящих в одном тексте
- По словам издателя — 15 языков, 18 региональных вариантов
- Оплата за символы
Где применить
- Повествование и аудиокниги
- Обучающие материалы
- Озвучка диалогов