Все модели

Microsoft

MAI-Voice-2

Выразительная речь для длинных текстов

Отвечает голосом
Текст
Голосов: 4
Тип
Синтез речи
Русский язык
высокий
Голосов
4
Цена
1 760 ₽ / 1M символов
Дата выхода
Июнь 2026
audio/speech
import OpenAI from "openai"
const client = new OpenAI({
baseURL: "https://api.yenisei.ru/v1",
apiKey: process.env.YENISEI_API_KEY,
})
const speech = await client.audio.speech.create({
model: "mai-voice",
input: "Здравствуйте! Это пример синтеза речи.",
voice: VOICE_ID, // идентификатор из списка голосов модели
response_format: "mp3",
})
const buffer = Buffer.from(await speech.arrayBuffer())
await writeFile("speech.mp3", buffer)

О модели

MAI-Voice-2 рассчитана на длинные формы: повествование, обучающие материалы, озвучку, где важна естественность интонации, а не скорость выдачи. Умеет вести нескольких говорящих в одном тексте и управлять подачей; по словам издателя, поддерживает 15 языков в 18 региональных вариантах.

Сильные стороны

  • Естественная интонация на длинных текстах
  • Несколько говорящих в одном тексте
  • По словам издателя — 15 языков, 18 региональных вариантов
  • Оплата за символы

Где применить

  • Повествование и аудиокниги
  • Обучающие материалы
  • Озвучка диалогов