Все модели

Mistral

Voxtral Mini TTS

Голоса-персонажи с настроениями

Отвечает голосом
Текст
Голосов: 30
Тип
Синтез речи
Русский язык
высокий
Голосов
30
Дата выхода
Апрель 2026

Этой модели сейчас нет в каталоге.

Посмотреть доступные модели
audio/speech
import OpenAI from "openai"
const client = new OpenAI({
baseURL: "https://api.yenisei.ru/v1",
apiKey: process.env.YENISEI_API_KEY,
})
const speech = await client.audio.speech.create({
model: "voxtral-tts-mini",
input: "Здравствуйте! Это пример синтеза речи.",
voice: VOICE_ID, // идентификатор из списка голосов модели
response_format: "mp3",
})
const buffer = Buffer.from(await speech.arrayBuffer())
await writeFile("speech.mp3", buffer)

О модели

Voxtral Mini TTS устроена иначе прочих речевых: голоса здесь не просто разные тембры, а четыре персонажа, у каждого набор настроений — нейтральное, радостное, грустное, уверенное, сердитое и другие, всего 30 вариантов. Нужную эмоцию выбирают вместе с голосом, а не подбирают интонацию текстом. Берут в диалоговые сцены, игры и озвучку, где реплика должна звучать с чувством.

Сильные стороны

  • Четыре персонажа, у каждого набор настроений
  • 30 вариантов голоса и эмоции
  • Эмоция выбирается вместе с голосом
  • Оплата за символы

Где применить

  • Диалоговые сцены и игры
  • Озвучка персонажей
  • Реплики с заданной эмоцией