Все модели
Mistral
Voxtral Mini TTS
Голоса-персонажи с настроениями
Отвечает голосом
Текст
Голосов: 30
- Тип
- Синтез речи
- Русский язык
- высокий
- Голосов
- 30
- Дата выхода
- Апрель 2026
Этой модели сейчас нет в каталоге.
Посмотреть доступные моделиaudio/speech
import OpenAI from "openai"const client = new OpenAI({ baseURL: "https://api.yenisei.ru/v1", apiKey: process.env.YENISEI_API_KEY,})const speech = await client.audio.speech.create({ model: "voxtral-tts-mini", input: "Здравствуйте! Это пример синтеза речи.", voice: VOICE_ID, // идентификатор из списка голосов модели response_format: "mp3",})const buffer = Buffer.from(await speech.arrayBuffer())await writeFile("speech.mp3", buffer)О модели
Voxtral Mini TTS устроена иначе прочих речевых: голоса здесь не просто разные тембры, а четыре персонажа, у каждого набор настроений — нейтральное, радостное, грустное, уверенное, сердитое и другие, всего 30 вариантов. Нужную эмоцию выбирают вместе с голосом, а не подбирают интонацию текстом. Берут в диалоговые сцены, игры и озвучку, где реплика должна звучать с чувством.
Сильные стороны
- Четыре персонажа, у каждого набор настроений
- 30 вариантов голоса и эмоции
- Эмоция выбирается вместе с голосом
- Оплата за символы
Где применить
- Диалоговые сцены и игры
- Озвучка персонажей
- Реплики с заданной эмоцией