Все модели

Alibaba

Qwen3.8 Flash

Быстрая и лёгкая Qwen

Текст
Картинки
Видео
Размышления
Инструменты
Тип
Чат
Контекст
1M токенов
Русский язык
высокий
Цена входа
12 ₽ / 1M токенов
Цена выхода
37,6 ₽ / 1M токенов
Дата выхода
Август 2026
chat/completions
import OpenAI from "openai"
const client = new OpenAI({
baseURL: "https://api.yenisei.ru/v1",
apiKey: process.env.YENISEI_API_KEY,
})
const stream = await client.chat.completions.create({
model: "qwen-flash",
messages: [{ role: "user", content: "Привет!" }],
stream: true,
})
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "")
}

О модели

Qwen3.8 Flash — быстрый и недорогой вариант линейки Qwen для высоконагруженных сценариев, где на первом месте низкая задержка и стоимость. Модель мгновенно отвечает в типовых задачах: автоответы, классификация, короткие диалоги и массовая обработка запросов. Несмотря на компактность, она аккуратно следует инструкциям и сохраняет многоязычность, уверенно работая с русским. Хорошо вписывается в продукты, где нужно масштабно обрабатывать поток пользовательских сообщений без раздувания расходов. Разумный выбор, когда важнее скорость и цена, чем максимальная глубина ответа.

Сильные стороны

  • Очень низкая задержка ответа
  • Высокая экономичность на большом потоке
  • Многоязычность и уверенный русский
  • Аккуратное следование инструкциям
  • Стабильная работа под нагрузкой
  • Предсказуемая стоимость запросов

Где применить

  • Автоответы и типовые диалоги
  • Классификация и маршрутизация обращений
  • Массовая обработка запросов
  • Встраивание в продукт в реальном времени
  • Извлечение простых полей из текста
  • Быстрые прототипы и демо