Все модели
Alibaba
Qwen3.8 Flash
Быстрая и лёгкая Qwen
Текст
Картинки
Видео
Размышления
Инструменты
- Тип
- Чат
- Контекст
- 1M токенов
- Русский язык
- высокий
- Цена входа
- 12 ₽ / 1M токенов
- Цена выхода
- 37,6 ₽ / 1M токенов
- Дата выхода
- Август 2026
chat/completions
import OpenAI from "openai"const client = new OpenAI({ baseURL: "https://api.yenisei.ru/v1", apiKey: process.env.YENISEI_API_KEY,})const stream = await client.chat.completions.create({ model: "qwen-flash", messages: [{ role: "user", content: "Привет!" }], stream: true,})for await (const chunk of stream) { process.stdout.write(chunk.choices[0]?.delta?.content ?? "")}О модели
Qwen3.8 Flash — быстрый и недорогой вариант линейки Qwen для высоконагруженных сценариев, где на первом месте низкая задержка и стоимость. Модель мгновенно отвечает в типовых задачах: автоответы, классификация, короткие диалоги и массовая обработка запросов. Несмотря на компактность, она аккуратно следует инструкциям и сохраняет многоязычность, уверенно работая с русским. Хорошо вписывается в продукты, где нужно масштабно обрабатывать поток пользовательских сообщений без раздувания расходов. Разумный выбор, когда важнее скорость и цена, чем максимальная глубина ответа.
Сильные стороны
- Очень низкая задержка ответа
- Высокая экономичность на большом потоке
- Многоязычность и уверенный русский
- Аккуратное следование инструкциям
- Стабильная работа под нагрузкой
- Предсказуемая стоимость запросов
Где применить
- Автоответы и типовые диалоги
- Классификация и маршрутизация обращений
- Массовая обработка запросов
- Встраивание в продукт в реальном времени
- Извлечение простых полей из текста
- Быстрые прототипы и демо