Все модели
Z.AI
GLM 5.3 Flash
Огромный контекст и мультимодальность недорого
Текст
Картинки
Видео
Размышления
Инструменты
- Тип
- Чат
- Контекст
- 1.3M токенов
- Русский язык
- средний
- Цена входа
- 6 ₽ / 1M токенов
- Цена выхода
- 20 ₽ / 1M токенов
- Дата выхода
- 26 августа 2026
chat/completions
import OpenAI from "openai"const client = new OpenAI({ baseURL: "https://api.yenisei.ru/v1", apiKey: process.env.YENISEI_API_KEY,})const stream = await client.chat.completions.create({ model: "glm-5.3-flash", messages: [{ role: "user", content: "Привет!" }], stream: true,})for await (const chunk of stream) { process.stdout.write(chunk.choices[0]?.delta?.content ?? "")}О модели
GLM 5.3 Flash — быстрый вариант старшей GLM, сохраняющий контекст свыше 1,3 млн токенов при заметно меньшей цене. В отличие от старшей модели, принимает не только текст, но и изображения с видео, поэтому подходит для разбора скриншотов, макетов и роликов. Рассуждения включаются под сложные задачи, вызов инструментов поддерживается — модель удобна как основа для агентов на потоке. Помогает с кодом и аккуратно держит формат ответа. Русский на среднем уровне. Берут, когда нужен огромный контекст и мультимодальность без больших расходов.
Сильные стороны
- Контекст свыше 1,3M токенов
- Изображения и видео на входе
- Рассуждения при высокой скорости
- Вызов инструментов (function-calling)
- Экономичность на большом потоке
Где применить
- Массовые задачи с длинным контекстом
- Разбор скриншотов, макетов и видео
- Агенты и автоматизация на потоке
- Помощь с кодом
- Пересказ и структурирование больших текстов