Все модели

Z.AI

GLM 5.3 Flash

Огромный контекст и мультимодальность недорого

Текст
Картинки
Видео
Размышления
Инструменты
Тип
Чат
Контекст
1.3M токенов
Русский язык
средний
Цена входа
6 ₽ / 1M токенов
Цена выхода
20 ₽ / 1M токенов
Дата выхода
26 августа 2026
chat/completions
import OpenAI from "openai"
const client = new OpenAI({
baseURL: "https://api.yenisei.ru/v1",
apiKey: process.env.YENISEI_API_KEY,
})
const stream = await client.chat.completions.create({
model: "glm-5.3-flash",
messages: [{ role: "user", content: "Привет!" }],
stream: true,
})
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "")
}

О модели

GLM 5.3 Flash — быстрый вариант старшей GLM, сохраняющий контекст свыше 1,3 млн токенов при заметно меньшей цене. В отличие от старшей модели, принимает не только текст, но и изображения с видео, поэтому подходит для разбора скриншотов, макетов и роликов. Рассуждения включаются под сложные задачи, вызов инструментов поддерживается — модель удобна как основа для агентов на потоке. Помогает с кодом и аккуратно держит формат ответа. Русский на среднем уровне. Берут, когда нужен огромный контекст и мультимодальность без больших расходов.

Сильные стороны

  • Контекст свыше 1,3M токенов
  • Изображения и видео на входе
  • Рассуждения при высокой скорости
  • Вызов инструментов (function-calling)
  • Экономичность на большом потоке

Где применить

  • Массовые задачи с длинным контекстом
  • Разбор скриншотов, макетов и видео
  • Агенты и автоматизация на потоке
  • Помощь с кодом
  • Пересказ и структурирование больших текстов