Все модели

Z.AI

GLM 4.7 Flash

Быстрая GLM с рассуждениями и агентами

Текст
Размышления
Инструменты
Тип
Чат
Контекст
203K токенов
Русский язык
средний
Цена входа
4,8 ₽ / 1M токенов
Цена выхода
32 ₽ / 1M токенов
Дата выхода
Декабрь 2025
chat/completions
import OpenAI from "openai"
const client = new OpenAI({
baseURL: "https://api.yenisei.ru/v1",
apiKey: process.env.YENISEI_API_KEY,
})
const stream = await client.chat.completions.create({
model: "glm-4.7-flash",
messages: [{ role: "user", content: "Привет!" }],
stream: true,
})
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "")
}

О модели

GLM 4.7 Flash — быстрый вариант китайской линейки GLM от Z.AI с поддержкой рассуждений и упором на агентные сценарии. Он включает пошаговый разбор под сложные задачи и мгновенно отвечает в типовых, обеспечивая хороший баланс качества и скорости при невысокой стоимости. Модель уверенно помогает с кодом, аккуратно следует инструкциям и надёжно вызывает инструменты (function-calling), что делает её удобной основой для агентов и автоматизации. Она держит большой контекст и хорошо подходит для высоконагруженных сценариев. Русский держит на среднем уровне. Разумный выбор, когда нужны рассуждения и агентные возможности GLM при высокой скорости и экономичности.

Сильные стороны

  • Опциональные рассуждения при высокой скорости
  • Упор на агентные сценарии и инструменты
  • Уверенная работа с кодом
  • Большой контекст для объёмных задач
  • Аккуратное следование инструкциям
  • Экономичность на большом потоке

Где применить

  • Быстрые агентные сценарии с инструментами
  • Помощь с кодом и его объяснение
  • Аналитика и структурирование данных
  • Разбор сложных многошаговых задач
  • Массовая обработка запросов
  • Встраивание в продукт с рассуждениями