Все модели
Z.AI
GLM 4.7 Flash
Быстрая GLM с рассуждениями и агентами
Текст
Размышления
Инструменты
- Тип
- Чат
- Контекст
- 203K токенов
- Русский язык
- средний
- Цена входа
- 4,8 ₽ / 1M токенов
- Цена выхода
- 32 ₽ / 1M токенов
- Дата выхода
- Декабрь 2025
chat/completions
import OpenAI from "openai"const client = new OpenAI({ baseURL: "https://api.yenisei.ru/v1", apiKey: process.env.YENISEI_API_KEY,})const stream = await client.chat.completions.create({ model: "glm-4.7-flash", messages: [{ role: "user", content: "Привет!" }], stream: true,})for await (const chunk of stream) { process.stdout.write(chunk.choices[0]?.delta?.content ?? "")}О модели
GLM 4.7 Flash — быстрый вариант китайской линейки GLM от Z.AI с поддержкой рассуждений и упором на агентные сценарии. Он включает пошаговый разбор под сложные задачи и мгновенно отвечает в типовых, обеспечивая хороший баланс качества и скорости при невысокой стоимости. Модель уверенно помогает с кодом, аккуратно следует инструкциям и надёжно вызывает инструменты (function-calling), что делает её удобной основой для агентов и автоматизации. Она держит большой контекст и хорошо подходит для высоконагруженных сценариев. Русский держит на среднем уровне. Разумный выбор, когда нужны рассуждения и агентные возможности GLM при высокой скорости и экономичности.
Сильные стороны
- Опциональные рассуждения при высокой скорости
- Упор на агентные сценарии и инструменты
- Уверенная работа с кодом
- Большой контекст для объёмных задач
- Аккуратное следование инструкциям
- Экономичность на большом потоке
Где применить
- Быстрые агентные сценарии с инструментами
- Помощь с кодом и его объяснение
- Аналитика и структурирование данных
- Разбор сложных многошаговых задач
- Массовая обработка запросов
- Встраивание в продукт с рассуждениями