Все статьи
Новости
4 июля 2026 г.6 мин

Qwen3.7 Plus в каталоге: миллион токенов контекста и vision

Старшая Qwen от Alibaba умеет держать в голове миллион токенов, читает картинки и свободно говорит по-русски. Смотрим, что это даёт на практике.

Команда Yenisei


Qwen3.7 Plus в каталоге: миллион токенов контекста и vision

Добавили Qwen3.7 Plus — старшую модель линейки Qwen от Alibaba. Главная причина, по которой на неё стоит посмотреть, — контекст в 1M токенов. Это другой класс задач.

Что умеет

  • Контекст 1M токенов. В окно помещается не глава, а целая книга. Или весь репозиторий среднего проекта. Или переписка за год.
  • Vision. Модель мультимодальная: принимает изображения — скриншоты, схемы, сканы документов, графики.
  • Tools. Полноценный function calling.
  • Русский на высоком уровне. Пишет чисто, без кальки.

Зачем миллион токенов

Большой контекст — это не про «влезет больше текста», а про исчезновение целого класса костылей. Не нужно нарезать документ на чанки, строить хитрый retrieval и склеивать ответы. Вы кладёте весь материал целиком, и модель видит связи, которые при нарезке теряются.

Пример: анализ большого договора. При chunk-подходе модель не увидит, что пункт 14 противоречит приложению Б, если они попали в разные чанки. С миллионным контекстом — увидит.

curl https://api.yenisei.ru/v1/chat/completions \
-H "Authorization: Bearer $YENISEI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-plus",
"messages": [
{"role": "user", "content": "Вот весь договор целиком. Найди внутренние противоречия между разделами."}
]
}'

Vision на практике

Картинки открывают отдельные сценарии: разобрать скриншот интерфейса и описать баг, извлечь таблицу из скана, объяснить архитектурную схему. Всё через тот же chat/completions с изображением в сообщении.

Когда Plus избыточна

Миллионный контекст стоит денег и времени — модель обрабатывает всё окно. Если ваши запросы укладываются в 30–40K токенов, огромное окно не нужно, и более лёгкая модель ответит дешевле и быстрее. Смотрите на Qwen3.7 Flash (тоже 1M, но быстрее и легче) или на Qwen3 Max, если хватает 262K.

Plus берите тогда, когда действительно кладёте в контекст очень много и хотите, чтобы модель это осмыслила целиком. Модель уже доступна под именем qwen3.7-plus.