1 млн токенов и 753 млрд параметров: разбираем модели Foundation Model Hub

07.08.2026

Искусственный интеллект

Машинное обучение

Пока рынок обсуждает новые возможности искусственного интеллекта, пользователи «Турбо Облака» уже работают с самыми свежими ИИ-моделями. В каталог сервиса Foundation Model Hub добавлены DeepSeek-V4-Flash-0731 и GLM 5.2. Вместе с Qwen3.6-35B-A3B и Qwen3.5-122B-A10B они формируют линейку моделей для разных задач: от повседневной работы с текстом и документами до работы со сложным программным кодом, большими объёмами данных и ИИ-агентами.

Мы регулярно обновляем каталог Foundation Model Hub, чтобы пользователи могли работать с актуальными LLM практически сразу после их выхода. Напомним, что для этого не требуется самостоятельно разворачивать GPU-инфраструктуру, устанавливать программное обеспечение или сопровождать вычислительные мощности — достаточно выбрать модель, получить API-ключ и интегрировать её в своё приложение, сервис или внутреннюю информационную бизнес-систему.

DeepSeek-V4-Flash-0731

Обновлённая версия DeepSeek-V4-Flash-0731 была представлена разработчиками 31 июля, а буквально на следующий день она появилась в каталоге Foundation Model Hub. На момент публикации этого материала модель является самой популярной в OpenRouter по объёму потребляемых токенов, что говорит о её высокой востребованности среди разработчиков и компаний по всему миру.

Одной из главных особенностей DeepSeek-V4-Flash-0731 стало контекстное окно до 1 миллиона токенов. Вместо того чтобы разбивать большой массив информации на отдельные части, модель может учитывать его целиком в рамках одного сценария. Это помогает сохранять связи между разными фрагментами данных и получать более содержательные ответы.

Новая версия получила улучшения в нескольких ключевых направлениях:

  • быстрая скорость генерации ответов;
  • более качественная работа с текстом и программным кодом;
  • улучшенное выполнение агентских сценариев.

Последнее особенно важно для систем, которые не ограничиваются одним ответом на запрос, а самостоятельно выполняют последовательность действий: анализируют информацию, обращаются к внешним инструментам и формируют результат на основе нескольких этапов обработки.

DeepSeek-V4-Flash-0731 подходит для генерации программного кода, анализа больших объёмов данных, работы с документацией, создания ИИ-агентов и других многоэтапных сценариев.

GLM 5.2

Наша вторая новинка — GLM 5.2. Сегодня это самая мощная модель в каталоге Foundation Model Hub и одна из лучших среди моделей с открытыми весами.

GLM 5.2 содержит 753 млрд параметров и поддерживает контекстное окно до 400 тысяч токенов. Большое количество параметров позволяет модели работать со сложными зависимостями между данными, а увеличенное контекстное окно — учитывать большой объём информации при формировании ответа.

Модель ориентирована прежде всего на задачи, где недостаточно простого ответа по заданному запросу. GLM 5.2 подходит для сложной генерации программного кода, многошаговых рассуждений, разработки ИИ-агентов и автоматизации инженерных и аналитических процессов. Такие возможности можно использовать, например, при создании внутренних ИИ-сервисов, автоматизации работы разработчиков и построении систем, способных самостоятельно выполнять последовательность операций.

Другие модели каталога

Пользователям сервиса Foundation Model Hub доступны также мультимодальные модели Qwen3.6-35B-A3B и Qwen3.5-122B-A10B.

Qwen3.6-35B-A3B с 35 млрд параметров и контекстом до 262 тысячи токенов подходит для повседневных ИИ-задач. Например, для генерация текстов, обработки изображений, поиска по базам знаний, работы с внутренней документацией, создания помощников для автоматизации типовых бизнес-процессов.

Qwen3.5-122B-A10B с 122 млрд параметров и контекстом до 262 тыс. токенов ориентирована на более сложные корпоративные сценарии. Модель эффективно работает с большими объёмами информации, внутренней документацией, аналитическими задачами и корпоративными ИИ-ассистентами.

Разные модели — одна платформа

Все модели сервиса Foundation Model Hub доступны через единый OpenAI-совместимый API. Это позволяет быстро переключаться между различными LLM без изменения архитектуры приложения и доработки пользовательского кода.

Для пользователей также доступны:

  • управление API-ключами для разных проектов и команд;
  • настройка дневных, недельных и месячных лимитов потребления токенов;
  • тарификация Pay-as-you-go с оплатой за фактически обработанные токены.

Сервисы «Турбо Облака»

Продукты, упомянутые в этом материале:

Читайте также