Foundation Model Hub
Наш новый продукт с быстрым доступом к готовым ИИ-моделям
Узнать подробности

1 млн токенов и 753 млрд параметров: разбираем модели Foundation Model Hub

07.08.2026

Искусственный интеллект

Машинное обучение

Пока рынок обсуждает новые возможности искусственного интеллекта, пользователи «Турбо Облака» уже работают с самыми свежими ИИ-моделями. В каталог сервиса Foundation Model Hub добавлены DeepSeek-V4-Flash-0731 и GLM 5.2 — модели для сложных сценариев работы с кодом, большими объёмами данных и ИИ-агентами.

Мы регулярно обновляем каталог Foundation Model Hub, чтобы пользователи могли работать с актуальными LLM практически сразу после их выхода. Напомним, что для этого не требуется самостоятельно разворачивать GPU-инфраструктуру, устанавливать программное обеспечение или сопровождать вычислительные мощности — достаточно выбрать модель, получить API-ключ и интегрировать её в приложение, сервис или внутреннюю информационную бизнес-систему.

DeepSeek-V4-Flash-0731

Обновлённая версия DeepSeek-V4-Flash-0731 была представлена разработчиками 31 июля, а буквально на следующий день она появилась в каталоге Foundation Model Hub. На момент публикации этого материала модель является самой популярной в OpenRouter по объёму потребляемых токенов, что говорит о её высокой востребованности среди разработчиков и компаний по всему миру.

Одной из главных особенностей модели стало контекстное окно до 1 миллиона токенов. Благодаря этому она может учитывать значительные объёмы исходных данных в рамках одного запроса.

Кроме того, новая версия получила улучшения в нескольких ключевых направлениях:

  • быстрая скорость генерации ответов;
  • более качественная работа с текстом и программным кодом;
  • улучшенное выполнение агентских сценариев.

Модель ориентирована на ресурсоёмкие задачи: от генерации кода и создания ИИ-агентов до анализа объёмных документов и сложных многоэтапных сценариев обработки информации. Поддержка агентских сценариев позволяет использовать её как основу для систем, которые могут выполнять последовательность действий: анализировать информацию, обращаться к внешним инструментам и формировать результат на основе нескольких этапов обработки.

GLM 5.2

Наша вторая новинка — GLM 5.2. Сегодня это самая мощная модель в каталоге Foundation Model Hub и одна из лучших среди моделей с открытыми весами.

Модель содержит 753 млрд параметров и поддерживает контекстное окно до 400 тысяч токенов. Это позволяет решать сложные инженерные и аналитические задачи, где требуется работа с большим объёмом входных данных и длинными цепочками рассуждений.

GLM 5.2 подходит для сложной генерации программного кода, многошаговых рассуждений, разработки агентских систем, автоматизации инженерных и аналитических процессов. Такие сценарии становятся всё более востребованными при создании внутренних ИИ-сервисов компаний и интеллектуальной автоматизации рабочих процессов.

Другие модели каталога

Помимо вышеназванных моделей пользователям Foundation Model Hub доступны Qwen3.6-35B-A3B и Qwen3.5-122B-A10B.

Qwen3.6-35B-A3B — универсальная мультимодальная модель с 35 млрд параметров и контекстом до 262 тысячи токенов, которая подходит для повседневных ИИ-задач: генерации текстов, обработки изображений, поиска по базам знаний, работы с внутренней документацией, создания помощников для автоматизации типовых бизнес-процессов.

Qwen3.5-122B-A10B ориентирована на более сложные корпоративные сценарии. Благодаря увеличенному до 122 млрд количеству параметров она эффективно работает с большими объёмами информации, внутренней документацией, аналитическими задачами и корпоративными ИИ-ассистентами.

Таким образом, каталог Foundation Model Hub охватывает широкий спектр задач — от повседневной генерации текстов до сложных агентских систем и разработки программного обеспечения.

ИИ без собственной инфраструктуры

Все модели Foundation Model Hub доступны через единый OpenAI-совместимый API. Это позволяет быстро переключаться между различными LLM без изменения архитектуры приложения или переписывания пользовательского кода. Достаточно выбрать подходящую модель под конкретную задачу и использовать её через единый интерфейс.

Для пользователей также доступны:

  • управление API-ключами для разных проектов и команд;
  • настройка дневных, недельных и месячных лимитов потребления токенов;
  • тарификация Pay-as-you-go с оплатой только за фактически обработанные токены.

Сервисы «Турбо Облака»

Продукты, упомянутые в этом материале:

Читайте также