Gemma 4 31B Instruct
нейросеть
Gemma 4 31B Instruct — мультимодальная модель Google DeepMind с контекстом 256K токенов и вызовом функций в едином API BotHub.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Gemma 4 31B Instruct?
Gemma 4 31B Instruct — плотная мультимодальная модель Google DeepMind на 30,7 млрд параметров: на вход принимает текст и изображения, на выходе даёт текст. Контекстное окно в 256 тысяч токенов позволяет держать в работе объёмные документы, длинные диалоги и крупные фрагменты кода целиком, а переключаемый режим рассуждений помогает там, где нужен разбор задачи по шагам. Нативный вызов функций превращает модель в исполнительное звено агентных сценариев: она сама выбирает инструмент и формирует аргументы. В BotHub вы работаете с Gemma 4 31B Instruct без VPN и зарубежной карты, платите российской картой по факту за токены, а не за подписку. Более 250 моделей собраны в одном окне, так что сравнить ответы соседних моделей можно в пару кликов, а единый OpenAI-совместимый API позволяет сменить модель без переписывания интеграции; переписка защищена шифрованием AES-GCM. Компании подключаются по договору со счётом, ЭДО и админ-панелью с лимитами. Подойдёт для анализа документов и скриншотов, ревью и рефакторинга кода, извлечения данных из изображений, сборки агентов с внешними инструментами и RAG-сценариев на длинном контексте.Частые вопросы о Gemma 4 31B Instruct
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Это текстовая модель Google с контекстом 65 536 токенов. Она разбирает длинные документы и описывает изображения, помогает с кодом — от рефакторинга до отладки, решает задачи на логику и STEM, вызывает функции и работает в пакетном режиме. Переключиться на другую модель в BotHub можно без переписывания интеграции.
За один ответ модель выдаёт до 16 384 токенов. Этого хватает на объёмную статью, подробный технический разбор или крупный модуль кода. Если материал больше, разбейте задачу на части: контекст в 65 536 токенов позволяет держать в диалоге исходные документы целиком.
Да, рассуждения перед ответом заявлены в возможностях модели. Она может выстроить ход решения по шагам, прежде чем выдать итог, — это заметно на задачах по математике, логике и разборе кода. Попросите показать рассуждение в промте, если вам нужна видимая цепочка шагов.
Да, модель поддерживает вызов функций и структурированный вывод в JSON. Вы описываете инструменты, она выбирает нужный и возвращает аргументы в заданной схеме — это удобно для агентов, парсинга документов и интеграций. В BotHub доступен единый OpenAI-совместимый API, так что подключение не отличается от привычного.
Изображения и документы — да: можно прислать скриншот, схему, фотографию или файл и попросить разбор, извлечение данных, перевод таблицы в текст. Приём аудио и видео в наших данных не отмечен, поэтому для озвучки или анализа роликов лучше выбрать в BotHub профильную модель.
Отдельной пометки о качестве языков в наших данных нет, поэтому обещать точность не станем — проверьте модель на своей задаче прямо в чате и сравните с другими в том же окне. Сам сервис работает из России без VPN и зарубежной карты, оплата в рублях.