Llama 4 Maverick
нейросеть
Llama 4 Maverick — мультимодальная модель Meta на архитектуре mixture-of-experts для работы с текстом и изображениями
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Llama 4 Maverick?
Llama 4 Maverick — мультимодальная модель от Meta, собранная по схеме mixture-of-experts: из 128 экспертов на каждый проход активируются лишь 17 миллиардов параметров, поэтому ёмкость крупной архитектуры сочетается с экономным вычислением. Версия Instruct дообучена под выполнение инструкций и диалог, а мультимодальность позволяет подавать на вход не только текст, но и изображения. В BotHub вы работаете с ней без VPN и зарубежной карты: оплата российскими картами в рублях по факту использования, токены не сгорают. Рядом в одном окне доступно более 250 нейросетей, так что llama 4 maverick легко сравнить с другими моделями, а единый OpenAI-совместимый API позволяет переключаться между ними без переписывания интеграции. Запросы и ответы шифруются, для компаний есть договор, счёт, ЭДО и админ-панель с лимитами. Пригодится, когда нужно разобрать содержимое скриншота или схемы, собрать ассистента с обработкой текста и картинок, разложить длинное техническое описание на понятные шаги, помочь с кодом и отладкой или прогнать один и тот же запрос через несколько моделей и выбрать лучший ответ.Частые вопросы о Llama 4 Maverick
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
llama-4-maverick работает с текстом: пишет и редактирует, разбирает код, отвечает по документам и анализирует изображения. Контекст до 524 288 токенов позволяет загружать объёмные файлы и длинные переписки целиком. Есть вызов функций, поэтому модель удобно встраивать в сервисы и автоматизации.
За один ответ модель выдаёт до 16 384 токенов — этого хватает на длинную статью, подробный разбор или большой фрагмент кода. Если нужен объём больше, попросите продолжить с места остановки или разбейте задачу на части: контекст в 524 288 токенов удержит весь предыдущий текст.
Отдельный режим рассуждений в наших данных не отмечен, поэтому обещать его не будем. На практике помогает простой приём: попросите в промпте разобрать задачу по шагам, выписать условия и только затем дать вывод — ответы на логике и расчётах становятся аккуратнее.
Да, вызов функций и структурированный вывод в JSON поддерживаются, так что модель можно подключить к поиску, базам или внутренним сервисам и получать ответ в заданной схеме. В BotHub это работает через единый OpenAI-совместимый API — переключить модель можно без переписывания интеграции.
Изображения и документы — да: можно прислать скриншот, схему, фотографию или файл и попросить разобрать содержимое. Аудио и видео в списке поддерживаемых входных форматов не отмечены, для таких задач в BotHub есть отдельные модели, доступные в том же окне.
Работа с русским языком в наших данных отдельно не описана, поэтому советуем проверить модель на своей задаче — пара тестовых промптов покажет больше любых обещаний. Со стороны BotHub всё по-русски: интерфейс, поддержка и оплата российскими картами, без VPN и зарубежной карты.