Как работает Nemotron 3 Super 120B A12B?
Nemotron 3 Super 120B A12B — открытая модель NVIDIA с гибридной архитектурой Mamba-Transformer и разреженной схемой MoE: из 120 миллиардов параметров на каждый запрос активируются около 12 миллиардов, что экономит вычисления на сложных многошаговых задачах. Создавалась она под мультиагентные приложения, где несколько ролей обмениваются промежуточными результатами и удерживают общую логику работы. В BotHub вы подключаете Nemotron 3 Super без VPN и зарубежной карты: оплата российскими картами в рублях по факту использования, токены не сгорают. Рядом в одном окне более 250 моделей, так что ответы легко сравнить и переключиться, а единый OpenAI-совместимый API позволяет сменить модель в коде без переписывания интеграции. Переписка шифруется по AES-GCM, данные не сохраняются, а компаниям доступны договор, счёт, ЭДО и админ-панель с лимитами. На практике модель берут под оркестрацию агентов и цепочек инструментов, аналитические задачи с длинной цепочкой рассуждений, прототипирование ассистентов поверх API, внутренние сервисы с предсказуемыми расходами и исследовательские эксперименты с открытыми моделями.Частые вопросы о Nemotron 3 Super 120B A12B
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Это текстовая модель NVIDIA с контекстом в миллион токенов. Подходит для работы с большими документами и кодовыми базами: рефакторинг, отладка, объяснение логики, разбор отчётов и STEM-задач. Принимает на вход текст, документы и изображения, умеет вызывать функции.
За один ответ модель выдаёт до 235 929 токенов — этого хватает на объёмный технический текст, большой модуль кода или подробный разбор документа целиком. Если задача ещё крупнее, разбивайте её на последовательные запросы в том же диалоге.
Да, режим рассуждений подтверждён: перед финальным ответом модель строит цепочку шагов. Это заметно помогает в математике, логике, анализе кода и многоступенчатых задачах, где важно не угадать ответ, а последовательно его вывести и проверить промежуточные выводы.
Да. Модель поддерживает function calling и структурированный вывод в JSON, поэтому её удобно встраивать в агентов и пайплайны. В BotHub она доступна через единый OpenAI-совместимый API — интеграцию писать заново при переключении на другую модель не придётся.
Изображения и документы загружать можно — модель разбирает их содержимое и отвечает текстом. Приём аудио и видео в наших данных не отмечен, так что рассчитывать на них не стоит; для таких форматов в BotHub есть отдельные специализированные модели.
Данных о языках промптов и ответов у нас нет, поэтому обещать конкретное качество не будем — проще проверить на своей задаче в несколько запросов. Интерфейс BotHub русскоязычный, доступ без VPN и зарубежной карты, оплата в рублях по факту.