GPT OSS 120B
нейросеть
GPT OSS 120B — открытая языковая модель OpenAI с архитектурой Mixture-of-Experts для задач с рассуждениями и агентных сценариев.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает GPT OSS 120B?
GPT OSS 120B — открытая по весам модель OpenAI на архитектуре Mixture-of-Experts: 117 млрд параметров, из которых на каждый проход активируется около 5,1 млрд. Модель оптимизирована под продакшен: высокую нагрузку, длинные цепочки размышлений и агентные сценарии, где задачу нужно разбить на шаги и довести до результата. В BotHub эта модель работает из России без VPN и зарубежной карты, а оплата идёт российскими картами в рублях и по факту — за израсходованные токены, которые не сгорают. Рядом в одном окне больше 250 моделей, их можно сравнивать между собой, а единый OpenAI-совместимый API подключает модель к вашему сервису и позволяет заменить её на другую без переписывания интеграции; трафик шифруется AES-GCM. Разработчикам модель пригодится для генерации и разбора кода, отладки и рефакторинга, аналитикам — для пошаговых расчётов и STEM-задач, продуктовым командам — для сборки агентов и внутренних ассистентов, а компаниям доступны договор, счёт, ЭДО и админ-панель с лимитами.Частые вопросы о GPT OSS 120B
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
gpt-oss-120b — открытая модель от OpenAI для работы с текстом: писать и править код, разбирать документы, решать задачи с рассуждением. Принимает на вход изображения и документы, умеет вызывать функции. Подойдёт для ассистентов, аналитики и мультимодельных сервисов через единый API BotHub.
Лимит вывода — 117 964 токена за ответ, общее окно контекста 131 072 токена. Этого хватает на длинные документы, объёмный код и подробные разборы. Учтите, что запрос и ответ делят общий контекст, поэтому при большом входе место под ответ сокращается.
Да, рассуждения перед ответом заявлены в возможностях модели: она разбивает задачу на шаги и только потом выдаёт результат. Это заметно помогает на математике, логике, отладке кода и многошаговых задачах, где важен не быстрый, а выверенный ответ.
Да, модель поддерживает вызов функций и структурированный вывод в JSON. Вы можете подключать внешние инструменты, базы и сервисы, получая ответ в предсказуемом формате. В BotHub это работает через единый OpenAI-совместимый API, поэтому сменить модель можно без переписывания интеграции.
Изображения и документы загрузить можно: модель читает их содержимое и отвечает текстом. Аудио и видео как входные форматы в наших данных не отмечены, как и генерация картинок или звука — для этого в каталоге BotHub есть профильные модели, доступные в том же интерфейсе.
Данных о языках промтов и ответов у нас нет, поэтому обещать конкретное качество русского не будем — проще проверить на своей задаче прямо в BotHub. Сам сервис полностью на русском: оплата российскими картами, доступ без VPN и зарубежной карты.