Как работает Inkling Small?
Inkling Small — открытая по весам мультимодальная модель Thinking Machines Lab на архитектуре mixture-of-experts: из 276 миллиардов параметров на каждый запрос активируются около 12 миллиардов, поэтому на генерацию уходит меньше вычислений, чем у плотной модели сопоставимого размера. В линейке Inkling это младшая и более экономичная версия, рассчитанная на потоковые задачи, где важны скорость отклика и предсказуемая стоимость обработки. В BotHub модель открывается без VPN и зарубежной карты: вы платите российской картой в рублях по факту за токены, а неизрасходованный баланс не сгорает. В одном окне рядом — более 250 нейросетей, между которыми можно переключаться и сравнивать ответы на одном запросе, а единый OpenAI-совместимый API даёт заменить модель в мультимодельной системе, не переписывая интеграцию. Трафик шифруется по AES-GCM, содержимое диалогов не сохраняется. Пригодится модель для массовой обработки текстов и мультимодальных запросов, работы с кодом, извлечения фактов из документов и прототипов ассистентов, а корпоративным клиентам BotHub оформит договор, счёт, ЭДО и админ-панель с лимитами.Частые вопросы о Inkling Small
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Это текстовая модель с режимом рассуждений: разбирает задачи по шагам, пишет и правит код, объясняет ошибки, принимает на вход документы и изображения. Контекстное окно 262 144 токена позволяет загружать объёмные файлы и длинные переписки целиком. Подходит для аналитики, STEM-задач и агентных сценариев с вызовом инструментов.
Лимит вывода — до 262 144 токенов, столько же, сколько вмещает контекстное окно. Этого хватает на крупный документ, развёрнутый разбор или большой объём кода. Учитывайте, что запрос и ответ делят общий бюджет контекста, поэтому доступный на практике объём зависит от размера промпта и вложений.
Да, режим рассуждений у модели подтверждён: перед финальным ответом она выстраивает цепочку шагов. Это помогает в математике, логике, отладке кода и многошаговых задачах, где важен проверяемый ход решения. Учтите, что рассуждения расходуют токены вывода, поэтому такие ответы получаются объёмнее и дольше.
Да, поддерживаются и вызов функций, и структурированный вывод в JSON. Модель можно подключать к внешним инструментам, базам и сервисам, собирая на ней агентов и пайплайны. В BotHub это доступно через единый OpenAI-совместимый API, так что при переключении на другую модель интеграцию переписывать не нужно.
По нашим данным на вход принимаются текст, изображения и документы: пришлите скриншот, схему, PDF или таблицу и получите разбор текстом. Аудио и видео среди заявленных входных форматов не указаны. Генерация чего-либо кроме текста у модели не отмечена — отвечает она текстом.
В наших данных язык запросов и ответов не указан, поэтому обещать конкретное качество русского мы не будем — проверьте модель на своей задаче в чате или через API. Со стороны сервиса ограничений нет: доступ из России без VPN и зарубежной карты, оплата рублями.