Gemma 4 26B A4B IT
нейросеть
Gemma 4 26B A4B IT — инструктивная MoE-модель Google DeepMind для текстовых задач и интеграций через gemma 4 api.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Gemma 4 26B A4B IT?
Gemma 4 26B A4B IT — инструктивная модель Google DeepMind с архитектурой Mixture-of-Experts: из 25,2 млрд параметров на каждый токен активируется лишь 3,8 млрд, поэтому качество держится на уровне плотных моделей около 31 млрд, а вычислений требуется меньше. Дообучение на инструкции делает её предсказуемой в диалоге и в чётко поставленных задачах. Через BotHub модель работает из России без VPN и зарубежной карты: вы платите российской картой в рублях и только за израсходованные токены, без подписки. В одном окне рядом — более 250 моделей, так что ответы легко сравнить между собой, а единый OpenAI-совместимый API позволяет сменить модель, не переписывая интеграцию. Переписка шифруется по AES-GCM, а для компаний есть договор, счёт, ЭДО и админ-панель с лимитами. Берут gemma 4 обычно под ассистентов и чат-ботов с плотным потоком запросов, под черновики и переработку текстов, разбор и краткое изложение документов, а также под фоновые задачи в продукте, где важна стоимость одного ответа.Частые вопросы о Gemma 4 26B A4B IT
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Это текстовая модель Google с контекстом 65 536 токенов. Подходит для работы с кодом, разбора документов и изображений, аналитики, пошаговых рассуждений над задачами и интеграций через вызов функций. На BotHub доступна без VPN и зарубежной карты, оплата в рублях.
Лимит вывода — до 235 929 токенов за один ответ, то есть объём очень большой: длинная статья, развёрнутый разбор, крупный фрагмент кода. При этом контекстное окно составляет 65 536 токенов, поэтому историю диалога и вложения планируйте отдельно.
Да, рассуждения перед ответом подтверждены. Модель может разложить задачу на шаги и только потом выдать результат. Это заметно помогает в логике, математике, отладке кода и разборе документов, где важен не только итог, но и сам ход решения.
Да, поддерживаются и вызов функций, и структурированный вывод в JSON. Благодаря этому модель удобно подключать к внешним инструментам, базам и сервисам. На BotHub всё работает через единый OpenAI-совместимый API, так что модель можно сменить, не переписывая интеграцию.
Изображения и документы — да, их можно отправить вместе с текстом и попросить разобрать скриншот, схему или файл. Аудио и видео в наших данных не отмечены, поэтому для озвучки и работы с роликами лучше взять профильную модель из каталога BotHub.
Данных о языках промтов и ответов у нас нет, поэтому обещать ничего не станем — проверьте модель на своей задаче. На BotHub вы платите по факту за использованные токены, они не сгорают, так что сравнить несколько моделей можно спокойно.