Рассуждение по запросу, изображения на входе и контекст в четверть миллиона токенов
Mistral Small 4 вышла в марте 2026 года. Это модель с архитектурой смеси экспертов: всего 119 миллиардов параметров, из них на каждый токен задействуется порядка 6,5 миллиарда. Она сводит в одну систему то, что раньше требовало нескольких моделей Mistral: ответы по инструкции, рассуждение и работу с кодом. Глубину размышления выбирают в каждом запросе: можно получить мгновенный ответ или включить рассуждение. Контекст равен 262 144 токенам, ответ может достигать около 210 тысяч токенов. На вход идут текст и изображения, на выходе текст. Модель поддерживает вызов функций и вывод в JSON, это пригодится в агентах, при автоматизации разработки и при разборе документов. Веса опубликованы под Apache 2.0. По цене модель относится к среднему сегменту.
Глубину размышления задаёт параметр reasoning_effort: значение none даёт обычный ответ, high включает рассуждение. Так описано у Mistral AI на Hugging Face.
Small 4 объединяет рассуждение, работу с кодом и ответы по инструкции в одной модели. Кроме того, у Small 4 архитектура смеси экспертов, а изображения на вход принимают обе.
Да, на вход можно подавать текст и изображения. Ответ всегда выдаётся текстом.
Да, они опубликованы на Hugging Face под лицензией Apache 2.0. Их размер указан в описании выше: 119 миллиардов параметров.
Да, разработчик заявляет встроенный вызов функций и вывод в JSON. Это основа для агентов, которые обращаются к внешним сервисам.
Все AI-модели каталога Apikley — доступ через API из России, оплата в рублях, без VPN.