Mistral Large 4 в QuickSilver Pro
Mistral Large 4 — передовая мультимодальная модель Mistral AI, выпущенная в preview 6 октября 2026 года: текст и изображения на входе, контекст на 524K токенов и ориентация на код, рассуждения и агентные задачи. QuickSilver Pro работает через собственный endpoint Mistral по цене $0.68 за вход / $2.09 за выход за миллион токенов — столько же, сколько по прайс-листу этой модели на OpenRouter, без наценки.
Коротко
Флагман Mistral для кода и агентов — текст и изображения на входе, контекст 524K и reasoning, который можно отключить для отдельного запроса.
Сравнение цен ($/1M токенов)
| Провайдер | Вход | Выход | к QSP |
|---|---|---|---|
| QuickSilver Pro | $0.68 | $2.09 | — |
| OpenRouter list price (mistralai/mistral-large-4-0) | $0.68 | $2.09 | так же |
Когда использовать
Используйте Mistral Large 4 для агентных циклов, работы с кодом в нескольких файлах и длинных документов, когда нужен актуальный европейский флагман: контекст на 524K токенов вмещает большой репозиторий или стопку отчётов, модель читает скриншоты и диаграммы вместе с текстом и поддерживает function calling (включая принудительный выбор инструмента) и структурированный вывод по JSON Schema. По умолчанию модель думает перед ответом; для быстрых прямых ответов передайте `reasoning: {"enabled": false}`. Кэшированный вход стоит $0.07 за миллион токенов.
Когда выбрать другую модель
Reasoning включён по умолчанию, работает основательно и может потратить тысячи выходных токенов до начала ответа, поэтому для обычного чата отключайте его, а если оставляете включённым, задавайте `max_tokens` с запасом. Для массового простого извлечения данных модель flash-уровня, например DeepSeek V4 Flash ($0.086/$0.173), обходится намного дешевле. Один ответ ограничен 131,072 выходными токенами. Это preview-релиз, который обслуживается собственным endpoint Mistral; он не предлагает нулевого хранения данных, а поведение может измениться до общего релиза.
Быстрый старт (curl)
curl https://api.quicksilverpro.io/v1/chat/completions \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mistral-large-4",
"messages": [{"role": "user", "content": "Hello!"}]
}'Совместимо с OpenAI. Миграция в одну строку через base_url.
FAQ
$0.68 за миллион входных токенов, $2.09 за миллион выходных токенов и $0.07 за миллион кэшированных входных токенов — столько же, сколько по прайс-листу этой модели на OpenRouter, без наценки. Токены reasoning оплачиваются как выходные.
Да. По умолчанию она думает перед ответом; ход рассуждений возвращается в отдельном поле, а его токены учитываются в `max_tokens` и оплачиваются по выходной ставке. Передайте в запросе `reasoning: {"enabled": false}`, чтобы отключить размышление для этого вызова; тогда токены reasoning не начисляются.
Да. Она принимает текст и изображения на входе и возвращает текст. Поддерживаются streaming, function calling (включая принудительный выбор инструмента) и структурированный вывод по JSON Schema. Изображения можно отправлять по URL или встроенными, в виде base64 data URL.
Укажите base_url=https://api.quicksilverpro.io/v1, используйте свой ключ QSP и задайте model="mistral-large-4". Клиенты Chat Completions и Responses API используют один и тот же публичный ID модели.