контекст 524KМультимодальнаяReasoningResponses API

Mistral Large 4 в QuickSilver Pro

Mistral Large 4 — передовая мультимодальная модель Mistral AI, выпущенная в preview 6 октября 2026 года: текст и изображения на входе, контекст на 524K токенов и ориентация на код, рассуждения и агентные задачи. QuickSilver Pro работает через собственный endpoint Mistral по цене $0.68 за вход / $2.09 за выход за миллион токенов — столько же, сколько по прайс-листу этой модели на OpenRouter, без наценки.

$0.68 вход · $2.09 выход за 1M токенов
Автор:Raullen Chai·Обновлено

Коротко

Контекст
524K токенов
Вход / 1M
$0.68
Выход / 1M
$2.09
Думает по умолчанию
Да

Флагман Mistral для кода и агентов — текст и изображения на входе, контекст 524K и reasoning, который можно отключить для отдельного запроса.

Сравнение цен ($/1M токенов)

ПровайдерВходВыходк QSP
QuickSilver Pro$0.68$2.09—
OpenRouter list price (mistralai/mistral-large-4-0)$0.68$2.09так же

Когда использовать

Используйте Mistral Large 4 для агентных циклов, работы с кодом в нескольких файлах и длинных документов, когда нужен актуальный европейский флагман: контекст на 524K токенов вмещает большой репозиторий или стопку отчётов, модель читает скриншоты и диаграммы вместе с текстом и поддерживает function calling (включая принудительный выбор инструмента) и структурированный вывод по JSON Schema. По умолчанию модель думает перед ответом; для быстрых прямых ответов передайте `reasoning: {"enabled": false}`. Кэшированный вход стоит $0.07 за миллион токенов.

Когда выбрать другую модель

Reasoning включён по умолчанию, работает основательно и может потратить тысячи выходных токенов до начала ответа, поэтому для обычного чата отключайте его, а если оставляете включённым, задавайте `max_tokens` с запасом. Для массового простого извлечения данных модель flash-уровня, например DeepSeek V4 Flash ($0.086/$0.173), обходится намного дешевле. Один ответ ограничен 131,072 выходными токенами. Это preview-релиз, который обслуживается собственным endpoint Mistral; он не предлагает нулевого хранения данных, а поведение может измениться до общего релиза.

Быстрый старт (curl)

curl https://api.quicksilverpro.io/v1/chat/completions \
  -H "Authorization: Bearer $QSP_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mistral-large-4",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Совместимо с OpenAI. Миграция в одну строку через base_url.

FAQ

$0.68 за миллион входных токенов, $2.09 за миллион выходных токенов и $0.07 за миллион кэшированных входных токенов — столько же, сколько по прайс-листу этой модели на OpenRouter, без наценки. Токены reasoning оплачиваются как выходные.

Да. По умолчанию она думает перед ответом; ход рассуждений возвращается в отдельном поле, а его токены учитываются в `max_tokens` и оплачиваются по выходной ставке. Передайте в запросе `reasoning: {"enabled": false}`, чтобы отключить размышление для этого вызова; тогда токены reasoning не начисляются.

Да. Она принимает текст и изображения на входе и возвращает текст. Поддерживаются streaming, function calling (включая принудительный выбор инструмента) и структурированный вывод по JSON Schema. Изображения можно отправлять по URL или встроенными, в виде base64 data URL.

Укажите base_url=https://api.quicksilverpro.io/v1, используйте свой ключ QSP и задайте model="mistral-large-4". Клиенты Chat Completions и Responses API используют один и тот же публичный ID модели.

Попробуйте Mistral Large 4 с удвоенным балансом — до $50 бонусных кредитов

Получить API Key