Независимая проверка цен · 2026-08-31

Сравнивайте стоимость по своему token mix.

Практическое сравнение prepaid blended pricing, официальных тарифов и подписочного доступа. Начинайте с реальной нагрузки, а не с одной цифры в заголовке.

Рассчитать workload

Публичные цены Model.sale

Цена указана за 1M charged tokens. Initial reservation временный и возвращается после terminal usage; это не отдельное списание за запрос. Цена остаётся видимой при временной недоступности модели.

МодельBlended / 1MНачальный резервСтатус
claude-haiku-4-5$0.075$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-opus-4-5$0.30$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-opus-4-6$0.40$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-opus-4-7$0.50$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-opus-4-8$0.60$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-sonnet-4-5$0.15$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
claude-sonnet-4-6$0.25$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
deepseek-v4-flash$0.20$0.01 (возвращается)LIVE
deepseek-v4-pro$0.20$0.01 (возвращается)LIVE
glm-5$0.12$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
glm-5.1$0.16$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
glm-5.2$0.20$0.01 (возвращается)LIVE
glm-5.3$0.20$0.01 (возвращается)LIVE
glm-5.3-flash$0.10$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-5.4$0.10$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-5.4-20$0.10$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-5.4-mini$0.09$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-5.5$0.45$0.01 (возвращается)LIVE
gpt-5.6-luna$0.09$0.01 (возвращается)LIVE
gpt-5.6-sol$0.45$0.01 (возвращается)LIVE
gpt-5.6-terra$0.15$0.01 (возвращается)LIVE
gpt-6-astra$1.125$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
gpt-image-2$0.10$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
kimi-k2.5$0.07$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
kimi-k2.6$0.11$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
kimi-k3$0.24$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
mimo-v2-omni$0.05$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
mimo-v2-pro$0.05$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
mimo-v2.5$0.01$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
mimo-v2.5-pro$0.03$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
minimax-m2.5$0.02$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
minimax-m2.7$0.04$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
minimax-m3$0.04$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen-3.8$0.25$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen3.5-plus$0.05$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen3.6-plus$0.04$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen3.7-max$0.11$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
qwen3.7-plus$0.03$0.01 (возвращается)ВРЕМЕННО НЕДОСТУПНА
Prepaid
Платите по факту

Пополните баланс и платите за использование. Средства резервируются до отправки запроса.

Официальные API
Раздельные ставки

Input, cached input и output могут иметь разные цены и уровни контекста.

Exact usage
Списание по usage

Временный резерв защищает wallet, а итоговый charge считает только terminal tokens из API.

Примеры одинаковой нагрузки

Ниже одна и та же mix: 800K input + 200K output. Это сравнение формы биллинга, а не утверждение об одинаковом качестве моделей.

СемействоBlended Model.saleПример Model.saleОфициальный split-пример
GPT-5.6 Luna$0.09/M$0.09$0.40 · $0.20 input + $1.20 output
GPT-5.6 Terra$0.15/M$0.15$4.00 · $2 input + $12 output
GPT-5.6 Sol$0.45/M$0.45$7.20 · $4 input + $20 output

В колонке Model.sale применяется одна blended-ставка к 1M charged tokens. В официальной колонке input и output считаются раздельно. При другой mix результат изменится.

Prepaid API и подписка

ВопросPrepaid APIПодписочный продукт
ОплатаБаланс, затем фактическое использованиеРегулярная плата за план или место
Кому подходитПеременная нагрузка, скрипты, coding agentsФиксированные места и функции продукта
ПрозрачностьЗапросы, токены и ledgerКвоты или лимиты плана
Контроль бюджетаЛимиты ключа и дневной capОтмена регулярного платежа

Популярные альтернативы API

Model.sale — prepaid-сервис с единым публичным каталогом. Ниже собраны распространённые альтернативы, но это разные типы продукта: агрегаторы, прямые платформы open-моделей и low-latency API. Таблица сравнивает документированные условия, а не качество моделей и не обещает универсальную «самую низкую цену».

СервисБиллингКаталог / маршрутизацияКому подходитПроверено
OpenRouter
Multi-provider aggregator
Pay-as-you-go credits; 5.5% credit purchase fee (minimum $0.80); crypto purchases have a 5% fee.400+ models and 70+ providers on the pay-as-you-go plan. Provider selection, fallbacks and auto-routing are available.Teams that want breadth and provider choice in one account.
Компромисс: More routing and pricing dimensions to understand; a headline per-token price is not a blended workload cost.
2026-08-31 · источник
Together AI
Open-model inference platform
Serverless inference is pay-per-token with no provisioning cost or minimum; dedicated options use reserved capacity.Open-weight models including DeepSeek, Qwen, Kimi, GLM and Llama families. You select the model/endpoint; serverless capacity is shared and best-effort.Developers who need open models and want a direct, programmable API.
Компромисс: You still manage model selection, split input/output math and the provider account; dedicated capacity adds a different cost model.
2026-08-31 · источник
Fireworks AI
Inference platform
Serverless inference is per-token; dedicated deployments are billed by GPU time. New users may receive free credits.A curated serverless catalog focused on open models, with custom and dedicated deployment paths. You choose a serverless model or run a dedicated deployment; no universal multi-provider router is promised.Fast prototypes that may later need a dedicated open-model deployment.
Компромисс: GPU-hour costs and operational choices matter once you leave serverless; compare total workload cost, not only token price.
2026-08-31 · источник
Groq
Low-latency inference platform
Developer usage is billed in arrears with progressive thresholds; the free/developer limits and payment requirements differ.A focused catalog of production and preview models, published with model-specific limits and token rates. You select a Groq model; the platform emphasizes predictable low-latency serving rather than cross-provider routing.Latency-sensitive applications using the models in Groq's active catalog.
Компромисс: It is not a broad aggregator, and postpaid billing is a different budget model from a prepaid wallet.
2026-08-31 · источник

Тарифы, комиссии, модели и лимиты меняются. Перед production запуском откройте источник и проверьте условия ещё раз. Model.sale не аффилирован с перечисленными сервисами.

Как посчитать эффективную стоимость

  1. Возьмите репрезентативный час или день запросов.
  2. Разделите input, cached и output tokens, retries и disconnect.
  3. Примените правила каждой официальной модели.
  4. Примените blended rate Model.sale к фактическому charged-token total; initial reservation возвращается после settlement.
  5. Сравните итог вместе с latency, availability и возможностями модели.

Reference rows ниже датированы и ведут на официальные источники. Это не benchmark и не обещание parity.

Официальные опубликованные ставки

USD за миллион токенов по стандартным опубликованным тарифам. Cached input показан отдельно, если он есть в источнике.

МодельInputCached inputOutputИсточник
OpenAI GPT-5.6 Sol$4.00See source$20.00Официальный тариф
OpenAI GPT-5.6 Terra$2.00See source$12.00Официальный тариф
OpenAI GPT-5.6 Luna$0.20See source$1.20Официальный тариф
Anthropic Claude Opus 4.8$5.00$0.50$25.00Официальный тариф
Anthropic Claude Sonnet 4.6$3.00$0.30$15.00Официальный тариф
Anthropic Claude Haiku 4.5$1.00$0.10$5.00Официальный тариф

Не утверждение эквивалентности

Названия, context limits и качество могут различаться. Смотрите на таблицу как на reference формы биллинга.

Цены меняются

Проверяйте дату и официальный источник перед расчётом бюджета.

Нужна формула?

Откройте методику цен для measured usage, reservation и settlement.