Acceso verificado al modelo

API de deepseek-v4-pro

Un endpoint prepago de Model.sale para deepseek-v4-pro: una sola API key, límites explícitos y una comprobación de compatibilidad en vivo. El modelo solicitado nunca se sustituye en silencio.

Precio$0.02 por 1M de tokens cobrablesReserva inicial $0.01, se libera tras el uso medido
Disponibilidad Activo · healthyÚltima comprobación 2026-10-04T21:41:35.354Z
Endpoints verificadosChat CompletionsEl streaming se prueba por separado en cada ruta.

Inicio rápido

Crea una API key, añade saldo y usa la base URL de abajo. Guarda la clave en una variable de entorno.

curl https://api.model.sale/v1/chat/completions \
  -H "Authorization: Bearer $MODEL_SALE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-pro","messages":[{"role":"user","content":"Reply exactly OK"}]}'
import os
from openai import OpenAI

client = OpenAI(base_url="https://api.model.sale/v1", api_key=os.environ["MODEL_SALE_API_KEY"])
response = client.chat.completions.create(model="deepseek-v4-pro", messages=[{"role": "user", "content": "Reply exactly OK"}])
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.model.sale/v1", apiKey: process.env.MODEL_SALE_API_KEY });
const response = await client.chat.completions.create({ model: "deepseek-v4-pro", messages: [{ role: "user", content: "Reply exactly OK" }] });
console.log(response.choices[0]?.message.content);
Facturación

El monedero reserva antes del envío y liquida a partir del uso final. El tratamiento de los tokens en caché y de razonamiento sigue la política de facturación vigente.

Crear API key

Cómo estimar una solicitud

La tarifa pública es un importe mixto en USD por cada millón de tokens cobrables. No es una tarifa separada para tokens de entrada o de salida. Para una estimación rápida, multiplica el número de tokens cobrables por la tarifa y divide entre 1.000.000. El registro de la solicitud es la fuente definitiva del uso real y de la liquidación.

Tokens cobrablesCargo ilustrativo
1000$0.00002
10.000$0.0002
100.000$0.002

Son ejemplos aritméticos, no una promesa de un precio fijo por solicitud. El número real de tokens depende de tu entrada, tu salida y del uso que informe el modelo. Cualquier importe mínimo de solicitud mostrado arriba es una reserva inicial; tras recibir el uso final, el monedero liquida el cargo medido y libera los fondos reservados no utilizados.

LímitesTu API key controla RPM, TPM, concurrencia y topes de gasto. Consulta el panel antes de enviar tráfico de producción.
Errores401 suele significar que la clave o la autorización no son válidas. Un 429 indica un límite de frecuencia o de gasto. Ante 5xx y tiempos de espera, revisa Uso antes de reintentar para que el cliente no duplique trabajo.
¿Necesitas ayuda?Usa las guías de configuración y el formulario de soporte. No incluyas nunca prompts, salidas ni secretos en un ticket.

Antes de usar este modelo en producción

  1. Confirma el ID exacto del modelo y uno de los endpoints verificados indicados arriba.
  2. Empieza con una API key dedicada y un tope bajo por solicitud y por día.
  3. Envía una solicitud JSON corta y verifica en Uso la solicitud completada y el cargo.
  4. Si tu cliente depende del streaming, prueba una solicitud SSE y confirma que llega a un evento final.
  5. Gestiona de forma explícita las respuestas 401, 429, de tiempo de espera y 5xx. Model.sale no reintenta automáticamente una solicitud fallida ni la cambia a otro modelo.

La disponibilidad es una observación reciente, no una garantía de tiempo de actividad. Consulta el catálogo completo de modelos, la tabla de precios, las guías de configuración de clientes y la metodología de facturación antes de elegir una configuración de producción.

Tu primera solicitud en menos de un minuto.

Crea una clave, recarga desde 5 US$ y cambia la base URL. Sin suscripción ni cargos ocultos.

Obtén tu API keyLeer la documentación