API de deepseek-v4-pro
Un endpoint prepago de Model.sale para deepseek-v4-pro: una sola API key, límites explícitos y una comprobación de compatibilidad en vivo. El modelo solicitado nunca se sustituye en silencio.
Inicio rápido
Crea una API key, añade saldo y usa la base URL de abajo. Guarda la clave en una variable de entorno.
curl https://api.model.sale/v1/chat/completions \
-H "Authorization: Bearer $MODEL_SALE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-v4-pro","messages":[{"role":"user","content":"Reply exactly OK"}]}'import os
from openai import OpenAI
client = OpenAI(base_url="https://api.model.sale/v1", api_key=os.environ["MODEL_SALE_API_KEY"])
response = client.chat.completions.create(model="deepseek-v4-pro", messages=[{"role": "user", "content": "Reply exactly OK"}])
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.model.sale/v1", apiKey: process.env.MODEL_SALE_API_KEY });
const response = await client.chat.completions.create({ model: "deepseek-v4-pro", messages: [{ role: "user", content: "Reply exactly OK" }] });
console.log(response.choices[0]?.message.content);El monedero reserva antes del envío y liquida a partir del uso final. El tratamiento de los tokens en caché y de razonamiento sigue la política de facturación vigente.
Cómo estimar una solicitud
La tarifa pública es un importe mixto en USD por cada millón de tokens cobrables. No es una tarifa separada para tokens de entrada o de salida. Para una estimación rápida, multiplica el número de tokens cobrables por la tarifa y divide entre 1.000.000. El registro de la solicitud es la fuente definitiva del uso real y de la liquidación.
| Tokens cobrables | Cargo ilustrativo |
|---|---|
| 1000 | $0.00002 |
| 10.000 | $0.0002 |
| 100.000 | $0.002 |
Son ejemplos aritméticos, no una promesa de un precio fijo por solicitud. El número real de tokens depende de tu entrada, tu salida y del uso que informe el modelo. Cualquier importe mínimo de solicitud mostrado arriba es una reserva inicial; tras recibir el uso final, el monedero liquida el cargo medido y libera los fondos reservados no utilizados.
Antes de usar este modelo en producción
- Confirma el ID exacto del modelo y uno de los endpoints verificados indicados arriba.
- Empieza con una API key dedicada y un tope bajo por solicitud y por día.
- Envía una solicitud JSON corta y verifica en Uso la solicitud completada y el cargo.
- Si tu cliente depende del streaming, prueba una solicitud SSE y confirma que llega a un evento final.
- Gestiona de forma explícita las respuestas 401, 429, de tiempo de espera y 5xx. Model.sale no reintenta automáticamente una solicitud fallida ni la cambia a otro modelo.
La disponibilidad es una observación reciente, no una garantía de tiempo de actividad. Consulta el catálogo completo de modelos, la tabla de precios, las guías de configuración de clientes y la metodología de facturación antes de elegir una configuración de producción.