Inicio rápido para usuarios de DeepSeek
Migra tu código al endpoint de LLM sin censura actualizando la URL base y la clave de API. La API sigue la especificación de chat-completions de OpenAI, lo que te permite cambiar al modelo sin modificar la lógica de tu aplicación.
- URL base
https://api.deepseekapikey.com/v1- Modelo
uncensored
Autenticación y URL base
Nuestra API se aloja en https://api.deepseekapikey.com/v1. Para autenticarte, incluye tu clave de API en el encabezado Authorization como un token Bearer. Puedes generar una clave en la página Obtener clave de API usando solo un correo electrónico y una contraseña. Si pierdes tu clave, puedes regenerarla en cualquier momento, lo que revoca inmediatamente la anterior. A diferencia de algunos proveedores, no requerimos una tarjeta de crédito para la cuenta de prueba inicial.
Primera petición
Envía una petición POST estándar a /v1/chat/completions. Usa el ID de modelo uncensored para acceder a nuestro modelo de pesos abiertos. El cuerpo de la petición sigue la estructura estándar con una matriz messages que contiene tu prompt. Este endpoint admite entrada y salida de texto, lo que lo convierte en un reemplazo listo para usar para muchas integraciones existentes.
curl https://api.deepseekapikey.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integración con SDK de Python
Si usas el cliente oficial de OpenAI para Python, puedes apuntarlo a nuestra URL base sobrescribiendo el parámetro base_url. Pasa tu clave a la inicialización del cliente. Este enfoque te permite mantener la estructura de tu código Python existente mientras enrutas las peticiones a través de nuestro endpoint sin censura. El cliente maneja la serialización JSON y el análisis de respuestas automáticamente.
from openai import OpenAI
client = OpenAI(base_url="https://api.deepseekapikey.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integración con SDK de Node.js
Para aplicaciones en Node.js, inicializa el cliente de OpenAI con la misma estrategia de configuración. Establece baseURL al endpoint de nuestra API y proporciona tu clave. Esto asegura que todas las llamadas posteriores, incluido el uso de herramientas, se enruten correctamente a nuestros servidores. Este método funciona con cualquier SDK compatible con OpenAI que respete la sobrescritura de baseURL.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.deepseekapikey.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respuestas en streaming
Habilita el streaming estableciendo stream: true en la carga útil de tu petición. La API devuelve un flujo de Server-Sent Events (SSE), lo que te permite recibir tokens a medida que se generan. Esto es ideal para interfaces de usuario que se benefician de la retroalimentación en tiempo real. El formato del flujo coincide con la especificación estándar de SSE de OpenAI, por lo que tus controladores de streaming existentes deberían funcionar sin modificaciones.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Límites, errores y contexto
La ventana de contexto admite 100,000 tokens para prompt y completion combinados. Si excedes el límite de peticiones de 300 peticiones por minuto, la API devuelve un error 429. Los fallos de autenticación devuelven un estado 401, mientras que un saldo insuficiente de crédito prepago genera un error 402. Puedes consultar los modelos disponibles mediante GET /v1/models, aunque el endpoint principal está diseñado para completados de chat. Los prompts no se utilizan para entrenamiento, y el modelo bloquea contenido sexual que involucra a menores.
Preguntas y respuestas
¿Es este modelo igual que DeepSeek?
No, es un modelo independiente de pesos abiertos ejecutado en nuestros propios servidores GPU. No es GPT, Claude, Gemini, Grok ni DeepSeek. Está ajustado para responder sin rechazos de contenido para uso adulto lícito.
¿Cómo funciona la facturación?
Usamos precios transparentes de pago por uso: $0,25 por 1M de tokens de entrada y $1,00 por 1M de tokens de salida. No hay cuotas mensuales ni niveles ocultos, y el crédito prepago no caduca.
¿Puedo usarlo para llamadas a herramientas/funciones?
Sí, el endpoint POST /v1/chat/completions admite cargas útiles estándar de llamadas a herramientas y funciones. La API acepta el mismo formato de esquema que usan los clientes compatibles con OpenAI.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave y cambia la URL base. Eso es todo el proceso de configuración.
Ficha técnica de la API
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.deepseekapikey.com/v1 |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Modo JSON | response_format: {"type": "json_object"} |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Límite de peticiones | 300 por minuto por clave |
| Tamaño de petición | hasta 8 MB |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Bono | +5 % desde $50, +10 % desde $100 |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |