ES ▾
Obtener clave de API

LLM Non CensureDocs

Documentación de la API: Integración Rápida en 5 Minutos

Integra nuestra API de modelo sin censura en minutos gracias a la compatibilidad nativa con OpenAI. Empieza con un crédito de prueba inmediato, sin tarjeta de crédito.

Configuración del entorno y Autenticación

Para empezar, debes recuperar tu clave de API única desde tu panel de control. Esta clave servirá como identificador para autenticar tus peticiones. A diferencia de los modelos genéricos, nuestra API se basa en un endpoint estandarizado que te permite usar los SDK oficiales o cualquier cliente compatible con OpenAI. No necesitas proporcionar un número de teléfono ni una tarjeta de crédito para acceder al crédito de prueba inicial.

El punto de entrada base es https://api.llmnoncensure.com/v1. Asegúrate de configurar tu entorno para usar esta base URL específica. La clave de API debe pasarse mediante el encabezado Authorization: Bearer <YOUR_API_KEY>. Se genera una clave por cuenta; puedes regenerar una en cualquier momento, lo que revocará automáticamente la anterior.

Primera petición con cURL

Envía tu primera petición para verificar que la integración funciona. Usamos el ID de modelo uncensored. Esta petición envía un texto de entrada y recibe una respuesta textual sin los filtros de contenido habituales, siempre que no sea contenido sexual que involucre menores. El modelo está afinado para responder a temas adultos, controversos o de investigación de seguridad sin rechazos injustificados.

Aquí tienes la estructura base para probar la conexión:

curl https://api.llmnoncensure.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Este comando permite validar que tu clave está activa y que el modelo está listo para recibir prompts complejos.

Integración con el SDK de Python

Si desarrollas en Python, utiliza la biblioteca openai para una integración transparente. Define la variable de entorno OPENAI_BASE_URL o pasa base_url directamente en el cliente. Esto permite reutilizar tu código existente cambiando solo la fuente del modelo. El SDK gestiona la serialización JSON y los errores de red por ti.

Aquí tienes un ejemplo mínimo:

from openai import OpenAI

client = OpenAI(base_url="https://api.llmnoncensure.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

El modelo uncensored acepta parámetros estándar como temperature y max_tokens. Puedes ajustar la creatividad de la respuesta sin temor a que la IA bloquee una respuesta considerada "arriesgada" por criterios genéricos.

Uso con Node.js y JavaScript

Para entornos JavaScript o TypeScript, el SDK openai funciona de manera idéntica. Configura el cliente con la URL base y la clave de API. Este enfoque es ideal para aplicaciones backend o servidores de API que deben integrar respuestas de IA dinámicas sin las limitaciones de los grandes proveedores generalistas.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmnoncensure.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Asegúrate de gestionar las respuestas asíncronas correctamente. Cada petición se procesa individualmente, lo que garantiza que tu lógica de negocio no se bloquee por los tiempos de generación del modelo. La ventana de contexto de 100.000 tokens permite enviar instrucciones de sistema largas o historiales de conversación extensos.

Soporte de streaming SSE

Para una experiencia de usuario fluida, activa el streaming mediante eventos enviados por el servidor (SSE). Esto permite mostrar la respuesta palabra por palabra en lugar de esperar al final de la generación. Es especialmente útil para interfaces de chat donde la latencia percibida es crítica. El flujo de datos está estructurado según el estándar de OpenAI, facilitando el análisis en el lado del cliente.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

El streaming no cambia la lógica del modelo; simplemente modifica el transporte de los datos. Cada fragmento es una parte de la respuesta final. Puedes detener el stream en cualquier momento si el usuario modifica el prompt, lo que optimiza el uso de tus créditos.

Límites de tasa, errores y contexto

Conocer los límites de tu API es crucial para una integración robusta. Estás limitado a 300 peticiones por minuto por clave de API. El cuerpo de la petición no debe superar 8 MB. En caso de error, se devuelven los códigos HTTP estándar: 401 para una clave inválida, 402 si tu crédito se agota, y 429 en caso de exceder la tasa de peticiones. El modelo dispone de una ventana de contexto de 100.000 tokens, combinando prompt y respuesta. Esto permite enviar documentos largos o conversaciones profundas sin interrupciones prematuras. A diferencia de otros servicios, no hay cuotas fijas mensuales; pagas solo lo que consumes con tus créditos prepago.

Ficha técnica de la API

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
Base URLhttps://api.llmnoncensure.com/v1
ID del modelouncensored
AutenticaciónAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
Ventana de contexto100.000 tokens (entrada + salida)
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Límite de peticiones300 por minuto por clave
Tamaño de peticiónhasta 8 MB
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrencia8 peticiones a la vez por clave
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Caducidadel crédito pagado no caduca, sin suscripción
Bono+5 % desde $50, +10 % desde $100
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
AccesoGoogle o correo y contraseña

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas frecuentes

¿Cuál es la diferencia con los modelos estándar de OpenAI?

Nuestro modelo está específicamente afinado para no rechazar temas adultos, controversos o creativos, manteniendo el cumplimiento legal (sin contenido sexual que involucre menores). No es ni GPT, ni Claude, ni Gemini. Responde a prompts que otras API marcarían como "arriesgados".

¿Cómo funciona el crédito de prueba?

Cada nuevo cuenta recibe 0,50 $ de crédito gratis válido por 7 días. No se requiere tarjeta de crédito para activarlo. Una vez agotado el crédito o expirado el plazo, puedes añadir fondos mediante criptomonedas (USDT o USDC) para seguir usando la API sin compromiso mensual.

¿Se usan mis datos para el entrenamiento?

No, los prompts enviados a través de la API no se utilizan para entrenar el modelo. Tu privacidad está preservada porque no almacenamos tus datos para reutilizarlos en nuestros conjuntos de datos de entrenamiento, a diferencia de muchos proveedores gratuitos o freemium.

Tu clave está a un paso

Crea una cuenta, copia la clave, modifica la URL base. Eso es todo.

Obtener clave de APILeer la documentación