LLM Non CensureDocs
Documentación de la API: Integración Rápida en 5 Minutos
Integra nuestra API de modelo sin censura en minutos gracias a la compatibilidad nativa con OpenAI. Empieza con un crédito de prueba inmediato, sin tarjeta de crédito.
Configuración del entorno y Autenticación
Para empezar, debes recuperar tu clave de API única desde tu panel de control. Esta clave servirá como identificador para autenticar tus peticiones. A diferencia de los modelos genéricos, nuestra API se basa en un endpoint estandarizado que te permite usar los SDK oficiales o cualquier cliente compatible con OpenAI. No necesitas proporcionar un número de teléfono ni una tarjeta de crédito para acceder al crédito de prueba inicial.
El punto de entrada base es https://api.llmnoncensure.com/v1. Asegúrate de configurar tu entorno para usar esta base URL específica. La clave de API debe pasarse mediante el encabezado Authorization: Bearer <YOUR_API_KEY>. Se genera una clave por cuenta; puedes regenerar una en cualquier momento, lo que revocará automáticamente la anterior.
Primera petición con cURL
Envía tu primera petición para verificar que la integración funciona. Usamos el ID de modelo uncensored. Esta petición envía un texto de entrada y recibe una respuesta textual sin los filtros de contenido habituales, siempre que no sea contenido sexual que involucre menores. El modelo está afinado para responder a temas adultos, controversos o de investigación de seguridad sin rechazos injustificados.
Aquí tienes la estructura base para probar la conexión:
curl https://api.llmnoncensure.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Este comando permite validar que tu clave está activa y que el modelo está listo para recibir prompts complejos.
Integración con el SDK de Python
Si desarrollas en Python, utiliza la biblioteca openai para una integración transparente. Define la variable de entorno OPENAI_BASE_URL o pasa base_url directamente en el cliente. Esto permite reutilizar tu código existente cambiando solo la fuente del modelo. El SDK gestiona la serialización JSON y los errores de red por ti.
Aquí tienes un ejemplo mínimo:
from openai import OpenAI
client = OpenAI(base_url="https://api.llmnoncensure.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)El modelo uncensored acepta parámetros estándar como temperature y max_tokens. Puedes ajustar la creatividad de la respuesta sin temor a que la IA bloquee una respuesta considerada "arriesgada" por criterios genéricos.
Uso con Node.js y JavaScript
Para entornos JavaScript o TypeScript, el SDK openai funciona de manera idéntica. Configura el cliente con la URL base y la clave de API. Este enfoque es ideal para aplicaciones backend o servidores de API que deben integrar respuestas de IA dinámicas sin las limitaciones de los grandes proveedores generalistas.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmnoncensure.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Asegúrate de gestionar las respuestas asíncronas correctamente. Cada petición se procesa individualmente, lo que garantiza que tu lógica de negocio no se bloquee por los tiempos de generación del modelo. La ventana de contexto de 100.000 tokens permite enviar instrucciones de sistema largas o historiales de conversación extensos.
Soporte de streaming SSE
Para una experiencia de usuario fluida, activa el streaming mediante eventos enviados por el servidor (SSE). Esto permite mostrar la respuesta palabra por palabra en lugar de esperar al final de la generación. Es especialmente útil para interfaces de chat donde la latencia percibida es crítica. El flujo de datos está estructurado según el estándar de OpenAI, facilitando el análisis en el lado del cliente.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)El streaming no cambia la lógica del modelo; simplemente modifica el transporte de los datos. Cada fragmento es una parte de la respuesta final. Puedes detener el stream en cualquier momento si el usuario modifica el prompt, lo que optimiza el uso de tus créditos.
Límites de tasa, errores y contexto
Conocer los límites de tu API es crucial para una integración robusta. Estás limitado a 300 peticiones por minuto por clave de API. El cuerpo de la petición no debe superar 8 MB. En caso de error, se devuelven los códigos HTTP estándar: 401 para una clave inválida, 402 si tu crédito se agota, y 429 en caso de exceder la tasa de peticiones. El modelo dispone de una ventana de contexto de 100.000 tokens, combinando prompt y respuesta. Esto permite enviar documentos largos o conversaciones profundas sin interrupciones prematuras. A diferencia de otros servicios, no hay cuotas fijas mensuales; pagas solo lo que consumes con tus créditos prepago.
Ficha técnica de la API
Una tabla con cada límite, función y precio.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Base URL | https://api.llmnoncensure.com/v1 |
| ID del modelo | uncensored |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Modo JSON | response_format: {"type": "json_object"} |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Límite de peticiones | 300 por minuto por clave |
| Tamaño de petición | hasta 8 MB |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Bono | +5 % desde $50, +10 % desde $100 |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Acceso | Google o correo y contraseña |
Errores y qué hacer
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas frecuentes
¿Cuál es la diferencia con los modelos estándar de OpenAI?
Nuestro modelo está específicamente afinado para no rechazar temas adultos, controversos o creativos, manteniendo el cumplimiento legal (sin contenido sexual que involucre menores). No es ni GPT, ni Claude, ni Gemini. Responde a prompts que otras API marcarían como "arriesgados".
¿Cómo funciona el crédito de prueba?
Cada nuevo cuenta recibe 0,50 $ de crédito gratis válido por 7 días. No se requiere tarjeta de crédito para activarlo. Una vez agotado el crédito o expirado el plazo, puedes añadir fondos mediante criptomonedas (USDT o USDC) para seguir usando la API sin compromiso mensual.
¿Se usan mis datos para el entrenamiento?
No, los prompts enviados a través de la API no se utilizan para entrenar el modelo. Tu privacidad está preservada porque no almacenamos tus datos para reutilizarlos en nuestros conjuntos de datos de entrenamiento, a diferencia de muchos proveedores gratuitos o freemium.
Tu clave está a un paso
Crea una cuenta, copia la clave, modifica la URL base. Eso es todo.