LLM Non CensureDocs
Documentazione API: Integrazione Rapida in 5 Minuti
Integra la nostra API di modello senza censura in pochi minuti grazie alla compatibilità nativa OpenAI. Inizia con un credito di prova immediato, senza carta di credito.
Configurazione ambiente e Autenticazione
Per iniziare, devi recuperare la tua chiave API univoca dal tuo dashboard. Questa chiave servirà da identificatore per autenticare le tue richieste. A differenza dei modelli generici, la nostra API si basa su un endpoint standardizzato che ti permette di usare gli SDK ufficiali o qualsiasi client compatibile OpenAI. Non devi fornire un numero di telefono o una carta di credito per accedere al credito di prova iniziale.
L'endpoint base è https://api.llmnoncensure.com/v1. Assicurati di configurare il tuo ambiente per usare questo base URL specifico. La chiave API deve essere passata tramite l'intestazione Authorization: Bearer <YOUR_API_KEY>. Viene generata una chiave per account; puoi rigenerarla in qualsiasi momento, revocando automaticamente quella vecchia.
Prima richiesta con cURL
Invia la tua prima richiesta per verificare che l'integrazione funzioni. Usiamo l'ID del modello uncensored. Questa richiesta invia un testo in input e riceve una risposta testuale senza i soliti filtri sui contenuti, purché non si tratti di contenuto sessuale con minori. Il modello è ottimizzato per rispondere a argomenti adulti, controversi o di ricerca sulla sicurezza senza rifiuti ingiustificati.
Ecco la struttura base per testare la connessione:
curl https://api.llmnoncensure.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Questo comando permette di validare che la tua chiave è attiva e che il modello è pronto a ricevere prompt complessi.
Integrazione con SDK Python
Se sviluppi in Python, usa la libreria openai per un'integrazione trasparente. Imposta la variabile d'ambiente OPENAI_BASE_URL o passa base_url direttamente nel client. Questo permette di riutilizzare il tuo codice esistente cambiando solo la fonte del modello. L'SDK gestisce la serializzazione JSON e gli errori di rete per te.
Ecco un esempio minimo:
from openai import OpenAI
client = OpenAI(base_url="https://api.llmnoncensure.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Il modello uncensored accetta parametri standard come temperature e max_tokens. Puoi regolare la creatività della risposta senza temere che l'IA blocchi una risposta giudicata "rischiosa" da criteri generici.
Utilizzo con Node.js e JavaScript
Per ambienti JavaScript o TypeScript, l'SDK openai funziona in modo identico. Configura il client con l'URL base e la chiave API. Questo approccio è ideale per applicazioni backend o server API che devono integrare risposte IA dinamiche senza i limiti dei grandi fornitori generalisti.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmnoncensure.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Assicurati di gestire correttamente le risposte asincrone. Ogni richiesta viene elaborata individualmente, garantendo che la tua logica di business non venga bloccata dai tempi di generazione del modello. Il contesto di 100.000 token permette di inviare istruzioni di sistema lunghe o cronologie di conversazione estese.
Supporto streaming SSE
Per un'esperienza utente fluida, attiva lo streaming tramite eventi server inviati (SSE). Questo permette di visualizzare la risposta parola per parola invece di attendere la fine della generazione. È particolarmente utile per le interfacce chat dove la latenza percepita è critica. Il flusso di dati è strutturato secondo lo standard OpenAI, facilitando il parsing lato client.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Lo streaming non cambia la logica del modello; modifica semplicemente il trasporto dei dati. Ogni chunk è una parte della risposta finale. Puoi interrompere lo stream in qualsiasi momento se l'utente modifica il prompt, ottimizzando l'utilizzo dei tuoi crediti.
Limiti di richieste, errori e contesto
Conoscere i limiti della tua API è cruciale per un'integrazione robusta. Sei limitato a 300 richieste al minuto per chiave API. Il corpo della richiesta non deve superare 8 MB. In caso di errore, vengono restituiti i codici HTTP standard: 401 per una chiave non valida, 402 se il tuo credito è esaurito, e 429 in caso di superamento del limite di richieste. Il modello dispone di una finestra di contesto di 100.000 token, combinando prompt e risposta. Questo permette di inviare documenti lunghi o conversazioni approfondite senza interruzioni premature. A differenza di altri servizi, non ci sono costi fissi mensili; paghi solo ciò che consumi con i tuoi crediti prepagati.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Base URL | https://api.llmnoncensure.com/v1 |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Modalità JSON | response_format: {"type": "json_object"} |
| Finestra di contesto | 100.000 token (input + output) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrenza | 8 richieste contemporanee per chiave |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Bonus | +5% da $50, +10% da $100 |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande frequenti
Qual è la differenza con i modelli OpenAI standard?
Il nostro modello è specificamente ottimizzato per non rifiutare argomenti adulti, controversi o creativi, restando conforme alla legge (niente contenuti sessuali con minori). Non è né GPT, né Claude, né Gemini. Risponde a prompt che altre API segnerebbero come "rischiosi".
Come funziona il credito di prova?
Ogni nuovo account riceve 0,50 $ di credito gratuito valido per 7 giorni. Non serve la carta di credito per attivarlo. Una volta esaurito il credito o scaduto il termine, puoi aggiungere fondi con criptovalute (USDT o USDC) per continuare a usare l'API senza impegno mensile.
I miei dati vengono usati per l'addestramento?
No, i prompt inviati via API non vengono usati per addestrare il modello. La tua privacy è preservata perché non memorizziamo i tuoi dati per riutilizzarli nei nostri set di addestramento, a differenza di molti fornitori gratuiti o freemium.
La tua chiave è a un passo
Crea un account, copia la chiave, modifica l'URL base. È tutto.