IT ▾
Ottieni la chiave API

LLM Non CensureDocs

Documentazione API: Integrazione Rapida in 5 Minuti

Integra la nostra API di modello senza censura in pochi minuti grazie alla compatibilità nativa OpenAI. Inizia con un credito di prova immediato, senza carta di credito.

Configurazione ambiente e Autenticazione

Per iniziare, devi recuperare la tua chiave API univoca dal tuo dashboard. Questa chiave servirà da identificatore per autenticare le tue richieste. A differenza dei modelli generici, la nostra API si basa su un endpoint standardizzato che ti permette di usare gli SDK ufficiali o qualsiasi client compatibile OpenAI. Non devi fornire un numero di telefono o una carta di credito per accedere al credito di prova iniziale.

L'endpoint base è https://api.llmnoncensure.com/v1. Assicurati di configurare il tuo ambiente per usare questo base URL specifico. La chiave API deve essere passata tramite l'intestazione Authorization: Bearer <YOUR_API_KEY>. Viene generata una chiave per account; puoi rigenerarla in qualsiasi momento, revocando automaticamente quella vecchia.

Prima richiesta con cURL

Invia la tua prima richiesta per verificare che l'integrazione funzioni. Usiamo l'ID del modello uncensored. Questa richiesta invia un testo in input e riceve una risposta testuale senza i soliti filtri sui contenuti, purché non si tratti di contenuto sessuale con minori. Il modello è ottimizzato per rispondere a argomenti adulti, controversi o di ricerca sulla sicurezza senza rifiuti ingiustificati.

Ecco la struttura base per testare la connessione:

curl https://api.llmnoncensure.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Questo comando permette di validare che la tua chiave è attiva e che il modello è pronto a ricevere prompt complessi.

Integrazione con SDK Python

Se sviluppi in Python, usa la libreria openai per un'integrazione trasparente. Imposta la variabile d'ambiente OPENAI_BASE_URL o passa base_url direttamente nel client. Questo permette di riutilizzare il tuo codice esistente cambiando solo la fonte del modello. L'SDK gestisce la serializzazione JSON e gli errori di rete per te.

Ecco un esempio minimo:

from openai import OpenAI

client = OpenAI(base_url="https://api.llmnoncensure.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Il modello uncensored accetta parametri standard come temperature e max_tokens. Puoi regolare la creatività della risposta senza temere che l'IA blocchi una risposta giudicata "rischiosa" da criteri generici.

Utilizzo con Node.js e JavaScript

Per ambienti JavaScript o TypeScript, l'SDK openai funziona in modo identico. Configura il client con l'URL base e la chiave API. Questo approccio è ideale per applicazioni backend o server API che devono integrare risposte IA dinamiche senza i limiti dei grandi fornitori generalisti.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmnoncensure.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Assicurati di gestire correttamente le risposte asincrone. Ogni richiesta viene elaborata individualmente, garantendo che la tua logica di business non venga bloccata dai tempi di generazione del modello. Il contesto di 100.000 token permette di inviare istruzioni di sistema lunghe o cronologie di conversazione estese.

Supporto streaming SSE

Per un'esperienza utente fluida, attiva lo streaming tramite eventi server inviati (SSE). Questo permette di visualizzare la risposta parola per parola invece di attendere la fine della generazione. È particolarmente utile per le interfacce chat dove la latenza percepita è critica. Il flusso di dati è strutturato secondo lo standard OpenAI, facilitando il parsing lato client.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Lo streaming non cambia la logica del modello; modifica semplicemente il trasporto dei dati. Ogni chunk è una parte della risposta finale. Puoi interrompere lo stream in qualsiasi momento se l'utente modifica il prompt, ottimizzando l'utilizzo dei tuoi crediti.

Limiti di richieste, errori e contesto

Conoscere i limiti della tua API è cruciale per un'integrazione robusta. Sei limitato a 300 richieste al minuto per chiave API. Il corpo della richiesta non deve superare 8 MB. In caso di errore, vengono restituiti i codici HTTP standard: 401 per una chiave non valida, 402 se il tuo credito è esaurito, e 429 in caso di superamento del limite di richieste. Il modello dispone di una finestra di contesto di 100.000 token, combinando prompt e risposta. Questo permette di inviare documenti lunghi o conversazioni approfondite senza interruzioni premature. A differenza di altri servizi, non ci sono costi fissi mensili; paghi solo ciò che consumi con i tuoi crediti prepagati.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
Base URLhttps://api.llmnoncensure.com/v1
ID modellouncensored
AutenticazioneAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Modalità JSONresponse_format: {"type": "json_object"}
Finestra di contesto100.000 token (input + output)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrenza8 richieste contemporanee per chiave
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Scadenzail credito pagato non scade, nessun abbonamento
Bonus+5% da $50, +10% da $100
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
AccessoGoogle oppure e-mail e password

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande frequenti

Qual è la differenza con i modelli OpenAI standard?

Il nostro modello è specificamente ottimizzato per non rifiutare argomenti adulti, controversi o creativi, restando conforme alla legge (niente contenuti sessuali con minori). Non è né GPT, né Claude, né Gemini. Risponde a prompt che altre API segnerebbero come "rischiosi".

Come funziona il credito di prova?

Ogni nuovo account riceve 0,50 $ di credito gratuito valido per 7 giorni. Non serve la carta di credito per attivarlo. Una volta esaurito il credito o scaduto il termine, puoi aggiungere fondi con criptovalute (USDT o USDC) per continuare a usare l'API senza impegno mensile.

I miei dati vengono usati per l'addestramento?

No, i prompt inviati via API non vengono usati per addestrare il modello. La tua privacy è preservata perché non memorizziamo i tuoi dati per riutilizzarli nei nostri set di addestramento, a differenza di molti fornitori gratuiti o freemium.

La tua chiave è a un passo

Crea un account, copia la chiave, modifica l'URL base. È tutto.

Ottieni la chiave APILeggi la documentazione