Comprendere l'inferenza senza censura
Quando gli sviluppatori cercano una soluzione di chat senza censura, spesso si trovano di fronte al compromesso tra flessibilità e costi. Gli aggregatori mescolano più modelli, introducendo latenza e comportamenti imprevedibili. Il nostro approccio è più semplice: eseguiamo un unico modello linguistico grande a pesi aperti dedicato sui nostri server. Questo garantisce un comportamento coerente e rimuove il rumore del routing dei modelli.
Il modello è ottimizzato per rispondere senza rifiuti di contenuto per l'uso adulto legale, rendendolo ideale per la scrittura creativa, il roleplay o la ricerca di sicurezza dove i modelli standard potrebbero bloccare argomenti sfumati. Non è GPT, Claude o il modello di alcun altro fornitore. L'unico limite rigido che si applica sempre è il rifiuto dei contenuti sessuali che coinvolgono minori. Tutti gli altri contenuti, dalle opinioni controverse alle scene esplicite di finzione, sono consentiti. Questo approccio a motore singolo significa che sai esattamente cosa stai ottenendo: input e output di testo, senza logica di aggregazione nascosta.
Configurazione e autenticazione della chiave API
Iniziare con l'api senza censura è progettato per essere immediato. Puoi iscriverti utilizzando "Continua con Google" o fornendo un indirizzo email e una password. Non è richiesto il numero di telefono e non è necessaria una carta di credito per la prova iniziale. Alla creazione, la tua chiave API viene mostrata immediatamente sullo schermo.
Ogni account è limitato a una chiave attiva. Se ne generi una nuova, quella vecchia viene sostituita. Questa chiave viene utilizzata per autenticare le tue richieste all'URL di base: https://api.uncensoredchat.top/v1. Questo URL è compatibile con gli SDK ufficiali OpenAI e con qualsiasi client che supporta il protocollo OpenAI. Aggiorna semplicemente l'URL di base del tuo client e imposta la chiave API nell'intestazione di autorizzazione. La chiave api ai senza censura è l'unica credenziale di cui hai bisogno per iniziare a inviare richieste.
Costruzione del payload di completamento chat
Per utilizzare l'api chat senza censura, invii una richiesta POST a /v1/chat/completions. Il payload segue il formato standard OpenAI, il che rende l'integrazione semplice se sei già familiare con l'API OpenAI. Devi specificare l'ID del modello come "uncensored". Questo dice al server di instradare la tua richiesta al nostro motore di inferenza dedicato.
La finestra di contesto supporta 100.000 token in totale, inclusi sia il prompt che il completamento. Puoi impostare un output massimo di 32.000 token per richiesta. Se non specifichi max_tokens, il limite predefinito è di 2.048 token. Questo è sufficiente per la maggior parte dei casi d'uso standard ma consente output più lunghi quando necessario. Puoi anche impostare parametri come temperature, top_p, stop e seed per controllare la casualità e la riproducibilità delle risposte. Il corpo della richiesta è limitato a 8 MB.
Gestione delle risposte in streaming
Per le applicazioni che beneficiano del feedback in tempo reale, l'API supporta lo streaming tramite Server-Sent Events (SSE). Quando imposti stream: true nella tua richiesta, il server restituisce un flusso di chunk. Ogni chunk contiene una parte della risposta. L'ultimo chunk include le statistiche di utilizzo dei token, consentendoti di monitorare il consumo con precisione.
Lo streaming è particolarmente utile per le interfacce chat dove gli utenti si aspettano l'apparizione immediata del testo. Riduce la latenza percepita rispetto all'attesa della risposta completa. L'api chatbot senza censura garantisce che tutti i parametri standard siano supportati in modalità streaming. Puoi analizzare il flusso utilizzando qualsiasi libreria client SSE standard. Nota che gli errori o i rifiuti non vengono addebitati, quindi puoi eseguire lo streaming in modo sicuro senza preoccuparti dei costi per le richieste fallite.
Abilitazione della chiamata di funzioni e strumenti
Le applicazioni LLM moderne richiedono spesso interazioni strutturate. La nostra api llm senza censura supporta la chiamata di funzioni, nota anche come strumenti. Puoi definire un insieme di funzioni nel parametro tools della tua richiesta. Il modello deciderà quindi quando chiamare una funzione in base all'input dell'utente. Questo è utile per attività come l'estrazione di dati dal testo, l'esecuzione di calcoli o l'attivazione di azioni esterne.
Puoi specificare tool_choice per forzare il modello a chiamare una funzione specifica o lasciarlo decidere. Il parametro response_format può essere impostato su {"type": "json_object"} per garantire che l'output sia JSON valido, il che è utile quando si analizzano gli argomenti delle funzioni. Questa combinazione di strumenti e modalità JSON rende l'api senza censura una scelta potente per la creazione di agenti autonomi o flussi di lavoro complessi che richiedono l'estrazione di dati strutturati.
Forzatura della modalità output JSON
Quando si integrano LLM nelle pipeline software, il formato di output affidabile è critico. Impostando response_format su {"type": "json_object"}, istruisci il modello a restituire solo JSON valido. Questo elimina la necessità di analisi regex complesse o gestione degli errori per testo non valido. È particolarmente utile quando si estraggono dati strutturati o si generano file di configurazione.
Questa modalità funziona in combinazione con la chiamata di funzioni, ma può essere utilizzata anche per attività semplici di estrazione dei dati. Il modello cercherà di aderire alla struttura JSON, sebbene sia ancora vincolato alle capacità intrinseche del modello. Per ottenere i risultati migliori, fornisci istruzioni chiare nel prompt di sistema riguardo allo schema JSON atteso. Questa funzionalità rende l'api chatbot senza filtri una scelta robusta per i servizi backend che richiedono output prevedibili e leggibili dalle macchine.
Gestione dei limiti di richiesta e della concorrenza
Per garantire un utilizzo equo e la stabilità, l'api nsfw impone limiti di richiesta specifici. Hai diritto a 300 richieste al minuto per chiave API. Inoltre, puoi avere fino a 8 richieste concorrenti contemporaneamente per chiave. Questo limite di concorrenza è importante per le applicazioni che inviano più richieste parallele, come l'elaborazione in batch o i sistemi di chat in tempo reale.
Se superi questi limiti, riceverai un errore 429 Too Many Requests. Si consiglia di implementare un backoff esponenziale nel tuo client per gestire questi errori in modo elegante. Il limite del corpo della richiesta di 8 MB si applica anche a ogni richiesta. Questi limiti sono coerenti e trasparenti, consentendoti di pianificare la tua infrastruttura di conseguenza. A differenza di alcuni provider, non nascondiamo questi limiti dietro strutture di tier complessi; si applicano uniformemente a tutti gli utenti prepagati.
Fatturazione e calcolo dei token
I prezzi sono semplici: $0,25 per 1M token di input e $1,00 per 1M token di output. Paghi solo per quello che usi, senza abbonamenti mensili o costi nascosti. Il credito viene ricaricato tramite cripto, e gli errori o i rifiuti sono gratuiti. Questo significa che paghi solo per i completamenti riusciti. Il credito prepagato non scade mai, quindi puoi ricaricare quando è conveniente.
I ricarichi con criptovalute sono accettati in USDT (TRC20) o USDC (Base). Puoi depositare qualsiasi importo intero da $10 a $500. Per depositi più grandi, offriamo credito bonus: +5% per depositi di $50 o più, e +10% per depositi di $100 o più. Non sono accettate carte, PayPal o bonifici bancari. Puoi verificare il tuo saldo e l'utilizzo nella dashboard. Se commetti un errore, come un addebito doppio, puoi richiedere una correzione tramite la pagina Supporto, ma il credito non viene rimborsato poiché non scade mai.
Privacy e limiti sui contenuti
La privacy è una preoccupazione chiave per molti sviluppatori. Quando ti iscrivi, hai bisogno solo di un indirizzo email. I tuoi prompt non vengono utilizzati per l'addestramento del modello, garantendo che i tuoi dati rimangano privati. Questo è un vantaggio significativo per le aziende che utilizzano l'API per contenuti proprietari o informazioni sensibili. Il modello chat senza censura è progettato per l'uso adulto legale, ma impone un limite rigido sui contenuti sessuali che coinvolgono minori. Le richieste contenenti tali contenuti verranno rifiutate.
Questo unico limite di contenuto consente una vasta gamma di altri temi adulti, violenza di finzione o opinioni controverse senza censura non necessaria. Il modello non è GPT, Claude o il modello di alcun altro fornitore, quindi il suo comportamento è unico per la nostra ottimizzazione. Mantenendo il motore di inferenza semplice e dedicato, garantiamo che la privacy e le politiche sui contenuti siano coerenti e prevedibili. Puoi fidarti che i tuoi dati non vengano utilizzati per migliorare altri modelli e che il tuo utilizzo non venga monitorato per scopi pubblicitari.