Zrozumienie wnioskowania bez cenzury
Gdy programiści szukają rozwiązania czatu bez cenzury, często muszą wybrać między elastycznością a kosztem. Agregatory mieszają wiele modeli, wprowadzając opóźnienia i nieprzewidywalne zachowania. Nasze podejście jest prostsze: uruchamiamy jeden dedykowany, otwarto-wagowy duży model językowy na naszych serwerach. Zapewnia to spójne zachowanie i eliminuje szum wynikający z routingu modeli.
Model jest dostrojony do odpowiadania bez odrzucania treści dla prawnego użytku dorosłego, co czyni go idealnym do pisania kreatywnego, roleplay lub badań bezpieczeństwa, gdzie standardowe modele mogą blokować niuanse tematów. Nie jest to GPT, Claude ani żaden inny model dostawcy. Jedynym twardym limitem, który zawsze obowiązuje, jest odrzucanie treści seksualnych z udziałem małoletnich. Pozostałe treści, od kontrowersyjnych opinii po wyraźne sceny fikcyjne, są dozwolone. To podejście oparte na jednym silniku oznacza, że wiesz dokładnie, co otrzymujesz: tekst na wejściu, tekst na wyjściu, bez ukrytej logiki agregacji.
Konfiguracja klucza API i uwierzytelnianie
Pierwsze kroki z API czatu bez cenzury są zaprojektowane tak, aby były natychmiastowe. Możesz zarejestrować się, używając opcji "Kontynuuj z Google" lub podając adres e-mail i hasło. Nie jest wymagany numer telefonu, a na początkowy okres próbny nie potrzeba karty kredytowej. Po utworzeniu Twój klucz API jest od razu wyświetlany na ekranie.
Każde konto jest ograniczone do jednego aktywnego klucza. Jeśli wygenerujesz nowy klucz, stary zostanie zastąpiony. Ten klucz służy do uwierzytelniania Twoich zapytań pod adresem bazowym: https://api.uncensoredchat.top/v1. Ten URL jest kompatybilny z oficjalnymi SDK OpenAI i dowolnym klientem obsługującym protokół OpenAI. Po prostu zaktualizuj adres bazowy klienta i ustaw klucz API w nagłówku autoryzacji. klucz API AI bez cenzury to jedyne dane logowania potrzebne do rozpoczęcia wysyłania zapytań.
Konstrukcja payloadu ukończenia czatu
Aby korzystać z API czatu bez cenzury, wysyłasz żądanie POST do /v1/chat/completions. Payload odpowiada standardowemu formatowi OpenAI, co ułatwia integrację, jeśli znasz już API OpenAI. Musisz określić ID modelu jako "uncensored". Informuje to serwer o przekierowaniu Twojego zapytania do naszego dedykowanego silnika wnioskowania.
Okno kontekstu obsługuje łącznie 100 000 tokenów, w tym zarówno prompt, jak i ukończenie. Możesz ustawić maksymalne wyjście na 32 000 tokenów na zapytanie. Jeśli nie określisz max_tokens, limit domyślny wynosi 2048 tokenów. Wystarcza to dla większości standardowych przypadków użycia, ale pozwala na dłuższe wyjścia, gdy jest to potrzebne. Możesz również ustawić parametry takie jak temperature, top_p, stop i seed, aby kontrolować losowość i odtwarzalność odpowiedzi. Ciało zapytania jest ograniczone do 8 MB.
Obsługa odpowiedzi strumieniowych
Dla aplikacji korzystających z informacji w czasie rzeczywistym, API obsługuje strumieniowanie za pomocą zdarzeń wysłanych przez serwer (SSE). Gdy ustawisz stream: true w swoim żądaniu, serwer zwraca strumień fragmentów. Każdy fragment zawiera część odpowiedzi. Ostatni fragment zawiera statystyki użycia tokenów, pozwalając na dokładne śledzenie zużycia.
Strumieniowanie jest szczególnie przydatne w interfejsach czatu, gdzie użytkownicy oczekują natychmiastowego pojawiania się tekstu. Zmniejsza postrzegane opóźnienia w porównaniu do oczekiwania na pełną odpowiedź. API czatu bez cenzury zapewnia obsługę wszystkich standardowych parametrów w trybie strumieniowania. Możesz analizować strumień za pomocą dowolnej standardowej biblioteki klienta SSE. Pamiętaj, że błędy lub odrzucenia nie są rozliczane, więc możesz bezpiecznie strumieniować, nie martwiąc się kosztami nieudanych zapytań.
Włączanie wywoływania funkcji i narzędzi
Współczesne aplikacje LLM często wymagają interakcji strukturalnych. Nasze API LLM bez cenzury obsługuje wywoływanie funkcji, znane również jako narzędzia. Możesz zdefiniować zestaw funkcji w parametrze tools swojego żądania. Model podejmie następnie decyzję, kiedy wywołać funkcję na podstawie wejścia użytkownika. Jest to przydatne w zadaniach takich jak ekstrakcja danych z tekstu, wykonywanie obliczeń lub wyzwalanie akcji zewnętrznych.
Możesz określić tool_choice, aby wymusić wywołanie konkretnej funkcji przez model lub pozwolić mu na podjęcie decyzji. Parametr response_format można ustawić na {"type": "json_object"}, aby zapewnić, że wyjście jest poprawnym JSON-em, co jest pomocne przy analizie argumentów funkcji. Ta kombinacja narzędzi i trybu JSON czyni API bez cenzury potężnym wyborem do budowania agentów autonomicznych lub złożonych przepływów pracy wymagających ekstrakcji danych strukturalnych.
Wymuszanie trybu wyjścia JSON
Podczas integracji LLM z potokami oprogramowania niezawodny format wyjścia jest kluczowy. Poprzez ustawienie response_format na {"type": "json_object"}, nakazujesz modelowi zwracanie tylko poprawnego JSON-a. Eliminuje to potrzebę złożonej analizy regex lub obsługi błędów dla niepoprawnego tekstu. Jest to szczególnie przydatne, gdy ekstrahujesz dane strukturalne lub generujesz pliki konfiguracyjne.
Ten tryb działa w połączeniu z wywoływaniem funkcji, ale może być również używany do prostych zadań ekstrakcji danych. Model będzie próbował przestrzegać struktury JSON, choć nadal jest ograniczony możliwościami samego modelu. Dla najlepszych rezultatów podaj jasne instrukcje w promptzie systemowym dotyczące oczekiwanego schematu JSON. Ta funkcja czyni API czatu bez filtrów solidnym wyborem dla usług backendowych wymagających przewidywalnych, czytelnych dla maszyn wyjść.
Zarządzanie limitami zapytań i współbieżnością
Aby zapewnić uczciwe użytkowanie i stabilność, API NSFW narzuca konkretne limity zapytań. Masz dozwolone 300 zapytań na minutę na klucz API. Dodatkowo możesz mieć do 8 równoległych zapytań jednocześnie na klucz. Ten limit współbieżności jest ważny dla aplikacji wysyłających wiele równoległych zapytań, takich jak przetwarzanie wsadowe lub systemy czatu w czasie rzeczywistym.
Jeśli przekroczysz te limity, otrzymasz błąd 429 Too Many Requests. Zaleca się wdrożenie wykładniczego opóźnienia ponownych prób w kliencie, aby obsłużyć te błady w sposób elegancki. Limit 8 MB ciała zapytania również obowiązuje dla każdego zapytania. Te limity są spójne i przejrzyste, pozwalając zaplanować infrastrukturę odpowiednio. W przeciwieństwie do niektórych dostawców, nie ukrywamy tych limitów za złożonymi strukturami warstw; obowiązują one jednolicie dla wszystkich użytkowników przedpłaconych.
Rozliczenia i kalkulacja tokenów
Cennik jest prosty: $0,25 za 1M tokenów wejściowych i $1,00 za 1M tokenów wyjściowych. Płacisz tylko za to, czego używasz, bez subskrypcji miesięcznych lub ukrytych opłat. Kredyt jest doładowywany przez krypto, a błędy lub odrzucenia są darmowe. Oznacza to, że płacisz tylko za pomyślne ukończenia. Przedpłacony kredyt nigdy nie wygasa, więc możesz doładować, gdy jest to wygodne.
Doładowania kryptowalutami przyjmujemy w USDT (TRC20) lub USDC (Base). Możesz wpłacić dowolną kwotę całkowitą od $10 do $500. Przy większych wpłatach oferujemy dodatkowy kredyt: +5% przy wpłatach od $50 i +10% przy wpłatach od $100. Nie przyjmujemy kart, PayPal ani przelewów bankowych. Saldo i zużycie możesz sprawdzić w panelu. Jeśli popełnisz błąd, np. podwójne obciążenie, możesz poprosić o jego poprawkę na stronie Wsparcie, ale kredyt nie jest zwracany, ponieważ nigdy nie wygasa.
Prywatność i limity treści
Prywatność jest kluczową troską dla wielu programistów. Podczas rejestracji potrzebujesz tylko adresu e-mail. Twoje prompty nie są używane do trenowania modelu, zapewniając, że Twoje dane pozostają prywatne. Jest to znacząca przewaga dla firm używających API do treści własnościowych lub wrażliwych informacji. Model czatu bez cenzury jest przeznaczony do prawnego użytku dorosłego, ale narzuca twardy limit treści seksualnych z udziałem małoletnich. Zapytania zawierające takie treści zostaną odrzucone.
Ten jeden limit treści pozwala na szeroki zakres innych tematów dla dorosłych, fikcyjnej przemocy lub kontrowersyjnych opinii bez niepotrzebnej cenzury. Model nie jest GPT, Claude ani żadnym innym modelem dostawcy, więc jego zachowanie jest unikalne dla naszego dostrojenia. Poprzez utrzymanie silnika wnioskowania prostego i dedykowanego, zapewniamy, że polityki prywatności i treści są spójne i przewidywalne. Możesz ufać, że Twoje dane nie są używane do ulepszania innych modeli, a Twoje użycie nie jest monitorowane w celach reklamowych.