무검열 추론 이해하기
개발자가 무검열 채팅 솔루션을 찾을 때, 종종 유연성과 비용 간의 trade-off에 직면합니다. 애그리게이터는 여러 모델을 혼합하여 지연 시간과 예측 불가능한 동작을 도입합니다. 우리의 접근 방식은 더 간단합니다: 자체 서버에서 하나의 전용 오픈 웨이트 대규모 언어 모델을 실행합니다. 이는 일관된 동작을 보장하고 모델 라우팅의 노이즈를 제거합니다.
이 모델은 합법적인 성인 사용에 대한 콘텐츠 거부 없이 답변하도록 튜닝되어 있어, 표준 모델이 미묘한 주제를 차단할 수 있는 창의적인 글쓰기, 역할극 또는 보안 연구에 이상적입니다. 이 모델은 GPT, Claude 또는 기타 벤더의 모델이 아닙니다. 항상 적용되는 유일한 하드 제한은 미성년자가 포함된 성적 콘텐츠에 대한 거부입니다. 논란의 여지가 있는 의견부터 명시적인 픽션 장면까지 모든 콘텐츠가 허용됩니다. 이 단일 엔진 방식은 숨겨진 애그리게이션 로직 없이 텍스트 입력, 텍스트 출력만 얻는다는 것을 정확히 알 수 있음을 의미합니다.
API 키 설정 및 인증
무검열 api 시작은 즉시 이루어지도록 설계되었습니다. "Google로 계속"을 사용하거나 이메일과 비밀번호를 제공하여 가입할 수 있습니다. 전화번호가 필요하지 않으며 초기 체험에는 신용카드도 필요하지 않습니다. 생성 시 API 키가 화면에 즉시 표시됩니다.
각 계정은 하나의 활성 키로 제한됩니다. 새 키를 생성하면 이전 키가 대체됩니다. 이 키는 베이스 URL에 대한 요청의 인증에 사용됩니다: https://api.uncensoredchat.top/v1. 이 URL은 공식 OpenAI SDK 및 OpenAI 프로토콜을 지원하는 모든 클라이언트와 호환됩니다. 클라이언트의 베이스 URL을 업데이트하고 인증 헤더에 API 키를 설정하십시오. 무검열 ai api 키은 요청을 보내기 위해 필요한 유일한 자격 증명입니다.
채팅 완료 페이로드 구성
무검열 채팅 api를 사용하려면 /v1/chat/completions로 POST 요청을 보냅니다. 페이로드는 표준 OpenAI 형식을 따르며, 이는 이미 OpenAI API에 익숙한 경우 통합을 간단하게 만듭니다. 모델 ID를 "uncensored"로 지정해야 합니다. 이는 서버가 요청을 전용 추론 엔진으로 라우팅하도록 알려줍니다.
컨텍스트 창은 프롬프트와 완성을 모두 포함하여 총 100,000 토큰을 지원합니다. 요청당 최대 출력은 32,000 토큰으로 설정할 수 있습니다. max_tokens을 지정하지 않으면 제한은 2,048 토큰으로 기본 설정됩니다. 이는 대부분의 표준 사용 사례에 충분하지만 필요할 때 더 긴 출력을 허용합니다. 응답의 무작위성과 재현성을 제어하기 위해 temperature, top_p, stop, seed과 같은 매개변수도 설정할 수 있습니다. 요청 본문의 크기는 8 MB로 제한됩니다.
스트리밍 응답 처리
실시간 피드백이 필요한 애플리케이션의 경우 API는 서버 전송 이벤트(SSE)를 통한 스트리밍을 지원합니다. 요청에 stream: true을 설정하면 서버는 청크의 스트림을 반환합니다. 각 청크에는 응답의 일부가 포함됩니다. 마지막 청크에는 토큰 사용 통계가 포함되어 소비량을 정확하게 추적할 수 있습니다.
스트리밍은 사용자가 즉각적인 텍스트 출력을 기대하는 채팅 인터페이스에 특히 유용합니다. 전체 응답을 기다리는 것보다 인지된 지연 시간을 줄입니다. 무검열 채팅봇 api은 모든 표준 매개변수가 스트리밍 모드에서 지원됨을 보장합니다. 모든 표준 SSE 클라이언트 라이브러리를 사용하여 스트림을 구문 분석할 수 있습니다. 오류나 거부는 청구되지 않으므로 실패한 요청에 대한 비용 걱정 없이 안전하게 스트리밍할 수 있습니다.
함수 호출 및 도구 활성화
최신 LLM 애플리케이션은 종종 구조화된 상호 작용을 필요로 합니다. 우리의 무검열 llm api는 도구라고도 알려진 함수 호출을 지원합니다. 요청의 tools 매개변수에서 함수 집합을 정의할 수 있습니다. 그런 다음 모델은 사용자 입력에 기반하여 함수를 호출할 시기를 결정합니다. 이는 텍스트에서 데이터 추출, 계산 수행 또는 외부 작업 트리거와 같은 작업에 유용합니다.
tool_choice을 지정하여 모델이 특정 함수를 호출하도록 강제하거나 직접 결정하게 할 수 있습니다. response_format 매개변수를 {"type": "json_object"}로 설정하여 출력이 유효한 JSON이 되도록 할 수 있으며, 이는 함수 인수를 구문 분석할 때 유용합니다. 이러한 도구와 JSON 모드의 조합은 구조화된 데이터 추출이 필요한 자율 에이전트나 복잡한 워크플로우 구축을 위해 uncensored api을 강력한 선택지로 만듭니다.
JSON 출력 모드 강제
LLM을 소프트웨어 파이프라인에 통합할 때 신뢰할 수 있는 출력 형식이 중요합니다. response_format을 {"type": "json_object"}로 설정하면 모델이 유효한 JSON만 반환하도록 지시합니다. 이는 복잡한 정규식 구문 분석 또는 잘못된 텍스트에 대한 오류 처리가 필요 없음을 의미합니다. 구조화된 데이터를 추출하거나 구성 파일을 생성할 때 특히 유용합니다.
이 모드는 함수 호출과 함께 작동하지만 간단한 데이터 추출 작업에도 사용할 수 있습니다. 모델은 JSON 구조를 따르려고 시도하지만 여전히 모델의 고유한 기능에 의해 제한됩니다. 최상의 결과를 얻으려면 시스템 프롬프트에 예상 JSON 스키마에 대한 명확한 지침을 제공하십시오. 이 기능은 예측 가능하고 기계가 읽을 수 있는 출력이 필요한 백엔드 서비스에 대해 무제한 채팅봇 api를 견고한 선택으로 만듭니다.
속도 제한 및 동시성 관리
공정한 사용과 안정성을 보장하기 위해 nsfw api은 특정 속도 제한을 시행합니다. API 키당 분당 300개의 요청이 허용됩니다. 또한 키당 동시에 최대 8개의 요청을 보낼 수 있습니다. 이 동시성 제한은 배치 처리 또는 실시간 채팅 시스템과 같은 여러 동시 요청을 보내는 애플리케이션에 중요합니다.
이러한 제한을 초과하면 429 Too Many Requests 오류가 발생합니다. 이러한 오류를 우아하게 처리하기 위해 클라이언트에서 지수 백오프를 구현하는 것이 좋습니다. 8 MB 요청 본문 제한도 각 요청에 적용됩니다. 이러한 제한은 일관되고 투명하여 인프라를 적절히 계획할 수 있습니다. 일부 제공업체와 달리 이러한 제한을 복잡한 계층 구조 뒤에 숨기지 않습니다. 모든 선불 사용자에게 균일하게 적용됩니다.
청구 및 토큰 계산
가격은 간단합니다: 입력 토큰 100만 개당 $0.25 및 출력 토큰 100만 개당 $1.00. 월별 구독 또는 숨겨진 요금 없이 사용한 만큼만 지불합니다. 크레딧은 암호화폐로 충전되며 오류나 거부는 무료입니다. 이는 성공적인 완료에 대해서만 지불한다는 의미입니다. 선불 크레딧은 만료되지 않으므로 편리할 때 충전할 수 있습니다.
암호화폐 충전은 USDT(TRC20) 또는 USDC(Base)로 수락됩니다. $10에서 $500 사이의 정수 금액을 입금할 수 있습니다. 큰 금액의 입금에는 보너스 크레딧이 제공됩니다: $50 이상의 입금에는 +5%, $100 이상의 입금에는 +10%의 보너스 크레딧이 제공됩니다. 카드, PayPal 또는 은행 이체는 수락되지 않습니다. 대시보드에서 잔액과 사용량을 확인할 수 있습니다. 이중 청구와 같은 실수를 한 경우 지원 페이지를 통해 수정을 요청할 수 있지만 크레딧 자체는 만료되지 않으므로 환불되지 않습니다.
개인정보 및 콘텐츠 제한
프라이버시는 많은 개발자에게 중요한 고려 사항입니다. 가입할 때 이메일 주소만 필요합니다. 프롬프트는 모델 학습에 사용되지 않으므로 데이터가 비공개로 유지됩니다. 이는 API를 독점 콘텐츠나 민감한 정보에 사용하는 기업에 큰 장점입니다. 무검열 채팅 모델은 합법적인 성인 사용용으로 설계되었지만 미성년자가 포함된 성적 콘텐츠에 대한 하드 제한을 시행합니다. 이러한 콘텐츠가 포함된 요청은 거부됩니다.
이 단일 콘텐츠 제한은 불필요한 검열 없이 다양한 기타 성인 테마, 픽션 폭력 또는 논쟁적인 의견을 허용합니다. 이 모델은 GPT, Claude 또는 기타 벤더의 모델이 아니므로 동작은 고유한 조정 결과입니다. 추론 엔진을 단순하고 전용으로 유지함으로써 우리는 개인정보 및 콘텐츠 정책이 일관되고 예측 가능함을 보장합니다. 귀하의 데이터가 다른 모델 개선에 사용되지 않으며 귀하의 사용량이 광고 목적으로 모니터링되지 않는다고 신뢰할 수 있습니다.