Comprensión de la inferencia sin censura
Cuando los desarrolladores buscan una solución de chat sin censura, a menudo enfrentan el compromiso entre flexibilidad y costo. Los agregadores combinan múltiples modelos, introduciendo latencia y comportamiento impredecible. Nuestro enfoque es más simple: ejecutamos un único modelo de lenguaje grande de pesos abiertos dedicado en nuestros propios servidores. Esto garantiza un comportamiento consistente y elimina el ruido del enrutamiento de modelos.
El modelo está ajustado para responder sin rechazos de contenido para uso adulto lícito, lo que lo hace ideal para escritura creativa, roleplay o investigación de seguridad donde los modelos estándar podrían bloquear temas matizados. No es GPT, Claude ni ningún otro modelo de proveedor. El único límite estricto que siempre se aplica es el rechazo de contenido sexual que involucre a menores. Todo lo demás, desde opiniones controversiales hasta escenas ficticias explícitas, está permitido. Este enfoque de motor único significa que sabes exactamente lo que estás obteniendo: texto de entrada, texto de salida, sin lógica de agregación oculta.
Configuración y autenticación de la clave de API
Comenzar con la API de chat sin censura está diseñado para ser inmediato. Puedes registrarte usando "Continuar con Google" o proporcionando un correo electrónico y contraseña. No se requiere número de teléfono, ni tarjeta de crédito para la prueba inicial. Al crearla, tu clave de API se muestra inmediatamente en la pantalla.
Cada cuenta está limitada a una clave activa. Si generas una nueva clave, la anterior se reemplaza. Esta clave se usa para autenticar tus peticiones a la URL base: https://api.uncensoredchat.top/v1. Esta URL es compatible con los SDK oficiales de OpenAI y cualquier cliente que soporte el protocolo de OpenAI. Simplemente actualiza la URL base de tu cliente y establece la clave de API en el encabezado de autorización. La clave de API de IA sin censura es la única credencial que necesitas para comenzar a enviar peticiones.
Construcción de la carga útil de finalización de chat
Para usar la API de chat sin censura, envías una petición POST a /v1/chat/completions. La carga útil sigue el formato estándar de OpenAI, lo que hace que la integración sea directa si ya estás familiarizado con la API de OpenAI. Debes especificar el ID del modelo como "uncensored". Esto indica al servidor que enrute tu petición a nuestro motor de inferencia dedicado.
La ventana de contexto admite 100.000 tokens en total, incluyendo tanto el prompt como la respuesta. Puedes establecer un máximo de salida de 32.000 tokens por petición. Si no especificas max_tokens, el límite predeterminado es de 2.048 tokens. Esto es suficiente para la mayoría de los casos de uso estándar, pero permite salidas más largas cuando sea necesario. También puedes establecer parámetros como temperature, top_p, stop y seed para controlar la aleatoriedad y la reproducibilidad de las respuestas. El cuerpo de la petición está limitado a 8 MB.
Manejo de respuestas en streaming
Para aplicaciones que se benefician de la retroalimentación en tiempo real, la API admite streaming mediante Eventos Enviados por Servidor (SSE). Cuando estableces stream: true en tu petición, el servidor devuelve un flujo de fragmentos. Cada fragmento contiene una parte de la respuesta. El fragmento final incluye las estadísticas de uso de tokens, lo que te permite rastrear el consumo con precisión.
El streaming es particularmente útil para interfaces de chat donde los usuarios esperan la aparición inmediata del texto. Reduce la latencia percibida en comparación con esperar la respuesta completa. La API de chatbot sin censura garantiza que todos los parámetros estándar sean compatibles en modo streaming. Puedes analizar el flujo utilizando cualquier biblioteca cliente SSE estándar. Ten en cuenta que los errores o rechazos no se cobran, por lo que puedes transmitir sin preocuparte por los costos de las peticiones fallidas.
Habilitación de llamadas a funciones y herramientas
Las aplicaciones modernas de LLM a menudo requieren interacciones estructuradas. Nuestra API de LLM sin censura admite llamadas a funciones, también conocidas como herramientas. Puedes definir un conjunto de funciones en el parámetro tools de tu petición. El modelo decidirá entonces cuándo llamar a una función basándose en la entrada del usuario. Esto es útil para tareas como extraer datos de texto, realizar cálculos o desencadenar acciones externas.
Puedes especificar tool_choice para forzar al modelo a llamar a una función específica o dejar que decida. El parámetro response_format puede establecerse en {"type": "json_object"} para garantizar que la salida sea JSON válido, lo cual es útil al analizar argumentos de funciones. Esta combinación de herramientas y modo JSON convierte a la API sin censura en una opción potente para construir agentes autónomos o flujos de trabajo complejos que requieren extracción de datos estructurados.
Forzar el modo de salida JSON
Al integrar LLM en pipelines de software, el formato de salida fiable es crítico. Al establecer response_format en {"type": "json_object"}, indicas al modelo que devuelva únicamente JSON válido. Esto elimina la necesidad de análisis complejo con regex o manejo de errores para texto mal formado. Es especialmente útil cuando extraes datos estructurados o generas archivos de configuración.
Este modo funciona junto con las llamadas a funciones, pero también puede usarse para tareas simples de extracción de datos. El modelo intentará adherirse a la estructura JSON, aunque sigue estando limitado por las capacidades inherentes del modelo. Para obtener los mejores resultados, proporciona instrucciones claras en el prompt del sistema sobre el esquema JSON esperado. Esta característica convierte a la API de chatbot sin filtros en una opción robusta para servicios backend que requieren salidas predecibles y legibles por máquina.
Gestión de límites de peticiones y concurrencia
Para garantizar un uso justo y la estabilidad, la API NSFW aplica límites específicos de peticiones. Tienes permitido realizar 300 peticiones por minuto por clave de API. Además, puedes tener hasta 8 peticiones concurrentes al mismo tiempo por clave. Este límite de concurrencia es importante para aplicaciones que envían múltiples peticiones simultáneas, como el procesamiento por lotes o sistemas de chat en tiempo real.
Si excedes estos límites, recibirás un error 429 Too Many Requests. Se recomienda implementar un retroceso exponencial en tu cliente para manejar estos errores de forma elegante. El límite de cuerpo de petición de 8 MB también se aplica a cada petición. Estos límites son consistentes y transparentes, permitiéndote planificar tu infraestructura en consecuencia. A diferencia de algunos proveedores, no ocultamos estos límites detrás de estructuras de niveles complejas; se aplican uniformemente a todos los usuarios prepago.
Facturación y cálculo de tokens
La facturación es sencilla: $0,25 por 1M de tokens de entrada y $1,00 por 1M de tokens de salida. Pagas solo por lo que usas, sin suscripciones mensuales ni tarifas ocultas. El crédito se recarga mediante criptomonedas, y los errores o rechazos son gratuitos. Esto significa que solo pagas por las completaciones exitosas. El crédito prepago no caduca, por lo que puedes recargar cuando te convenga.
Se aceptan recargas de criptomonedas en USDT (TRC20) o USDC (Base). Puedes depositar cualquier cantidad entera de $10 a $500. Para depósitos más grandes, ofrecemos crédito adicional: +5% para depósitos de $50 o más, y +10% para depósitos de $100 o más. No se aceptan tarjetas, PayPal ni transferencias bancarias. Puedes consultar tu saldo y uso en el panel. Si cometes un error, como un cargo doble, puedes solicitar una corrección a través de la página de Soporte, pero el crédito en sí no se reembolsa ya que no caduca.
Privacidad y límites de contenido
La privacidad es una preocupación clave para muchos desarrolladores. Cuando te registras, solo necesitas una dirección de correo electrónico. Tus prompts no se utilizan para entrenar el modelo, asegurando que tus datos permanezcan privados. Esta es una ventaja significativa para empresas que usan la API para contenido propietario o información sensible. El modelo de chat sin censura está diseñado para uso adulto legal, pero aplica un límite estricto en el contenido sexual que involucre a menores. Las peticiones que contengan dicho contenido serán rechazadas.
Este único límite de contenido permite una amplia gama de otros temas para adultos, violencia ficticia o opiniones controversiales sin censura innecesaria. El modelo no es GPT, Claude ni ningún otro modelo de proveedor, por lo que su comportamiento es único de nuestro ajuste. Al mantener el motor de inferencia simple y dedicado, garantizamos que las políticas de privacidad y contenido sean consistentes y predecibles. Puedes confiar en que tus datos no se utilizan para mejorar otros modelos, y tu uso no se monitorea con fines publicitarios.