Понимание неограниченного вывода
Когда разработчики ищут решение для чата без цензуры, они часто сталкиваются с компромиссом между гибкостью и стоимостью. Агрегаторы смешивают несколько моделей, что увеличивает задержку и приводит к непредсказуемому поведению. Наш подход проще: мы запускаем одну выделенную модель с открытыми весами на наших собственных серверах. Это обеспечивает согласованное поведение и устраняет шум маршрутизации моделей.
Модель настроена на ответы без отказов по контенту для законного использования взрослыми, что делает её идеальной для творческого письма, ролевых игр или исследований в области безопасности, где стандартные модели могут блокировать тонкие темы. Это не GPT, Claude или любая другая модель поставщика. Единственное жесткое ограничение, которое всегда применяется, — это отказ от сексуального контента с участием несовершеннолетних. Весь остальной контент, от спорных мнений до откровенных вымышленных сцен, разрешен. Этот подход с одним механизмом означает, что вы точно знаете, что получаете: текст на вход, текст на выход, без скрытой логики агрегации.
Настройка API-ключа и аутентификация
Начало работы с API без цензуры спроектировано так, чтобы быть мгновенным. Вы можете зарегистрироваться, используя «Войти через Google» или указав адрес электронной почты и пароль. Номер телефона не требуется, и для начального пробного периода не нужна кредитная карта. При создании ваш API-ключ отображается на экране сразу.
Каждый аккаунт ограничен одним активным ключом. Если вы сгенерируете новый ключ, старый будет заменён. Этот ключ используется для аутентификации ваших запросов к базовому URL: https://api.uncensoredchat.top/v1. Этот URL совместим с официальными SDK OpenAI и любым клиентом, поддерживающим протокол OpenAI. Просто обновите базовый URL вашего клиента и укажите API-ключ в заголовке авторизации. ключ API без цензуры AI — это единственное учётное данные, которое вам нужно для начала отправки запросов.
Формирование полезной нагрузки для завершения чата
Чтобы использовать API чата без цензуры, вы отправляете запрос POST на /v1/chat/completions. Полезная нагрузка соответствует стандартному формату OpenAI, что делает интеграцию простой, если вы уже знакомы с API OpenAI. Вы должны указать идентификатор модели как "uncensored". Это указывает серверу маршрутизировать ваш запрос к нашему выделенному механизму вывода.
Контекстное окно поддерживает 100 000 токенов всего, включая как промпт, так и завершение. Вы можете установить максимальный вывод на уровне 32 000 токенов на запрос. Если вы не указываете max_tokens, лимит по умолчанию составляет 2 048 токенов. Этого достаточно для большинства стандартных сценариев использования, но позволяет получать более длинные выводы при необходимости. Вы также можете установить параметры, такие как temperature, top_p, stop и seed, чтобы контролировать случайность и воспроизводимость ответов. Тело запроса ограничено 8 МБ.
Обработка потоковых ответов
Для приложений, которым полезна обратная связь в реальном времени, API поддерживает потоковую передачу через Server-Sent Events (SSE). Когда вы устанавливаете stream: true в своем запросе, сервер возвращает поток фрагментов. Каждый фрагмент содержит часть ответа. Последний фрагмент включает статистику использования токенов, позволяя точно отслеживать потребление.
Потоковая передача особенно полезна для интерфейсов чата, где пользователи ожидают немедленного появления текста. Это снижает воспринимаемую задержку по сравнению с ожиданием полного ответа. API чат-бота без цензуры гарантирует, что все стандартные параметры поддерживаются в режиме потоковой передачи. Вы можете обрабатывать поток с помощью любой стандартной библиотеки клиента SSE. Обратите внимание, что ошибки или отказы не тарифицируются, поэтому вы можете безопасно использовать потоковую передачу, не беспокоясь о затратах за неудачные запросы.
Включение вызова функций и инструментов
Современные приложения LLM часто требуют структурированного взаимодействия. Наш API LLM без цензуры поддерживает вызов функций, также известный как инструменты. Вы можете определить набор функций в параметре tools вашего запроса. Модель затем решит, когда вызвать функцию на основе ввода пользователя. Это полезно для задач, таких как извлечение данных из текста, выполнение вычислений или запуск внешних действий.
Вы можете указать tool_choice, чтобы принудительно заставить модель вызвать определенную функцию или позволить ей решить самостоятельно. Параметр response_format можно установить в {"type": "json_object"}, чтобы гарантировать, что вывод является допустимым JSON, что полезно при разборе аргументов функций. Эта комбинация инструментов и JSON-режима делает API без цензуры мощным выбором для создания автономных агентов или сложных рабочих процессов, требующих извлечения структурированных данных.
Принудительный режим вывода JSON
При интеграции LLM в конвейеры программного обеспечения надежный формат вывода имеет решающее значение. Установив response_format в {"type": "json_object"}, вы указываете модели возвращать только допустимый JSON. Это устраняет необходимость в сложном разборе регулярными выражениями или обработке ошибок для некорректного текста. Это особенно полезно, когда вы извлекаете структурированные данные или генерируете конфигурационные файлы.
Этот режим работает совместно с вызовом функций, но также может использоваться для простых задач извлечения данных. Модель будет пытаться придерживаться структуры JSON, хотя она всё ещё ограничена собственными возможностями модели. Для получения наилучших результатов предоставьте четкие инструкции в системном промпте относительно ожидаемой схемы JSON. Эта функция делает API без фильтров для чат-ботов надежным выбором для бэкенд-сервисов, которым требуются предсказуемые выходные данные, доступные для машинной обработки.
Управление лимитами запросов и параллелизмом
Для обеспечения справедливого использования и стабильности API NSFW устанавливает определенные лимиты запросов. Вам разрешено 300 запросов в минуту на каждый API-ключ. Кроме того, вы можете иметь до 8 параллельных запросов одновременно на ключ. Этот лимит параллелизма важен для приложений, отправляющих несколько параллельных запросов, таких как пакетная обработка или системы чата в реальном времени.
Если вы превысите эти лимиты, вы получите ошибку 429 Too Many Requests. Рекомендуется реализовать экспоненциальное замедление в вашем клиенте для корректной обработки этих ошибок. Лимит тела запроса 8 МБ также применяется к каждому запросу. Эти лимиты последовательны и прозрачны, что позволяет вам планировать инфраструктуру соответствующим образом. В отличие от некоторых провайдеров, мы не скрываем эти лимиты за сложными структурами тарифов; они применяются равномерно ко всем пользователям с предоплаченным балансом.
Биллинг и расчет токенов
Ценообразование простое: $0,25 за 1M входных токенов и $1,00 за 1M выходных токенов. Вы платите только за то, что используете, без ежемесячных подписок или скрытых платежей. Баланс пополняется через криптовалюту, а ошибки или отказы бесплатны. Это означает, что вы платите только за успешные завершения. Предоплаченный баланс не сгорает, поэтому вы можете пополнять его, когда удобно.
Принимаются крипто-пополнения в USDT (TRC20) или USDC (Base). Вы можете внести любую целую сумму от $10 до $500. За крупные депозиты мы предлагаем бонусный баланс: +5% для депозитов от $50 и +10% для депозитов от $100. Не принимаются карты, PayPal или банковские переводы. Вы можете проверить свой баланс и использование в панели управления. Если вы допустили ошибку, например, двойной заряд, вы можете запросить исправление через страницу Поддержки, но сам баланс не возвращается, так как он не сгорает.
Конфиденциальность и ограничения контента
Конфиденциальность является ключевой проблемой для многих разработчиков. При регистрации вам нужен только адрес электронной почты. Ваши промпты не используются для обучения модели, что гарантирует сохранность ваших данных. Это значительное преимущество для компаний, использующих API для проприетарного контента или конфиденциальной информации. Модель чата без цензуры предназначена для законного использования взрослыми, но она устанавливает жесткое ограничение на сексуальный контент с участием несовершеннолетних. Запросы, содержащие такой контент, будут отклонены.
Это единственное ограничение контента позволяет широкий спектр других взрослых тем, вымышленного насилия или спорных мнений без излишней цензуры. Модель не является GPT, Claude или какой-либо другой моделью поставщика, поэтому её поведение уникально для нашей настройки. Сохраняя движок вывода простым и специализированным, мы обеспечиваем, чтобы политика конфиденциальности и контента были последовательными и предсказуемыми. Вы можете быть уверены, что ваши данные не используются для улучшения других моделей, а ваше использование не контролируется для рекламных целей.