Hiểu về suy luận không kiểm duyệt
Khi các nhà phát triển tìm kiếm giải pháp chat không kiểm duyệt, họ thường phải đối mặt với sự đánh đổi giữa tính linh hoạt và chi phí. Các bộ tổng hợp kết hợp nhiều mô hình, gây ra độ trễ và hành vi khó dự đoán. Cách tiếp cận của chúng tôi đơn giản hơn: chúng tôi chạy một mô hình ngôn ngữ lớn trọng số mở chuyên dụng trên máy chủ của riêng mình. Điều này đảm bảo hành vi nhất quán và loại bỏ nhiễu từ việc định tuyến mô hình.
Mô hình được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp, khiến nó lý tưởng cho viết sáng tạo, nhập vai hoặc nghiên cứu bảo mật nơi các mô hình tiêu chuẩn có thể chặn các chủ đề tinh tế. Nó không phải là GPT, Claude hay bất kỳ mô hình của nhà cung cấp nào khác. Giới hạn cứng duy nhất luôn áp dụng là từ chối nội dung tình dục liên quan đến trẻ vị thành niên. Tất cả nội dung khác, từ ý kiến gây tranh cãi đến các cảnh hư cấu rõ ràng, đều được cho phép. Cách tiếp cận động cơ đơn lẻ này có nghĩa là bạn biết chính xác những gì mình đang nhận: văn bản vào, văn bản ra, không có logic tổng hợp ẩn nào.
Thiết lập Khóa API và Xác thực
Việc bắt đầu với api chat không kiểm duyệt được thiết kế để bạn có thể sử dụng ngay lập tức. Bạn có thể đăng ký bằng cách sử dụng "Tiếp tục với Google" hoặc bằng cách cung cấp địa chỉ email và mật khẩu. Không cần số điện thoại và không cần thẻ tín dụng cho bản dùng thử ban đầu. Sau khi tạo, khóa API của bạn sẽ được hiển thị ngay lập tức trên màn hình.
Mỗi tài khoản chỉ giới hạn một khóa hoạt động. Nếu bạn tạo khóa mới, khóa cũ sẽ bị thay thế. Khóa này được sử dụng để xác thực các yêu cầu của bạn với URL cơ sở: https://api.uncensoredchat.top/v1. URL này tương thích với các SDK OpenAI chính thức và bất kỳ client nào hỗ trợ giao thức OpenAI. Chỉ cần cập nhật URL cơ sở của client và đặt khóa API trong tiêu đề ủy quyền. khóa api ai không kiểm duyệt là thông tin xác thực duy nhất bạn cần để bắt đầu gửi yêu cầu.
Xây dựng Payload Hoàn thành Chat
Để sử dụng api chat không kiểm duyệt, bạn gửi một yêu cầu POST đến /v1/chat/completions. Dữ liệu tải theo định dạng OpenAI tiêu chuẩn, giúp việc tích hợp trở nên dễ dàng nếu bạn đã quen thuộc với API của OpenAI. Bạn phải chỉ định ID mô hình là "uncensored". Điều này cho máy chủ biết để định tuyến yêu cầu của bạn đến công cụ suy luận chuyên dụng của chúng tôi.
Cửa sổ ngữ cảnh hỗ trợ tổng cộng 100.000 token, bao gồm cả prompt và phần hoàn thành. Bạn có thể đặt giới hạn đầu ra tối đa là 32.000 token cho mỗi yêu cầu. Nếu bạn không chỉ định max_tokens, giới hạn mặc định là 2.048 token. Điều này đủ cho hầu hết các trường hợp sử dụng tiêu chuẩn nhưng cho phép đầu ra dài hơn khi cần. Bạn cũng có thể đặt các tham số như temperature, top_p, stop và seed để kiểm soát tính ngẫu nhiên và khả năng tái lập của các phản hồi. Thân yêu cầu được giới hạn ở 8 MB.
Xử lý Phản hồi Streaming
Đối với các ứng dụng hưởng lợi từ phản hồi thời gian thực, API hỗ trợ truyền phát (streaming) qua Sự kiện gửi qua máy chủ (SSE). Khi bạn đặt stream: true trong yêu cầu của mình, máy chủ sẽ trả về một luồng các khối dữ liệu. Mỗi khối chứa một phần của phản hồi. Khối cuối cùng bao gồm thống kê sử dụng token, cho phép bạn theo dõi mức tiêu thụ chính xác.
Truyền phát (streaming) đặc biệt hữu ích cho các giao diện chat nơi người dùng mong đợi văn bản xuất hiện ngay lập tức. Nó làm giảm độ trễ cảm nhận được so với việc chờ đợi phản hồi đầy đủ. api chatbot không kiểm duyệt đảm bảo rằng tất cả các tham số tiêu chuẩn đều được hỗ trợ ở chế độ truyền phát. Bạn có thể phân tích luồng bằng bất kỳ thư viện khách hàng SSE tiêu chuẩn nào. Lưu ý rằng lỗi hoặc từ chối không được tính phí, vì vậy bạn có thể an toàn truyền phát mà không phải lo lắng về chi phí cho các yêu cầu thất bại.
Bật Gọi hàm và Công cụ
Các ứng dụng LLM hiện đại thường yêu cầu các tương tác có cấu trúc. api llm không kiểm duyệt của chúng tôi hỗ trợ gọi hàm, còn được gọi là công cụ. Bạn có thể xác định một bộ các hàm trong tham số tools của yêu cầu của mình. Mô hình sau đó sẽ quyết định khi nào gọi một hàm dựa trên đầu vào của người dùng. Điều này hữu ích cho các nhiệm vụ như trích xuất dữ liệu từ văn bản, thực hiện tính toán hoặc kích hoạt các hành động bên ngoài.
Bạn có thể chỉ định tool_choice để buộc mô hình gọi một hàm cụ thể hoặc để nó tự quyết định. Tham số response_format có thể được đặt thành {"type": "json_object"} để đảm bảo đầu ra là JSON hợp lệ, điều này rất hữu ích khi phân tích các đối số hàm. Sự kết hợp giữa các công cụ và chế độ JSON này khiến api không kiểm duyệt trở thành một lựa chọn mạnh mẽ để xây dựng các tác nhân tự hành hoặc các quy trình phức tạp yêu cầu trích xuất dữ liệu có cấu trúc.
Buộc chế độ đầu ra JSON
Khi tích hợp LLM vào các quy trình phần mềm, định dạng đầu ra đáng tin cậy là rất quan trọng. Bằng cách đặt response_format thành {"type": "json_object"}, bạn hướng dẫn mô hình chỉ trả về JSON hợp lệ. Điều này loại bỏ nhu cầu phân tích cú pháp regex phức tạp hoặc xử lý lỗi cho văn bản bị lỗi. Nó đặc biệt hữu ích khi bạn đang trích xuất dữ liệu có cấu trúc hoặc tạo các tệp cấu hình.
Chế độ này hoạt động cùng với gọi hàm nhưng cũng có thể được sử dụng cho các nhiệm vụ trích xuất dữ liệu đơn giản. Mô hình sẽ cố gắng tuân thủ cấu trúc JSON, mặc dù nó vẫn bị ràng buộc bởi các khả năng vốn có của mô hình. Để có kết quả tốt nhất, hãy cung cấp hướng dẫn rõ ràng trong prompt hệ thống về lược đồ JSON dự kiến. Tính năng này khiến api chatbot không lọc trở thành một lựa chọn mạnh mẽ cho các dịch vụ backend yêu cầu đầu ra có thể dự đoán và đọc được bằng máy.
Quản lý Giới hạn tốc độ và Độ đồng thời
Để đảm bảo sử dụng công bằng và ổn định, api nsfw áp dụng các giới hạn tốc độ cụ thể. Bạn được phép 300 yêu cầu mỗi phút cho mỗi khóa API. Ngoài ra, bạn có thể có tối đa 8 yêu cầu đồng thời cùng lúc cho mỗi khóa. Giới hạn đồng thời này rất quan trọng đối với các ứng dụng gửi nhiều yêu cầu đồng thời, chẳng hạn như xử lý hàng loạt hoặc hệ thống chat thời gian thực.
Nếu bạn vượt quá các giới hạn này, bạn sẽ nhận được lỗi 429 Quá nhiều yêu cầu. Bạn nên triển khai backoff theo cấp số nhân trong máy khách của mình để xử lý các lỗi này một cách tinh tế. Giới hạn thân yêu cầu 8 MB cũng áp dụng cho mỗi yêu cầu. Các giới hạn này nhất quán và minh bạch, cho phép bạn lập kế hoạch cơ sở hạ tầng của mình. Không giống như một số nhà cung cấp khác, chúng tôi không ẩn các giới hạn này đằng sau các cấu trúc cấp phức tạp; chúng áp dụng đồng đều cho tất cả người dùng tín dụng trả trước.
Thanh toán và tính token
Giá cả rất đơn giản: $0,25 cho mỗi 1M token đầu vào và $1,00 cho mỗi 1M token đầu ra. Bạn chỉ trả tiền cho những gì bạn sử dụng, không có đăng ký hàng tháng hoặc phí ẩn. Tín dụng được nạp tiền thông qua tiền điện tử, và lỗi hoặc từ chối đều miễn phí. Điều này có nghĩa là bạn chỉ trả tiền cho các phần hoàn thành thành công. Tín dụng trả trước không bao giờ hết hạn, vì vậy bạn có thể nạp tiền khi thuận tiện.
Nạp tiền crypto được chấp nhận bằng USDT (TRC20) hoặc USDC (Base). Bạn có thể nạp bất kỳ số tiền nguyên nào từ $10 đến $500. Đối với các khoản nạp lớn hơn, chúng tôi cung cấp tín dụng bổ sung: +5% cho các khoản nạp từ $50 trở lên và +10% cho các khoản nạp từ $100 trở lên. Không chấp nhận thẻ, PayPal hoặc chuyển khoản ngân hàng. Bạn có thể kiểm tra số dư và mức sử dụng trong bảng điều khiển. Nếu bạn mắc lỗi, chẳng hạn như nạp tiền gấp đôi, bạn có thể yêu cầu sửa chữa qua trang Hỗ trợ, nhưng bản thân tín dụng không được hoàn lại vì nó không bao giờ hết hạn.
Quyền riêng tư và Giới hạn nội dung
Quyền riêng tư là một mối quan tâm chính của nhiều nhà phát triển. Khi bạn đăng nhập, bạn chỉ cần một địa chỉ email. Các prompt của bạn không được sử dụng để huấn luyện mô hình, đảm bảo rằng dữ liệu của bạn vẫn ở trạng thái riêng tư. Đây là một lợi thế đáng kể đối với các công ty sử dụng API cho nội dung độc quyền hoặc thông tin nhạy cảm. Mô hình chat không kiểm duyệt được thiết kế cho người trưởng thành sử dụng hợp pháp, nhưng nó áp dụng giới hạn cứng về nội dung tình dục liên quan đến trẻ vị thành niên. Các yêu cầu chứa nội dung như vậy sẽ bị từ chối.
Giới hạn nội dung đơn này cho phép một loạt các chủ đề người lớn khác, bạo lực hư cấu hoặc ý kiến gây tranh cãi mà không có kiểm duyệt không cần thiết. Mô hình không phải là GPT, Claude hoặc bất kỳ mô hình của nhà cung cấp nào khác, vì hành vi của nó là duy nhất đối với việc tinh chỉnh của chúng tôi. Bằng cách giữ cho công cụ suy luận đơn giản và chuyên dụng, chúng tôi đảm bảo rằng các chính sách quyền riêng tư và nội dung là nhất quán và dự đoán được. Bạn có thể tin tưởng rằng dữ liệu của bạn không được sử dụng để cải thiện các mô hình khác và việc sử dụng của bạn không được theo dõi cho mục đích quảng cáo.