無検閲推論の理解
開発者が無検閲チャットソリューションを求める際、しばしば柔軟性とコストのトレードオフに直面します。エグリーゲーターは複数のモデルを混合するため、レイテンシや予測不可能な動作を引き起こします。私たちのアプローチはよりシンプルです:独自のサーバーで1つの専用オープンウェイト大規模言語モデルを実行します。これにより、一貫した動作が保証され、モデルルーティングのノイズが排除されます。
モデルは法的な成人利用に対してコンテンツ拒否なしで回答するように調整されており、標準的なモデルが微妙なトピックをブロックする可能性があるクリエイティブライティング、ロールプレイ、セキュリティ調査に最適です。GPT、Claude、またはその他のベンダーのモデルではありません。常に適用される唯一のハードリミットは、未成年者を含む性的コンテンツの拒否です。論争的な意見から明示的なフィクションシーンまで、その他のコンテンツはすべて許可されます。この単一エンジンアプローチにより、あなたは自分が何を得ているかを正確に知ることができます:テキスト入力、テキスト出力、隠れた集約ロジックはありません。
APIキーの設定と認証
無検閲APIの開始は即時に設計されています。「Googleで続行」またはメールアドレスとパスワードでサインアップできます。電話番号は不要で、初期トライアルにはクレジットカードも必要ありません。作成後、APIキーはすぐに画面上に表示されます。
各アカウントにはアクティブなキーが1つまで制限されています。新しいキーを生成すると、古いキーは置き換えられます。このキーはベースURLhttps://api.uncensoredchat.top/v1へのリクエストの認証に使用されます。このURLは公式OpenAI SDKおよびOpenAIプロトコルをサポートするすべてのクライアントと互換性があります。クライアントのベースURLを更新し、認証ヘッダーにAPIキーを設定するだけです。無検閲AI APIキーは、リクエストの送信を開始するために必要な唯一の認証情報です。
チャット完了ペイロードの構築
無検閲チャットAPIを使用するには、/v1/chat/completionsにPOSTリクエストを送信します。ペイロードは標準的なOpenAI形式に従うため、OpenAI APIにすでに精通している場合は統合が簡単です。モデルIDを"uncensored"として指定する必要があります。これにより、サーバーはリクエストを専用の推論エンジンにルーティングします。
コンテキストウィンドウは、プロンプトと完了の両方を含めて合計100,000トークンをサポートします。リクエストごとに最大32,000トークンの出力を設定できます。max_tokensを指定しない場合、制限はデフォルトで2,048トークンになります。これはほとんどの標準的なユースケースに十分ですが、必要に応じてより長い出力を許可します。temperature、top_p、stop、seedなどのパラメータを設定して、応答のランダム性と再現性を制御することもできます。リクエストボディは8 MBに制限されています。
ストリーミング応答の処理
リアルタイムフィードバックを必要とするアプリケーションの場合、APIはServer-Sent Events(SSE)を介したストリーミングをサポートします。リクエストでstream: trueを設定すると、サーバーはチャンクのストリームを返します。各チャンクには応答の一部が含まれます。最終チャンクにはトークン使用量統計が含まれており、消費を正確に追跡できます。
ストリーミングは、ユーザーが即時のテキスト表示を期待するチャットインターフェースで特に有用です。これは、完全な応答を待つよりも知覚されるレイテンシを削減します。無検閲チャットボットAPIは、ストリーミングモードですべての標準パラメータをサポートすることを保証します。標準的なSSEクライアントライブラリを使用してストリームを解析できます。エラーや拒否は課金されないため、失敗したリクエストのコストを気にせずに安全にストリーミングできます。
関数呼び出しとツールの有効化
現代のLLMアプリケーションでは構造化された対話がしばしば必要です。私たちの無検閲LLM APIは関数呼び出し(ツールとも呼ばれる)をサポートします。リクエストのtoolsパラメータに関数のセットを定義できます。モデルはユーザーの入力に基づいて関数を呼び出すタイミングを判断します。これは、テキストからのデータ抽出、計算の実行、または外部アクションのトリガーなどのタスクに有用です。
tool_choiceを指定して、モデルに特定の関数を呼び出させるか、判断を委ねることができます。response_formatパラメータを{"type": "json_object"}に設定することで、出力が有効なJSONであることを保証できます。これは関数引数の解析に役立ちます。ツールとJSONモードのこの組み合わせにより、無検閲APIは構造化されたデータ抽出を必要とする自律型エージェントや複雑なワークフローの構築に強力な選択肢となります。
JSON出力モードの強制
LLMをソフトウェアパイプラインに統合する場合、信頼できる出力形式が重要です。response_formatを{"type": "json_object"}に設定することで、モデルに有効なJSONのみを返すよう指示します。これにより、複雑な正規表現解析や不適切なテキストのエラー処理の必要性がなくなります。構造化データの抽出や設定ファイルの生成に特に役立ちます。
このモードは関数呼び出しと連動して動作しますが、単純なデータ抽出タスクにも使用できます。モデルはJSON構造に従おうとしますが、モデルの固有の能力に制約されます。最良の結果を得るには、システムプロンプトで期待されるJSONスキーマについて明確な指示を提供してください。この機能により、フィルタなしチャットボットAPIは、予測可能で機械可読な出力を必要とするバックエンドサービスにとって堅牢な選択肢となります。
レート制限と同時実行の管理
公平な利用と安定性を確保するため、NSFW APIは特定のレート制限を適用します。APIキーごとに1分あたり300リクエストが許可されます。さらに、キーごとに同時に最大8つのリクエストを送信できます。この同時実行数の制限は、バッチ処理やリアルタイムチャットシステムなど、複数の同時リクエストを送信するアプリケーションにとって重要です。
これらの制限を超えると、429 Too Many Requestsエラーが返されます。これらのエラーを適切に処理するために、クライアントで指数バックオフを実装することをお勧めします。8 MBのリクエストボディ制限も各リクエストに適用されます。これらの制限は一貫しており透明であり、インフラストラクチャを適切に計画できます。一部のプロバイダーとは異なり、これらの制限は複雑なティア構造の背後に隠れていません。すべての前払いユーザーに均一に適用されます。
請求とトークン計算
価格はシンプルです:入力トークン100万トークンあたり$0.25および出力トークン100万トークンあたり$1.00。月額サブスクリプションや隠れた料金なしで、使用した分のみを支払います。クレジットは暗号通貨でチャージされ、エラーや拒否は無料です。つまり、成功した完了に対してのみ支払います。前払いクレジットは期限切れにならないため、都合の良いときにチャージできます。
暗号通貨によるチャージはUSDT(TRC20)またはUSDC(Base)で受け付けます。$10から$500までの任意の整数金額を入金できます。大口入金にはボーナスクレジットを提供します:$50以上の入金で+5%、$100以上の入金で+10%。クレジットカード、PayPal、銀行振込は受け付けません。ダッシュボードで残高と使用状況を確認できます。二重チャージなどのミスをした場合、サポートページを通じて修正をリクエストできますが、クレジット自体は期限切れにならないため返金されません。
プライバシーとコンテンツの制限
プライバシーは多くの開発者にとって重要な懸念事項です。サインアップするにはメールアドレスのみが必要です。プロンプトはモデルのトレーニングに使用されないため、データはプライベートに保たれます。これは、APIを独自のコンテンツや機密情報に使用している企業にとって大きな利点です。無検閲チャットモデルは法的な成人向けに設計されていますが、未成年者を含む性的コンテンツには厳格な制限を設けています。そのようなコンテンツを含むリクエストは拒否されます。
この単一のコンテンツ制限により、不必要な検閲なしに、その他の多くのアダルトテーマ、フィクションの暴力、または論争的な意見が許可されます。モデルはGPT、Claude、またはその他のベンダーのモデルではないため、その動作は私たちの調整に固有です。推論エンジンをシンプルで専用に保つことで、プライバシーとコンテンツポリシーが一貫して予測可能であることを保証します。あなたのデータが他のモデルの改善に使用されていないこと、およびあなたの使用状況が広告目的で監視されていないことを信頼できます。