Skip to main content
POST
Chat Completion

チャットの完了

オプションのナレッジ ベース取得 (RAG)、モデルの冗長性/フェイルオーバー、通話ごとのセキュリティ ポリシー、ストリーミングを備えた AI チャット完了のメイン エンドポイント。

エンドポイント

説明

オプションのナレッジ ベース取得 (RAG) を備えた AI チャット完了のメイン エンドポイント。以下をサポートします。
  • 2 つの入力形式 - 単一の prompt 文字列 (レガシー) または OpenAI スタイルの messages 配列。
  • モデルの冗長性 — 呼び出し元定義のフェイルオーバー チェーン (プライマリ + 最大 2 つのフォールバック)。 「冗長性とフェイルオーバー」(/ja/ja/api/redundancy) を参照してください。
  • 通話ごとのセキュリティ - SMLTP ポリシーの選択とインライン プロンプト シールドのオーバーライド。
  • ストリーミング — サーバー送信イベント (SSE)。
  • 署名済み受領書 — ゲートウェイを介してルーティングされた応答に関する SMLTP 準拠の受領書参照。
OpenAI SDK の互換性コード変更なしで SecureAI を既存の OpenAI 統合にドロップしたい場合は、代わりに /api/external/v1/chat/completionsOpenAI 互換エンドポイント を使用してください。このクラシック エンドポイントは、RAG をサポートする唯一のエンドポイントです。

認証

必須: API キー

ヘッダー

リクエスト本文

入力パラメータ

**prompt または messages の両方を指定することはできません。

モデルと冗長パラメータ

パラメータの取得と生成

リクエストの例

応答

成功の応答 (200)

メタデータ オブジェクト

ストリーミング

サーバー送信イベントを受信するには "stream": true を設定します。各 SSE 行は data: <json> で、ストリームは data: [DONE] で終わります。フレームは type フィールドを介して入力されます。

エラー応答

400 不正なリクエスト

401 不正

403 禁止

429 / 502 — 冗長チェーンが枯渇しました

冗長チェーン内のすべてのモデルに障害が発生すると、応答で各試行が報告されます。すべての障害がレート制限であった場合、ステータスは 429、それ以外の場合は 502 です。

500 内部サーバーエラー

使用例

JavaScript/Node.js

パイソン

注意事項

  • indexは必須です。 RAG を使用しない直接 AI 応答の場合は index: "Zero-Knowledge" を送信します。
  • user_id パラメーターは、リクエストを別のユーザー アカウント (管理者ゲート) に請求します。
  • 温度は 0 ~ 2 に固定されます。 max_tokens の上限は 4000 です。
  • モデルの呼び出しやポイントの消費をせずに、すべてのポリシーに対してリクエストを検証するには、ポリシー チェック を使用します。
  • フェイルオーバー チェーンのセマンティクス (トリガー、タイムアウト、ストリーミング動作、枯渇ステータス コード) については、冗長性とフェイルオーバー を参照してください。

承認

Authorization
string
header
必須

API key authentication using Bearer token format. Example: Authorization: Bearer sk-your-api-key-here

ボディ

application/json
prompt
string
必須

The user's message/prompt

:

"What is the company's policy on remote work?"

model
string

The AI model to use for completion

:

"openai/gpt-4.1-mini"

index
string

Knowledge base to search for context (use 'Zero-Knowledge' for direct AI responses)

:

"my-knowledge-base"

smltp_policy
string

Security policy to apply

:

"internal"

temperature
number<float>
デフォルト:0.7

Controls randomness in the response (0 = deterministic, 2 = very random)

必須範囲: 0 <= x <= 2
:

0.7

max_tokens
integer
デフォルト:1000

Maximum number of tokens in the response

必須範囲: 1 <= x <= 4000
:

1000

stream
boolean
デフォルト:false

Whether to stream the response

:

false

conversation_id
string

Optional conversation ID for tracking

:

"conv-123"

system_message
string

Optional custom system message

:

"You are a helpful assistant."

use_rag
boolean
デフォルト:true

Whether to use RAG (knowledge base retrieval)

:

true

user_id
string

MongoDB ObjectId of the user to bill for this request. If not provided, the API key owner will be billed

:

"60a7c8f5e8b4f5001f7a8c23"

レスポンス

Successful chat completion

success
boolean
:

true

id
string
:

"req-abc123"

object
string
:

"chat.completion"

created
integer
:

1705312200

model
string
:

"openai/gpt-4.1-mini"

choices
object[]
usage
object
metadata
object