ルーティングされたチャット補完を作成する
標準のチャット補完リクエストを送信します。model はタスクエイリアス、
alias@v2 などのバージョン固定、または openai/gpt-5.6-sol などの登録済みプロバイダーへの直接参照を受け入れます。タスクリクエストは自動的にトレースされます。
承認
選択したタスクとプロバイダーを所有する個人/デフォルトの entity またはチームに属する W&B APIキー。
ヘッダー
ストリーミングではないタスクルーティング経由または直接の provider/model リクエストで、応答の完全一致に基づくキャッシュを有効にします。キャッシュの識別には、実際に上流へ送信されるリクエストボディと、転送されるパスおよびクエリパラメーターが使用されます。直接リクエストのキャッシュはさらに、entity、プロバイダー設定、モデル、パススルーのユーザーアイデンティティ、および転送される W&B Inference project ごとに分離されます。readWrite はキャッシュの読み取りと書き込みを行い、readOnly は読み取りのみ、writeOnly は書き込みのみを行います。保存されるのは、正常な応答のうち 8 MiB 以下のものだけです。無効な値を指定すると HTTP 400 が返されます。op-cache も指定する場合は、両方のヘッダーで同じモードを選択する必要があります。ストリーミングリクエストでは応答のキャッシュはサポートされません。
readWrite, readOnly, writeOnly wandb-cache-mode の OpenPipe 互換エイリアスです。同じモードを受け入れ、true は readWrite と同等です。両方のヘッダーを指定する場合は、同じモードを選択する必要があります。
readWrite, readOnly, writeOnly, true ボディ
タスクエイリアス、alias@vN、または {provider}/{model-id}。
111 <= x <= 90071992547409911 <= x <= 9007199254740991