オープンソース ゲートウェイは、OpenAI 互換のチャット応答を維持しながら、リストされた正規モデル ID を検証済みのカスタム推論プロバイダーにルーティングします。
#リクエストを作成する
curl https://api.agihalo.com/qwen/v1/chat/completions \
-H "Authorization: Bearer $HALO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3.6-35b-a3b",
"messages": [{"role": "user", "content": "Reply with OK"}],
"max_tokens": 16,
"stream": false
}'import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.HALO_API_KEY,
baseURL: "https://api.agihalo.com/v1",
});
const response = await client.chat.completions.create({
model: "qwen/qwen3.6-35b-a3b",
messages: [{ role: "user", content: "Reply with OK" }],
});This SDK base URL accepts configured OpenAI and official DeepSeek model IDs as well as listed open-model IDs. HALO selects exactly one runtime from the canonical model value.
#ランタイム コントラクト
- テキストのみのメッセージと表示されるアシスタント出力。
nおよびbest_of存在する場合は 1 である必要があります。- ツール、関数宣言、ツールロールメッセージ、オーディオ、画像、およびマルチモーダルコンテンツは、プロバイダーのディスパッチ前に拒否されます。
- ランタイムは
stream: falseに正規化し、出力を 32,768 に制限します。
#モデル ファミリ
本番環境カタログ グループには、Qwen、Llama、DeepSeek、Kimi、Mistral、Gemma、GLM、MiniMax、Nemotron、MiMo、GPT-OSS、および AllenAI ファミリ全体のモデルがリストされています。現在のプロジェクトに表示される ID については、ダッシュボードの [モデル] ページを使用してください。
Family-bound base URLs are /qwen/v1,/llama/v1, /deepseek/v1,/kimi/v1, /mistral/v1,/gemma/v1, /glm/v1,/minimax/v1, /nemotron/v1,/mimo/v1, /gpt-oss/v1, and/allenai/v1. A family URL rejects a canonical model ID belonging to another family.
#推論の提供
OpenAI 互換の HTTPS エンドポイントを運用している場合は、登録前に Keeper 契約をお読みください。モデルの検出、ベースライン チェック、境界付きヘルス プローブ、決定論的な計測、支払いルールが適用されます。