オープンソース ゲートウェイは、OpenAI 互換のチャット応答を維持しながら、リストされた正規モデル ID を検証済みのカスタム推論プロバイダーにルーティングします。
#リクエストを作成する
curl https://api.agihalo.com/open-source/v1/chat/completions \
-H "Authorization: Bearer $HALO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3.6-35b-a3b",
"messages": [{"role": "user", "content": "Reply with OK"}],
"max_tokens": 16,
"stream": false
}'#ランタイム コントラクト
- テキストのみのメッセージと表示されるアシスタント出力。
nおよびbest_of存在する場合は 1 である必要があります。- ツール、関数宣言、ツールロールメッセージ、オーディオ、画像、およびマルチモーダルコンテンツは、プロバイダーのディスパッチ前に拒否されます。
- ランタイムは
stream: falseに正規化し、出力を 32,768 に制限します。
#モデル ファミリ
本番環境カタログ グループには、Qwen、Llama、DeepSeek、Kimi、Mistral、Gemma、GLM、MiniMax、Nemotron、MiMo、GPT-OSS、および AllenAI ファミリ全体のモデルがリストされています。現在のプロジェクトに表示される ID については、ダッシュボードの [モデル] ページを使用してください。
#推論の提供
OpenAI 互換の HTTPS エンドポイントを運用している場合は、登録前に Keeper 契約をお読みください。モデルの検出、ベースライン チェック、境界付きヘルス プローブ、決定論的な計測、支払いルールが適用されます。