ダッシュボード
モデル ゲートウェイ

オープンソース モデル

リストされたオープン モデルへの OpenAI 互換アクセス。

オープンソース ゲートウェイは、OpenAI 互換のチャット応答を維持しながら、リストされた正規モデル ID を検証済みのカスタム推論プロバイダーにルーティングします。

#リクエストを作成する

curl https://api.agihalo.com/qwen/v1/chat/completions \
  -H "Authorization: Bearer $HALO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.6-35b-a3b",
    "messages": [{"role": "user", "content": "Reply with OK"}],
    "max_tokens": 16,
    "stream": false
  }'
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.HALO_API_KEY,
  baseURL: "https://api.agihalo.com/v1",
});

const response = await client.chat.completions.create({
  model: "qwen/qwen3.6-35b-a3b",
  messages: [{ role: "user", content: "Reply with OK" }],
});

This SDK base URL accepts configured OpenAI and official DeepSeek model IDs as well as listed open-model IDs. HALO selects exactly one runtime from the canonical model value.

#ランタイム コントラクト

  • テキストのみのメッセージと表示されるアシスタント出力。
  • n および best_of存在する場合は 1 である必要があります。
  • ツール、関数宣言、ツールロールメッセージ、オーディオ、画像、およびマルチモーダルコンテンツは、プロバイダーのディスパッチ前に拒否されます。
  • ランタイムは stream: false に正規化し、出力を 32,768 に制限します。

#モデル ファミリ

本番環境カタログ グループには、Qwen、Llama、DeepSeek、Kimi、Mistral、Gemma、GLM、MiniMax、Nemotron、MiMo、GPT-OSS、および AllenAI ファミリ全体のモデルがリストされています。現在のプロジェクトに表示される ID については、ダッシュボードの [モデル] ページを使用してください。

Family-bound base URLs are /qwen/v1,/llama/v1, /deepseek/v1,/kimi/v1, /mistral/v1,/gemma/v1, /glm/v1,/minimax/v1, /nemotron/v1,/mimo/v1, /gpt-oss/v1, and/allenai/v1. A family URL rejects a canonical model ID belonging to another family.

#推論の提供

OpenAI 互換の HTTPS エンドポイントを運用している場合は、登録前に Keeper 契約をお読みください。モデルの検出、ベースライン チェック、境界付きヘルス プローブ、決定論的な計測、支払いルールが適用されます。