控制台
模型网关

开源模型

与 OpenAI 兼容的方式访问列出的开放模型。

开源网关将列出的规范模型 ID 路由到经过验证的自定义推理提供商,同时保留 OpenAI 兼容的聊天响应。

#提出请求

curl https://api.agihalo.com/open-source/v1/chat/completions \
  -H "Authorization: Bearer $HALO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.6-35b-a3b",
    "messages": [{"role": "user", "content": "Reply with OK"}],
    "max_tokens": 16,
    "stream": false
  }'

#运行时合约

  • 纯文本消息和可见的助手输出。
  • nbest_of(如果存在)必须为 1。
  • 工具、函数声明、工具角色消息、音频、图像和多模式内容在提供商调度之前被拒绝。
  • 运行时标准化为 stream: false 并将输出上限限制为 32,768 个令牌。

#模型系列

生产目录对 Qwen、Llama、DeepSeek 中列出的模型进行分组, Kimi、Mistral、Gemma、GLM、MiniMax、Nemotron、MiMo、GPT-OSS 和 AllenAI 系列。使用仪表板的“模型”页面获取当前项目可见的 ID。

#提供推理

如果您操作兼容 OpenAI 的 HTTPS 端点,请在注册前阅读 Keeper 合同。模型发现、基线检查、有界运行状况探测、确定性计量和支付规则适用。