provider/model 格式
使用與 OpenAI 相容的端點(/v1/chat/completions、/v1/embeddings)時,
請使用 provider/model 格式指定模型:
model 欄位改寫為提供商的原生格式。
範例
原生 SDK 端點
對於擁有自己 SDK 格式的提供商,請直接使用原生端點。 提供商由端點路徑決定,而非 model 欄位:原生端點不使用
provider/model 前綴——它們使用提供商的
原始模型名稱,因為提供商已由端點路徑隱含確定。通用提供商代理
對於任何提供商,您也可以使用通用代理格式:POST /openai/v1/chat/completions→ 代理至 OpenAIPOST /deepseek/v1/chat/completions→ 代理至 DeepSeekPOST /anthropic/v1/messages→ 代理至 Anthropic
自動路由
將model 設定為 "auto",ARouter 將自動為您的提示選擇最佳可用模型。無需任何模型設定。
運作原理
- ARouter 的路由服務分析您的請求(提示複雜度、任務類型、所需模態等)
- 根據成本效率和品質,從健康的可用提供商中選出最優模型
- 將您的請求轉發至所選模型
- 回應中包含
model欄位,顯示實際使用的模型
限制可選模型
使用auto-router 外掛透過萬用字元模式限制 auto 可選擇的模型範圍:
- TypeScript
- Python
- cURL
response.model 以確認實際使用的模型。
程式碼範例
- Python (OpenAI)
- Node.js (OpenAI)
- Go
- cURL
使用場景
- 通用應用 — 當您不確定使用者會傳送哪類提示時
- 成本最佳化 — 讓 ARouter 自動將簡單任務路由到高效模型
- 零設定原型 — 無需選擇特定模型即可快速上手
- 自適應路由 — 先讓 ARouter 自動選擇,僅在需要精確控制時再切換為有序候選清單
限制說明
- 自動路由使用標準
messages請求格式 - 自動路由從您帳戶可用的模型中選擇
- 串流傳輸完全支援
"model": "auto" - 您按 ARouter 所選模型的正常費率付費,不收取額外路由費
- 所選模型始終體現在回應的
model欄位中
候選模型清單
將models 陣列與 route 結合使用,讓 ARouter 按順序遍歷候選模型清單。
運作原理
- ARouter 嘗試清單中的第一個模型
- 如果該模型無法處理請求(提供商錯誤、速率限制、金鑰不可用),則切換到下一個
- 如果所有模型均失敗,ARouter 返回含最後一次失敗原因的錯誤
路由行為
控制分區行為
預設情況下,使用候選清單時,端點按模型分組——第一個模型的端點始終在第二個模型之前嘗試。您可以透過provider.sort.partition 變更此行為:
partition: "none" 可在所有候選模型間全域排序端點——當您希望使用當前最快的模型而不關心清單順序時非常有用。完整參考請參閱提供商路由。
在 OpenAI SDK 中使用候選清單
OpenAI SDK 原生不支援models 參數。請使用 extra_body 傳入:
- Python (OpenAI)
- Node.js (OpenAI)
- cURL
助手預填充
ARouter 支援讓模型補全部分回應。在messages 陣列末尾新增一條 role: "assistant" 的訊息,即可從您留下的位置繼續:
- 強制特定輸出格式
- 恢復多輪補全
- 引導模型生成特定回應結構
並非所有模型都支援助手預填充。Anthropic Claude 和大多數開源模型支援此功能。OpenAI 模型支援有限。