Inference 整合 WorkDaddy:大模型接入(2026)
讓 Inference 成為你 WorkDaddy Agent 團隊的引擎:9 個可用模型、上下文視窗最高 125K token,用自己的密鑰幾分鐘接入。
Inference 是 2026 年 WorkDaddy 模型層支援的 178 家 LLM 供應商之一,屬於「推理雲平台」組。目錄現收錄 Inference 的 9 個模型:0 個顯式推理、3 個視覺輸入、8 個支援工具調用——這正是 Agent 工作最關鍵的能力。最大上下文視窗達 125K token。
關鍵資訊一覽
| 可用模型數 | 9 |
|---|---|
| 推理模型 | 0 |
| 視覺模型 | 3 |
| 支援工具調用 | 8 |
| 最大上下文視窗 | 125K tokens |
| API 端點 | https://inference.net/v1 |
| API Key 變數 | INFERENCE_API_KEY |
| SDK 轉接器 | @ai-sdk/openai-compatible |
| 官方文件 | inference.net ↗ |
2026 年為何讓 WorkDaddy Agent 跑在 Inference 上
工具調用、上下文規模和成本決定一家供應商驅動 Agent 團隊的水平。Inference 為 WorkDaddy 帶來 8 個工具調用模型——足以支撐店舖修改、數據查詢、內容生產的完整閉環——頂配 125K token 上下文可處理整倉代碼和長報告。WorkDaddy 模型無關,你可以把重推理路由給 Inference 最強的模型,批量任務交給最便宜的,同一支團隊內完成。
2026 年 Inference 最佳電商 Agent 模型
WorkDaddy 目錄中 Inference 目前的旗艦陣容,按發佈時間由新到舊:
Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)
Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)
Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)
Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
如何把 Inference 接入 WorkDaddy
WorkDaddy 透過 @ai-sdk/openai-compatible 轉接器與 inference.net 通訊。在「設定 → 模型」加入憑證(通常是 INFERENCE_API_KEY),選擇預設模型,所有 Agent 即刻可用——也可以把 Inference 作為多引擎之一,讓任務自動路由到最合適的模型。
代表模型
| 模型 | 上下文 | 推理 | 發佈時間 |
|---|---|---|---|
| Google Gemma 3 | 125K | 不支援 | 2025-01-01 |
| Qwen 2.5 7B Vision Instruct | 125K | 不支援 | 2025-01-01 |
| Qwen 3 Embedding 4B | 32K | 不支援 | 2025-01-01 |
| Llama 3.2 1B Instruct | 16K | 不支援 | 2025-01-01 |
| Llama 3.2 3B Instruct | 16K | 不支援 | 2025-01-01 |
| Llama 3.1 8B Instruct | 16K | 不支援 | 2025-01-01 |
運作方式
完成連接
在 WorkDaddy 打開「設定 → 模型」,選擇 Inference,貼上你的 API Key(INFERENCE_API_KEY)。沒有密鑰?可先用託管閘道。
交給 Agent 做事
把 Google Gemma 3 或 9 個可用模型中的任何一個設為預設——支援按 Agent 覆寫,讓模型匹配任務。
審閱並批准
無論用甚麼模型,Agent 輸出都保持草稿優先:如常審閱 diff、批准操作。
常見問題
2026 年 WorkDaddy 支援 Inference 嗎?
支援——Inference 是受支援的 LLM 供應商,目錄收錄其 9 個模型,透過 @ai-sdk/openai-compatible 轉接器以自帶 API Key 方式接入。
在 WorkDaddy 能用多少個 Inference 模型?
目錄為 Inference 收錄 9 個模型,其中 0 個推理模型、3 個視覺模型。上文旗艦陣容展示了最新的幾款。
Inference 模型的上下文視窗有多大?
最大型號可達 125K token——適合整倉店舖代碼和長篇分析報告。
Inference 是電商 Agent 的最佳大模型供應商嗎?
取決於任務組合——Inference 屬於「推理雲平台」組。WorkDaddy 模型無關,2026 年的務實答案是組合使用:每個 Agent 任務路由到最合適的模型。