Inference 整合 WorkDaddy:大模型接入(2026)

讓 Inference 成為你 WorkDaddy Agent 團隊的引擎:9 個可用模型、上下文視窗最高 125K token,用自己的密鑰幾分鐘接入。

Inference 是 2026 年 WorkDaddy 模型層支援的 178 家 LLM 供應商之一,屬於「推理雲平台」組。目錄現收錄 Inference 的 9 個模型:0 個顯式推理、3 個視覺輸入、8 個支援工具調用——這正是 Agent 工作最關鍵的能力。最大上下文視窗達 125K token。

關鍵資訊一覽

可用模型數 9
推理模型 0
視覺模型 3
支援工具調用 8
最大上下文視窗 125K tokens
API 端點 https://inference.net/v1
API Key 變數 INFERENCE_API_KEY
SDK 轉接器 @ai-sdk/openai-compatible
官方文件 inference.net ↗

2026 年為何讓 WorkDaddy Agent 跑在 Inference 上

工具調用、上下文規模和成本決定一家供應商驅動 Agent 團隊的水平。Inference 為 WorkDaddy 帶來 8 個工具調用模型——足以支撐店舖修改、數據查詢、內容生產的完整閉環——頂配 125K token 上下文可處理整倉代碼和長報告。WorkDaddy 模型無關,你可以把重推理路由給 Inference 最強的模型,批量任務交給最便宜的,同一支團隊內完成。

2026 年 Inference 最佳電商 Agent 模型

WorkDaddy 目錄中 Inference 目前的旗艦陣容,按發佈時間由新到舊:

  • Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)

  • Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)

  • Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)

  • Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

如何把 Inference 接入 WorkDaddy

WorkDaddy 透過 @ai-sdk/openai-compatible 轉接器與 inference.net 通訊。在「設定 → 模型」加入憑證(通常是 INFERENCE_API_KEY),選擇預設模型,所有 Agent 即刻可用——也可以把 Inference 作為多引擎之一,讓任務自動路由到最合適的模型。

代表模型

模型 上下文 推理 發佈時間
Google Gemma 3 125K 不支援 2025-01-01
Qwen 2.5 7B Vision Instruct 125K 不支援 2025-01-01
Qwen 3 Embedding 4B 32K 不支援 2025-01-01
Llama 3.2 1B Instruct 16K 不支援 2025-01-01
Llama 3.2 3B Instruct 16K 不支援 2025-01-01
Llama 3.1 8B Instruct 16K 不支援 2025-01-01

運作方式

01

完成連接

在 WorkDaddy 打開「設定 → 模型」,選擇 Inference,貼上你的 API Key(INFERENCE_API_KEY)。沒有密鑰?可先用託管閘道。

02

交給 Agent 做事

把 Google Gemma 3 或 9 個可用模型中的任何一個設為預設——支援按 Agent 覆寫,讓模型匹配任務。

03

審閱並批准

無論用甚麼模型,Agent 輸出都保持草稿優先:如常審閱 diff、批准操作。

常見問題

2026 年 WorkDaddy 支援 Inference 嗎?

支援——Inference 是受支援的 LLM 供應商,目錄收錄其 9 個模型,透過 @ai-sdk/openai-compatible 轉接器以自帶 API Key 方式接入。

在 WorkDaddy 能用多少個 Inference 模型?

目錄為 Inference 收錄 9 個模型,其中 0 個推理模型、3 個視覺模型。上文旗艦陣容展示了最新的幾款。

Inference 模型的上下文視窗有多大?

最大型號可達 125K token——適合整倉店舖代碼和長篇分析報告。

Inference 是電商 Agent 的最佳大模型供應商嗎?

取決於任務組合——Inference 屬於「推理雲平台」組。WorkDaddy 模型無關,2026 年的務實答案是組合使用:每個 Agent 任務路由到最合適的模型。

讓這支團隊開始打理你的店舖

接上店舖、分析與電郵行銷工具,設定目標,其餘交給 Agent 由頭到尾做完。免費方案可自備模型金鑰,即刻開始。