Inference 集成 WorkDaddy:大模型接入(2026)
让 Inference 成为你 WorkDaddy Agent 团队的引擎:9 个可用模型、上下文窗口最高 125K token,用自己的密钥几分钟接入。
Inference 是 2026 年 WorkDaddy 模型层支持的 178 家 LLM 提供商之一,属于「推理云平台」组。目录当前收录 Inference 的 9 个模型:0 个显式推理、3 个视觉输入、8 个支持工具调用——这正是 Agent 工作最关键的能力。最大上下文窗口达 125K token。
关键信息一览
| 可用模型数 | 9 |
|---|---|
| 推理模型 | 0 |
| 视觉模型 | 3 |
| 支持工具调用 | 8 |
| 最大上下文窗口 | 125K tokens |
| API 端点 | https://inference.net/v1 |
| API Key 变量 | INFERENCE_API_KEY |
| SDK 适配器 | @ai-sdk/openai-compatible |
| 官方文档 | inference.net ↗ |
2026 年为什么让 WorkDaddy Agent 跑在 Inference 上
工具调用、上下文规模和成本决定一家提供商驱动 Agent 团队的水平。Inference 为 WorkDaddy 带来 8 个工具调用模型——足以支撑店铺修改、数据查询、内容生产的完整闭环——顶配 125K token 上下文可处理整仓代码和长报告。WorkDaddy 模型无关,你可以把重推理路由给 Inference 最强的模型,批量任务交给最便宜的,同一支团队内完成。
2026 年 Inference 最佳电商 Agent 模型
WorkDaddy 目录中 Inference 当前的旗舰阵容,按发布时间从新到旧:
Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)
Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)
Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)
Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
如何把 Inference 接入 WorkDaddy
WorkDaddy 通过 @ai-sdk/openai-compatible 适配器与 inference.net 通信。在「设置 → 模型」里添加凭据(通常是 INFERENCE_API_KEY),选择默认模型,所有 Agent 即刻可用——也可以把 Inference 作为多引擎之一,让任务自动路由到最合适的模型。
代表模型
| 模型 | 上下文 | 推理 | 发布时间 |
|---|---|---|---|
| Google Gemma 3 | 125K | 不支持 | 2025-01-01 |
| Qwen 2.5 7B Vision Instruct | 125K | 不支持 | 2025-01-01 |
| Qwen 3 Embedding 4B | 32K | 不支持 | 2025-01-01 |
| Llama 3.2 1B Instruct | 16K | 不支持 | 2025-01-01 |
| Llama 3.2 3B Instruct | 16K | 不支持 | 2025-01-01 |
| Llama 3.1 8B Instruct | 16K | 不支持 | 2025-01-01 |
运行方式
完成连接
在 WorkDaddy 打开「设置 → 模型」,选择 Inference,粘贴你的 API Key(INFERENCE_API_KEY)。没有密钥?可先用托管网关。
交给 Agent 干活
把 Google Gemma 3 或 9 个可用模型中的任何一个设为默认——支持按 Agent 覆写,让模型匹配任务。
审阅并批准
无论用什么模型,Agent 输出都保持草稿优先:像往常一样审阅 diff、批准操作。
常见问题
2026 年 WorkDaddy 支持 Inference 吗?
支持——Inference 是受支持的 LLM 提供商,目录收录其 9 个模型,通过 @ai-sdk/openai-compatible 适配器以自带 API Key 方式接入。
在 WorkDaddy 里能用多少个 Inference 模型?
目录为 Inference 收录 9 个模型,其中 0 个推理模型、3 个视觉模型。上文旗舰阵容展示了最新的几款。
Inference 模型的上下文窗口有多大?
最大型号可达 125K token——适合整仓店铺代码和长篇分析报告。
Inference 是电商 Agent 的最佳大模型提供商吗?
取决于任务组合——Inference 属于「推理云平台」组。WorkDaddy 模型无关,2026 年的务实答案是组合使用:每个 Agent 任务路由到最合适的模型。