Inference × WorkDaddy:LLMプロバイダー連携(2026年版)
InferenceをWorkDaddyエージェントチームのエンジンに:9の利用可能モデル、最大125Kトークンのコンテキスト、自分のキーで数分接続。
Inferenceは2026年にWorkDaddyのモデルレイヤーが対応する178のLLMプロバイダーのひとつで、「推論クラウド」グループに属します。カタログにはInferenceの9モデルが収録:推論0、ビジョン入力3、ツール呼び出し8——エージェント作業に最も重要な能力です。最大コンテキストは125Kトークン。
概要データ
| 利用可能モデル数 | 9 |
|---|---|
| 推論モデル | 0 |
| ビジョンモデル | 3 |
| ツール呼び出し対応 | 8 |
| 最大コンテキスト | 125K tokens |
| APIエンドポイント | https://inference.net/v1 |
| APIキー変数 | INFERENCE_API_KEY |
| SDKアダプター | @ai-sdk/openai-compatible |
| 公式ドキュメント | inference.net ↗ |
2026年、WorkDaddyエージェントをInferenceで動かす理由
ツール呼び出し、コンテキストサイズ、コストがエージェントチームの駆動力を決めます。Inferenceは8のツール呼び出しモデルをWorkDaddyにもたらし、最大125Kトークンのコンテキストでコードベース全体や長文レポートを扱えます。WorkDaddyはモデル非依存なので、重い推論はInferenceの最強モデルに、大量処理は最安モデルにルーティングできます。
2026年、ECエージェントに最適なInferenceモデル
WorkDaddyカタログにおけるInferenceの現行フラッグシップ、新しい順:
Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)
Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)
Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)
Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
InferenceをWorkDaddyに接続する方法
WorkDaddyは@ai-sdk/openai-compatibleアダプターでinference.netと通信します。「設定 → モデル」で認証情報(通常はINFERENCE_API_KEY)を追加し、デフォルトモデルを選ぶだけで、すべてのエージェントがすぐに使えます。
主要モデル
| モデル | コンテキスト | 推論 | リリース |
|---|---|---|---|
| Google Gemma 3 | 125K | 非対応 | 2025-01-01 |
| Qwen 2.5 7B Vision Instruct | 125K | 非対応 | 2025-01-01 |
| Qwen 3 Embedding 4B | 32K | 非対応 | 2025-01-01 |
| Llama 3.2 1B Instruct | 16K | 非対応 | 2025-01-01 |
| Llama 3.2 3B Instruct | 16K | 非対応 | 2025-01-01 |
| Llama 3.1 8B Instruct | 16K | 非対応 | 2025-01-01 |
動作の流れ
接続する
WorkDaddyの「設定 → モデル」でInferenceを選び、APIキー(INFERENCE_API_KEY)を貼り付けます。キーがなければマネージドゲートウェイから始められます。
エージェントに任せる
Google Gemma 3または9モデルのどれかをデフォルトに設定——エージェント別の上書きでタスクに合わせられます。
レビューして承認
どのモデルでもエージェント出力はドラフトファースト:これまで通りdiffをレビューして承認します。
よくある質問
2026年、WorkDaddyはInferenceに対応していますか?
はい。Inferenceは対応LLMプロバイダーで、カタログに9モデルが収録され、@ai-sdk/openai-compatibleアダプター経由で自分のAPIキーで接続します。
WorkDaddyで使えるInferenceモデルはいくつですか?
Inferenceのモデルは9収録されており、うち推論モデル0、ビジョン対応3です。
Inferenceモデルのコンテキストウィンドウは?
最大モデルで125Kトークン——リポジトリ全体のストア作業や長文アナリティクスレポートに有効です。
InferenceはECエージェントに最適なLLMプロバイダーですか?
タスク構成次第です——Inferenceは「推論クラウド」グループに属します。WorkDaddyはモデル非依存なので、2026年の実務的な答えは組み合わせ:各タスクを最適なモデルにルーティングすることです。