Inference × WorkDaddy:LLMプロバイダー連携(2026年版)

InferenceをWorkDaddyエージェントチームのエンジンに:9の利用可能モデル、最大125Kトークンのコンテキスト、自分のキーで数分接続。

Inferenceは2026年にWorkDaddyのモデルレイヤーが対応する178のLLMプロバイダーのひとつで、「推論クラウド」グループに属します。カタログにはInferenceの9モデルが収録:推論0、ビジョン入力3、ツール呼び出し8——エージェント作業に最も重要な能力です。最大コンテキストは125Kトークン。

概要データ

利用可能モデル数 9
推論モデル 0
ビジョンモデル 3
ツール呼び出し対応 8
最大コンテキスト 125K tokens
APIエンドポイント https://inference.net/v1
APIキー変数 INFERENCE_API_KEY
SDKアダプター @ai-sdk/openai-compatible
公式ドキュメント inference.net ↗

2026年、WorkDaddyエージェントをInferenceで動かす理由

ツール呼び出し、コンテキストサイズ、コストがエージェントチームの駆動力を決めます。Inferenceは8のツール呼び出しモデルをWorkDaddyにもたらし、最大125Kトークンのコンテキストでコードベース全体や長文レポートを扱えます。WorkDaddyはモデル非依存なので、重い推論はInferenceの最強モデルに、大量処理は最安モデルにルーティングできます。

2026年、ECエージェントに最適なInferenceモデル

WorkDaddyカタログにおけるInferenceの現行フラッグシップ、新しい順:

  • Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)

  • Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)

  • Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)

  • Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

InferenceをWorkDaddyに接続する方法

WorkDaddyは@ai-sdk/openai-compatibleアダプターでinference.netと通信します。「設定 → モデル」で認証情報(通常はINFERENCE_API_KEY)を追加し、デフォルトモデルを選ぶだけで、すべてのエージェントがすぐに使えます。

主要モデル

モデル コンテキスト 推論 リリース
Google Gemma 3 125K 非対応 2025-01-01
Qwen 2.5 7B Vision Instruct 125K 非対応 2025-01-01
Qwen 3 Embedding 4B 32K 非対応 2025-01-01
Llama 3.2 1B Instruct 16K 非対応 2025-01-01
Llama 3.2 3B Instruct 16K 非対応 2025-01-01
Llama 3.1 8B Instruct 16K 非対応 2025-01-01

動作の流れ

01

接続する

WorkDaddyの「設定 → モデル」でInferenceを選び、APIキー(INFERENCE_API_KEY)を貼り付けます。キーがなければマネージドゲートウェイから始められます。

02

エージェントに任せる

Google Gemma 3または9モデルのどれかをデフォルトに設定——エージェント別の上書きでタスクに合わせられます。

03

レビューして承認

どのモデルでもエージェント出力はドラフトファースト:これまで通りdiffをレビューして承認します。

よくある質問

2026年、WorkDaddyはInferenceに対応していますか?

はい。Inferenceは対応LLMプロバイダーで、カタログに9モデルが収録され、@ai-sdk/openai-compatibleアダプター経由で自分のAPIキーで接続します。

WorkDaddyで使えるInferenceモデルはいくつですか?

Inferenceのモデルは9収録されており、うち推論モデル0、ビジョン対応3です。

Inferenceモデルのコンテキストウィンドウは?

最大モデルで125Kトークン——リポジトリ全体のストア作業や長文アナリティクスレポートに有効です。

InferenceはECエージェントに最適なLLMプロバイダーですか?

タスク構成次第です——Inferenceは「推論クラウド」グループに属します。WorkDaddyはモデル非依存なので、2026年の実務的な答えは組み合わせ:各タスクを最適なモデルにルーティングすることです。

あなたのストアにチームを配置する

ストアフロント、アナリティクス、メール基盤を接続し、目標を設定すれば、あとはエージェントが一気通貫で実行します。無料プランなら自分のモデルキーですぐに始められます。