Inference × WorkDaddy: LLM-Anbieter-Integration (2026)

Inference als Motor Ihres WorkDaddy-Agenten-Teams: 9 verfügbare Modelle, Kontextfenster bis 125K Tokens, in Minuten mit eigenem Schlüssel verbunden.

Inference ist einer von 178 LLM-Anbietern, die WorkDaddys Modellebene 2026 unterstützt, in der Gruppe Inferenz-Clouds. Der Katalog listet aktuell 9 Modelle von Inference: 0 mit explizitem Reasoning, 3 mit Vision-Eingabe und 8 mit Tool-Aufrufen — der wichtigsten Fähigkeit für Agentenarbeit. Das größte Kontextfenster erreicht 125K Tokens.

Auf einen Blick

Verfügbare Modelle 9
Reasoning-Modelle 0
Vision-Modelle 3
Modelle mit Tool-Aufrufen 8
Größtes Kontextfenster 125K tokens
API-Endpunkt https://inference.net/v1
API-Schlüssel-Variable INFERENCE_API_KEY
SDK-Adapter @ai-sdk/openai-compatible
Anbieter-Doku inference.net ↗

Warum WorkDaddy-Agenten 2026 auf Inference laufen lassen

Tool-Aufrufe, Kontextgröße und Kosten entscheiden, wie gut ein Anbieter ein Agenten-Team antreibt. Inference bringt 8 Tool-fähige Modelle in WorkDaddy — genug für den kompletten Loop aus Shop-Änderungen, Analytics-Abfragen und Content-Produktion — mit bis zu 125K Tokens Kontext für Codebase- und Langbericht-Arbeit. Da WorkDaddy modellagnostisch ist, können Sie schweres Reasoning zum stärksten Inference-Modell routen und Massenarbeit zum günstigsten.

Beste Inference-Modelle für E-Commerce-Agenten (2026)

Die aktuellen Flaggschiffe von Inference im WorkDaddy-Katalog, neueste zuerst:

  • Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)

  • Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)

  • Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)

  • Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

So verbinden Sie Inference mit WorkDaddy

WorkDaddy spricht mit Inference unter inference.net über den @ai-sdk/openai-compatible-Adapter. Fügen Sie Ihre Zugangsdaten (üblicherweise INFERENCE_API_KEY) unter Einstellungen → Modelle hinzu, wählen Sie ein Standardmodell — und jeder Agent kann es sofort nutzen.

Wichtige Modelle

Modell Kontext Reasoning Veröffentlicht
Google Gemma 3 125K Nein 2025-01-01
Qwen 2.5 7B Vision Instruct 125K Nein 2025-01-01
Qwen 3 Embedding 4B 32K Nein 2025-01-01
Llama 3.2 1B Instruct 16K Nein 2025-01-01
Llama 3.2 3B Instruct 16K Nein 2025-01-01
Llama 3.1 8B Instruct 16K Nein 2025-01-01

So funktioniert es

01

Verbinden

Öffnen Sie in WorkDaddy Einstellungen → Modelle, wählen Sie Inference und fügen Sie Ihren API-Schlüssel (INFERENCE_API_KEY) ein. Kein Schlüssel? Starten Sie mit dem verwalteten Gateway.

02

Agenten arbeiten lassen

Setzen Sie Google Gemma 3 oder eines der 9 verfügbaren Modelle als Standard — Überschreibungen pro Agent passen Modell an Aufgabe an.

03

Prüfen und freigeben

Agenten-Output bleibt unabhängig vom Modell entwurfsbasiert: Diffs prüfen und Aktionen freigeben wie gewohnt.

Häufige Fragen

Unterstützt WorkDaddy Inference in 2026?

Ja — Inference ist ein unterstützter LLM-Anbieter mit 9 Modellen im WorkDaddy-Katalog, verbunden mit eigenem API-Schlüssel über den @ai-sdk/openai-compatible-Adapter.

Wie viele Inference-Modelle kann ich mit WorkDaddy nutzen?

9 Modelle sind für Inference gelistet, darunter 0 Reasoning- und 3 Vision-fähige Modelle.

Welches Kontextfenster bieten Inference-Modelle?

Bis zu 125K Tokens beim größten Modell — relevant für Ganz-Repository-Arbeit am Shop und lange Analytics-Berichte.

Ist Inference der beste LLM-Anbieter für E-Commerce-Agenten?

Das hängt vom Aufgabenmix ab — Inference gehört zur Gruppe Inferenz-Clouds. WorkDaddy ist modellagnostisch; die praktische Antwort 2026 lautet: Anbieter kombinieren und jede Aufgabe zum passenden Modell routen.

Lassen Sie das Team für Ihren Shop arbeiten

Verbinden Sie Storefront, Analytics und E-Mail-Stack, setzen Sie ein Ziel, und die Agenten erledigen die Arbeit von Anfang bis Ende. Im kostenlosen Tarif starten Sie mit Ihrem eigenen Modell-Key.