Inference × WorkDaddy: LLM-Anbieter-Integration (2026)
Inference als Motor Ihres WorkDaddy-Agenten-Teams: 9 verfügbare Modelle, Kontextfenster bis 125K Tokens, in Minuten mit eigenem Schlüssel verbunden.
Inference ist einer von 178 LLM-Anbietern, die WorkDaddys Modellebene 2026 unterstützt, in der Gruppe Inferenz-Clouds. Der Katalog listet aktuell 9 Modelle von Inference: 0 mit explizitem Reasoning, 3 mit Vision-Eingabe und 8 mit Tool-Aufrufen — der wichtigsten Fähigkeit für Agentenarbeit. Das größte Kontextfenster erreicht 125K Tokens.
Auf einen Blick
| Verfügbare Modelle | 9 |
|---|---|
| Reasoning-Modelle | 0 |
| Vision-Modelle | 3 |
| Modelle mit Tool-Aufrufen | 8 |
| Größtes Kontextfenster | 125K tokens |
| API-Endpunkt | https://inference.net/v1 |
| API-Schlüssel-Variable | INFERENCE_API_KEY |
| SDK-Adapter | @ai-sdk/openai-compatible |
| Anbieter-Doku | inference.net ↗ |
Warum WorkDaddy-Agenten 2026 auf Inference laufen lassen
Tool-Aufrufe, Kontextgröße und Kosten entscheiden, wie gut ein Anbieter ein Agenten-Team antreibt. Inference bringt 8 Tool-fähige Modelle in WorkDaddy — genug für den kompletten Loop aus Shop-Änderungen, Analytics-Abfragen und Content-Produktion — mit bis zu 125K Tokens Kontext für Codebase- und Langbericht-Arbeit. Da WorkDaddy modellagnostisch ist, können Sie schweres Reasoning zum stärksten Inference-Modell routen und Massenarbeit zum günstigsten.
Beste Inference-Modelle für E-Commerce-Agenten (2026)
Die aktuellen Flaggschiffe von Inference im WorkDaddy-Katalog, neueste zuerst:
Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)
Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)
Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)
Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
So verbinden Sie Inference mit WorkDaddy
WorkDaddy spricht mit Inference unter inference.net über den @ai-sdk/openai-compatible-Adapter. Fügen Sie Ihre Zugangsdaten (üblicherweise INFERENCE_API_KEY) unter Einstellungen → Modelle hinzu, wählen Sie ein Standardmodell — und jeder Agent kann es sofort nutzen.
Wichtige Modelle
| Modell | Kontext | Reasoning | Veröffentlicht |
|---|---|---|---|
| Google Gemma 3 | 125K | Nein | 2025-01-01 |
| Qwen 2.5 7B Vision Instruct | 125K | Nein | 2025-01-01 |
| Qwen 3 Embedding 4B | 32K | Nein | 2025-01-01 |
| Llama 3.2 1B Instruct | 16K | Nein | 2025-01-01 |
| Llama 3.2 3B Instruct | 16K | Nein | 2025-01-01 |
| Llama 3.1 8B Instruct | 16K | Nein | 2025-01-01 |
So funktioniert es
Verbinden
Öffnen Sie in WorkDaddy Einstellungen → Modelle, wählen Sie Inference und fügen Sie Ihren API-Schlüssel (INFERENCE_API_KEY) ein. Kein Schlüssel? Starten Sie mit dem verwalteten Gateway.
Agenten arbeiten lassen
Setzen Sie Google Gemma 3 oder eines der 9 verfügbaren Modelle als Standard — Überschreibungen pro Agent passen Modell an Aufgabe an.
Prüfen und freigeben
Agenten-Output bleibt unabhängig vom Modell entwurfsbasiert: Diffs prüfen und Aktionen freigeben wie gewohnt.
Häufige Fragen
Unterstützt WorkDaddy Inference in 2026?
Ja — Inference ist ein unterstützter LLM-Anbieter mit 9 Modellen im WorkDaddy-Katalog, verbunden mit eigenem API-Schlüssel über den @ai-sdk/openai-compatible-Adapter.
Wie viele Inference-Modelle kann ich mit WorkDaddy nutzen?
9 Modelle sind für Inference gelistet, darunter 0 Reasoning- und 3 Vision-fähige Modelle.
Welches Kontextfenster bieten Inference-Modelle?
Bis zu 125K Tokens beim größten Modell — relevant für Ganz-Repository-Arbeit am Shop und lange Analytics-Berichte.
Ist Inference der beste LLM-Anbieter für E-Commerce-Agenten?
Das hängt vom Aufgabenmix ab — Inference gehört zur Gruppe Inferenz-Clouds. WorkDaddy ist modellagnostisch; die praktische Antwort 2026 lautet: Anbieter kombinieren und jede Aufgabe zum passenden Modell routen.
Weiterlesen
NovitaAI
Inferenz-Clouds
Nvidia
Inferenz-Clouds
Venice AI
Inferenz-Clouds
DigitalOcean
Inferenz-Clouds
Weitere Integrationsverzeichnisse
Lassen Sie das Team für Ihren Shop arbeiten
Verbinden Sie Storefront, Analytics und E-Mail-Stack, setzen Sie ein Ziel, und die Agenten erledigen die Arbeit von Anfang bis Ende. Im kostenlosen Tarif starten Sie mit Ihrem eigenen Modell-Key.