Inference × WorkDaddy : intégration fournisseur LLM (2026)

Faites de Inference le moteur de votre équipe d’agents WorkDaddy : 9 modèles disponibles, fenêtres de contexte jusqu’à 125K tokens, connecté en minutes avec votre clé.

Inference est l’un des 178 fournisseurs LLM pris en charge par la couche modèle de WorkDaddy en 2026, dans le groupe Clouds d’inférence. Le catalogue liste actuellement 9 modèles de Inference : 0 avec raisonnement explicite, 3 avec entrée vision et 8 avec appels d’outils — la capacité qui compte le plus pour l’agentique. La plus grande fenêtre de contexte atteint 125K tokens.

En un coup d’œil

Modèles disponibles 9
Modèles de raisonnement 0
Modèles vision 3
Modèles avec appels d’outils 8
Fenêtre de contexte max 125K tokens
Point de terminaison API https://inference.net/v1
Variable de clé API INFERENCE_API_KEY
Adaptateur SDK @ai-sdk/openai-compatible
Docs du fournisseur inference.net ↗

Pourquoi faire tourner les agents WorkDaddy sur Inference en 2026

Appels d’outils, taille de contexte et coût décident de la qualité avec laquelle un fournisseur anime une équipe d’agents. Inference apporte 8 modèles à appels d’outils à WorkDaddy — de quoi alimenter la boucle complète d’éditions boutique, de requêtes analytics et de production de contenu — avec 125K tokens de contexte au sommet. WorkDaddy étant agnostique au modèle, routez le raisonnement lourd vers le plus fort modèle de Inference et le travail de masse vers le moins cher.

Meilleurs modèles Inference pour agents e-commerce (2026)

Les vaisseaux amiraux actuels de Inference dans le catalogue WorkDaddy, du plus récent au plus ancien :

  • Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)

  • Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)

  • Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)

  • Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

Comment connecter Inference à WorkDaddy

WorkDaddy dialogue avec Inference sur inference.net via l’adaptateur @ai-sdk/openai-compatible. Ajoutez votre identifiant (généralement INFERENCE_API_KEY) dans Réglages → Modèles, choisissez un modèle par défaut, et chaque agent peut l’utiliser immédiatement.

Modèles phares

Modèle Contexte Raisonnement Sortie
Google Gemma 3 125K Non 2025-01-01
Qwen 2.5 7B Vision Instruct 125K Non 2025-01-01
Qwen 3 Embedding 4B 32K Non 2025-01-01
Llama 3.2 1B Instruct 16K Non 2025-01-01
Llama 3.2 3B Instruct 16K Non 2025-01-01
Llama 3.1 8B Instruct 16K Non 2025-01-01

Comment ça marche

01

Connecter

Dans WorkDaddy, ouvrez Réglages → Modèles, choisissez Inference et collez votre clé API (INFERENCE_API_KEY). Pas de clé ? Commencez avec la passerelle gérée.

02

Mettre les agents au travail

Choisissez Google Gemma 3 ou l’un des 9 modèles disponibles par défaut — les surcharges par agent adaptent le modèle à la tâche.

03

Relire et valider

La sortie des agents reste en brouillon d’abord quel que soit le modèle : relisez les diffs et validez les actions comme d’habitude.

Questions fréquentes

WorkDaddy prend-il en charge Inference en 2026 ?

Oui — Inference est un fournisseur LLM pris en charge avec 9 modèles au catalogue, connecté avec votre clé API via l’adaptateur @ai-sdk/openai-compatible.

Combien de modèles Inference puis-je utiliser avec WorkDaddy ?

9 modèles sont listés pour Inference, dont 0 modèles de raisonnement et 3 capables de vision.

Quelle fenêtre de contexte offrent les modèles Inference ?

Jusqu’à 125K tokens sur le plus grand modèle — pertinent pour le travail boutique sur dépôt entier et les longs rapports analytics.

Inference est-il le meilleur fournisseur LLM pour agents e-commerce ?

Cela dépend du mix de tâches — Inference appartient au groupe Clouds d’inférence. WorkDaddy étant agnostique au modèle, la réponse pragmatique en 2026 est de combiner les fournisseurs et de router chaque tâche vers le modèle le plus adapté.

Mettez l’équipe au travail sur votre boutique

Connectez votre boutique, vos analytics et votre outil e-mail, fixez un objectif, et laissez les agents exécuter de bout en bout. Le plan gratuit fonctionne avec votre propre clé de modèle.