Inference × WorkDaddy : intégration fournisseur LLM (2026)
Faites de Inference le moteur de votre équipe d’agents WorkDaddy : 9 modèles disponibles, fenêtres de contexte jusqu’à 125K tokens, connecté en minutes avec votre clé.
Inference est l’un des 178 fournisseurs LLM pris en charge par la couche modèle de WorkDaddy en 2026, dans le groupe Clouds d’inférence. Le catalogue liste actuellement 9 modèles de Inference : 0 avec raisonnement explicite, 3 avec entrée vision et 8 avec appels d’outils — la capacité qui compte le plus pour l’agentique. La plus grande fenêtre de contexte atteint 125K tokens.
En un coup d’œil
| Modèles disponibles | 9 |
|---|---|
| Modèles de raisonnement | 0 |
| Modèles vision | 3 |
| Modèles avec appels d’outils | 8 |
| Fenêtre de contexte max | 125K tokens |
| Point de terminaison API | https://inference.net/v1 |
| Variable de clé API | INFERENCE_API_KEY |
| Adaptateur SDK | @ai-sdk/openai-compatible |
| Docs du fournisseur | inference.net ↗ |
Pourquoi faire tourner les agents WorkDaddy sur Inference en 2026
Appels d’outils, taille de contexte et coût décident de la qualité avec laquelle un fournisseur anime une équipe d’agents. Inference apporte 8 modèles à appels d’outils à WorkDaddy — de quoi alimenter la boucle complète d’éditions boutique, de requêtes analytics et de production de contenu — avec 125K tokens de contexte au sommet. WorkDaddy étant agnostique au modèle, routez le raisonnement lourd vers le plus fort modèle de Inference et le travail de masse vers le moins cher.
Meilleurs modèles Inference pour agents e-commerce (2026)
Les vaisseaux amiraux actuels de Inference dans le catalogue WorkDaddy, du plus récent au plus ancien :
Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)
Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)
Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)
Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Comment connecter Inference à WorkDaddy
WorkDaddy dialogue avec Inference sur inference.net via l’adaptateur @ai-sdk/openai-compatible. Ajoutez votre identifiant (généralement INFERENCE_API_KEY) dans Réglages → Modèles, choisissez un modèle par défaut, et chaque agent peut l’utiliser immédiatement.
Modèles phares
| Modèle | Contexte | Raisonnement | Sortie |
|---|---|---|---|
| Google Gemma 3 | 125K | Non | 2025-01-01 |
| Qwen 2.5 7B Vision Instruct | 125K | Non | 2025-01-01 |
| Qwen 3 Embedding 4B | 32K | Non | 2025-01-01 |
| Llama 3.2 1B Instruct | 16K | Non | 2025-01-01 |
| Llama 3.2 3B Instruct | 16K | Non | 2025-01-01 |
| Llama 3.1 8B Instruct | 16K | Non | 2025-01-01 |
Comment ça marche
Connecter
Dans WorkDaddy, ouvrez Réglages → Modèles, choisissez Inference et collez votre clé API (INFERENCE_API_KEY). Pas de clé ? Commencez avec la passerelle gérée.
Mettre les agents au travail
Choisissez Google Gemma 3 ou l’un des 9 modèles disponibles par défaut — les surcharges par agent adaptent le modèle à la tâche.
Relire et valider
La sortie des agents reste en brouillon d’abord quel que soit le modèle : relisez les diffs et validez les actions comme d’habitude.
Questions fréquentes
WorkDaddy prend-il en charge Inference en 2026 ?
Oui — Inference est un fournisseur LLM pris en charge avec 9 modèles au catalogue, connecté avec votre clé API via l’adaptateur @ai-sdk/openai-compatible.
Combien de modèles Inference puis-je utiliser avec WorkDaddy ?
9 modèles sont listés pour Inference, dont 0 modèles de raisonnement et 3 capables de vision.
Quelle fenêtre de contexte offrent les modèles Inference ?
Jusqu’à 125K tokens sur le plus grand modèle — pertinent pour le travail boutique sur dépôt entier et les longs rapports analytics.
Inference est-il le meilleur fournisseur LLM pour agents e-commerce ?
Cela dépend du mix de tâches — Inference appartient au groupe Clouds d’inférence. WorkDaddy étant agnostique au modèle, la réponse pragmatique en 2026 est de combiner les fournisseurs et de router chaque tâche vers le modèle le plus adapté.
À lire ensuite
NovitaAI
Clouds d’inférence
Nvidia
Clouds d’inférence
Venice AI
Clouds d’inférence
DigitalOcean
Clouds d’inférence
Explorer les autres annuaires d’intégrations
Mettez l’équipe au travail sur votre boutique
Connectez votre boutique, vos analytics et votre outil e-mail, fixez un objectif, et laissez les agents exécuter de bout en bout. Le plan gratuit fonctionne avec votre propre clé de modèle.