Inference × WorkDaddy: integración de proveedor LLM (2026)
Convierte Inference en el motor de tu equipo de agentes WorkDaddy: 9 modelos disponibles, ventanas de contexto de hasta 125K tokens, conectado en minutos con tu propia clave.
Inference es uno de los 178 proveedores LLM compatibles con la capa de modelos de WorkDaddy en 2026, del grupo Nubes de inferencia. El catálogo lista 9 modelos de Inference: 0 con razonamiento explícito, 3 con entrada de visión y 8 con llamadas a herramientas — la capacidad que más importa para el trabajo agéntico. La mayor ventana de contexto alcanza 125K tokens.
De un vistazo
| Modelos disponibles | 9 |
|---|---|
| Modelos de razonamiento | 0 |
| Modelos con visión | 3 |
| Modelos con llamadas a herramientas | 8 |
| Mayor ventana de contexto | 125K tokens |
| Endpoint de API | https://inference.net/v1 |
| Variable de clave API | INFERENCE_API_KEY |
| Adaptador SDK | @ai-sdk/openai-compatible |
| Documentación del proveedor | inference.net ↗ |
Por qué ejecutar los agentes de WorkDaddy con Inference en 2026
Las llamadas a herramientas, el tamaño de contexto y el coste deciden lo bien que un proveedor impulsa un equipo de agentes. Inference aporta 8 modelos con llamadas a herramientas a WorkDaddy — suficiente para el ciclo completo de ediciones de tienda, consultas de analítica y producción de contenido — con hasta 125K tokens de contexto. Como WorkDaddy es agnóstico al modelo, puedes enrutar el razonamiento pesado al modelo más fuerte de Inference y el trabajo masivo al más barato.
Mejores modelos de Inference para agentes de e-commerce (2026)
Los buques insignia actuales de Inference en el catálogo de WorkDaddy, primero los más nuevos:
Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)
Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)
Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)
Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)
Cómo conectar Inference a WorkDaddy
WorkDaddy habla con Inference en inference.net mediante el adaptador @ai-sdk/openai-compatible. Añade tu credencial (normalmente INFERENCE_API_KEY) en Ajustes → Modelos, elige un modelo por defecto y todos los agentes podrán usarlo de inmediato.
Modelos destacados
| Modelo | Contexto | Razonamiento | Lanzamiento |
|---|---|---|---|
| Google Gemma 3 | 125K | No | 2025-01-01 |
| Qwen 2.5 7B Vision Instruct | 125K | No | 2025-01-01 |
| Qwen 3 Embedding 4B | 32K | No | 2025-01-01 |
| Llama 3.2 1B Instruct | 16K | No | 2025-01-01 |
| Llama 3.2 3B Instruct | 16K | No | 2025-01-01 |
| Llama 3.1 8B Instruct | 16K | No | 2025-01-01 |
Cómo funciona
Conectar
En WorkDaddy, abre Ajustes → Modelos, elige Inference y pega tu clave API (INFERENCE_API_KEY). ¿Sin clave? Empieza con la pasarela gestionada.
Poner a trabajar a los agentes
Elige Google Gemma 3 o cualquiera de los 9 modelos disponibles como predeterminado — las anulaciones por agente ajustan el modelo a la tarea.
Revisar y aprobar
La salida del agente sigue siendo borrador primero sea cual sea el modelo: revisa los diffs y aprueba las acciones como siempre.
Preguntas frecuentes
¿WorkDaddy admite Inference en 2026?
Sí — Inference es un proveedor LLM compatible con 9 modelos en el catálogo de WorkDaddy, conectado con tu clave API mediante el adaptador @ai-sdk/openai-compatible.
¿Cuántos modelos de Inference puedo usar con WorkDaddy?
Hay 9 modelos listados para Inference, incluidos 0 de razonamiento y 3 con visión.
¿Qué ventana de contexto ofrecen los modelos de Inference?
Hasta 125K tokens en el modelo más grande — relevante para trabajar sobre el repositorio completo de la tienda y para informes largos de analítica.
¿Es Inference el mejor proveedor LLM para agentes de e-commerce?
Depende de la mezcla de tareas — Inference pertenece al grupo Nubes de inferencia. Como WorkDaddy es agnóstico al modelo, la respuesta práctica en 2026 es combinar proveedores y enrutar cada tarea al modelo que mejor encaje.
Seguir leyendo
NovitaAI
Nubes de inferencia
Nvidia
Nubes de inferencia
Venice AI
Nubes de inferencia
DigitalOcean
Nubes de inferencia
Explorar más directorios de integraciones
Pon al equipo a trabajar en tu tienda
Conecta tu tienda, tu analítica y tu herramienta de email, marca un objetivo y deja que los agentes ejecuten de principio a fin. El plan gratuito funciona con tu propia clave de modelo.