Inference × WorkDaddy: integración de proveedor LLM (2026)

Convierte Inference en el motor de tu equipo de agentes WorkDaddy: 9 modelos disponibles, ventanas de contexto de hasta 125K tokens, conectado en minutos con tu propia clave.

Inference es uno de los 178 proveedores LLM compatibles con la capa de modelos de WorkDaddy en 2026, del grupo Nubes de inferencia. El catálogo lista 9 modelos de Inference: 0 con razonamiento explícito, 3 con entrada de visión y 8 con llamadas a herramientas — la capacidad que más importa para el trabajo agéntico. La mayor ventana de contexto alcanza 125K tokens.

De un vistazo

Modelos disponibles 9
Modelos de razonamiento 0
Modelos con visión 3
Modelos con llamadas a herramientas 8
Mayor ventana de contexto 125K tokens
Endpoint de API https://inference.net/v1
Variable de clave API INFERENCE_API_KEY
Adaptador SDK @ai-sdk/openai-compatible
Documentación del proveedor inference.net ↗

Por qué ejecutar los agentes de WorkDaddy con Inference en 2026

Las llamadas a herramientas, el tamaño de contexto y el coste deciden lo bien que un proveedor impulsa un equipo de agentes. Inference aporta 8 modelos con llamadas a herramientas a WorkDaddy — suficiente para el ciclo completo de ediciones de tienda, consultas de analítica y producción de contenido — con hasta 125K tokens de contexto. Como WorkDaddy es agnóstico al modelo, puedes enrutar el razonamiento pesado al modelo más fuerte de Inference y el trabajo masivo al más barato.

Mejores modelos de Inference para agentes de e-commerce (2026)

Los buques insignia actuales de Inference en el catálogo de WorkDaddy, primero los más nuevos:

  • Google Gemma 3 — Open Gemma instruction model for efficient chat and self-hosted deployments (125K context)

  • Qwen 2.5 7B Vision Instruct — Qwen vision-language model for visual reasoning, documents, and agent tasks (125K context)

  • Qwen 3 Embedding 4B — Embedding model for semantic search, retrieval, clustering, and ranking pipelines (32K context)

  • Llama 3.2 1B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.2 3B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

  • Llama 3.1 8B Instruct — Open Llama instruction model for multilingual chat, reasoning, and coding (16K context)

Cómo conectar Inference a WorkDaddy

WorkDaddy habla con Inference en inference.net mediante el adaptador @ai-sdk/openai-compatible. Añade tu credencial (normalmente INFERENCE_API_KEY) en Ajustes → Modelos, elige un modelo por defecto y todos los agentes podrán usarlo de inmediato.

Modelos destacados

Modelo Contexto Razonamiento Lanzamiento
Google Gemma 3 125K No 2025-01-01
Qwen 2.5 7B Vision Instruct 125K No 2025-01-01
Qwen 3 Embedding 4B 32K No 2025-01-01
Llama 3.2 1B Instruct 16K No 2025-01-01
Llama 3.2 3B Instruct 16K No 2025-01-01
Llama 3.1 8B Instruct 16K No 2025-01-01

Cómo funciona

01

Conectar

En WorkDaddy, abre Ajustes → Modelos, elige Inference y pega tu clave API (INFERENCE_API_KEY). ¿Sin clave? Empieza con la pasarela gestionada.

02

Poner a trabajar a los agentes

Elige Google Gemma 3 o cualquiera de los 9 modelos disponibles como predeterminado — las anulaciones por agente ajustan el modelo a la tarea.

03

Revisar y aprobar

La salida del agente sigue siendo borrador primero sea cual sea el modelo: revisa los diffs y aprueba las acciones como siempre.

Preguntas frecuentes

¿WorkDaddy admite Inference en 2026?

Sí — Inference es un proveedor LLM compatible con 9 modelos en el catálogo de WorkDaddy, conectado con tu clave API mediante el adaptador @ai-sdk/openai-compatible.

¿Cuántos modelos de Inference puedo usar con WorkDaddy?

Hay 9 modelos listados para Inference, incluidos 0 de razonamiento y 3 con visión.

¿Qué ventana de contexto ofrecen los modelos de Inference?

Hasta 125K tokens en el modelo más grande — relevante para trabajar sobre el repositorio completo de la tienda y para informes largos de analítica.

¿Es Inference el mejor proveedor LLM para agentes de e-commerce?

Depende de la mezcla de tareas — Inference pertenece al grupo Nubes de inferencia. Como WorkDaddy es agnóstico al modelo, la respuesta práctica en 2026 es combinar proveedores y enrutar cada tarea al modelo que mejor encaje.

Pon al equipo a trabajar en tu tienda

Conecta tu tienda, tu analítica y tu herramienta de email, marca un objetivo y deja que los agentes ejecuten de principio a fin. El plan gratuito funciona con tu propia clave de modelo.