Cómo ejecutar Claude Cowork y Claude Code con cualquier LLM (GPT, Grok, Gemini, OpenRouter, modelos locales)
La función de inferencia de terceros de Anthropic te permite potenciar el agent harness de Claude con cualquier modelo, sin necesidad de una suscripción de $200/mes
Cómo ejecutar Claude Cowork y Claude Code con cualquier LLM (GPT, Grok, Gemini, OpenRouter, modelos locales)
Anthropic lanzó una función que casi nadie notó: ahora puedes ejecutar Claude Cowork y Claude Code con cualquier LLM que elijas — GPT-5, Grok, Gemini, modelos open-weight a través de OpenRouter, un modelo local en tu portátil o tu gateway empresarial (Bedrock, Vertex AI, Azure AI Foundry). El agent harness, las skills, los plugins, los servidores MCP y los controles de administración siguen intactos. Solo cambia el modelo que está detrás.
Esto abre dos escenarios muy atractivos. Las personas que están alcanzando los límites de uso del plan Max de Claude — o que simplemente no quieren pagar $100–$200/mes — ahora pueden apuntar Cowork a un modelo gratuito de OpenRouter y obtener la experiencia completa del agente a un coste casi nulo. Las empresas que ya operan en Bedrock, Vertex o Foundry pueden desplegar Cowork dentro de su perímetro de cumplimiento existente sin enrutar datos a través de la infraestructura de primera parte de Anthropic.
Esta guía cubre qué es realmente Cowork sobre inferencia de terceros, para quién está pensado, cómo configurarlo paso a paso y cómo resolver los problemas más comunes.

¿Qué es Cowork sobre inferencia de terceros?
Cowork sobre inferencia de terceros (también llamado "Cowork on 3P") es un modo de configuración que sustituye el modelo Claude que impulsa Cowork por cualquier endpoint de API compatible con OpenAI. La documentación oficial de Anthropic presenta tres vías de despliegue:
- Sectores regulados — organizaciones con requisitos de residencia de datos
- Usuarios de gateway empresarial — empresas que ejecutan Claude a través de Amazon Bedrock, Google Cloud Vertex AI o Azure AI Foundry
- Personas en configuraciones piloto o de evaluación — cualquiera que instale Claude Desktop y quiera probar un modelo diferente
Las tres vías comparten el mismo panel de configuración y el mismo conjunto de controles de administración. Todas las funciones de nivel empresarial (límites de tokens por usuario, allowlist de MCP, OpenTelemetry, bloquear actualizaciones automáticas, eliminar herramientas integradas) están disponibles en las tres vías.
OpenRouter también funciona como gateway de LLM — Anthropic no lo menciona en la documentación oficial, pero pruebas independientes lo confirman. Esto significa que cualquier modelo del catálogo de OpenRouter (incluidos muchos modelos gratuitos) puede impulsar el agent harness completo de Cowork.
Aquí tienes una comparación rápida de lo que cambia y lo que permanece igual:
Una nota importante sobre la residencia de datos: Durante esta vista previa de investigación, Claude en Azure AI Foundry todavía enruta a través de la infraestructura de Anthropic. Amazon Bedrock y Google Cloud Vertex AI son las vías que ofrecen residencia de datos completa del lado del proveedor.
¿Quién debería usar esta función?
Dos audiencias distintas se benefician de la inferencia de terceros, y los casos de uso no se solapan demasiado.
Los usuarios individuales son los principales beneficiarios a corto plazo. Si estás alcanzando los límites de uso semanal del plan Max de Claude, quieres evaluar Cowork antes de comprometerte con una suscripción de pago o estás trabajando con un modelo local que contiene código propietario que no puedes enviar a ninguna API externa, Cowork sobre 3P resuelve esos tres problemas. Hoy puedes ejecutar el agent harness completo — incluidas las herramientas de archivos, los servidores MCP, las skills y los plugins — contra un modelo gratuito en OpenRouter.
Los equipos empresariales obtienen algo diferente: la capacidad de mantener Cowork dentro de un perímetro aprobado de proveedor de nube. Si tu organización ya ha aprobado Bedrock, Vertex o Foundry en tu revisión de seguridad, Cowork sobre 3P te permite desplegarlo para los empleados sin abrir un nuevo flujo de datos hacia la infraestructura de primera parte de Anthropic. Los controles de administración (límites de tokens, allowlist de MCP, exportador de OpenTelemetry) funcionan igual, independientemente del proveedor que esté detrás.
Configuración paso a paso
1. Conéctate a OpenRouter
No se necesita servidor proxy. Apuntas Claude Desktop directamente al endpoint de API de OpenRouter.
- Abre Claude Desktop → Menú → Developer → Configure Third-Party Inference
- Establece los siguientes valores:
- Connection: Gateway
- Gateway base URL:
https://openrouter.ai/api - Gateway API key: tu clave API de OpenRouter
- Gateway auth scheme:
x-api-key
- En Sandbox & workspace, configura Allowed egress hosts para que tus agentes puedan acceder a la web. Para permitir todos los sitios, puedes usar una entrada comodín.
- Haz clic en Apply locally → Relaunch now
- Cierra sesión en tu cuenta de Anthropic y luego elige Continue with Gateway
- Verás "Setting up Claude's workspace…" — cuando eso termine, ya puedes empezar a chatear
Para seleccionar tu modelo, usa el identificador del modelo de OpenRouter en el selector de modelos. Un modelo gratuito que funciona de forma fiable para tareas agentic: tencent/hy3-preview:free
Los modelos locales siguen el mismo patrón: enrútalos a través de un proxy compatible con OpenAI, como LiteLLM o el endpoint OpenAI integrado de Ollama.
2. Importa Anthropic Skills
Las configuraciones de OpenRouter vienen con el panel Customize → Skills vacío. Las skills oficiales de Anthropic (docx, pdf, pptx, xlsx, skill-creator) deben instalarse manualmente.
- Descarga el repositorio de Anthropic skills como archivo
.zip - Extrae
skills-main.zip - Comprime individualmente cada carpeta de skill que quieras (por ejemplo, la carpeta
docxse convierte endocx.zip) - En Claude Desktop: Customize → Skills → Create skill → Upload a skill — sube cada
.zip
Un consejo práctico: importa solo las skills que realmente necesites. Cada skill ocupa espacio en la ventana de contexto incluso cuando no se está ejecutando activamente, así que mantener la lista reducida mejora el rendimiento en modelos más pequeños.
3. Importa Anthropic Plugins
El mismo patrón de importación manual se aplica a los plugins. Merece la pena extraer de dos repositorios oficiales:
- Plugins para trabajo de conocimiento (marketing, gestión de producto, legal, finanzas): github.com/anthropics/knowledge-work-plugins
- Plugins de la pestaña Code: github.com/anthropics/claude-plugins-official
Pasos:
- Descarga el repositorio como
.zipy extráelo - Comprime individualmente cada carpeta de plugin que quieras
- En Claude Desktop: Customize → Personal plugins → + → Create plugin → Upload plugin
Empieza con no más de 2–3 plugins. Para muchos flujos de trabajo, cero plugins es la respuesta correcta: los prompts ligeros funcionan mejor en modelos que no son Claude.
4. Configura servidores MCP
Los servidores MCP se ejecutan localmente en tu máquina y se configuran en Settings → Developer.

Las configuraciones MCP se escriben en un archivo dedicado claude_desktop_config.json (si no ves la opción "Local MCP servers", consulta la sección de resolución de problemas más abajo). El registro oficial de servidores MCP está en github.com/modelcontextprotocol/servers.
Como ejemplo, el servidor comunitario mcp-atlassian da a tus agentes acceso tanto a Jira como a Confluence mediante una sola conexión MCP, una configuración empresarial habitual.
5. Gestiona la búsqueda web
OpenRouter no admite la herramienta nativa web_search de Anthropic. Tienes tres opciones:
Opción A — Sustituirla por un servidor MCP de Brave Search (recomendado)
Añade WebSearch a disabledBuiltinTools en tu configuración para que el agente no intente usar la herramienta nativa y luego instala el servidor MCP de Brave. Brave ofrece 2,000 búsquedas gratuitas al mes, o $3 por cada 1,000 adicionales.

Opción B — Cambiar a Vertex AI o Azure AI Foundry
Ambos proveedores admiten de forma nativa la herramienta web_search de Anthropic. Amazon Bedrock todavía no la admite.
Opción C — Esperar
OpenRouter ha comentado la posibilidad de enrutar la herramienta web_search de Anthropic a Perplexity o a un proveedor similar, pero esta capacidad aún no se ha lanzado.
Resolución de problemas
"Configure Third-Party Inference" no aparece en Menú → Developer Actualiza Claude Desktop y reinicia. Luego habilita el modo desarrollador mediante Help → Troubleshooting → Enable Developer Mode. Usuarios de planes corporativos o Team han informado de que este ajuste sigue oculto incluso con el modo desarrollador habilitado — puede estar restringido por plan o sometido a pruebas A/B.
"Local MCP servers" no aparece en Cowork on 3P La misma solución: actualiza Claude Desktop, reinicia y habilita el modo desarrollador.
Los conectores aparecen como "Unavailable" Este es el comportamiento esperado, no un error. La inferencia de terceros significa ejecutar sin la infraestructura de conectores de Anthropic. Los conectores dependen de esa capa. Usa los servidores MCP como sustituto (consulta el paso 4 arriba).
Las llamadas a herramientas no son fiables en modelos que no son Claude La calidad del modelo varía significativamente para tareas agentic. Algunos modelos gestionan correctamente las llamadas MCP de varios pasos; otros fallan en flujos complejos. Si un modelo gratuito no funciona bien para tu flujo de trabajo, prueba un modelo más capaz en el nivel de pago de OpenRouter o cambia a una de las opciones alojadas por el proveedor (Bedrock, Vertex).
La configuración de la pestaña Code no coincide con la de Cowork Este es un problema conocido y reconocido en la documentación de Anthropic: algunas claves de configuración de Cowork on 3P todavía no se propagan de forma idéntica a las sesiones de la pestaña Code. Se espera que esto se resuelva a medida que la función salga de la vista previa de investigación.
Qué indican los controles de administración
El panel de configuración para la inferencia de terceros incluye controles que van mucho más allá de lo que necesitaría un usuario individual:

- Máximo de tokens por ventana (límite flexible por usuario)
- Permitir servidores MCP añadidos por el usuario
- Endpoint del recopilador de OpenTelemetry
- Bloquear actualizaciones automáticas
- Eliminar herramientas integradas de Cowork
Estos son controles de administración empresarial. Combinados con el soporte para Bedrock, Vertex y Foundry, el posicionamiento oficial de Anthropic es explícito: Cowork sobre 3P está diseñado para organizaciones cuyos requisitos de seguridad, normativos o contractuales les impiden enviar datos a la infraestructura de primera parte de Anthropic.
Que se documente la vía individual — no solo como caso extremo — dice mucho sobre la dirección del producto. Claude Desktop está evolucionando hacia una plataforma de agentes gestionada donde el harness (skills, plugins, servidores MCP, subagentes) es el valor central, independientemente del modelo que lo impulse.
Conclusiones clave
Ejecutar Claude Cowork y Claude Code con LLM de terceros ya es una función documentada y compatible, no una solución improvisada. Esto es lo que debes recordar:
- Cualquiera puede usarlo hoy. Instala Claude Desktop, configura OpenRouter como tu gateway y empieza con un modelo gratuito. No se requiere suscripción.
- El agent harness completo funciona. Skills, plugins, servidores MCP y herramientas de archivos funcionan igual, independientemente del modelo que esté detrás.
- Las vías empresariales están bien soportadas. Bedrock y Vertex AI proporcionan residencia de datos completa. Foundry enruta a través de la infraestructura de Anthropic durante la vista previa de investigación actual.
- La búsqueda web requiere una solución alternativa. Sustituye la herramienta nativa por el servidor MCP de Brave o cambia a Vertex/Foundry.
- La calidad del modelo importa para tareas agentic. Los modelos pequeños o gratuitos pueden tener dificultades con llamadas complejas a herramientas de varios pasos. Prueba con tus flujos de trabajo reales antes de comprometerte con un modelo.
La función está en vista previa de investigación, pero la configuración principal es estable y está lista para producción en la mayoría de los casos de uso. Empezar lleva unos diez minutos.
Cowork sobre API de terceros vs. Cowork totalmente open source: ¿cuál es la diferencia?
Cowork sobre inferencia de terceros es un paso importante hacia la flexibilidad de modelos, pero sigue construyéndose sobre el harness propietario de Anthropic. Una alternativa totalmente open source como Eigent adopta una postura arquitectónica diferente, y las diferencias importan según lo que realmente necesites.
La diferencia principal
Claude Cowork sobre inferencia de terceros te permite sustituir el modelo que impulsa la plataforma de agentes de código cerrado de Anthropic. Sigues dependiendo de la aplicación de escritorio de Anthropic, sus formatos de skills y plugins, su infraestructura de sesiones y su ciclo de actualizaciones. El modelo cambia; la plataforma no.
Eigent es la propia plataforma de agentes — open source (Apache 2.0), construida sobre CAMEL-AI y diseñada para ejecutarse por completo en tu máquina. No hay un harness propietario. Cada componente — orquestación, ejecución de herramientas, acceso a archivos, coordinación multiagente — se puede inspeccionar, bifurcar y autoalojar.
Comparación lado a lado
| Dimensión | Claude Cowork sobre API de terceros | Eigent (Open Source) |
|---|---|---|
| Código fuente de la plataforma | Propietario (cerrado) | Open source con licencia Apache 2.0 |
| Flexibilidad de modelo | Cualquier endpoint compatible con OpenAI | Claude, GPT, Gemini, Ollama, cualquier proveedor |
| Infraestructura | Aplicación de escritorio de Anthropic + conectores en la nube | Se ejecuta por completo en tu máquina local |
| Flujo de datos | Los conectores enrutan a través de la infraestructura de Anthropic | Los datos nunca salen de tu máquina |
| Orquestación multiagente | Vista previa de investigación, acceso restringido | Listo para producción mediante CAMEL-AI |
| Skills y plugins | Formato de Anthropic, instalación manual para 3P | Sistema de skills abierto, extensible por la comunidad |
| Servidores MCP | Compatible | Más de 200 herramientas MCP compatibles |
| Controles de administración | Límites de tokens, allowlist, OpenTelemetry | Control completo autogestionado |
| Perímetro de cumplimiento | Bedrock/Vertex para residencia de datos | On-premises, sin dependencia externa |
| Coste | Costes de inferencia de API + Claude Desktop | Gratis (Apache 2.0) + costes de inferencia de API |
| Control de actualizaciones | Bloqueo opcional mediante configuración de administración | Control total — tú posees el binario |
| Personalización | Solo a nivel de configuración | Acceso completo al código fuente, bifurca y amplía |
Cuándo Cowork sobre API de terceros es la opción correcta
Si ya usas Claude Desktop como tu herramienta diaria y quieres extenderlo a modelos que no sean Claude — especialmente por motivos de coste o porque tu organización ya ha aprobado Bedrock o Vertex — Cowork sobre 3P es la ruta con menos fricción. Obtienes la interfaz familiar, los flujos de trabajo existentes y la UX pulida de Anthropic, con un modelo distinto debajo.
También es la opción correcta si dependes de los conectores nativos de Claude (Gmail, Notion, Slack, etc.) y no quieres replicar esa configuración mediante servidores MCP. Esos conectores no funcionan en 3P, pero si tu motivación principal es solo el coste del modelo, y te parece bien reconstruir la búsqueda mediante Brave MCP, la compensación puede valer la pena.
Cuándo Cowork totalmente open source es la opción correcta
Si la soberanía de los datos no es negociable — sectores regulados, bases de código propietarias, lógica de negocio sensible — ejecutar en Eigent elimina la duda por completo. Nada sale de tu máquina. No hay una capa de infraestructura de Anthropic en la que confiar o auditar.
Si necesitas verdadera diversidad de modelos dentro de un solo flujo de trabajo, la arquitectura de Eigent permite asignar distintos LLM a distintos workers en la misma tarea multiagente. Ejecuta Claude Opus para razonamiento complejo, un modelo local de Llama para el análisis de documentos y GPT para revisión de código — todo coordinado por un único orquestador CAMEL-AI.
Y si la extensibilidad importa — construir sobre la plataforma, contribuir a ella o auditar exactamente lo que hace — el open source es la única respuesta honesta. Cowork sobre 3P te da opciones de configuración. Eigent te da el código fuente.
Eigent es una plataforma de IA multiagente gratuita y open source construida sobre CAMEL-AI. Se ejecuta por completo en tu máquina, admite cualquier proveedor de LLM y te ofrece control total sobre tu infraestructura de agentes.
Recent Posts

Alternativa a Cursor (Gratuita y de Código Abierto): El Espacio de Trabajo que Tú Controlas
¿Buscas una alternativa gratuita y de código abierto a Cursor tras la adquisición por SpaceX? Compara costes, autoalojamiento, elección de modelo y residencia de datos, además de una ruta de migración.

Claude Record a Skill: Enseña a Claude grabando tu flujo de trabajo en pantalla
La función Record a skill de Claude convierte una grabación de pantalla en una habilidad reutilizable. Aprende cómo funciona, quién tiene acceso, los pasos de configuración y sus limitaciones.

Cursor Router Explicado: Calidad de Código Frontier a Menor Costo
Cursor Router selecciona automáticamente el mejor modelo para cada solicitud de programación, manteniendo calidad frontier mientras reduce costos. Descubre cómo funciona, sus tres modos y las compensaciones.