Como Executar Claude Cowork e Claude Code com Qualquer LLM (GPT, Grok, Gemini, OpenRouter, Modelos Locais)
O recurso de inferência de terceiros da Anthropic permite alimentar o agent harness do Claude com qualquer modelo — sem precisar da assinatura de US$ 200/mês
Como Executar Claude Cowork e Claude Code com Qualquer LLM (GPT, Grok, Gemini, OpenRouter, Modelos Locais)
A Anthropic lançou um recurso que quase ninguém notou: agora você pode executar Claude Cowork e Claude Code usando qualquer LLM que você escolher — GPT-5, Grok, Gemini, modelos open-weight via OpenRouter, um modelo local no seu laptop ou seu gateway corporativo (Bedrock, Vertex AI, Azure AI Foundry). O agent harness, os skills, os plugins, os servidores MCP e os controles de administração continuam intactos. Só muda o modelo por trás deles.
Isso abre dois cenários bastante atraentes. Pessoas que estão atingindo os limites semanais do plano Max do Claude — ou que simplesmente não querem pagar US$ 100–US$ 200/mês — agora podem apontar o Cowork para um modelo gratuito no OpenRouter e ter a experiência completa de agentes com custo quase zero. Empresas que já usam Bedrock, Vertex ou Foundry podem implantar o Cowork dentro do perímetro de compliance existente, sem roteamento de dados pela infraestrutura first-party da Anthropic.
Este guia cobre o que é, na prática, o Cowork com inferência de terceiros, para quem ele serve, como configurá-lo passo a passo e como resolver os problemas mais comuns.

O que é Cowork com Inferência de Terceiros?
Cowork com inferência de terceiros (também chamado de "Cowork on 3P") é um modo de configuração que substitui o modelo Claude que alimenta o Cowork por qualquer endpoint de API compatível com OpenAI. A documentação oficial da Anthropic apresenta três caminhos de implantação:
- Setores regulados — organizações com requisitos de residência de dados
- Usuários de gateway corporativo — empresas executando o Claude por meio de Amazon Bedrock, Google Cloud Vertex AI ou Azure AI Foundry
- Pessoas em setups piloto ou de avaliação — qualquer pessoa que instale o Claude Desktop e queira experimentar um modelo diferente
Todos os três caminhos compartilham o mesmo painel de configuração e o mesmo conjunto de controles de administração. Todos os recursos de nível corporativo (limites de tokens por usuário, allowlist de MCP, OpenTelemetry, bloqueio de autoatualizações, remoção de ferramentas встроídas) estão disponíveis nos três caminhos.
O OpenRouter também funciona como um gateway de LLM — a Anthropic não o lista na documentação oficial, mas testes independentes confirmam isso. Isso significa que qualquer modelo no catálogo do OpenRouter (incluindo muitos modelos gratuitos) pode alimentar todo o agent harness do Cowork.
Aqui está uma comparação rápida do que muda e do que permanece igual:
Uma observação importante sobre residência de dados: Durante esta prévia de pesquisa, o Claude no Azure AI Foundry ainda roteia pela infraestrutura da Anthropic. Amazon Bedrock e Google Cloud Vertex AI são os caminhos que oferecem residência de dados completa do lado do provedor.
Quem Deve Usar Este Recurso?
Dois públicos distintos se beneficiam da inferência de terceiros, e os casos de uso não se sobrepõem muito.
Usuários individuais são os principais beneficiados no curto prazo. Se você está atingindo os limites de uso semanal do plano Max do Claude, quer avaliar o Cowork antes de assinar uma assinatura paga ou está trabalhando com um modelo local que contém código proprietário e que você não pode enviar para nenhuma API externa, o Cowork on 3P resolve os três problemas. Você pode executar hoje todo o agent harness — incluindo ferramentas de arquivos, servidores MCP, skills e plugins — contra um modelo gratuito no OpenRouter.
Equipes corporativas ganham outra coisa: a capacidade de manter o Cowork dentro de um limite aprovado do provedor de nuvem. Se a sua organização já aprovou Bedrock, Vertex ou Foundry na revisão de segurança, o Cowork on 3P permite implantar para os funcionários sem abrir um novo fluxo de dados para a infraestrutura first-party da Anthropic. Os controles de administração (limites de tokens, allowlist de MCP, exportador OpenTelemetry) funcionam da mesma forma, independentemente do provedor por trás deles.
Configuração Passo a Passo
1. Conecte ao OpenRouter
Nenhum servidor proxy é necessário. Você aponta o Claude Desktop diretamente para o endpoint de API do OpenRouter.
- Abra o Claude Desktop → Menu → Developer → Configure Third-Party Inference
- Defina os valores a seguir:
- Connection: Gateway
- Gateway base URL:
https://openrouter.ai/api - Gateway API key: sua chave de API do OpenRouter
- Gateway auth scheme:
x-api-key
- Em Sandbox & workspace, configure Allowed egress hosts para que seus agentes possam acessar a web. Para permitir todos os sites, você pode usar uma entrada curinga.
- Clique em Apply locally → Relaunch now
- Saia da sua conta Anthropic e, em seguida, escolha Continue with Gateway
- Você verá "Setting up Claude's workspace…" — assim que isso terminar, você pode começar a conversar
Para selecionar seu modelo, use o identificador do modelo do OpenRouter no seletor de modelos. Um modelo gratuito que funciona de forma confiável para tarefas agentic: tencent/hy3-preview:free
Modelos locais seguem o mesmo padrão — roteie-os por meio de um proxy compatível com OpenAI, como LiteLLM ou o endpoint OpenAI integrado do Ollama.
2. Importe os Skills da Anthropic
As configurações com OpenRouter vêm com o painel Customize → Skills vazio. Os skills oficiais da Anthropic (docx, pdf, pptx, xlsx, skill-creator) precisam ser instalados manualmente.
- Baixe o repositório de skills da Anthropic como um arquivo
.zip - Extraia
skills-main.zip - Compacte individualmente cada pasta de skill que você quiser (por exemplo, a pasta
docxviradocx.zip) - No Claude Desktop: Customize → Skills → Create skill → Upload a skill — faça upload de cada
.zip
Uma dica prática: importe apenas os skills de que você realmente precisa. Cada skill ocupa espaço na janela de contexto mesmo quando não está em execução ativa, então manter a lista enxuta melhora o desempenho em modelos menores.
3. Importe os Plugins da Anthropic
O mesmo padrão de importação manual se aplica aos plugins. Dois repositórios oficiais valem a pena:
- Plugins de trabalho do conhecimento (marketing, gerenciamento de produto, jurídico, finanças): github.com/anthropics/knowledge-work-plugins
- Plugins da aba Code: github.com/anthropics/claude-plugins-official
Etapas:
- Baixe o repositório como um
.zipe extraia-o - Compacte individualmente cada pasta de plugin que você quiser
- No Claude Desktop: Customize → Personal plugins → + → Create plugin → Upload plugin
Comece com no máximo 2–3 plugins. Para muitos fluxos de trabalho, zero plugins é a resposta certa — prompts enxutos funcionam melhor em modelos que não sejam do Claude.
4. Configure os Servidores MCP
Os servidores MCP rodam localmente na sua máquina e são configurados em Settings → Developer.

As configurações MCP são gravadas em um arquivo dedicado claude_desktop_config.json (se você não vir a opção "Local MCP servers", veja a seção de solução de problemas abaixo). O registro oficial de servidores MCP está em github.com/modelcontextprotocol/servers.
Como exemplo, o servidor comunitário mcp-atlassian dá aos seus agentes acesso ao Jira e ao Confluence por meio de uma única conexão MCP — uma configuração corporativa comum.
5. Lidar com a Busca na Web
O OpenRouter não oferece suporte à ferramenta nativa web_search da Anthropic. Você tem três opções:
Opção A — Substituir por um servidor MCP do Brave Search (recomendado)
Adicione WebSearch a disabledBuiltinTools na sua configuração para que o agente não tente usar a ferramenta nativa e, em seguida, instale o servidor MCP do Brave. O Brave oferece 2.000 buscas gratuitas por mês, ou US$ 3 por 1.000 além disso.

Opção B — Mudar para Vertex AI ou Azure AI Foundry
Ambos os provedores oferecem suporte nativo à ferramenta web_search da Anthropic. O Amazon Bedrock ainda não oferece suporte a ela.
Opção C — Aguardar
O OpenRouter discutiu rotear a ferramenta web_search da Anthropic para a Perplexity ou um provedor semelhante, mas esse recurso ainda não foi lançado.
Solução de Problemas
"Configure Third-Party Inference" não aparece em Menu → Developer Atualize o Claude Desktop e reinicie. Depois, ative o modo de desenvolvedor em Help → Troubleshooting → Enable Developer Mode. Usuários em planos corporativos ou Team relataram que essa configuração continua oculta mesmo com o modo de desenvolvedor ativado — isso pode estar bloqueado por plano ou em teste A/B.
"Local MCP servers" não aparece no Cowork on 3P Mesma correção: atualize o Claude Desktop, reinicie e ative o modo de desenvolvedor.
Conectores aparecem como "Unavailable" Esse é o comportamento esperado, não um bug. Inferência de terceiros significa operar sem a infraestrutura de conectores da Anthropic. Os conectores dependem dessa camada. Use servidores MCP como substituição (veja a etapa 4 acima).
A chamada de ferramentas é pouco confiável em modelos que não sejam Claude A qualidade dos modelos varia significativamente para tarefas agentic. Alguns modelos lidam bem com chamadas MCP em várias etapas; outros quebram em fluxos complexos. Se um modelo gratuito não estiver funcionando bem para o seu fluxo, tente um modelo mais capaz no plano pago do OpenRouter ou mude para uma das opções hospedadas pelo provedor (Bedrock, Vertex).
As configurações da aba Code não correspondem às configurações do Cowork Esse é um problema conhecido e reconhecido na documentação da Anthropic: algumas chaves de configuração do Cowork on 3P ainda não são propagadas de forma idêntica para sessões da aba Code. Espere que isso seja resolvido à medida que o recurso sair da prévia de pesquisa.
O que os Controles de Administração IndicAM
O painel de configuração para inferência de terceiros vem com controles que vão muito além do que um usuário individual precisaria:

- Máximo de tokens por janela (limite suave por usuário)
- Permitir servidores MCP adicionados pelo usuário
- Endpoint do coletor OpenTelemetry
- Bloquear autoatualizações
- Remover ferramentas integradas do Cowork
Esses são controles de administração corporativa. Combinados com o suporte a Bedrock, Vertex e Foundry, o enquadramento oficial da Anthropic é explícito: o Cowork on 3P foi projetado para organizações cujos requisitos de segurança, regulamentação ou contrato impedem o envio de dados para a infraestrutura first-party da Anthropic.
O caminho individual sendo documentado — e não apenas um caso extremo — diz algo sobre a direção do produto. O Claude Desktop está evoluindo para uma plataforma de agentes gerenciada, na qual o harness (skills, plugins, servidores MCP, subagentes) é o valor central, independentemente de qual modelo o alimenta.
Principais Conclusões
Executar Claude Cowork e Claude Code com LLMs de terceiros agora é um recurso documentado e suportado — não uma gambiarra. Veja o que lembrar:
- Qualquer pessoa pode usar hoje. Instale o Claude Desktop, configure o OpenRouter como seu gateway e comece com um modelo gratuito. Não é necessária assinatura.
- O agent harness completo funciona. Skills, plugins, servidores MCP e ferramentas de arquivos funcionam da mesma forma, independentemente do modelo por trás deles.
- Os caminhos corporativos são bem suportados. Bedrock e Vertex AI oferecem residência de dados completa. O Foundry roteia pela infraestrutura da Anthropic durante a prévia de pesquisa atual.
- A busca na web requer uma alternativa. Troque a ferramenta nativa pelo servidor MCP do Brave ou mude para Vertex/Foundry.
- A qualidade do modelo importa para tarefas agentic. Modelos menores ou gratuitos podem ter dificuldade com chamadas complexas de ferramentas em várias etapas. Teste com seus fluxos reais antes de se comprometer com um modelo.
O recurso está em prévia de pesquisa, mas a configuração central é estável e pronta para produção na maioria dos casos de uso. Começar leva cerca de dez minutos.
Cowork com API de Terceiros vs. Cowork Totalmente Open Source: Qual é a Diferença?
Cowork com inferência de terceiros é um passo importante rumo à flexibilidade de modelos, mas ainda é construído sobre o harness proprietário da Anthropic. Uma alternativa totalmente open source como Eigent adota uma postura arquitetural diferente — e as diferenças importam dependendo do que você realmente precisa.
A Distinção Central
O Claude Cowork com inferência de terceiros permite trocar o modelo que alimenta a plataforma de agentes closed-source da Anthropic. Você ainda depende do aplicativo desktop da Anthropic, dos formatos de skills e plugins deles, da infraestrutura de sessão deles e do ciclo de atualizações deles. O modelo muda; a plataforma, não.
O Eigent é a própria plataforma de agentes — open source (Apache 2.0), construída em cima do CAMEL-AI e projetada para rodar inteiramente na sua máquina. Não existe harness proprietário. Cada componente — orquestração, execução de ferramentas, acesso a arquivos, coordenação multiagente — é inspecionável, bifurcável e auto-hospedável.
Comparação Lado a Lado
| Dimensão | Claude Cowork com API de 3P | Eigent (Open Source) |
|---|---|---|
| Código-fonte da plataforma | Proprietário (fechado) | Open source Apache 2.0 |
| Flexibilidade de modelo | Qualquer endpoint compatível com OpenAI | Claude, GPT, Gemini, Ollama, qualquer provedor |
| Infraestrutura | App desktop da Anthropic + conectores de nuvem | Roda inteiramente na sua máquina local |
| Fluxo de dados | Conectores roteiam pela infraestrutura da Anthropic | Os dados nunca saem da sua máquina |
| Orquestração multiagente | Prévia de pesquisa, acesso limitado | Pronto para produção via CAMEL-AI |
| Skills e plugins | Formato Anthropic, instalação manual para 3P | Sistema aberto de skills, extensível pela comunidade |
| Servidores MCP | Suportados | Mais de 200 ferramentas MCP suportadas |
| Controles de administração | Limites de tokens, allowlist, OpenTelemetry | Controle total auto-hospedado |
| Perímetro de compliance | Bedrock/Vertex para residência de dados | On-premises, sem dependência externa |
| Custo | Custos de inferência via API + Claude Desktop | Gratuito (Apache 2.0) + custos de inferência via API |
| Controle de atualização | Bloqueio opcional via configuração administrativa | Controle total — você possui o binário |
| Personalização | Apenas no nível de configuração | Acesso total ao código-fonte, faça fork e estenda |
Quando o Cowork com API de Terceiros é a Escolha Certa
Se você já usa o Claude Desktop como seu ambiente principal e quer estendê-lo para modelos que não sejam Claude — especialmente por questões de custo ou porque sua organização já aprovou Bedrock ou Vertex — o Cowork on 3P é o caminho de menor atrito. Você obtém a interface familiar, os fluxos de trabalho existentes e a UX refinada da Anthropic, com um modelo diferente por baixo.
Ele também é a escolha certa se você depende dos conectores nativos do Claude (Gmail, Notion, Slack, etc.) e não quer replicar essa configuração por meio de servidores MCP. Esses conectores não funcionam no 3P, mas se sua motivação principal for apenas o custo do modelo, e você estiver disposto a recriar a busca via Brave MCP, a troca pode valer a pena.
Quando o Cowork Totalmente Open Source é a Escolha Certa
Se soberania de dados é inegociável — setores regulados, bases de código proprietárias, lógica de negócio sensível — rodar no Eigent elimina a dúvida por completo. Nada sai da sua máquina. Não há camada de infraestrutura da Anthropic para confiar ou auditar.
Se você precisa de verdadeira diversidade de modelos dentro de um único fluxo de trabalho, a arquitetura do Eigent permite atribuir diferentes LLMs a diferentes workers na mesma tarefa multiagente. Execute Claude Opus para raciocínio complexo, um modelo local Llama para análise de documentos e GPT para revisão de código — tudo coordenado por um único orquestrador CAMEL-AI.
E se extensibilidade importa — construir em cima da plataforma, contribuir para ela ou auditar exatamente o que ela faz — open source é a única resposta honesta. O Cowork on 3P oferece controles de configuração. O Eigent oferece o código-fonte.
Eigent é uma plataforma de IA multiagente gratuita e open source construída em CAMEL-AI. Ela roda inteiramente na sua máquina, suporta qualquer provedor de LLM e oferece controle total sobre sua infraestrutura de agentes.
Recent Posts

Alternativa ao Cursor (Gratuita e Open Source): O Workspace Que É Seu
Procurando uma alternativa gratuita e open source ao Cursor após a aquisição pela SpaceX? Compare custo, self-hosting, escolha de modelo e residência de dados, além de um caminho de migração.

Claude Record a Skill: Ensine o Claude Gravando Sua Tela de Trabalho
O recurso Record a skill do Claude transforma uma gravação de tela em uma skill reutilizável. Saiba como funciona, quem tem acesso, as etapas de configuração e suas limitações.

Cursor Router Explicado: Qualidade de Código Frontier com Menor Custo
O Cursor Router seleciona automaticamente o melhor modelo para cada requisição de codificação, mantendo qualidade frontier com menor custo. Veja como funciona, seus três modos e os trade-offs envolvidos.