Comment exécuter Claude Cowork et Claude Code avec n’importe quel LLM (GPT, Grok, Gemini, OpenRouter, modèles locaux)
La fonctionnalité d’inférence tierce d’Anthropic vous permet d’alimenter le framework d’agent de Claude avec n’importe quel modèle — sans abonnement à 200 $/mois
Comment exécuter Claude Cowork et Claude Code avec n’importe quel LLM (GPT, Grok, Gemini, OpenRouter, modèles locaux)
Anthropic a lancé une fonctionnalité que presque personne n’a remarquée : vous pouvez désormais exécuter Claude Cowork et Claude Code avec n’importe quel LLM de votre choix — GPT-5, Grok, Gemini, des modèles open-weight via OpenRouter, un modèle local sur votre ordinateur portable, ou votre passerelle d’entreprise (Bedrock, Vertex AI, Azure AI Foundry). Le framework d’agent, les skills, les plugins, les serveurs MCP et les contrôles d’administration restent tous en place. Seul le modèle derrière change.
Cela ouvre deux scénarios intéressants. Les particuliers qui atteignent les limites d’utilisation du forfait Max de Claude — ou qui ne veulent tout simplement pas payer 100 à 200 $/mois — peuvent désormais connecter Cowork à un modèle OpenRouter gratuit et obtenir une expérience d’agent complète à coût quasi nul. Les entreprises déjà déployées sur Bedrock, Vertex ou Foundry peuvent exécuter Cowork dans leur périmètre de conformité existant sans faire transiter les données par l’infrastructure first-party d’Anthropic.
Ce guide couvre ce qu’est réellement Cowork sur une inférence tierce, à qui il s’adresse, comment le configurer étape par étape, et comment résoudre les problèmes les plus courants.

Qu’est-ce que Cowork sur une inférence tierce ?
Cowork sur une inférence tierce (également appelé « Cowork on 3P ») est un mode de configuration qui remplace le modèle Claude alimentant Cowork par n’importe quel endpoint d’API compatible OpenAI. La documentation officielle d’Anthropic présente trois voies de déploiement :
- Secteurs réglementés — organisations soumises à des exigences de résidence des données
- Utilisateurs de passerelles d’entreprise — entreprises exécutant Claude via Amazon Bedrock, Google Cloud Vertex AI ou Azure AI Foundry
- Particuliers sur des configurations pilote ou d’évaluation — toute personne installant Claude Desktop et souhaitant essayer un modèle différent
Ces trois voies partagent le même panneau de configuration et le même ensemble de contrôles d’administration. Chaque fonctionnalité de niveau entreprise (plafonds de jetons par utilisateur, allowlist MCP, OpenTelemetry, blocage des mises à jour automatiques, suppression des outils intégrés) est disponible sur les trois.
OpenRouter fonctionne également comme une passerelle LLM — Anthropic ne l’indique pas dans la documentation officielle, mais des tests indépendants le confirment. Cela signifie que n’importe quel modèle du catalogue OpenRouter (y compris de nombreux modèles gratuits) peut alimenter l’ensemble du framework d’agent de Cowork.
Voici une comparaison rapide de ce qui change et de ce qui reste identique :
Note importante sur la résidence des données : Pendant cet aperçu de recherche, Claude sur Azure AI Foundry continue de transiter par l’infrastructure d’Anthropic. Amazon Bedrock et Google Cloud Vertex AI sont les voies qui offrent une résidence complète des données côté fournisseur.
Qui devrait utiliser cette fonctionnalité ?
Deux publics distincts bénéficient de l’inférence tierce, et leurs cas d’usage se recoupent peu.
Les utilisateurs individuels sont les principaux bénéficiaires à court terme. Si vous atteignez les limites d’utilisation hebdomadaires du forfait Max de Claude, souhaitez évaluer Cowork avant de souscrire un abonnement payant, ou travaillez avec un modèle local contenant du code propriétaire que vous ne pouvez envoyer à aucune API externe, Cowork sur 3P résout ces trois problèmes. Vous pouvez exécuter dès aujourd’hui l’intégralité du framework d’agent — y compris les outils de fichiers, les serveurs MCP, les skills et les plugins — avec un modèle gratuit sur OpenRouter.
Les équipes d’entreprise obtiennent autre chose : la possibilité de conserver Cowork à l’intérieur d’un périmètre de fournisseur cloud approuvé. Si votre organisation a déjà validé Bedrock, Vertex ou Foundry via son examen de sécurité, Cowork sur 3P vous permet de le déployer auprès des employés sans ouvrir un nouveau flux de données vers l’infrastructure first-party d’Anthropic. Les contrôles d’administration (plafonds de jetons, allowlist MCP, collecteur OpenTelemetry) fonctionnent de la même manière quel que soit le fournisseur situé en arrière-plan.
Configuration étape par étape
1. Se connecter à OpenRouter
Aucun serveur proxy n’est nécessaire. Vous pointez Claude Desktop directement vers l’endpoint API d’OpenRouter.
- Ouvrez Claude Desktop → Menu → Developer → Configure Third-Party Inference
- Définissez les valeurs suivantes :
- Connection: Gateway
- Gateway base URL:
https://openrouter.ai/api - Gateway API key: votre clé API OpenRouter
- Gateway auth scheme:
x-api-key
- Dans Sandbox & workspace, configurez Allowed egress hosts afin que vos agents puissent accéder au web. Pour autoriser tous les sites, vous pouvez utiliser une entrée générique.
- Cliquez sur Apply locally → Relaunch now
- Déconnectez-vous de votre compte Anthropic, puis choisissez Continue with Gateway
- Vous verrez « Setting up Claude's workspace… » — une fois cette étape terminée, vous pouvez commencer à discuter
Pour sélectionner votre modèle, utilisez l’identifiant de modèle OpenRouter dans le sélecteur de modèle. Un modèle gratuit qui fonctionne de manière fiable pour les tâches agentiques : tencent/hy3-preview:free
Les modèles locaux suivent le même schéma — faites-les passer par un proxy compatible OpenAI tel que LiteLLM ou l’endpoint OpenAI intégré d’Ollama.
2. Importer les Skills Anthropic
Les configurations OpenRouter s’installent avec le panneau Customize → Skills vide. Les skills officiels d’Anthropic (docx, pdf, pptx, xlsx, skill-creator) doivent être installés manuellement.
- Téléchargez le dépôt des skills Anthropic au format
.zip - Extrayez
skills-main.zip - Compressez individuellement chaque dossier de skill que vous souhaitez (par exemple, le dossier
docxdevientdocx.zip) - Dans Claude Desktop : Customize → Skills → Create skill → Upload a skill — importez chaque
.zip
Conseil pratique : n’importez que les skills dont vous avez réellement besoin. Chaque skill occupe de l’espace dans la fenêtre de contexte même lorsqu’il n’est pas actif, donc garder une liste légère améliore les performances sur les modèles plus petits.
3. Importer les plugins Anthropic
Le même schéma d’importation manuelle s’applique aux plugins. Deux dépôts officiels valent la peine d’être récupérés :
- Plugins de travail de connaissance (marketing, gestion de produit, juridique, finance) : github.com/anthropics/knowledge-work-plugins
- Plugins de l’onglet Code : github.com/anthropics/claude-plugins-official
Étapes :
- Téléchargez le dépôt au format
.zipet extrayez-le - Compressez individuellement chaque dossier de plugin que vous souhaitez
- Dans Claude Desktop : Customize → Personal plugins → + → Create plugin → Upload plugin
Commencez avec 2 à 3 plugins maximum. Pour de nombreux workflows, zéro plugin est la bonne réponse — des prompts sobres fonctionnent mieux sur les modèles non-Claude.
4. Configurer les serveurs MCP
Les serveurs MCP s’exécutent localement sur votre machine et se configurent dans Settings → Developer.

Les configurations MCP sont écrites dans un fichier dédié claude_desktop_config.json (si vous ne voyez pas l’option « Local MCP servers », consultez la section de dépannage ci-dessous). Le registre officiel des serveurs MCP se trouve à l’adresse github.com/modelcontextprotocol/servers.
À titre d’exemple, le serveur communautaire mcp-atlassian donne à vos agents l’accès à Jira et Confluence via une seule connexion MCP — une configuration d’entreprise courante.
5. Gérer la recherche web
OpenRouter ne prend pas en charge l’outil natif web_search d’Anthropic. Vous avez trois options :
Option A — Le remplacer par un serveur MCP Brave Search (recommandé)
Ajoutez WebSearch à disabledBuiltinTools dans votre configuration afin que l’agent n’essaie pas d’utiliser l’outil natif, puis installez le serveur Brave MCP. Brave offre 2 000 recherches gratuites par mois, puis 3 $ pour 1 000 recherches supplémentaires.

Option B — Passer à Vertex AI ou Azure AI Foundry
Les deux fournisseurs prennent nativement en charge l’outil web_search d’Anthropic. Amazon Bedrock ne le prend pas encore en charge.
Option C — Attendre
OpenRouter a évoqué le routage de l’outil web_search d’Anthropic vers Perplexity ou un fournisseur similaire, mais cette capacité n’est pas encore disponible.
Dépannage
« Configure Third-Party Inference » est absent de Menu → Developer Mettez à jour Claude Desktop et redémarrez. Activez ensuite le mode développeur via Help → Troubleshooting → Enable Developer Mode. Des utilisateurs sur des forfaits entreprise ou Team ont signalé que ce réglage restait masqué même avec le mode développeur activé — il est peut-être soumis au forfait ou testé en A/B.
« Local MCP servers » n’apparaît pas dans Cowork on 3P Même correction : mettez à jour Claude Desktop, redémarrez et activez le mode développeur.
Les connecteurs apparaissent comme « Unavailable » C’est un comportement attendu, pas un bug. L’inférence tierce signifie fonctionner sans l’infrastructure de connecteurs d’Anthropic. Les connecteurs dépendent de cette couche. Utilisez des serveurs MCP comme remplacement (voir l’étape 4 ci-dessus).
L’appel d’outils est peu fiable sur les modèles non-Claude La qualité des modèles varie fortement pour les tâches agentiques. Certains modèles gèrent proprement les appels MCP multi-étapes ; d’autres échouent sur des flux complexes. Si un modèle gratuit ne fonctionne pas bien pour votre workflow, essayez un modèle plus performant sur l’offre payante d’OpenRouter ou passez à l’une des options hébergées par le fournisseur (Bedrock, Vertex).
Les paramètres de l’onglet Code ne correspondent pas à ceux de Cowork Il s’agit d’un problème connu, signalé dans la documentation d’Anthropic : certaines clés de configuration de Cowork sur 3P ne sont pas encore propagées de manière identique aux sessions de l’onglet Code. Cette situation devrait être corrigée à mesure que la fonctionnalité sortira de l’aperçu de recherche.
Ce que signalent les contrôles d’administration
Le panneau de configuration pour l’inférence tierce inclut des contrôles qui vont bien au-delà des besoins d’un utilisateur individuel :

- Nombre maximal de jetons par fenêtre (plafond souple par utilisateur)
- Autoriser les serveurs MCP ajoutés par l’utilisateur
- Point de terminaison du collecteur OpenTelemetry
- Bloquer les mises à jour automatiques
- Supprimer les outils intégrés de Cowork
Ce sont des contrôles d’administration d’entreprise. Associés à la prise en charge de Bedrock, Vertex et Foundry, le positionnement officiel d’Anthropic est explicite : Cowork sur 3P est conçu pour les organisations dont les exigences de sécurité, de réglementation ou contractuelles empêchent l’envoi de données vers l’infrastructure first-party d’Anthropic.
Le fait que la voie individuelle soit documentée — et pas seulement comme un cas limite — en dit long sur la direction du produit. Claude Desktop évolue vers une plateforme d’agents managée où le framework (skills, plugins, serveurs MCP, sous-agents) constitue la valeur principale, indépendamment du modèle qui l’alimente.
Points clés à retenir
Exécuter Claude Cowork et Claude Code avec des LLM tiers est désormais une fonctionnalité documentée et prise en charge — pas une solution de contournement. Voici l’essentiel à retenir :
- Tout le monde peut l’utiliser aujourd’hui. Installez Claude Desktop, configurez OpenRouter comme passerelle et commencez avec un modèle gratuit. Aucun abonnement requis.
- L’ensemble du framework d’agent fonctionne. Les skills, plugins, serveurs MCP et outils de fichiers fonctionnent tous de la même manière quel que soit le modèle derrière.
- Les voies entreprise sont bien prises en charge. Bedrock et Vertex AI offrent une résidence complète des données. Foundry transite par l’infrastructure d’Anthropic pendant l’aperçu de recherche actuel.
- La recherche web nécessite un contournement. Remplacez l’outil natif par le serveur MCP de Brave ou passez à Vertex/Foundry.
- La qualité du modèle compte pour les tâches agentiques. Les modèles plus petits ou gratuits peuvent avoir du mal avec des appels d’outils multi-étapes complexes. Testez avec vos workflows réels avant de vous engager sur un modèle.
La fonctionnalité est en aperçu de recherche, mais la configuration de base est stable et prête pour la production dans la plupart des cas d’usage. La prise en main prend environ dix minutes.
Cowork sur API tierce vs Cowork entièrement open source : quelle différence ?
Cowork sur inférence tierce est une avancée importante vers la flexibilité des modèles, mais il repose toujours sur le framework propriétaire d’Anthropic. Une alternative entièrement open source comme Eigent adopte une approche architecturale différente — et ces différences comptent selon vos besoins réels.
La distinction fondamentale
Claude Cowork sur inférence tierce vous permet de remplacer le modèle qui alimente la plateforme d’agents fermée d’Anthropic. Vous dépendez toujours de l’application desktop d’Anthropic, de leurs formats de skills et de plugins, de leur infrastructure de session et de leur cycle de mises à jour. Le modèle change ; pas la plateforme.
Eigent est la plateforme d’agents elle-même — open source (Apache 2.0), construite sur CAMEL-AI, et conçue pour s’exécuter entièrement sur votre machine. Il n’y a pas de framework propriétaire. Chaque composant — orchestration, exécution des outils, accès aux fichiers, coordination multi-agents — est inspectable, forkable et auto-hébergeable.
Comparaison côte à côte
| Dimension | Claude Cowork sur API 3P | Eigent (Open Source) |
|---|---|---|
| Code source de la plateforme | Propriétaire (fermé) | Open source Apache 2.0 |
| Flexibilité des modèles | N’importe quel endpoint compatible OpenAI | Claude, GPT, Gemini, Ollama, n’importe quel fournisseur |
| Infrastructure | Application desktop Anthropic + connecteurs cloud | S’exécute entièrement sur votre machine locale |
| Flux de données | Les connecteurs transitent par l’infrastructure d’Anthropic | Les données ne quittent jamais votre machine |
| Orchestration multi-agents | Aperçu de recherche, accès restreint | Prêt pour la production via CAMEL-AI |
| Skills et plugins | Format Anthropic, installation manuelle pour 3P | Système de skills ouvert, extensible par la communauté |
| Serveurs MCP | Pris en charge | Plus de 200 outils MCP pris en charge |
| Contrôles d’administration | Plafonds de jetons, allowlist, OpenTelemetry | Contrôle complet auto-hébergé |
| Périmètre de conformité | Bedrock/Vertex pour la résidence des données | Sur site, sans dépendance externe |
| Coût | Coûts d’inférence API + Claude Desktop | Gratuit (Apache 2.0) + coûts d’inférence API |
| Contrôle des mises à jour | Blocage optionnel via la configuration d’administration | Contrôle total — vous possédez le binaire |
| Personnalisation | Uniquement au niveau de la configuration | Accès complet au code source, fork et extension |
Quand Cowork sur API tierce est le bon choix
Si vous utilisez déjà Claude Desktop au quotidien et souhaitez l’étendre à des modèles non-Claude — surtout pour des raisons de coût ou parce que votre organisation a validé Bedrock ou Vertex — Cowork sur 3P est l’option la moins contraignante. Vous obtenez l’interface familière, les workflows existants et l’UX soignée d’Anthropic, avec un modèle différent en dessous.
C’est aussi le bon choix si vous dépendez des connecteurs natifs de Claude (Gmail, Notion, Slack, etc.) et ne voulez pas reproduire cette configuration via des serveurs MCP. Ces connecteurs ne fonctionnent pas sur 3P, mais si votre motivation principale est simplement le coût du modèle, et que vous êtes prêt à reconstruire la recherche via Brave MCP, le compromis peut en valoir la peine.
Quand Cowork entièrement open source est le bon choix
Si la souveraineté des données n’est pas négociable — secteurs réglementés, bases de code propriétaires, logique métier sensible — exécuter Eigent élimine complètement la question. Rien ne quitte votre machine. Il n’y a aucune couche d’infrastructure Anthropic à faire confiance ou à auditer.
Si vous avez besoin d’une vraie diversité de modèles dans un même workflow, l’architecture d’Eigent permet d’attribuer différents LLM à différents workers dans une même tâche multi-agents. Utilisez Claude Opus pour le raisonnement complexe, un modèle Llama local pour l’analyse de documents et GPT pour la revue de code — le tout coordonné par un orchestrateur CAMEL-AI unique.
Et si l’extensibilité compte — construire sur la plateforme, y contribuer ou auditer exactement ce qu’elle fait — l’open source est la seule réponse honnête. Cowork sur 3P vous donne des paramètres de configuration. Eigent vous donne le code source.
Eigent est une plateforme d’IA multi-agents gratuite et open source construite sur CAMEL-AI. Elle s’exécute entièrement sur votre machine, prend en charge n’importe quel fournisseur LLM et vous donne un contrôle total sur votre infrastructure d’agents.
Recent Posts

Qwen3.8-Max : le modèle de codage à poids ouverts de 2,4 T d’Alibaba
Qwen3.8-Max est le modèle à poids ouverts de 2,4 T d’Alibaba pour le codage et le travail agentique. Découvrez ses caractéristiques, ses tarifs, les faits confirmés et les points à suivre.

Thinking Machines Inkling-Small : un modèle 276B qui surpasse son grand frère
Inkling-Small de Thinking Machines Lab est un MoE open-weights de 276B qui égale Inkling au quart de sa taille. Spécifications, benchmarks, tarifs et enjeux pour les développeurs IA.

Alternative à Augment Code
Comparez les alternatives à Augment Code pour les grandes bases de code selon les tarifs actuels, l’usage mutualisé, la qualité du contexte, l’accès aux sources, l’auto-hébergement, la sécurité et les besoins de l’équipe.