logo
  • Environnements
  • Entreprise
  • Tarifs
Blogs
Apr 27, 2026

Comment exécuter Claude Cowork et Claude Code avec n’importe quel LLM (GPT, Grok, Gemini, OpenRouter, modèles locaux)

La fonctionnalité d’inférence tierce d’Anthropic vous permet d’alimenter le framework d’agent de Claude avec n’importe quel modèle — sans abonnement à 200 $/mois

Douglas LaiDouglas Lai
Share to
Comment exécuter Claude Cowork et Claude Code avec n’importe quel LLM (GPT, Grok, Gemini, OpenRouter, modèles locaux)
  • Comment exécuter Claude Cowork et Claude Code avec n’importe quel LLM (GPT, Grok, Gemini, OpenRouter, modèles locaux)
  • Qu’est-ce que Cowork sur une inférence tierce ?
  • Qui devrait utiliser cette fonctionnalité ?
  • Configuration étape par étape
  • Dépannage
  • Ce que signalent les contrôles d’administration
  • Points clés à retenir
  • Cowork sur API tierce vs Cowork entièrement open source : quelle différence ?
Automate Everything with
AI Workforce on Desktop
Download Eigent

Comment exécuter Claude Cowork et Claude Code avec n’importe quel LLM (GPT, Grok, Gemini, OpenRouter, modèles locaux)

Anthropic a lancé une fonctionnalité que presque personne n’a remarquée : vous pouvez désormais exécuter Claude Cowork et Claude Code avec n’importe quel LLM de votre choix — GPT-5, Grok, Gemini, des modèles open-weight via OpenRouter, un modèle local sur votre ordinateur portable, ou votre passerelle d’entreprise (Bedrock, Vertex AI, Azure AI Foundry). Le framework d’agent, les skills, les plugins, les serveurs MCP et les contrôles d’administration restent tous en place. Seul le modèle derrière change.

Cela ouvre deux scénarios intéressants. Les particuliers qui atteignent les limites d’utilisation du forfait Max de Claude — ou qui ne veulent tout simplement pas payer 100 à 200 $/mois — peuvent désormais connecter Cowork à un modèle OpenRouter gratuit et obtenir une expérience d’agent complète à coût quasi nul. Les entreprises déjà déployées sur Bedrock, Vertex ou Foundry peuvent exécuter Cowork dans leur périmètre de conformité existant sans faire transiter les données par l’infrastructure first-party d’Anthropic.

Ce guide couvre ce qu’est réellement Cowork sur une inférence tierce, à qui il s’adresse, comment le configurer étape par étape, et comment résoudre les problèmes les plus courants.

Claude Cowork running with Third Party gateway

Qu’est-ce que Cowork sur une inférence tierce ?

Cowork sur une inférence tierce (également appelé « Cowork on 3P ») est un mode de configuration qui remplace le modèle Claude alimentant Cowork par n’importe quel endpoint d’API compatible OpenAI. La documentation officielle d’Anthropic présente trois voies de déploiement :

  • Secteurs réglementés — organisations soumises à des exigences de résidence des données
  • Utilisateurs de passerelles d’entreprise — entreprises exécutant Claude via Amazon Bedrock, Google Cloud Vertex AI ou Azure AI Foundry
  • Particuliers sur des configurations pilote ou d’évaluation — toute personne installant Claude Desktop et souhaitant essayer un modèle différent

Ces trois voies partagent le même panneau de configuration et le même ensemble de contrôles d’administration. Chaque fonctionnalité de niveau entreprise (plafonds de jetons par utilisateur, allowlist MCP, OpenTelemetry, blocage des mises à jour automatiques, suppression des outils intégrés) est disponible sur les trois.

OpenRouter fonctionne également comme une passerelle LLM — Anthropic ne l’indique pas dans la documentation officielle, mais des tests indépendants le confirment. Cela signifie que n’importe quel modèle du catalogue OpenRouter (y compris de nombreux modèles gratuits) peut alimenter l’ensemble du framework d’agent de Cowork.

Voici une comparaison rapide de ce qui change et de ce qui reste identique :

Claude Desktop vs. comparaison de Cowork sur passerelle 3P

Note importante sur la résidence des données : Pendant cet aperçu de recherche, Claude sur Azure AI Foundry continue de transiter par l’infrastructure d’Anthropic. Amazon Bedrock et Google Cloud Vertex AI sont les voies qui offrent une résidence complète des données côté fournisseur.

Qui devrait utiliser cette fonctionnalité ?

Deux publics distincts bénéficient de l’inférence tierce, et leurs cas d’usage se recoupent peu.

Les utilisateurs individuels sont les principaux bénéficiaires à court terme. Si vous atteignez les limites d’utilisation hebdomadaires du forfait Max de Claude, souhaitez évaluer Cowork avant de souscrire un abonnement payant, ou travaillez avec un modèle local contenant du code propriétaire que vous ne pouvez envoyer à aucune API externe, Cowork sur 3P résout ces trois problèmes. Vous pouvez exécuter dès aujourd’hui l’intégralité du framework d’agent — y compris les outils de fichiers, les serveurs MCP, les skills et les plugins — avec un modèle gratuit sur OpenRouter.

Les équipes d’entreprise obtiennent autre chose : la possibilité de conserver Cowork à l’intérieur d’un périmètre de fournisseur cloud approuvé. Si votre organisation a déjà validé Bedrock, Vertex ou Foundry via son examen de sécurité, Cowork sur 3P vous permet de le déployer auprès des employés sans ouvrir un nouveau flux de données vers l’infrastructure first-party d’Anthropic. Les contrôles d’administration (plafonds de jetons, allowlist MCP, collecteur OpenTelemetry) fonctionnent de la même manière quel que soit le fournisseur situé en arrière-plan.

Configuration étape par étape

1. Se connecter à OpenRouter

Aucun serveur proxy n’est nécessaire. Vous pointez Claude Desktop directement vers l’endpoint API d’OpenRouter.

  1. Ouvrez Claude Desktop → Menu → Developer → Configure Third-Party Inference
  2. Définissez les valeurs suivantes :
    • Connection: Gateway
    • Gateway base URL: https://openrouter.ai/api
    • Gateway API key: votre clé API OpenRouter
    • Gateway auth scheme: x-api-key
  3. Dans Sandbox & workspace, configurez Allowed egress hosts afin que vos agents puissent accéder au web. Pour autoriser tous les sites, vous pouvez utiliser une entrée générique.
  4. Cliquez sur Apply locally → Relaunch now
  5. Déconnectez-vous de votre compte Anthropic, puis choisissez Continue with Gateway
  6. Vous verrez « Setting up Claude's workspace… » — une fois cette étape terminée, vous pouvez commencer à discuter

Pour sélectionner votre modèle, utilisez l’identifiant de modèle OpenRouter dans le sélecteur de modèle. Un modèle gratuit qui fonctionne de manière fiable pour les tâches agentiques : tencent/hy3-preview:free

Les modèles locaux suivent le même schéma — faites-les passer par un proxy compatible OpenAI tel que LiteLLM ou l’endpoint OpenAI intégré d’Ollama.

2. Importer les Skills Anthropic

Les configurations OpenRouter s’installent avec le panneau Customize → Skills vide. Les skills officiels d’Anthropic (docx, pdf, pptx, xlsx, skill-creator) doivent être installés manuellement.

  1. Téléchargez le dépôt des skills Anthropic au format .zip
  2. Extrayez skills-main.zip
  3. Compressez individuellement chaque dossier de skill que vous souhaitez (par exemple, le dossier docx devient docx.zip)
  4. Dans Claude Desktop : Customize → Skills → Create skill → Upload a skill — importez chaque .zip

Conseil pratique : n’importez que les skills dont vous avez réellement besoin. Chaque skill occupe de l’espace dans la fenêtre de contexte même lorsqu’il n’est pas actif, donc garder une liste légère améliore les performances sur les modèles plus petits.

3. Importer les plugins Anthropic

Le même schéma d’importation manuelle s’applique aux plugins. Deux dépôts officiels valent la peine d’être récupérés :

  • Plugins de travail de connaissance (marketing, gestion de produit, juridique, finance) : github.com/anthropics/knowledge-work-plugins
  • Plugins de l’onglet Code : github.com/anthropics/claude-plugins-official

Étapes :

  1. Téléchargez le dépôt au format .zip et extrayez-le
  2. Compressez individuellement chaque dossier de plugin que vous souhaitez
  3. Dans Claude Desktop : Customize → Personal plugins → + → Create plugin → Upload plugin

Commencez avec 2 à 3 plugins maximum. Pour de nombreux workflows, zéro plugin est la bonne réponse — des prompts sobres fonctionnent mieux sur les modèles non-Claude.

4. Configurer les serveurs MCP

Les serveurs MCP s’exécutent localement sur votre machine et se configurent dans Settings → Developer.

Configuring MCP servers in Claude Cowork on a third-party gateway

Les configurations MCP sont écrites dans un fichier dédié claude_desktop_config.json (si vous ne voyez pas l’option « Local MCP servers », consultez la section de dépannage ci-dessous). Le registre officiel des serveurs MCP se trouve à l’adresse github.com/modelcontextprotocol/servers.

À titre d’exemple, le serveur communautaire mcp-atlassian donne à vos agents l’accès à Jira et Confluence via une seule connexion MCP — une configuration d’entreprise courante.

5. Gérer la recherche web

OpenRouter ne prend pas en charge l’outil natif web_search d’Anthropic. Vous avez trois options :

Option A — Le remplacer par un serveur MCP Brave Search (recommandé) Ajoutez WebSearch à disabledBuiltinTools dans votre configuration afin que l’agent n’essaie pas d’utiliser l’outil natif, puis installez le serveur Brave MCP. Brave offre 2 000 recherches gratuites par mois, puis 3 $ pour 1 000 recherches supplémentaires.

Recherche web dans Cowork sur une passerelle tierce avec Brave MCP

Option B — Passer à Vertex AI ou Azure AI Foundry Les deux fournisseurs prennent nativement en charge l’outil web_search d’Anthropic. Amazon Bedrock ne le prend pas encore en charge.

Option C — Attendre OpenRouter a évoqué le routage de l’outil web_search d’Anthropic vers Perplexity ou un fournisseur similaire, mais cette capacité n’est pas encore disponible.

Dépannage

« Configure Third-Party Inference » est absent de Menu → Developer Mettez à jour Claude Desktop et redémarrez. Activez ensuite le mode développeur via Help → Troubleshooting → Enable Developer Mode. Des utilisateurs sur des forfaits entreprise ou Team ont signalé que ce réglage restait masqué même avec le mode développeur activé — il est peut-être soumis au forfait ou testé en A/B.

« Local MCP servers » n’apparaît pas dans Cowork on 3P Même correction : mettez à jour Claude Desktop, redémarrez et activez le mode développeur.

Les connecteurs apparaissent comme « Unavailable » C’est un comportement attendu, pas un bug. L’inférence tierce signifie fonctionner sans l’infrastructure de connecteurs d’Anthropic. Les connecteurs dépendent de cette couche. Utilisez des serveurs MCP comme remplacement (voir l’étape 4 ci-dessus).

L’appel d’outils est peu fiable sur les modèles non-Claude La qualité des modèles varie fortement pour les tâches agentiques. Certains modèles gèrent proprement les appels MCP multi-étapes ; d’autres échouent sur des flux complexes. Si un modèle gratuit ne fonctionne pas bien pour votre workflow, essayez un modèle plus performant sur l’offre payante d’OpenRouter ou passez à l’une des options hébergées par le fournisseur (Bedrock, Vertex).

Les paramètres de l’onglet Code ne correspondent pas à ceux de Cowork Il s’agit d’un problème connu, signalé dans la documentation d’Anthropic : certaines clés de configuration de Cowork sur 3P ne sont pas encore propagées de manière identique aux sessions de l’onglet Code. Cette situation devrait être corrigée à mesure que la fonctionnalité sortira de l’aperçu de recherche.

Ce que signalent les contrôles d’administration

Le panneau de configuration pour l’inférence tierce inclut des contrôles qui vont bien au-delà des besoins d’un utilisateur individuel :

Admin telemetry controls in Cowork on third-party gateway

  • Nombre maximal de jetons par fenêtre (plafond souple par utilisateur)
  • Autoriser les serveurs MCP ajoutés par l’utilisateur
  • Point de terminaison du collecteur OpenTelemetry
  • Bloquer les mises à jour automatiques
  • Supprimer les outils intégrés de Cowork

Ce sont des contrôles d’administration d’entreprise. Associés à la prise en charge de Bedrock, Vertex et Foundry, le positionnement officiel d’Anthropic est explicite : Cowork sur 3P est conçu pour les organisations dont les exigences de sécurité, de réglementation ou contractuelles empêchent l’envoi de données vers l’infrastructure first-party d’Anthropic.

Le fait que la voie individuelle soit documentée — et pas seulement comme un cas limite — en dit long sur la direction du produit. Claude Desktop évolue vers une plateforme d’agents managée où le framework (skills, plugins, serveurs MCP, sous-agents) constitue la valeur principale, indépendamment du modèle qui l’alimente.

Points clés à retenir

Exécuter Claude Cowork et Claude Code avec des LLM tiers est désormais une fonctionnalité documentée et prise en charge — pas une solution de contournement. Voici l’essentiel à retenir :

  • Tout le monde peut l’utiliser aujourd’hui. Installez Claude Desktop, configurez OpenRouter comme passerelle et commencez avec un modèle gratuit. Aucun abonnement requis.
  • L’ensemble du framework d’agent fonctionne. Les skills, plugins, serveurs MCP et outils de fichiers fonctionnent tous de la même manière quel que soit le modèle derrière.
  • Les voies entreprise sont bien prises en charge. Bedrock et Vertex AI offrent une résidence complète des données. Foundry transite par l’infrastructure d’Anthropic pendant l’aperçu de recherche actuel.
  • La recherche web nécessite un contournement. Remplacez l’outil natif par le serveur MCP de Brave ou passez à Vertex/Foundry.
  • La qualité du modèle compte pour les tâches agentiques. Les modèles plus petits ou gratuits peuvent avoir du mal avec des appels d’outils multi-étapes complexes. Testez avec vos workflows réels avant de vous engager sur un modèle.

La fonctionnalité est en aperçu de recherche, mais la configuration de base est stable et prête pour la production dans la plupart des cas d’usage. La prise en main prend environ dix minutes.


Cowork sur API tierce vs Cowork entièrement open source : quelle différence ?

Cowork sur inférence tierce est une avancée importante vers la flexibilité des modèles, mais il repose toujours sur le framework propriétaire d’Anthropic. Une alternative entièrement open source comme Eigent adopte une approche architecturale différente — et ces différences comptent selon vos besoins réels.

La distinction fondamentale

Claude Cowork sur inférence tierce vous permet de remplacer le modèle qui alimente la plateforme d’agents fermée d’Anthropic. Vous dépendez toujours de l’application desktop d’Anthropic, de leurs formats de skills et de plugins, de leur infrastructure de session et de leur cycle de mises à jour. Le modèle change ; pas la plateforme.

Eigent est la plateforme d’agents elle-même — open source (Apache 2.0), construite sur CAMEL-AI, et conçue pour s’exécuter entièrement sur votre machine. Il n’y a pas de framework propriétaire. Chaque composant — orchestration, exécution des outils, accès aux fichiers, coordination multi-agents — est inspectable, forkable et auto-hébergeable.

Comparaison côte à côte

DimensionClaude Cowork sur API 3PEigent (Open Source)
Code source de la plateformePropriétaire (fermé)Open source Apache 2.0
Flexibilité des modèlesN’importe quel endpoint compatible OpenAIClaude, GPT, Gemini, Ollama, n’importe quel fournisseur
InfrastructureApplication desktop Anthropic + connecteurs cloudS’exécute entièrement sur votre machine locale
Flux de donnéesLes connecteurs transitent par l’infrastructure d’AnthropicLes données ne quittent jamais votre machine
Orchestration multi-agentsAperçu de recherche, accès restreintPrêt pour la production via CAMEL-AI
Skills et pluginsFormat Anthropic, installation manuelle pour 3PSystème de skills ouvert, extensible par la communauté
Serveurs MCPPris en chargePlus de 200 outils MCP pris en charge
Contrôles d’administrationPlafonds de jetons, allowlist, OpenTelemetryContrôle complet auto-hébergé
Périmètre de conformitéBedrock/Vertex pour la résidence des donnéesSur site, sans dépendance externe
CoûtCoûts d’inférence API + Claude DesktopGratuit (Apache 2.0) + coûts d’inférence API
Contrôle des mises à jourBlocage optionnel via la configuration d’administrationContrôle total — vous possédez le binaire
PersonnalisationUniquement au niveau de la configurationAccès complet au code source, fork et extension

Quand Cowork sur API tierce est le bon choix

Si vous utilisez déjà Claude Desktop au quotidien et souhaitez l’étendre à des modèles non-Claude — surtout pour des raisons de coût ou parce que votre organisation a validé Bedrock ou Vertex — Cowork sur 3P est l’option la moins contraignante. Vous obtenez l’interface familière, les workflows existants et l’UX soignée d’Anthropic, avec un modèle différent en dessous.

C’est aussi le bon choix si vous dépendez des connecteurs natifs de Claude (Gmail, Notion, Slack, etc.) et ne voulez pas reproduire cette configuration via des serveurs MCP. Ces connecteurs ne fonctionnent pas sur 3P, mais si votre motivation principale est simplement le coût du modèle, et que vous êtes prêt à reconstruire la recherche via Brave MCP, le compromis peut en valoir la peine.

Quand Cowork entièrement open source est le bon choix

Si la souveraineté des données n’est pas négociable — secteurs réglementés, bases de code propriétaires, logique métier sensible — exécuter Eigent élimine complètement la question. Rien ne quitte votre machine. Il n’y a aucune couche d’infrastructure Anthropic à faire confiance ou à auditer.

Si vous avez besoin d’une vraie diversité de modèles dans un même workflow, l’architecture d’Eigent permet d’attribuer différents LLM à différents workers dans une même tâche multi-agents. Utilisez Claude Opus pour le raisonnement complexe, un modèle Llama local pour l’analyse de documents et GPT pour la revue de code — le tout coordonné par un orchestrateur CAMEL-AI unique.

Et si l’extensibilité compte — construire sur la plateforme, y contribuer ou auditer exactement ce qu’elle fait — l’open source est la seule réponse honnête. Cowork sur 3P vous donne des paramètres de configuration. Eigent vous donne le code source.


Eigent est une plateforme d’IA multi-agents gratuite et open source construite sur CAMEL-AI. Elle s’exécute entièrement sur votre machine, prend en charge n’importe quel fournisseur LLM et vous donne un contrôle total sur votre infrastructure d’agents.

Recent Posts

Qwen3.8-Max : le modèle de codage à poids ouverts de 2,4 T d’Alibaba
Aug 4, 2026

Qwen3.8-Max : le modèle de codage à poids ouverts de 2,4 T d’Alibaba

Qwen3.8-Max est le modèle à poids ouverts de 2,4 T d’Alibaba pour le codage et le travail agentique. Découvrez ses caractéristiques, ses tarifs, les faits confirmés et les points à suivre.

EigentEigent
Thinking Machines Inkling-Small : un modèle 276B qui surpasse son grand frère
Aug 4, 2026

Thinking Machines Inkling-Small : un modèle 276B qui surpasse son grand frère

Inkling-Small de Thinking Machines Lab est un MoE open-weights de 276B qui égale Inkling au quart de sa taille. Spécifications, benchmarks, tarifs et enjeux pour les développeurs IA.

EigentEigent
Alternative à Augment Code
Aug 3, 2026

Alternative à Augment Code

Comparez les alternatives à Augment Code pour les grandes bases de code selon les tarifs actuels, l’usage mutualisé, la qualité du contexte, l’accès aux sources, l’auto-hébergement, la sécurité et les besoins de l’équipe.

Douglas LaiDouglas Lai
Automate everything with AI workforce on desktop
Download Eigent

Essayez Eigent dès aujourd’hui

Téléchargez l’application de bureau open source. Votre workforce IA, exécutée sur votre machine.

Télécharger Eigent
Eigent

Recevez les dernières mises à jour, tutoriels et versions sur l’automatisation de la workforce IA.

ProduitEigentEnvironnementsTarifsEntreprise
ExplorerSolutionsCas d’usageCompétencesPluginsBlogs
DéveloppeursDocumentationGitHubCAMEL-AIOpen Source FundPartenaire
TéléchargementPour open source
EntrepriseÀ propos de nousMarqueCarrièresConditions d’utilisationPolitique de confidentialitéSécurité et confiancePolitique relative aux cookiesPolitique de remboursement et d’essai

Tous droits réservés © 2026 EIGENT UK LTD

Nouvelle version d’Eigent 1.0 publiée !download