Jak uruchomić Claude Cowork i Claude Code z dowolnym LLM (GPT, Grok, Gemini, OpenRouter, modele lokalne)
Funkcja inferencji zewnętrznej Anthropic pozwala zasilać agentowy harness Claude dowolnym modelem — bez subskrypcji za 200 USD/miesiąc
Jak uruchomić Claude Cowork i Claude Code z dowolnym LLM (GPT, Grok, Gemini, OpenRouter, modele lokalne)
Anthropic udostępniło funkcję, którą prawie nikt nie zauważył: teraz możesz uruchomić Claude Cowork i Claude Code na dowolnym wybranym LLM — GPT-5, Grok, Gemini, modele open-weight przez OpenRouter, lokalny model na laptopie albo firmową bramę (Bedrock, Vertex AI, Azure AI Foundry). Agentowy harness, skills, plugins, serwery MCP i kontrola administracyjna pozostają bez zmian. Zmienia się tylko model działający pod spodem.
Otwiera to dwa bardzo atrakcyjne scenariusze. Użytkownicy indywidualni, którzy dochodzą do limitów planu Max Claude — albo po prostu nie chcą płacić 100–200 USD/miesiąc — mogą teraz podłączyć Cowork do darmowego modelu w OpenRouter i uzyskać pełne doświadczenie agentowe niemal bez kosztów. Firmy, które już działają na Bedrock, Vertex lub Foundry, mogą wdrożyć Cowork w obrębie istniejącej granicy zgodności bez kierowania danych przez własną infrastrukturę Anthropic.
W tym przewodniku wyjaśniam, czym dokładnie jest Cowork na inferencji zewnętrznej, dla kogo jest przeznaczony, jak go skonfigurować krok po kroku oraz jak rozwiązać najczęstsze problemy.

Czym jest Cowork na inferencji zewnętrznej?
Cowork na inferencji zewnętrznej (nazywany też „Cowork on 3P”) to tryb konfiguracji, który zastępuje model Claude napędzający Cowork dowolnym punktem końcowym API zgodnym z OpenAI. Oficjalna dokumentacja Anthropic wyróżnia trzy ścieżki wdrożenia:
- Branże regulowane — organizacje z wymaganiami dotyczącymi rezydencji danych
- Użytkownicy firmowych bram — firmy uruchamiające Claude przez Amazon Bedrock, Google Cloud Vertex AI lub Azure AI Foundry
- Użytkownicy indywidualni na konfiguracjach pilotażowych lub ewaluacyjnych — każdy, kto instaluje Claude Desktop i chce wypróbować inny model
Wszystkie trzy ścieżki korzystają z tego samego panelu konfiguracji i tego samego zestawu kontroli administracyjnych. Każda funkcja klasy enterprise (limity tokenów na użytkownika, allowlist MCP, OpenTelemetry, blokada automatycznych aktualizacji, usuwanie wbudowanych narzędzi) jest dostępna we wszystkich trzech wariantach.
OpenRouter działa również jako brama LLM — Anthropic nie wymienia go w oficjalnej dokumentacji, ale niezależne testy to potwierdzają. Oznacza to, że dowolny model z katalogu OpenRouter (w tym wiele modeli w darmowej warstwie) może zasilać pełny agentowy harness Cowork.
Oto szybkie porównanie tego, co się zmienia, a co pozostaje bez zmian:
Ważna uwaga dotycząca rezydencji danych: W trakcie tego research preview Claude na Azure AI Foundry nadal kieruje ruch przez infrastrukturę Anthropic. Amazon Bedrock i Google Cloud Vertex AI to ścieżki, które oferują pełną rezydencję danych po stronie dostawcy.
Kto powinien korzystać z tej funkcji?
Z inferencji zewnętrznej korzystają dwie różne grupy odbiorców, a ich zastosowania niewiele się pokrywają.
Użytkownicy indywidualni są głównymi beneficjentami w najbliższym czasie. Jeśli co tydzień osiągasz limity użycia planu Max Claude, chcesz przetestować Cowork przed wykupieniem płatnej subskrypcji albo pracujesz z lokalnym modelem zawierającym kod własnościowy, którego nie możesz wysyłać do żadnego zewnętrznego API, Cowork on 3P rozwiązuje wszystkie trzy problemy. Możesz dziś uruchomić pełny agentowy harness — w tym narzędzia do plików, serwery MCP, skills i plugins — na darmowym modelu w OpenRouter.
Zespoły enterprise dostają coś innego: możliwość utrzymania Cowork wewnątrz zatwierdzonej granicy dostawcy chmurowego. Jeśli Twoja organizacja przeszła już akceptację Bedrock, Vertex lub Foundry w ramach przeglądu bezpieczeństwa, Cowork on 3P pozwala wdrożyć go dla pracowników bez otwierania nowego przepływu danych do własnej infrastruktury Anthropic. Kontrola administracyjna (limity tokenów, allowlist MCP, exporter OpenTelemetry) działa tak samo niezależnie od dostawcy znajdującego się pod spodem.
Konfiguracja krok po kroku
1. Połącz z OpenRouter
Nie jest potrzebny żaden serwer proxy. Wskazujesz Claude Desktop bezpośrednio na punkt końcowy API OpenRouter.
- Otwórz Claude Desktop → Menu → Developer → Configure Third-Party Inference
- Ustaw następujące wartości:
- Connection: Gateway
- Gateway base URL:
https://openrouter.ai/api - Gateway API key: Twój klucz API OpenRouter
- Gateway auth scheme:
x-api-key
- W sekcji Sandbox & workspace skonfiguruj Allowed egress hosts, aby agenci mogli uzyskiwać dostęp do sieci. Aby zezwolić na wszystkie witryny, możesz użyć wpisu z wildcardem.
- Kliknij Apply locally → Relaunch now
- Wyloguj się ze swojego konta Anthropic, a następnie wybierz Continue with Gateway
- Zobaczysz komunikat „Setting up Claude's workspace…” — po zakończeniu możesz zacząć rozmowę
Aby wybrać model, użyj identyfikatora modelu OpenRouter w selektorze modeli. Darmowy model, który dobrze sprawdza się w zadaniach agentowych: tencent/hy3-preview:free
Modele lokalne działają według tego samego schematu — kieruj je przez kompatybilny z OpenAI proxy, taki jak LiteLLM albo wbudowany endpoint OpenAI Ollama.
2. Zaimportuj Anthropic Skills
Konfiguracje OpenRouter mają pusty panel Customize → Skills. Oficjalne skills Anthropic (docx, pdf, pptx, xlsx, skill-creator) trzeba zainstalować ręcznie.
- Pobierz repozytorium Anthropic skills repository jako plik
.zip - Rozpakuj
skills-main.zip - Spakuj osobno każdy folder skills, który chcesz zainstalować (np. folder
docxstaje siędocx.zip) - W Claude Desktop: Customize → Skills → Create skill → Upload a skill — wgraj każdy
.zip
Praktyczna wskazówka: importuj tylko te skills, których naprawdę potrzebujesz. Każdy skill zajmuje miejsce w oknie kontekstu, nawet gdy nie działa aktywnie, więc utrzymywanie krótkiej listy poprawia wydajność na słabszych modelach.
3. Zaimportuj Anthropic Plugins
Ten sam ręczny proces importu dotyczy plugins. Warto pobrać dwa oficjalne repozytoria:
- Knowledge-work plugins (marketing, zarządzanie produktem, prawo, finanse): github.com/anthropics/knowledge-work-plugins
- Code tab plugins: github.com/anthropics/claude-plugins-official
Kroki:
- Pobierz repozytorium jako
.zipi rozpakuj je - Spakuj osobno każdy folder pluginu, który chcesz
- W Claude Desktop: Customize → Personal plugins → + → Create plugin → Upload plugin
Zacznij od nie więcej niż 2–3 plugins. W wielu workflow odpowiedź brzmi: zero plugins — proste prompty działają lepiej na modelach innych niż Claude.
4. Skonfiguruj serwery MCP
Serwery MCP działają lokalnie na Twoim komputerze i są konfigurowane w sekcji Settings → Developer.

Konfiguracje MCP są zapisywane w dedykowanym pliku claude_desktop_config.json (jeśli nie widzisz opcji „Local MCP servers”, zobacz sekcję rozwiązywania problemów poniżej). Oficjalny rejestr serwerów MCP znajduje się pod adresem github.com/modelcontextprotocol/servers.
Na przykład społecznościowy serwer mcp-atlassian daje Twoim agentom dostęp do Jira i Confluence przez jedno połączenie MCP — to częsta konfiguracja enterprise.
5. Obsługa wyszukiwania w sieci
OpenRouter nie obsługuje natywnego narzędzia Anthropic web_search. Masz trzy opcje:
Opcja A — Zastąp je serwerem Brave Search MCP (zalecane)
Dodaj WebSearch do disabledBuiltinTools w swojej konfiguracji, aby agent nie próbował używać natywnego narzędzia, a następnie zainstaluj serwer Brave MCP. Brave oferuje 2 000 darmowych wyszukiwań miesięcznie albo 3 USD za każde 1 000 ponad ten limit.

Opcja B — Przełącz się na Vertex AI lub Azure AI Foundry
Obaj dostawcy natywnie obsługują narzędzie Anthropic web_search. Amazon Bedrock jeszcze tego nie wspiera.
Opcja C — Poczekaj
OpenRouter dyskutował o przekierowaniu narzędzia Anthropic web_search do Perplexity lub podobnego dostawcy, ale ta funkcja nie została jeszcze udostępniona.
Rozwiązywanie problemów
Brakuje opcji „Configure Third-Party Inference” w Menu → Developer Zaktualizuj Claude Desktop i uruchom go ponownie. Następnie włącz tryb deweloperski przez Help → Troubleshooting → Enable Developer Mode. Użytkownicy planów korporacyjnych lub Team zgłaszali, że to ustawienie pozostaje ukryte nawet po włączeniu trybu deweloperskiego — możliwe, że jest zależne od planu albo testowane A/B.
„Local MCP servers” nie pojawia się w Cowork on 3P Ta sama poprawka: zaktualizuj Claude Desktop, uruchom ponownie i włącz tryb deweloperski.
Łączniki pokazują status „Unavailable” To oczekiwane zachowanie, a nie błąd. Inferencja zewnętrzna oznacza pracę bez infrastruktury łączników Anthropic. Łączniki zależą od tej warstwy. Zamiast tego używaj serwerów MCP (zobacz krok 4 powyżej).
Wywoływanie narzędzi jest zawodnie działa na modelach innych niż Claude Jakość modeli znacząco różni się w zadaniach agentowych. Niektóre modele poprawnie obsługują wieloetapowe wywołania MCP; inne zawodzą przy złożonych przepływach. Jeśli darmowy model nie działa dobrze w Twoim workflow, wypróbuj mocniejszy model w płatnej warstwie OpenRouter albo przejdź na jedną z opcji hostowanych przez dostawcę (Bedrock, Vertex).
Ustawienia Code tab nie zgadzają się z ustawieniami Cowork To znany problem opisany w dokumentacji Anthropic: niektóre klucze konfiguracji Cowork on 3P nie propagują się jeszcze identycznie do sesji Code-tab. Należy oczekiwać, że zostanie to naprawione, gdy funkcja wyjdzie z research preview.
Co sygnalizują kontrolki administracyjne
Panel konfiguracji inferencji zewnętrznej zawiera kontrolki, które wykraczają daleko poza potrzeby pojedynczego użytkownika:

- Maksymalna liczba tokenów na okno (miękki limit per użytkownik)
- Zezwalaj na dodawanie własnych serwerów MCP przez użytkowników
- Endpoint kolektora OpenTelemetry
- Blokuj automatyczne aktualizacje
- Usuń wbudowane narzędzia z Cowork
To są administracyjne kontrolki enterprise. W połączeniu ze wsparciem dla Bedrock, Vertex i Foundry oficjalne stanowisko Anthropic jest jasne: Cowork on 3P jest projektowany dla organizacji, których wymagania bezpieczeństwa, regulacyjne lub kontraktowe uniemożliwiają wysyłanie danych do własnej infrastruktury Anthropic.
Fakt, że dokumentowana jest ścieżka dla użytkowników indywidualnych — a nie tylko przypadek brzegowy — mówi wiele o kierunku rozwoju produktu. Claude Desktop ewoluuje w zarządzaną platformę agentową, w której harness (skills, plugins, serwery MCP, sub-agenty) stanowi podstawową wartość, niezależnie od modelu, który go napędza.
Najważniejsze wnioski
Uruchamianie Claude Cowork i Claude Code na zewnętrznych LLM-ach jest teraz udokumentowaną, wspieraną funkcją — nie obejściem. Oto, co warto zapamiętać:
- Każdy może z tego korzystać już dziś. Zainstaluj Claude Desktop, skonfiguruj OpenRouter jako swoją bramę i zacznij od darmowego modelu. Bez subskrypcji.
- Pełny agentowy harness działa. Skills, plugins, serwery MCP i narzędzia do plików działają tak samo niezależnie od modelu działającego pod spodem.
- Ścieżki enterprise są dobrze wspierane. Bedrock i Vertex AI zapewniają pełną rezydencję danych. Foundry podczas obecnego research preview kieruje ruch przez infrastrukturę Anthropic.
- Wyszukiwanie w sieci wymaga obejścia. Zamień natywne narzędzie na serwer MCP Brave albo przełącz się na Vertex/Foundry.
- Jakość modelu ma znaczenie w zadaniach agentowych. Mniejsze lub darmowe modele mogą mieć trudności ze złożonymi, wieloetapowymi wywołaniami narzędzi. Przetestuj je na swoich rzeczywistych workflow, zanim zdecydujesz się na dany model.
Funkcja jest w research preview, ale podstawowa konfiguracja jest stabilna i gotowa do produkcji w większości zastosowań. Rozpoczęcie zajmuje około dziesięciu minut.
Cowork na zewnętrznym API vs. w pełni open-source Cowork: jaka jest różnica?
Cowork na inferencji zewnętrznej to ważny krok w stronę elastyczności modeli, ale nadal jest zbudowany na zastrzeżonym harness Anthropic. W pełni open-source’owa alternatywa, taka jak Eigent, przyjmuje inne podejście architektoniczne — a różnice mają znaczenie w zależności od tego, czego naprawdę potrzebujesz.
Kluczowa różnica
Claude Cowork na inferencji zewnętrznej pozwala podmienić model napędzający zamkniętą platformę agentową Anthropic. Nadal polegasz na desktopowej aplikacji Anthropic, ich formatach skills i plugins, infrastrukturze sesji oraz cyklu aktualizacji. Zmienia się model; platforma pozostaje ta sama.
Eigent to sama platforma agentowa — open source (Apache 2.0), zbudowana na CAMEL-AI i zaprojektowana do działania w całości na Twoim komputerze. Nie ma zastrzeżonego harness. Każdy komponent — orkiestracja, wykonywanie narzędzi, dostęp do plików, koordynacja wieloagentowa — można przejrzeć, rozwidlić i hostować samodzielnie.
Porównanie obok siebie
| Wymiar | Claude Cowork na API 3P | Eigent (Open Source) |
|---|---|---|
| Kod źródłowy platformy | Zastrzeżony (zamknięty) | Open source Apache 2.0 |
| Elastyczność modelu | Dowolny endpoint zgodny z OpenAI | Claude, GPT, Gemini, Ollama, dowolny dostawca |
| Infrastruktura | Aplikacja desktopowa Anthropic + konektory chmurowe | Działa w całości na Twoim komputerze |
| Przepływ danych | Konektory kierują ruch przez infrastrukturę Anthropic | Dane nigdy nie opuszczają Twojego komputera |
| Orkiestracja wieloagentowa | Research preview, dostęp ograniczony | Gotowe do produkcji dzięki CAMEL-AI |
| Skills i plugins | Format Anthropic, ręczna instalacja dla 3P | Otwarty system skills, rozszerzalny przez społeczność |
| Serwery MCP | Obsługiwane | Obsługiwanych ponad 200 narzędzi MCP |
| Kontrola administracyjna | Limity tokenów, allowlist, OpenTelemetry | Pełna kontrola self-hosted |
| Granica zgodności | Bedrock/Vertex dla rezydencji danych | On-premises, bez zależności zewnętrznych |
| Koszt | Koszty inferencji API + Claude Desktop | Darmowe (Apache 2.0) + koszty inferencji API |
| Kontrola aktualizacji | Opcjonalna blokada przez konfigurację administracyjną | Pełna kontrola — binarka należy do Ciebie |
| Personalizacja | Tylko na poziomie konfiguracji | Pełny dostęp do kodu źródłowego, fork i rozbudowa |
Kiedy Cowork na zewnętrznym API jest właściwym wyborem
Jeśli już używasz Claude Desktop na co dzień i chcesz rozszerzyć go na modele inne niż Claude — zwłaszcza ze względów kosztowych albo dlatego, że Twoja organizacja zaakceptowała Bedrock lub Vertex — Cowork on 3P to ścieżka o najmniejszym tarciu. Dostajesz znajomy interfejs, istniejące workflow i dopracowany UX Anthropic, z innym modelem pod spodem.
To także dobry wybór, jeśli polegasz na natywnych łącznikach Claude (Gmail, Notion, Slack itd.) i nie chcesz odtwarzać tej konfiguracji przez serwery MCP. Te łączniki nie działają w 3P, ale jeśli Twoją główną motywacją są po prostu koszty modelu, a nie przeszkadza Ci odbudowanie wyszukiwania przez Brave MCP, kompromis może być tego wart.
Kiedy w pełni open-source’owy Cowork jest właściwym wyborem
Jeśli suwerenność danych jest niepodlegająca negocjacjom — branże regulowane, własnościowe bazy kodu, wrażliwa logika biznesowa — uruchomienie na Eigent usuwa pytanie całkowicie. Nic nie opuszcza Twojego komputera. Nie ma warstwy infrastruktury Anthropic, której trzeba ufać lub którą trzeba audytować.
Jeśli potrzebujesz prawdziwej różnorodności modeli w jednym workflow, architektura Eigent pozwala przypisać różne LLM-y do różnych workerów w tym samym zadaniu wieloagentowym. Uruchom Claude Opus do złożonego rozumowania, lokalny model Llama do parsowania dokumentów i GPT do code review — wszystko koordynowane przez jednego orkiestratora CAMEL-AI.
A jeśli liczy się rozszerzalność — budowanie na platformie, współtworzenie jej lub audyt tego, co dokładnie robi — open source jest jedyną uczciwą odpowiedzią. Cowork on 3P daje Ci pokrętła konfiguracji. Eigent daje Ci kod źródłowy.
Eigent to darmowa, open-source’owa wieloagentowa platforma AI zbudowana na CAMEL-AI. Działa w całości na Twoim komputerze, obsługuje dowolnego dostawcę LLM i daje Ci pełną kontrolę nad infrastrukturą agentową.
Recent Posts

Qwen3.8-Max: model Alibaba do kodowania z otwartymi wagami i 2,4 bln parametrów
Qwen3.8-Max to model Alibaba z otwartymi wagami i 2,4 bln parametrów do kodowania oraz pracy agentowej. Poznaj specyfikację, ceny, potwierdzone fakty i niewiadome.

Thinking Machines Inkling-Small: Model 276B, który bije swojego większego brata
Inkling-Small od Thinking Machines Lab to model MoE 276B z otwartymi wagami, który dorównuje Inkling przy jednej czwartej rozmiaru. Specyfikacja, benchmarki, ceny i znaczenie dla branży.

Alternatywa dla Augment Code
Porównaj alternatywy dla Augment Code w dużych bazach kodu pod względem aktualnych cen, wspólnego użycia, jakości kontekstu, dostępu do źródeł, samodzielnego hostingu, bezpieczeństwa i dopasowania do zespołu.