Agent do kodu w firmie: dane, bezpieczeństwo i licencje
Czy dostawca uczy modele na kodzie firmy, jak długo go trzyma, gdzie są serwery i kto odpowiada za prawa autorskie. Fakty z polityk pięciu dostawców.

👁 118 przeczytań
- Na kontach firmowych (Team, Business, Enterprise, API) żaden z pięciu dostawców nie trenuje modeli na kodzie klienta domyślnie, w przeciwieństwie do kont prywatnych.
- Ochronę przed roszczeniami o prawa autorskie oferują tylko plany płatne i tylko gdy filtry są włączone, a wygenerowany kod nie został zmodyfikowany.
- Rezydencję danych w UE zapewnia OpenAI dla planów Enterprise i API oraz Anthropic wyłącznie przez Amazon Bedrock lub Google Cloud z dopłatą 10%.
Agent AI do kodu w firmie czyta całe repozytorium, wysyła jego fragmenty do dostawcy modelu i wykonuje polecenia z uprawnieniami osoby, która go uruchomiła. Zanim zespół zacznie z niego korzystać, trzeba odpowiedzieć na trzy pytania: czy dostawca uczy modele na naszym kodzie, jak długo go przechowuje i kto odpowiada, gdy wygenerowany kod narusza cudze prawa. Poniżej odpowiedzi z polityk Anthropic, OpenAI, GitHuba, Cursora i Factory, stan na 25 września 2026. To nie jest porada prawna, tylko zestawienie tego, co dostawcy sami deklarują.
W skrócie
Na kontach firmowych (Team, Business, Enterprise, API) żaden z pięciu dostawców nie uczy modeli na kodzie klienta domyślnie. Na kontach prywatnych zależy to od ustawienia użytkownika. Dlatego pierwsza zasada brzmi: kod firmy nigdy nie idzie przez prywatne konto programisty. Ochronę przed roszczeniami o prawa autorskie dają tylko plany płatne i tylko pod warunkami: u GitHuba wyłącznie Business i Enterprise z włączonym filtrem kodu publicznego, u OpenAI i Anthropic z wyłączeniem kodu zmodyfikowanego. Rezydencję danych w UE ma OpenAI dla Enterprise i API, Anthropic tylko przez AWS albo Google Cloud.
Konto firmowe, nie prywatne
Największe ryzyko nie jest w polityce dostawcy, tylko w tym, przez które konto idzie kod. Polityki firmowe i prywatne tego samego dostawcy różnią się zasadniczo. OpenAI podaje w centrum pomocy, że na indywidualnych planach ChatGPT treści z Codex mogą być użyte do trenowania modeli, chyba że użytkownik to wyłączy, a Codex ma do tego osobny przełącznik, którego ustawienia czatu nie zmieniają. Anthropic na planach konsumenckich (Free, Pro, Max) używa czatów i sesji kodowania do ulepszania modeli tylko wtedy, gdy użytkownik na to pozwoli w ustawieniach prywatności, ale każde zgłoszenie opinii (kciuk w górę lub w dół) trafia do Anthropic razem z całą rozmową na okres do 5 lat.
Programista, który uruchamia Claude Code albo Codex na własnym abonamencie, przenosi kod firmy pod zasady konsumenckie, poza kontrolą administratora. Rozwiązaniem jest przypisanie narzędzia do konta firmowego, zanim ktokolwiek wpisze pierwsze polecenie.
Co deklarują dostawcy
| Dostawca | Trening na kodzie firmy | Przechowywanie i ZDR | Rezydencja danych | Prawa do kodu i ochrona przed roszczeniami |
|---|---|---|---|---|
| Anthropic (Claude Code w Team, Enterprise, API) | regulamin komercyjny: „Anthropic may not train models on Customer Content”; wyjątek: zgłoszona opinia, którą admin może wyłączyć | zero data retention na życzenie dla API; dane z opinii do 5 lat | tylko „us” (mnożnik 1,1x) albo „global”; UE wyłącznie przez Amazon Bedrock lub Google Cloud, z dopłatą 10% | klient jest właścicielem wyników; ochrona za płatne użycie, z wyłączeniem wyników zmodyfikowanych albo połączonych z cudzą technologią |
| OpenAI (Codex w Business, Enterprise, API) | domyślnie nie; właściciel organizacji API może włączyć udostępnianie, poza Enterprise i kontami z ZDR | API: do 30 dni na potrzeby nadzoru nad nadużyciami; ZDR dla uprawnionych klientów API, od sierpnia 2026 także dla najnowszych modeli | Europa dla Enterprise, Edu i API, nie dla Business; od 16 stycznia 2026 także wykonywanie modelu w regionie | klient jest właścicielem wyników; Copyright Shield dla Enterprise i API, wyłączony m.in. dla wyników zmodyfikowanych i przy wyłączonych filtrach; usługi beta bez ochrony |
| GitHub Copilot (Business, Enterprise) | nie, według Trust Center GitHuba | wykluczanie plików z kontekstu ustawia administrator | brak osobnej rezydencji dla Copilota poza ustawieniami GitHub Enterprise | ochrona tylko dla Business i Enterprise, gdy filtr „suggestions matching public code” jest na „Block” i sugestia nie została zmieniona; filtr wyłapuje fragmenty od 65 leksemów (ok. 150 znaków) |
| Cursor (Teams, Enterprise) | nie w trybie Privacy Mode; w Teams włączony domyślnie, admin może go wymusić | umowy ZDR z dostawcami modeli; indeks kodu jako wektory z zaciemnionymi ścieżkami; przy własnym kluczu API ZDR nie obowiązuje | rezydencja w USA dla Enterprise; UE w przygotowaniu | SOC 2, ISO 27001, ISO 42001 według strony polityki prywatności; brak deklaracji o ochronie przed roszczeniami na stronie cennika |
| Factory (Business, Enterprise) | brak deklaracji na stronie cennika; Droid czyta pliki lokalnie i według dokumentacji nie wymaga wgrywania kopii repozytorium | opcja zero data retention i dzienniki audytu w Business | wdrożenie u siebie w Enterprise | brak deklaracji na stronie cennika |
Replit ma w planie Enterprise SSO/SAML i osobne środowisko dla klienta, ale polityki treningowej strona cennika nie opisuje. Te zapisy zmieniają się co kilka miesięcy, więc przed podpisaniem umowy czytaj aktualną wersję, nie zestawienia.
Czego polityka dostawcy nie załatwia
Zapis „nie trenujemy na Twoich danych” dotyczy dostawcy modelu. Nie dotyczy tego, co agent zrobi na komputerze programisty, bo tam działa z jego uprawnieniami. Dwa przypadki z tego roku:
- W lipcu 2026 stary mechanizm dowiązań symbolicznych w Uniksie pozwolił obejść zatwierdzanie poleceń w sześciu popularnych asystentach do kodowania. Opisałem to w tekście o błędzie GhostApproval.
- We wrześniu 2026 narzędzie Z.ai Zcode podjęło 564 próby wysłania 313 MB kodu na serwer w Chinach. Co to znaczy dla polskiego zespołu, policzyłem w osobnym tekście.
Stąd wnioski niezależne od dostawcy: agent pracuje na osobnej gałęzi, bez dostępu do produkcyjnej bazy i bez kluczy w plikach; polecenia sieciowe i usuwające wymagają zatwierdzenia; każdy pull request agenta przechodzi ten sam przegląd co ludzki. Zasady zatwierdzania i warunku końca opisałem w tekście o agentach AI.
Licencje i prawa do kodu
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Regulaminy OpenAI i Anthropic mówią to samo: klient zachowuje prawa do tego, co wysyła, i jest właścicielem wyników, a dostawca przenosi na klienta swoje prawa do wyników, „jeśli jakiekolwiek ma”. To zastrzeżenie jest istotne, bo ten sam wynik może dostać inny użytkownik, a status prawny kodu wygenerowanego przez model różni się między krajami. Ochrona przed roszczeniami ma u każdego dostawcy warunki: OpenAI wyłącza ją, gdy klient wyłączył filtry albo zmodyfikował wynik; Anthropic - gdy klient zmienił wynik albo połączył go z cudzą technologią; GitHub - gdy filtr kodu publicznego jest wyłączony albo sugestia została zmieniona. Większość kodu z agenta jest potem zmieniana, więc te klauzule chronią mniej, niż wynika z nagłówków. Osobną sprawą jest obowiązek z art. 4 AI Act, który opisałem w tekście o kompetencjach w zakresie AI.
Lista kontrolna przed wdrożeniem
- Konto firmowe u dostawcy dla każdego programisty; zakaz używania prywatnych abonamentów do kodu firmy.
- Zapisany stan ustawień: trening wyłączony, Privacy Mode wymuszony (Cursor), filtr kodu publicznego na „Block” (Copilot), zgłaszanie opinii wyłączone (Anthropic).
- Decyzja o rezydencji danych: jeśli umowy z klientami wymagają UE, zostaje OpenAI Enterprise/API albo Claude przez Bedrock lub Vertex w regionie europejskim.
- Pliki wykluczone z kontekstu agenta: klucze, konfiguracje produkcyjne, dane klientów.
- Agent na gałęzi, bez dostępu do produkcji, z zatwierdzaniem poleceń i przeglądem każdego pull requesta; umowa powierzenia danych (DPA), jeśli w kodzie albo testach są dane osobowe.
Zobacz też: Agenci AI do kodu: który wybrać, ile kosztują i od czego zacząć · Ile kosztuje AI do programowania: abonamenty, tokeny i limity w zł · Vibe coding krok po kroku: od pomysłu do działającej aplikacji · Claude Code: agent, który sam wchodzi w projekt i zmienia kod · Codex: agent OpenAI, któremu oddaje się zadanie, a nie linijkę kodu
Najczęstsze pytania
Czy Claude Code i Codex uczą się na kodzie mojej firmy?
Na kontach firmowych (Team, Enterprise, Business, API) domyślnie nie. Na kontach prywatnych zależy to od ustawień użytkownika, a w Codex jest osobny przełącznik. Dlatego kod firmy powinien iść wyłącznie przez konto firmowe.
Czy kod wygenerowany przez AI można użyć komercyjnie?
Regulaminy OpenAI i Anthropic przyznają klientowi własność wyników, a GitHub, OpenAI i Anthropic oferują ochronę przed roszczeniami w planach płatnych pod warunkami (filtry włączone, wynik niezmieniony). Status prawny takiego kodu zależy od kraju; to pytanie do prawnika, nie do regulaminu.
Który agent do kodu ma rezydencję danych w Unii Europejskiej?
OpenAI dla ChatGPT Enterprise, Edu i API (nie dla Business). Anthropic nie ma własnego regionu w UE; Claude w UE działa przez Amazon Bedrock lub Google Cloud.
Źródła i data sprawdzenia
Regulamin komercyjny Anthropic, Anthropic o treningu na danych komercyjnych, Anthropic o planach konsumenckich, Anthropic o lokalizacji serwerów; OpenAI o Codex w planach ChatGPT, OpenAI o ZDR, OpenAI o rezydencji danych, warunki usług OpenAI; GitHub Copilot Trust Center, opis filtra kodu publicznego; Cursor o użyciu danych, polityka prywatności Cursora; cennik Factory, dokumentacja bezpieczeństwa Factory; nota CSA o raporcie Veracode. Sprawdzone 25 września 2026.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Czy Claude Code i Codex uczą się na kodzie mojej firmy?
Na kontach firmowych (Team, Enterprise, Business, API) domyślnie nie. Na kontach prywatnych zależy to od ustawień użytkownika, a Codex ma do tego osobny przełącznik niezależny od ustawień czatu.
Jak długo OpenAI przechowuje dane z API?
OpenAI przechowuje dane z API do 30 dni na potrzeby nadzoru nad nadużyciami. Uprawnieni klienci API mogą skorzystać z opcji zero data retention (ZDR), dostępnej od sierpnia 2026 także dla najnowszych modeli.
Który agent do kodu ma rezydencję danych w Unii Europejskiej?
OpenAI oferuje rezydencję danych w Europie dla planów Enterprise, Edu i API - od 16 stycznia 2026 obejmuje to także wykonywanie modelu w regionie. Anthropic nie ma własnego regionu UE; Claude w UE działa wyłącznie przez Amazon Bedrock lub Google Cloud.
Kiedy GitHub Copilot chroni firmę przed roszczeniami o prawa autorskie?
Ochrona działa tylko w planach Business i Enterprise, gdy filtr sugestii pasujących do publicznego kodu jest ustawiony na "Block" i gdy sugestia nie została zmodyfikowana. Filtr wykrywa fragmenty od 65 leksemów, czyli około 150 znaków.
