✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Magazyn

Policzyłem kroki: wyłączenie czytania ekranu przez Gemini to 11 dotknięć w trzech osobnych miejscach

Google wygasza Asystenta Google i w jego miejsce wstawia Gemini, który potrafi odczytać to, co masz w danej chwili na ekranie. Przeszedłem przez ustawienia polskiego Androida z zegarkiem w ręku i policzyłem, ile dokładnie ruchów trzeba wykonać, by to ograniczyć - oraz ile z tych przełączników jest domyślnie włączonych.

8 min czytania
Policzyłem kroki: wyłączenie czytania ekranu przez Gemini to 11 dotknięć w trzech osobnych miejscach

👁 117 przeczytań

Zmiana, którą Google przeprowadza na telefonach z Androidem, wygląda z zewnątrz jak wymiana jednej aplikacji na inną. Asystent Google odchodzi, Gemini wchodzi. Różnica jest jednak głębsza niż logo: stary asystent działał jak rozbudowany pilot - słuchał polecenia, wykonywał akcję, kończył. Nowy model działa jak uczestnik tego, co robisz. Potrafi spojrzeć na zawartość ekranu, streścić maila, który masz otwarty, przeczytać PDF w przeglądarce, podpowiedzieć odpowiedź w komunikatorze. Żeby to zrobić, musi tę zawartość gdzieś wysłać.

Serwis Niebezpiecznik zapowiedział na ten temat transmisję z współzałożycielem firmy Proget, stawiając pytanie wprost: kiedy informacje z telefonu opuszczają urządzenie i trafiają do dostawcy modelu. To dobre pytanie, więc postanowiłem je rozbić na części mierzalne. Nie na wrażenia, a na liczbę przełączników i liczbę dotknięć ekranu.

// taniej niż u producentaw magazynie
Google AI Gemini Pro + Google Drive 5 TB - 18 miesięcy
Google AI Gemini Pro + Google Drive 5 TB - 18 miesięcyVoucher, którym włączasz Google AI Pro na 18 miesięcy na własnym koncie Google.kinetyka.pl - mój sklep z rocznymi dostępami do narzędzi AI
170 zł-91%zamiast 1 800 zł9,44 zł / mies.Kup w Kinetyce →

Jedenaście dotknięć, trzy różne ekrany ustawień, zero jednego wyłącznika

Siadłem z telefonem z Androidem 15 i polską wersją systemu, i przeszedłem całą ścieżkę ograniczania dostępu AI do treści ekranu. Wyszło mi jedenaście dotknięć rozłożonych na trzy niepowiązane ze sobą miejsca - i to w scenariuszu, w którym wiem dokładnie, czego szukam. Pierwsze miejsce to aplikacja Gemini i jej ustawienia aktywności: tam wyłącza się zapisywanie rozmów i zgodę na przegląd przez ludzi. Drugie to ustawienia systemowe i sekcja asystenta cyfrowego, gdzie leży przełącznik odpowiadający za wykorzystanie kontekstu ekranu. Trzecie to konto Google w przeglądarce lub w ustawieniach konta, bo część opcji związanych z personalizacją nie mieszka w telefonie, tylko po stronie usługi.

Liczba sama w sobie nie szokuje. Szokuje proporcja. Włączenie tych samych uprawnień zajmuje jedno dotknięcie - jeden przycisk zgody w kreatorze, który pokazuje się przy pierwszym uruchomieniu Gemini po aktualizacji. Stosunek wynosi zatem 11:1. Za każdy ruch potrzebny do udzielenia dostępu trzeba wykonać jedenaście, żeby go odebrać. To nie jest przypadek projektowy, to standardowa asymetria interfejsu: zgoda jest w drodze użytkownika, odmowa jest w zakamarku.

Druga policzona przeze mnie rzecz dotyczy stanu domyślnego. Przy przejściu z Asystenta na Gemini użytkownik, który po prostu kliknął „dalej”, ma włączone trzy z czterech mechanizmów zbierania danych: zapis historii rozmów z modelem, możliwość wykorzystania fragmentów tych rozmów do poprawy usługi oraz dostęp do kontekstu ekranu na żądanie. Wyłączony domyślnie jest jedynie stały, ciągły podgląd bez wywołania. Innymi słowy: domyślnie AI nie patrzy przez cały czas, ale domyślnie ma prawo zajrzeć, kiedy ją zawołasz, i domyślnie zapisuje to, co zobaczyła.

Policzyłem kroki: wyłączenie czytania ekranu przez Gemini to 11 dotknięć w trzech osobnych miejscach

Stary Asystent widział polecenie, Gemini widzi dokument

Żeby pokazać skalę różnicy, zestawiłem zakres danych dostępnych obu rozwiązaniom. Nie chodzi o listę uprawnień w manifeście aplikacji, bo ta wygląda podobnie, a o to, co realnie opuszcza urządzenie przy typowym użyciu.

ZakresAsystent GoogleGemini
Treść polecenia głosowegotaktak
Zawartość aktualnego ekranunie, poza wąskim trybem rozpoznawaniatak, na żądanie
Treść otwartego dokumentu lub mailanietak
Historia wcześniejszych wymian jako kontekstograniczonatak, domyślnie zapisywana
Przetwarzanie poza urządzeniemgłosgłos plus obraz lub tekst z ekranu

Różnica sprowadza się do jednej rzeczy: zmienia się jednostka danych. Asystent przetwarzał zapytanie, czyli kilka słów, które sam świadomie wypowiedziałeś. Gemini przetwarza widok, czyli wszystko, co akurat znajduje się w kadrze - łącznie z tym, czego nie zamierzałeś nikomu pokazywać, bo było w tym samym oknie. Numer rachunku obok podsumowania przelewu. Nazwisko pacjenta nad wynikiem badania. Fragment umowy pod akapitem, o który pytałeś.

Rachunek dla firmy: 12 złotych miesięcznie za telefon, żeby mieć nad tym kontrolę

Jest druga strona tej historii, czysto kosztowa, i tutaj liczba robi największe wrażenie. Zwykły użytkownik może przejść przez te jedenaście dotknięć i ma sprawę zamkniętą. Organizacja, która wydała pracownikom sto telefonów, nie ma takiej możliwości - nie przejdzie stu razy przez trzy ekrany ustawień i nie zweryfikuje, czy ktoś przypadkiem nie kliknął „dalej” po kolejnej aktualizacji. Potrzebuje systemu MDM, czyli centralnego zarządzania urządzeniami, który wymusi politykę odgórnie.

Policzyłem, ile to kosztuje przy typowych stawkach rynkowych za licencję MDM, które mieszczą się w przedziale 2-4 dolarów za urządzenie miesięcznie. Przy kursie 3,78 złotego za dolara daje to od 7,56 do 15,12 złotego za telefon miesięcznie, czyli około 12 złotych w środku widełek. Dla stu urządzeń to 1200 złotych miesięcznie i 14 400 złotych rocznie. Dla pięciuset telefonów - 72 tysiące złotych w roku. To realna kwota, którą firmy zaczną wpisywać w budżet nie z powodu nowego zagrożenia hakerskiego, tylko z powodu zmiany domyślnego ustawienia w aplikacji, której nie instalowały.

Warto to przeliczyć jeszcze inaczej. Jeden telefon służbowy klasy średniej to wydatek rzędu 1800-2500 złotych, zwykle amortyzowany przez dwa, trzy lata. Licencja MDM przez trzy lata to przy 12 złotych miesięcznie 432 złote, czyli około 20 procent ceny samego urządzenia. Koszt panowania nad tym, co telefon wysyła na zewnątrz, stanowi zatem jedną piątą kosztu telefonu.

Apple poszło inną drogą i to też da się policzyć

Na iPhone’ach architektura wygląda inaczej, choć nie należy jej idealizować. Apple rozdzieliło przetwarzanie na dwa poziomy: część zadań wykonuje model działający lokalnie na układzie telefonu, część trafia do infrastruktury serwerowej, a najbardziej złożone zapytania mogą być przekazane do zewnętrznego dostawcy po osobnym potwierdzeniu. To ostatnie potwierdzenie jest kluczowe, bo oznacza dodatkowy, widoczny krok przed wysłaniem danych poza ekosystem.

Z mojego liczenia wynika, że na iOS do pełnego ograniczenia funkcji AI potrzeba sześciu, siedmiu dotknięć, bo większość przełączników siedzi w jednej sekcji ustawień zamiast być rozrzucona po trzech miejscach. To mniej niż jedenaście, ale nie z powodu większej dbałości o prywatność - po prostu Apple kontroluje cały system i nie musi dzielić ustawień między telefon, aplikację i konto w chmurze. Przy tym samym telefonie funkcje AI Apple w Polsce i w języku polskim działają w węższym zakresie niż w angielskim, co paradoksalnie oznacza mniej danych wychodzących na zewnątrz - nie z wyboru użytkownika, a z braku wsparcia językowego.

RODO: zgoda na coś, czego pracownik nie mógł odrzucić, jest wątpliwa

Tutaj wchodzimy na grunt, na którym polski czytelnik ma mocniejszą pozycję niż użytkownik w Stanach. Artykuł 4 punkt 11 RODO definiuje zgodę jako dobrowolne, konkretne, świadome i jednoznaczne okazanie woli. Kliknięcie „dalej” w kreatorze, który pojawia się po automatycznej aktualizacji i nie oferuje równorzędnej opcji odmowy, trudno uznać za spełniające ten standard. Europejska Rada Ochrony Danych zwracała na to uwagę przy ocenie projektowania interfejsów, pisząc o wzorcach, które ukierunkowują wybór użytkownika.

„Interfejsy nie powinny być projektowane w sposób, który wpływa na użytkowników, by podejmowali decyzje niezgodne z ich interesem w zakresie ochrony danych, na przykład przez wyróżnianie opcji mniej chroniących prywatność.” - Europejska Rada Ochrony Danych, wytyczne 03/2022 w sprawie dark patterns

Dla firmy wniosek jest konkretny i kosztowny. Jeśli na telefonie służbowym leżą dane klientów, pacjentów, kandydatów do pracy czy cokolwiek, czego administratorem jest pracodawca, to wysłanie fragmentu ekranu z tymi danymi do zewnętrznego modelu jest powierzeniem przetwarzania. Potrzebna jest podstawa prawna, umowa powierzenia i wpis w rejestrze czynności. Nikt tego nie załatwi przez kliknięcie pracownika. Urząd Ochrony Danych Osobowych wielokrotnie karał administratorów właśnie za brak kontroli nad tym, gdzie dane fizycznie wyciekają - i tu mechanizm jest identyczny, tylko kanałem nie jest zgubiony pendrive, a asystent AI.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Co zrobić dziś, zanim kolejna aktualizacja ustawi wszystko od nowa

Dla prywatnego telefonu kolejność jest następująca. Otwórz Gemini, wejdź w ustawienia aktywności aplikacji i wyłącz zapisywanie rozmów - to odcina gromadzenie historii i ogranicza przeglądanie fragmentów przez osoby weryfikujące jakość. Potem wejdź w ustawienia systemowe, znajdź sekcję odpowiedzialną za aplikacje domyślne i asystenta cyfrowego, i odbierz zgodę na korzystanie z kontekstu ekranu. Na koniec zajrzyj w ustawienia konta Google w przeglądarce, bo tam leżą opcje personalizacji niewidoczne z telefonu. Zapisz sobie gdzieś datę tej operacji, bo przy większych aktualizacjach systemu część przełączników wraca do stanu domyślnego i trzeba je sprawdzić ponownie.

Dla telefonu, na którym jest praca i życie prywatne jednocześnie, jedyna sensowna odpowiedź to rozdzielenie profili. Android ma profil służbowy, który trzyma aplikacje firmowe w osobnym kontenerze - asystent z profilu prywatnego nie powinien widzieć treści z tej drugiej strony. To nie jest zabezpieczenie absolutne, ale przenosi problem z „wszystko w jednym kadrze” na „dwa osobne kadry”, a to w praktyce najtańsza zmiana, jaką można wprowadzić bez kupowania licencji za 12 złotych miesięcznie.

Na koniec rzecz, której żadna liczba nie zmierzy, a która jest w tej historii najważniejsza. Przez lata uczyliśmy się pytać, jakie uprawnienia ma dana aplikacja. To pytanie przestaje wystarczać, bo asystent AI nie potrzebuje dostępu do Twojej galerii, żeby zobaczyć zdjęcie - wystarczy, że je otworzysz, a on spojrzy na ekran. Granicą nie jest już lista uprawnień, a to, co w danej chwili masz przed oczami. Nowym nawykiem higieny cyfrowej jest więc pytanie: czy chcę, żeby ktoś trzeci patrzył na to razem ze mną.

Fakty sprawdzone 3 października 2026. Kurs przyjęty do przeliczeń: 3,78 zł za dolara, 4,30 zł za euro. Źródła: Niebezpiecznik - AI w telefonie może czytać Twój ekran, EDPB, wytyczne 03/2022, Urząd Ochrony Danych Osobowych, dokumentacja pomocy Gemini, podręcznik użytkownika iPhone’a. Liczby dotyczące liczby dotknięć i stanu domyślnego przełączników pochodzą z mojego własnego przejścia przez ustawienia na urządzeniu z polską wersją systemu i mogą się różnić w zależności od nakładki producenta.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro+ 99 zł/mc Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›