Představte si personalistku, která do chatbota vloží třicet životopisů a napíše: seřaď mi je podle zkušeností s vedením týmu. Za dvacet vteřin má hotovo, zároveň má osobní údaje třiceti cizích lidí na serverech firmy, se kterou její zaměstnavatel nemá podepsaný jediný papír.
Tahle scéna se odehrává denně v tisících kanceláří a málokdo u ní přemýšlí o právu. Přitom celý rozdíl mezi „nevinná pomůcka“ a „ohlašovaný incident“ leží v jedné jediné věci: v jakém tarifu jste přihlášení a co má daná firma napsáno ve svých podmínkách.
Kam ten text vlastně jde
Když napíšete dotaz do chatbota, text neputuje do nějakého abstraktního mraku. Odejde na server konkrétní společnosti, tam ho zpracuje model, odpověď se vrátí zpátky a kopie konverzace vám zůstane v historii účtu. Dokud je řeč o dotazu typu „napiš mi recept z toho, co mám v lednici“, je to jedno.
Jenže spolu s tím dotazem odchází i všechno ostatní, co jste do něj vložili. Přílohu se smlouvou. Screenshot z interního systému. Tabulku s adresami zákazníků.
A tady se láme, jestli firma text jen zpracuje a zapomene, nebo jestli ho použije k trénování dalších verzí modelu. To je ta otázka, kterou má smysl si položit dřív, než něco vložíte. Odpověď na ni se u jednoho a téhož nástroje liší podle toho, jestli jste na bezplatném účtu, nebo pod firemní licencí.
Co vlastně „trénování“ znamená? Model si z milionů vět odvozuje statistické vzorce, jak jazyk vypadá, ne konkrétní věty, které by šlo vytáhnout na požádání. Představte si kuchaře, který ochutná deset tisíc polévek a naučí se, kolik soli tam patří. Nepamatuje si jednotlivé hrnce. Jenže když do jednoho z nich někdo nalil něco hodně nezvyklého, třeba unikátní kombinaci jména a rodného čísla, může se ta chuť za vhodných okolností objevit ve výsledku. Výzkumníci tomuhle jevu říkají memorizace a je to důvod, proč se regulátoři o tréninková data zajímají.
Bezplatný účet a firemní tarif se liší víc, než čekáte
Ověřoval jsem to přímo v dokumentaci čtyř největších poskytovatelů, údaje níže platí k srpnu 2026 a podmínky se mění, takže před rozhodnutím s dopadem na firemní data si je přečtěte znovu. Odkazy na původní stránky najdete na konci článku.
OpenAI (ChatGPT). U služeb pro jednotlivce, tedy Free, Plus i Pro, si OpenAI vyhrazuje právo používat obsah konverzací k trénování modelů, dokud to uživatel nevypne. Vypínač je v nastavení účtu v sekci Data Controls pod položkou „Improve the model for everyone“. Pod firemními licencemi je to obráceně: OpenAI výslovně píše, že na vstupech a výstupech z ChatGPT Business, Enterprise, Edu a z API netrénuje, pokud si to zákazník sám nezapne. Jeden detail se snadno přehlédne. I když máte trénování vypnuté a kliknete na palec nahoru nebo dolů, může se celá související konverzace k trénování použít, protože jste ji poslali jako zpětnou vazbu.
Anthropic (Claude). Tady je logika jiná. U tarifů Free, Pro a Max je použití konverzací k vylepšování modelu volbou uživatele v nastavení soukromí. Když ji zapnete, Anthropic uvádí, že může data v odosobněné podobě uchovávat až pět let. Chaty v režimu Incognito se k trénování nepoužívají ani tak. Firemní varianty Claude for Work, Team a Enterprise plus API na zákaznických datech netrénují, ledaže se firma sama přihlásí do partnerského programu.
Google (Gemini). Spotřebitelská aplikace Gemini používá vaši aktivitu i k trénování generativních modelů, pokud ukládání aktivity nevypnete. Google zároveň na své nápovědní stránce otevřeně píše, že část konverzací čtou lidští posuzovatelé včetně proškolených dodavatelů. Tyhle zkontrolované konverzace se podle Googlu uchovávají až tři roky a nesmažou se s vaší historií. Ve Workspace, tedy ve firemní verzi, se Google zavazuje zákaznická data k trénování generativních modelů bez svolení zákazníka nepoužívat.
Microsoft (Copilot). Spotřebitelská verze Copilota spadá do stejného pytle jako Bing a MSN. Microsoft píše, že data odtud používá k trénování AI, s výjimkou vyjmenovaných zemí a uživatelů, kteří se odhlásili. V tom seznamu zemí je mimo jiné Brazílie, Jižní Korea nebo Vietnam. Evropský hospodářský prostor tam není, takže český uživatel bezplatného Copilota je v tréninkové množině, dokud si to sám nevypne v profilu v sekci ochrany soukromí. Microsoft 365 Copilot, tedy placená firemní verze napojená na vaše dokumenty a maily, funguje jinak: prompty, odpovědi ani data získaná přes Microsoft Graph se podle dokumentace nepoužívají k trénování základních jazykových modelů.
Vzorec je poměrně jednotný. Spotřebitelské verze trénují, pokud jim to nezakážete. Firemní licence netrénují, pokud jim to výslovně nedovolíte. Zaplacené Plus nebo Pro na tom nic nemění, protože pořád jde o účet pro jednotlivce.
Trénink je půlka příběhu. Zbytek je lidská kontrola a doba uchování
Spousta lidí si po vypnutí trénování oddechne. Tím ale zmizí jen jeden ze čtyř způsobů, jak se vaše data mohou dostat dál.
Prvním je právě trénink. Druhým je lidská kontrola kvůli bezpečnosti. Google výslovně píše, že i při vypnutém ukládání aktivity a v dočasných chatech konverzace používá k ochraně služby a uživatelů, a to i s pomocí lidských posuzovatelů. Microsoft u spotřebitelského Copilota uvádí automatickou i lidskou kontrolu části konverzací a upozorňuje, že odhlášení z trénování nevylučuje použití dat pro obecné zlepšování produktu, reklamu ani bezpečnostní účely. OpenAI má u API takzvané abuse monitoring, kdy vstupy a výstupy drží zhruba třicet dní a u vybraných rozhraní jde požádat o nulovou retenci. Třetím způsobem je prosté uchování v historii vašeho účtu, kam se dostane každý, kdo se do účtu dostane. Čtvrtým je únik nebo chyba na straně poskytovatele, což není hypotetická obava. Právě neohlášený bezpečnostní incident z března 2023 patřil mezi důvody, proč italský úřad pro ochranu osobních údajů vedl proti OpenAI řízení.
Doby uchování se mezi službami liší o řád. Google u spotřebitelské aplikace maže aktivitu ve výchozím nastavení po osmnácti měsících, u lidsky kontrolovaných konverzací mluví až o třech letech. Microsoft u spotřebitelského Copilota uvádí osmnáct měsíců. Anthropic u uživatelů, kteří trénování povolili, mluví až o pěti letech. Jestli vás zajímá, jak dlouho po vás zůstane stopa, tohle je číslo, které si stojí za to najít.
Kde do toho vstupuje GDPR
Obecné nařízení o ochraně osobních údajů, nařízení Evropského parlamentu a Rady (EU) 2016/679, se na AI nástroje vztahuje úplně stejně jako na jakoukoliv jinou službu, která pracuje s údaji o lidech. Žádná zvláštní výjimka pro umělou inteligenci v něm není. Pravidla přímo pro umělou inteligenci stanoví samostatně evropský AI Act. Pro praxi z toho plyne několik věcí, které nemají nic společného s technologií a všechno s rolemi.
Když zaměstnanec vloží do veřejného chatbota data klientů, správcem těch údajů zůstává jeho zaměstnavatel. Ten za zpracování odpovídá, i když o něm neví. Poskytovatel AI se stává zpracovatelem jen tam, kde je uzavřená smlouva o zpracování osobních údajů podle článku 28 GDPR. U běžného osobního účtu žádná taková smlouva neexistuje. Právě v ní leží hlavní právní rozdíl mezi bezplatnou a firemní verzí, mnohem víc než v délce kontextu nebo rychlosti modelu.
Dál platí zásada minimalizace údajů. Když modelu stačí smlouva bez jmen a rodných čísel, nemá důvod je vidět. Anonymizace vstupu je nejlevnější ochrana, jakou máte k dispozici, a nepotřebujete k ní právníka.
Mimořádnou pozornost si zaslouží takzvané zvláštní kategorie údajů podle článku 9, tedy údaje o zdraví, biometrické údaje, náboženské vyznání nebo sexuální orientaci. Ty se zpracovávají jen ve vyjmenovaných případech a vložit je do veřejného chatbota „na zkoušku“ je právně mnohem citlivější než totéž s běžnou adresou. Málokdo domyslí i konec toho řetězce. Pokud se ukáže, že se osobní údaje dostaly ven způsobem, který GDPR označuje za porušení zabezpečení, má správce podle článku 33 povinnost ohlásit to dozorovému úřadu bez zbytečného odkladu, pokud možno do 72 hodin. Ta lhůta běží od okamžiku, kdy se o problému dozvíte, ne od chvíle, kdy k němu došlo. Firmy, které plánují nasadit AI na rozsáhlejší zpracování údajů o lidech, navíc podle článku 35 obvykle potřebují posouzení vlivu na ochranu osobních údajů. To je práce pro pověřence nebo právníka, ne pro odpolední nápad.
Na evropské úrovni se výklad teprve usazuje. Evropský sbor pro ochranu osobních údajů přijal v prosinci 2024 stanovisko 28/2024, které se zabývá tím, kdy lze AI model považovat za anonymní, jestli může být oprávněný zájem právním základem pro jeho vývoj a co se stane s modelem vyvinutým z nezákonně zpracovaných dat. V červenci 2026 sbor přijal pokyny 03/2026 k web scrapingu v kontextu generativní AI, které byly v době psaní tohoto textu ve veřejné konzultaci do konce října 2026. Jinými slovy, ani regulátoři ještě nemají hotovo.
Ukázkou, jak nejistý ten terén je, je italský případ. Tamní dozorový úřad Garante rozhodl 2. listopadu 2024 o pokutě patnáct milionů eur pro OpenAI, mimo jiné za zpracování osobních údajů k trénování ChatGPT bez odpovídajícího právního základu. Rozhodnutí zveřejnil na portálu docweb až 20. prosince 2024. Římský soud ale v březnu 2026 pokutu zrušil, a to z důvodu příslušnosti: po vzniku irské pobočky měl případ převzít irský úřad. Meritorní otázku, tedy jestli trénování na těch datech bylo v pořádku, soud nerozhodl. Kdo z toho vyvozuje, že je vše dovoleno, čte rozsudek špatně.
V Česku dohlíží na dodržování GDPR Úřad pro ochranu osobních údajů. Na jeho stránkách najdete přehled práv subjektu údajů i stručné desatero pro správce, které je psané pro živnostníky a menší firmy, ne pro korporátní právníky. Konkrétní situaci, hlavně pokud jde o zpracování ve větším rozsahu nebo o citlivé údaje, ale s obecným textem nevyřešíte a vyplatí se probrat ji s právníkem nebo pověřencem pro ochranu osobních údajů.
Co do chatbota nepatří
Praktický seznam vychází z toho, co byste nechtěli vidět v cizí databázi ani za pět let:
- rodná čísla, čísla dokladů, čísla účtů a platebních karet,
- zdravotní dokumentace, výsledky vyšetření, diagnózy, ať už vaše nebo cizí,
- celé životopisy, kontakty a hodnocení uchazečů či zaměstnanců,
- nepodepsané smlouvy, cenové nabídky a interní kalkulace,
- přihlašovací údaje, API klíče a tokeny, které se do promptu dostanou náhodou s kusem kódu,
- fotografie a hlasové nahrávky konkrétních lidí bez jejich vědomí.
U většiny z toho existuje řešení, které trvá o třicet vteřin déle a riziko snese pod únosnou hranici: nahradit jména písmeny, smazat rodné číslo, ponechat jen tu část dokumentu, které se dotaz opravdu týká. Model potřebuje strukturu textu, ne identitu lidí v něm.
Když AI používáte v práci
Nejčastější problém, na který dnes firmy narážejí, nemá jméno hacker. Jmenuje se zaměstnanec, který si chce ulehčit odpoledne.
Pokud jste na straně zaměstnance, zjistěte si dvě věci, než něco vložíte. Jestli má firma nějakou psanou politiku pro používání AI nástrojů. A jestli vám platí firemní licenci, nebo jestli jste přihlášení pod soukromým účtem. Rozdíl mezi tím, co se s daty stane, je v těchto dvou případech skutečný, ne formální.
Pokud jste na straně zaměstnavatele, zákaz obvykle nefunguje. Lidé nástroje používají dál, jen o tom přestanou mluvit, a firma ztratí přehled úplně. Levnější cesta bývá koupit firemní tarif s uzavřenou smlouvou o zpracování a napsat k němu dvě stránky pravidel, co do něj smí a co ne. Nechávat to na intuici zaměstnanců je rozhodnutí, jen si ho většina firem neuvědomuje jako rozhodnutí. Kdo chce širší přehled rizik kolem umělé inteligence, najde ho v článku o bezpečnosti a soukromí u AI. Samostatná past, se kterou GDPR nesouvisí, ale která firmy stojí stejně reálné peníze, je spolehlivost odpovědí. Tomu se věnuje text o ověřování faktů od AI.
Na co si dát pozor
Nastavení soukromí si zkontrolujte znovu po každé větší aktualizaci aplikace. Přepínače se stěhují a přejmenovávají a to, co jste vypnuli loni, se může jmenovat jinak a stát jinde. Placený tarif automaticky neznamená ochranu dat. Plus, Pro nebo Max jsou pořád účty pro jednotlivce a řídí se spotřebitelskými podmínkami. Ochranu, o kterou vám jde, dává až firemní licence se smlouvou o zpracování.
Zpětná vazba palcem nahoru není nevinné kliknutí. U OpenAI může poslat celou konverzaci k trénování i uživateli, který má trénování vypnuté.
Vypnutí trénování nemaže historii. To jsou dvě různá tlačítka a k odstranění dat potřebujete obě. A nakonec: podmínky se mění častěji než cokoliv jiného v tomhle článku. Anthropic svoje spotřebitelské podmínky v tomto směru přepsal v roce 2025, Google svoje stránky o soukromí Gemini aktualizoval během léta 2026. Datum poslední aktualizace bývá na stránce dole a je to první věc, kterou má smysl si přečíst.
Shrnutí
Bezplatné a spotřebitelské verze ChatGPT, Gemini i Copilota podle podmínek svých provozovatelů trénují na vašich datech, pokud jim to nezakážete. Claude to nechává jako výslovnou volbu uživatele s pětiletou retencí, když ji zapnete. Firemní licence všech čtyř poskytovatelů na zákaznických datech netrénují, dokud si to zákazník sám nevyžádá. GDPR na tom nic nemění a ani nic neusnadňuje. Odpovědnost za osobní údaje zůstává na tom, kdo je do nástroje vložil, respektive na jeho zaměstnavateli. Nejúčinnější ochrana je pořád ta nejnudnější: nedávat modelu údaje, které k odpovědi nepotřebuje.