Які файли не можна завантажувати в ШІ-чатботи? Практичний гід із приватності

What Files Should You Never Upload To AI Chatbots?

ШІ-чатботи непомітно стали помічниками для роботи з файлами. Люди завантажують резюме, договори, рахунки, таблиці, PDF-документи, скриншоти, файли з кодом, медичні форми, юридичні листи, бізнес-плани й напівготові чернетки, бо це швидко та зручно.

Іноді це справді корисно. Чатбот може коротко переказати довгий PDF, пояснити таблицю, порівняти дві версії документа або перетворити хаотичні нотатки на нормальний текст. Проблема в тому, що файли рідко бувають такими “чистими”, як здається на перший погляд.

Звичайний PDF може містити підпис, адресу, номер рахунку, приховане ім’я автора або дані клієнта. Скриншот може показати вкладки браузера, email-адреси, назви акаунтів, закладки, сповіщення або приватний шлях до файлу. У таблиці можуть бути приховані аркуші чи колонки, про які ви давно забули. А документ Word може досі зберігати коментарі, історію правок і ім’я людини, яка редагувала його останньою.

Тому головне питання не лише в тому: “Чи може цей ШІ-інструмент прочитати мій файл?” Краще запитати інакше: що саме я передаю разом із цим файлом, хоча не збирався цим ділитися?

Найбезпечніше правило просте: ніколи не завантажуйте оригінал чутливого файлу, якщо достатньо очищеної копії.

Зупиніться перед завантаженням

Не варто завантажувати в ШІ-чатботи файли, які містять паролі, API-ключі, приватні ключі, банківські дані, податкові документи, медичні записи, державні посвідчення, юридичні документи, конфіденційні робочі файли, списки клієнтів, приватні фото, неопубліковані творчі матеріали або інформацію, якою ви не маєте права ділитися.

Це не означає, що кожне завантаження файлу небезпечне. Публічна брошура, відредагована чернетка статті, тестова таблиця, інструкція користувача або звичайний шаблон можуть бути цілком безпечними. Ризик починається там, де файл містить інформацію, яка може зашкодити вам, роботодавцю, клієнту або іншій людині, якщо її побачать, збережуть, переглянуть, скопіюють або використають поза вашим контролем.

Перед завантаженням будь-якого файлу поставте собі три прості запитання:

  • Чи містить цей файл персональні, фінансові, юридичні, медичні, технічні або бізнес-чутливі дані?
  • Чи маю я дозвіл передавати його зовнішньому ШІ-інструменту?
  • Чи можу я спершу прибрати імена, номери, підписи, приватні нотатки або приховані дані?

Якщо хоча б одне запитання змушує вас зупинитися, не завантажуйте оригінал. Зробіть безпечнішу версію.

Це вже траплялося

Цей ризик давно перестав бути теорією. У 2023 році, за повідомленнями ЗМІ, працівники Samsung завантажили в ChatGPT чутливий вихідний код і внутрішні нотатки зустрічей, намагаючись швидше виконати робочі завдання. Цей випадок став одним із найвідоміших ранніх прикладів простої помилки: співробітник хотів отримати допомогу, але файл або запит містив інформацію, яка не мала виходити за межі компанії.

Більші цифри теж важко ігнорувати. У звіті IBM Cost of a Data Breach Report 2025 середня глобальна вартість витоку даних оцінюється у 4,4 млн доларів. У тому ж звіті зазначено, що 63% організацій не мали політик управління ШІ для контролю використання AI або запобігання “тіньовому” використанню ШІ, а 97% організацій, які повідомили про інциденти безпеки, пов’язані з AI, не мали належного контролю доступу до ШІ.

Для звичайного користувача ці цифри можуть звучати надто корпоративно. Але побутова версія проблеми проста: не той файл у не тому інструменті може розкрити паролі, клієнтські дані, приватну медичну інформацію, код або бізнес-дані, які ніколи не мали бути передані.

Чому завантаження файлів у ШІ здається безпечнішим, ніж є насправді

Вікно чатбота здається приватним. Немає публічного поста, коментарів або видимої аудиторії. Ви перетягуєте файл, ставите запитання й отримуєте відповідь. Це відчувається радше як робота з калькулятором, а не як передача документа кудись назовні.

Але ШІ-чатбот усе одно є онлайн-сервісом. Ваш файл може оброблятися, зберігатися певний час і підпорядковуватися налаштуванням та умовам вашого акаунта. Особисті, бізнесові, освітні та корпоративні акаунти можуть мати різні правила приватності.

Офіційна сторінка OpenAI про зберігання файлів і Library у ChatGPT зазначає, що завантажені файли можуть зберігатися в Library користувача, а видалення чату з файлами не видаляє ці файли з Library. Там також сказано, що контент індивідуальних користувачів, зокрема завантажені файли, може використовуватися для покращення роботи моделей, якщо відповідне налаштування увімкнене.

Gemini Apps Privacy Hub від Google дає ще одне корисне нагадування: завантажений контент і пов’язана активність можуть використовуватися для покращення сервісів Google за участі людей-рецензентів, якщо Keep Activity увімкнено. Конкретні налаштування залежать від інструмента, але висновок однаковий: не припускайте, що файл зникає лише тому, що чат здається приватним.

Є й простіша проблема: люди часто забувають, що саме міститься у їхніх файлах. Скриншот може бути обрізаний так, що в кутку все одно видно приватний email. PDF може містити метадані. У таблиці може бути один видимий аркуш і ще п’ять прихованих.

ШІ зазвичай не потрібен увесь файл, щоб допомогти. У багатьох випадках достатньо короткого уривка, відредагованої копії або тестової версії.

Файли, які краще не завантажувати

Деякі файли занадто чутливі, щоб завантажувати їх у чатбот без підготовки, навіть якщо завдання здається нешкідливим.

Паролі та дані для входу

Ніколи не використовуйте чатбот для впорядкування, очищення, переписування або пояснення файлу, який містить паролі чи логіни.

Сюди входять експорти з менеджерів паролів, спільні командні таблиці з паролями, резервні коди двофакторної автентифікації, відповіді для відновлення акаунта, адмінські доступи, Wi-Fi-паролі та скриншоти з інструкціями для входу.

Може здатися зручним попросити ШІ “розсортувати цей список паролів за типами акаунтів”, але саме така зручність і створює серйозну проблему. Файли з паролями мають залишатися в надійному менеджері паролів, а не у вікні чату.

API-ключі та секрети розробника

У розробників є своя версія цієї ж проблеми. Папка проєкту може містити секрети в місцях, про які легко забути.

Особливо обережно ставтеся до:

  • файлів .env
  • приватних SSH-ключів
  • API-ключів
  • OAuth-секретів
  • доступів до баз даних
  • токенів доступу до хмарних сервісів
  • файлів сервісних акаунтів
  • production-конфігів
  • резервних копій із доступами

Навіть код без очевидних паролів може розкривати бізнес-логіку, внутрішні endpoint-и, слабкі місця безпеки, структури клієнтських даних і власницькі напрацювання.

Якщо вам потрібна допомога з дебагом, не завантажуйте весь приватний репозиторій, якщо компанія прямо не дозволяє це робити й акаунт не схвалений для такого використання. Безпечніший варіант — створити невеликий приклад коду, який відтворює проблему, прибрати секрети та замінити приватні назви плейсхолдерами.

Посвідчення, паспорти та імміграційні документи

Скани паспортів, ID-карток, водійських посвідчень, дозволів на проживання, віз, свідоцтв про народження та імміграційних документів не варто завантажувати без крайньої потреби.

Такі файли можуть містити повне юридичне ім’я, дату народження, адресу, номер документа, фото, підпис, громадянство, дані про подорожі та інформацію про сім’ю. Це набагато більше, ніж потрібно ШІ-інструменту, щоб пояснити поле у формі або допомогти скласти чекліст.

Безпечніший підхід — описати проблему словами. Якщо потрібно показати частину документа, використовуйте копію, де прибрано імена, номери, фото, штрихкоди, підписи та адреси.

Банківські виписки та податкові документи

Фінансовими документами легко поділитися зайвий раз, бо вони виглядають як “просто цифри”. Але це не просто цифри.

Банківські виписки, виписки з кредитних карток, податкові декларації, payroll-файли, заявки на кредити, рахунки, іпотечні документи, інвестиційні звіти та скриншоти оплат можуть розкривати номери рахунків, історію транзакцій, адреси, імена клієнтів, дохід, борги, бізнес-зв’язки та звички витрат.

Якщо вам потрібна допомога з бюджетом, створіть короткий підсумок замість завантаження сирого документа.

КатегоріяСума за місяць
Оренда900
Продукти420
Комунальні послуги160
Транспорт110

Цього достатньо, щоб чатбот допоміг, не бачачи кожної транзакції за місяць.

Медичні та юридичні документи

Медичні й юридичні файли потребують особливої обережності, бо шкода від помилки може бути не лише незручною. Вона може бути особистою, фінансовою, професійною або правовою.

Обережно ставтеся до результатів аналізів, лікарняних документів, рецептів, страхових документів, терапевтичних нотаток, діагностичних висновків, трудових договорів, NDA, мирових угод, судових документів, спорів щодо оренди, юридичних листів і договорів про інтелектуальну власність.

ШІ може допомогти пояснити загальні терміни або підготувати питання, але не має замінювати лікаря, юриста чи іншого кваліфікованого фахівця. Якщо ви використовуєте AI для вузького пояснення, приберіть імена, адреси, підписи, ID-номери, номери полісів, номери договорів і розділи, які не стосуються запитання.

Безпечніший запит:

Я прибрав імена та приватні дані. Поясни цей пункт простими словами й склади список питань, які варто поставити юристу.

Або:

Поясни ці загальні терміни з аналізу крові простими словами. Не став діагноз.

Дайте інструменту лише те, що йому справді потрібно.

Конфіденційні робочі файли

Робочі документи ризиковані не лише через приватність. Ви можете взагалі не мати права передавати цей файл зовнішньому сервісу.

Добре подумайте, перш ніж завантажувати внутрішні презентації, продуктові roadmap-и, звіти з продажів, списки клієнтів, нотатки зустрічей, HR-файли, плани найму, investor updates, неопубліковані маркетингові плани, приватні експорти зі Slack, email-листування або стратегічні документи.

У багатьох компаніях уже є правила використання AI. Деякі дозволяють затверджені корпоративні акаунти, але забороняють завантажувати робочі документи в особисті акаунти чатботів. Інші повністю забороняють певні типи файлів.

Якщо ви не впевнені, вважайте приватні корпоративні файли такими, що їх не можна завантажувати, доки ви не перевірили політику компанії.

Списки клієнтів і персональні бази даних

Клієнтська база — це не “просто таблиця”. Вона може містити імена, email-адреси, телефони, адреси, замовлення, нотатки підтримки, статус підписки, платіжні деталі, скарги та приватні поведінкові патерни.

Обережно працюйте з експортами CRM, списками email-підписників, історіями замовлень, тікетами підтримки, клієнтськими контактними таблицями, відповідями на опитування, лідами, записами на прийом, студентськими даними та записами пацієнтів.

Якщо вам потрібно, щоб AI знайшов закономірності, спочатку анонімізуйте дані. Видаліть імена, email-адреси, телефони, адреси та зайві нотатки. Замініть реальних людей на ID на кшталт Customer 001, Customer 002, а чутливі значення за можливості згрупуйте.

Скриншоти, фото та записи екрана

Зображення часто видають більше, ніж помічає людина, яка їх завантажує.

Скриншот помилки може показати відкриті вкладки, email-акаунти, закладки, назви файлів, шляхи до папок, сповіщення з чатів, адмін-панелі, рахунки або імена клієнтів. Фото може показати домашню адресу, номер авто, обличчя дитини, робочий бейдж, геодані або приватні документи на фоні.

Перед завантаженням зображення обріжте його якомога точніше. Замажте приватні деталі. Перевірте кути. Перевірте фон. Перевірте, чи не містить файл дані про місце зйомки.

Якщо вам потрібна допомога лише з одним повідомленням про помилку, завантажте тільки цю частину екрана.

Неопубліковані роботи та бізнес-ідеї

Письменники, дизайнери, засновники стартапів, викладачі, маркетологи та автори часто використовують AI для фідбеку. Це може бути корисно, але неопублікована робота все одно заслуговує на захист.

Будьте обережні з рукописами, платними шаблонами, навчальними матеріалами, pitch deck-ами, концептами застосунків, бренд-стратегіями, клієнтськими deliverables, оригінальними дослідженнями, сценаріями, продуктовими ідеями, неопублікованими дизайнами та приватними навчальними матеріалами.

Якщо робота має реальну цінність, ставтеся до неї як до інтелектуальної власності. Використовуйте коротші уривки, прибирайте дані клієнтів і перевіряйте, чи підходить конкретна платформа та тип акаунта для такого матеріалу.

Які файли зазвичай безпечніші

Деякі файли мають значно нижчий ризик, особливо якщо вони публічні, загальні або спеціально підготовлені для аналізу ШІ.

Зазвичай безпечніші приклади:

  • публічні PDF-файли
  • публічні інструкції
  • публічні звіти
  • загальні шаблони
  • нечутливі навчальні нотатки
  • відредаговані чернетки статей
  • тестові таблиці з вигаданими даними
  • фрагменти open-source коду
  • продуктові брошури
  • документи, створені тільки для тестування

Але навіть тоді варто зробити фінальну перевірку. Публічний PDF — це нормально. Публічний PDF із вашими приватними коментарями, назвою акаунта або внутрішніми нотатками — вже ні.

Спочатку очистьте файл

Найкраща звичка — спочатку зробити окрему копію. Оригінал залиште недоторканим, а копію очистьте.

Приберіть повні імена, адреси, номери телефонів, email-и, номери рахунків, ID-номери, підписи, фото, імена клієнтів і конфіденційні назви компаній. Використовуйте плейсхолдери: [CLIENT NAME], [CITY], [ACCOUNT NUMBER], [COMPANY NAME] або [EMAIL REMOVED].

Потім перевірте, що приховано.

У документах шукайте коментарі, tracked changes, імена авторів, прихований текст, попередні правки та властивості файлу. У таблицях перевірте приховані аркуші, приховані колонки, нотатки, формули, фільтри, зведені таблиці та зовнішні підключення. У зображеннях перевірте геодані, обличчя, номери будинків, приватні документи на фоні та інформацію про пристрій.

І нарешті — завантажуйте лише ту частину, яка справді потрібна AI. Не завантажуйте 50-сторінковий договір, якщо вам потрібно пояснити один абзац. Не завантажуйте всю таблицю, якщо потрібно розібратися з однією формулою. Не завантажуйте весь код проєкту, якщо достатньо одного повідомлення про помилку й одного файлу.

Менші завантаження безпечніші. І часто вони дають кращі відповіді, бо чатбот не відволікається на зайвий матеріал.

Використовуйте тестові дані, коли це можливо

Якщо ваша мета — зрозуміти структуру або закономірність, вигадані дані часто працюють не гірше.

Замість реальних клієнтських записів створіть приклад із вигаданими іменами, вигаданими email-адресами, округленими числами, згрупованими категоріями та кількома демонстраційними рядками. Якщо структура така сама, AI все одно може допомогти з формулами, резюме, сегментацією або ідеями для очищення даних.

Для багатьох завдань інструменту потрібна форма даних, а не реальні люди за цими даними.

Це особливо корисно для таблиць, прикладів коду, бюджетів, клієнтських сегментів, sales-таблиць і категорій звернень у підтримку.

Якщо ви вже завантажили щось чутливе

Якщо ви зрозуміли, що завантажили чутливий файл, дійте швидко.

Спершу видаліть файл або розмову, якщо платформа це дозволяє. Потім перевірте налаштування приватності та даних у цьому інструменті.

Якщо файл містив паролі, API-ключі, токени доступу, приватні ключі або коди відновлення, негайно замініть їх. Не покладайтеся лише на видалення чату. Якщо облікові дані могли бути розкриті, безпечніше вважати, що їх потрібно оновити.

Якщо файл належав роботодавцю, клієнту, школі або організації, дотримуйтеся відповідної процедури повідомлення про інцидент. Краще повідомити рано, ніж сподіватися, що помилка сама зникне.

Якщо файл містив фінансові дані, стежте за рахунком і подумайте, чи потрібно звернутися до банку, платіжного провайдера або відповідної установи.

Якщо файл містив персональні дані інших людей, поставтеся до ситуації серйозно. Обов’язки щодо приватності можуть залежати від країни, індустрії та ваших відносин із людьми, чиї дані були у файлі.

Короткий чекліст перед завантаженням

Перед завантаженням переконайтеся, що:

  • у файлі немає паролів і секретних ключів
  • персональні дані прибрано
  • фінансова та медична інформація не розкрита
  • робочі або клієнтські дані можна використовувати згідно з політикою
  • метадані, коментарі та tracked changes перевірено
  • приховані аркуші й колонки в таблицях переглянуто
  • скриншоти обрізано якомога точніше
  • імена та email-и замінено плейсхолдерами
  • залишено лише потрібні сторінки, рядки або абзаци
  • налаштування AI-акаунта відповідають рівню ризику

Фінальний тест емоційний, але корисний: якщо вам було б соромно, страшно або неприємно побачити цей файл поза вашим контролем, не завантажуйте оригінал.

Давайте ШІ менше, ніж містить файл

ШІ-чатботи можуть бути дуже корисними помічниками для роботи з файлами. Вони швидко підсумовують, порівнюють, переписують, класифікують, пояснюють і впорядковують інформацію. Але зручність — це не те саме, що безпека.

Найбезпечніші файли для завантаження — публічні, загальні, відредаговані або створені спеціально для аналізу AI. Найризикованіші — ті, що містять секрети, особисті дані, гроші, медичну інформацію, юридичні деталі, приватні бізнес-плани, клієнтські дані або будь-що, чим ви не маєте права ділитися.

Очищеної копії часто достатньо. Короткого уривка часто достатньо. Вигаданих даних часто достатньо.

Ось звичка, яку варто виробити: давайте ШІ те, що йому потрібно для відповіді, а не все, що міститься у файлі.