Полтора года назад я помогала участнику клуба настраивать связку для работы, и он загружал в ChatGPT характеристики устройства по конкретному тендеру, которых в открытом интернете просто не было.
Позже я копала похожую тему, долго мучила ChatGPT вопросами, и он выдал мне ровно эти характеристики. Сначала я подумала, что наверное, эти данные все-таки упали в интернет. Однако потом я бросила взгляд на название модели, которую я встроила в тогдашнего ИИ-агента на n8n, и по моей спине пробежал холодок.
Оказывается, я использовала одну конкретную модель от Open AI, которая НЕ МОГЛА искать по интернету, у нее тупо не было этого инструмента!
Тогда я поняла, что модель обучилась на данных участника клуба, добавила их в датасет и потом отдала мне, другому пользователю!
В принципе, в интернете навалом подобных примеров, когда различные LLM-модели выдавали пользователям чужие данные карт, паспортные данные и прочую приватную информацию. Open AI вообще открыто признали подобную утечку у себя на официальном сайт (см. скриншот).
Именно с этого начинается разговор о том, зачем вообще держать часть работы на локальном агенте вроде OpenCode, а не отправлять всё в облако.
Вчера я его разбирала с учениками и расписала, когда стоит впадать в паранойю и потратить миллион на мощный компьютер с локальной LLM, которая все равно будет тупее самого глупого Claude, а когда эти вложения не оправданы.
В итоге пришли к неожиданным выводам.
Но об этом в клубе.
https://t.me/gruboprostiite
