AI Safety: что можно доверять ИИ, а что нельзя. 5 уровней ваших данных и где проходит граница
Что можно доверять искусственному интеллекту, а что нельзя, если он не просто хранит ваши данные, а понимает вас и может влиять на ваши решения?
Ведущий показывает, что отключение обучения не решает главного вопроса: чаты в ChatGPT продолжают храниться, удаляются тридцать дней, а удалить их по теме не дают ни ChatGPT, ни Gemini, ни Anthropic. Отдельная система решает, отправлять ли запрос модераторам — в кейсе с убийством в Канаде сотрудники OpenAI отказались передавать запросы правоохранительным органам, — а Google хранит проверенные чаты до трёх лет. Главный риск для Александра Волчека — не реклама, а портрет человека: система, которая понимает, как вы думаете и чего боитесь, получает карту того, как с вами разговаривать. Пять уровней данных — от зелёного до чёрного — дают рамку, а его собственный вывод неожиданный: личные мысли ценнее анализов крови и доступа к счетам, который просит GPT Finance.
На что обратить внимание
Ключевые тезисы и выводы
Почта и раньше хранилась в облаке, банки видели транзакции, телефоны хранили переписки, но искусственный интеллект добавляет новый слой — он может всё это понять. Систему, которую можно научить понимать человека, можно научить и влиять на него: не рекламой кроссовок, а советом, аргументом и формулировкой, меняющей решение. Поэтому разговор идёт не о паранойе, а о взрослой работе с ИИ — что ему доверять, что нет и где границы.
Есть страны, где записываются все телефонные звонки — в России это закон Яровой, — и записи лежат несколько лет, удалить их нельзя. Раньше для анализа один человек должен был прослушать звонки или искать по транскрибации упоминания людей и действий. Сегодня вывод о том, рассуждал ли человек на определённые темы, занимает меньше секунды, и дело уже не в скорости, а в том, что система может воспользоваться тем, кто вы такой.
ChatGPT базово обучается на данных пользователя, но даже с отключённым обучением все чаты продолжают храниться, а удалённый чат удаляется тридцать дней, а не сразу. Человек обычно решает удалить данные, когда появляется угроза, — а значит, угроза уже существует, и данные ещё тридцать дней, а может быть, и дольше остаются доступны. Удалить чаты по определённой теме не дают ни ChatGPT, ни Gemini, ни Anthropic; сам ведущий чаты не удаляет и осознанно меняет конфиденциальность на качество работы системы.
Каждый запрос теперь попадает в модель, которая рассуждает, и внутри неё есть блок безопасности: защита от дистилляции — Китай запускает десятки тысяч ботов, чтобы обучать свои модели на ответах американских, — законы стран и внутренние правила компаний. OpenAI, Anthropic, xAI и Gemini различаются по стилю и качеству ответов, и ответ зависит от страны, IP-адреса, регистрации аккаунта, предыдущих чатов, языка и промта. Американские компании договорились не рассказывать, как делать бомбы и химическое оружие, но в остальном чату приходится выбирать, что отвечать людям в странах с разными законами.
Сначала запрос проверяют автоматизированные модераторы, потом человек. В кейсе с убийством в Канаде запросы убийцы в ChatGPT ушли на проверку сотрудникам OpenAI, и те отказались передавать их правоохранительным органам. Расшаренные чаты ChatGPT целиком попадали в интернет, а Google прямо пишет, что проверенные чаты могут храниться до трёх лет, хотя обычные удаляются через восемнадцать месяцев. Разговор с адвокатом или врачом в Америке нельзя вынести на общее рассмотрение, а разговор с ChatGPT или Gemini — можно.
Реклама кроссовок — слабый уровень; настоящее влияние начинается там, где система знает, чего вы боитесь, что для вас важно и где у вас деньги. Даже после удаления чатов система уже обучилась тому, кто вы: она видит слабости, мечты, конфликты, кто на вас влияет и где у вас слабая позиция. Раньше влияние стоило дорого — нужен был психолог, продавец, политтехнолог, — теперь его можно масштабировать, и, отдавая данные, вы отдаёте карту того, как с вами разговаривать.
OpenAI и Google с Gemini действуют в рамках законов США: AGI, к которому они стремятся, не должен использоваться против граждан США, но может — для защиты страны, а значит, и против граждан других стран в случае войны. В Китае все системы проходят через государственную систему контроля, которую строили десятилетиями: ещё пять лет назад политически отрицательное сообщение в WeChat вызывало уведомление о нарушении закона, а камеры фиксируют даже мусор в неположенном месте. Системы, создаваемые в Иране, России или Китае, полностью под контролем, и на их данных чаты могут обучаться бесконечно.
Лидеров по моделям два — США и Китай, но у США феноменальный отрыв. У одного ChatGPT миллиард еженедельных пользователей, во всём Китае суммарно шестьсот миллионов, у Gemini больше восьмисот миллионов ежемесячных, а у Google в поиске миллиард. Денег и инфраструктуры в США в десятки раз больше: Anthropic, xAI и OpenAI готовят размещение на бирже, xAI — через SpaceX Илона Маска, а Goldman Sachs ждёт роста рынка инфраструктуры AI до более чем семи триллионов долларов за пять лет.
Системы всё лучше диагностируют попытки обойти санкции и ограничения доступа — не из-за санкций, а потому что OpenAI и Anthropic не заинтересованы в использовании своих систем на внешних рынках и работают в интересах определённых людей, кланов и государства. В Европе жёсткая регуляция и права пользователей, но магического исчезновения данных нет; Павел Дуров, Apple и Илон Маск говорят, что Европа требует делиться данными, чтобы управлять людьми, — и ведущий с этим согласен. Данные живут в правовом мире, а не в вакууме, и разбираться нужно в правилах своей страны.
Зелёный — общие вопросы вроде болезни цветка или выбора крупы; жёлтый — личные мысли, планы и черновики, которые ведущий называет фундаментом настоящего AGI; оранжевый — работа, договоры, код и клиентские данные. Красный — финансы, медицина, налоги, паспорта и юридические конфликты; чёрный — пароли, приватные ключи и чужие персональные данные без права на них, которые в обычный чат отдавать надо очень аккуратно. Ведущему странно, что мир ставит рабочие данные выше мыслей человека.
У ведущего записаны тысячи часов собственных мыслей за десять с лишним лет, и они кажутся ему важнее показателей крови, холестерина или УЗИ, хотя мир считает медицинские данные более чувствительными. Свои налоговые декларации он спокойно загружает в ChatGPT — там нет номера социального страхования, — но не призывает других повторять. Новый модуль GPT Finance, по его мнению, сделан ради доступа к финансам пользователя, а это гораздо менее важная информация, чем мысли: именно через них на человека смогут влиять в реально большом объёме.
О чём этот выпуск
Соло-выпуск ToTheMoon с Александром Волчеком об AI Safety и приватности. Самое личное люди теперь пишут не в дневник, а в ChatGPT — работу, деньги, здоровье, отношения, документы, страхи и планы. Ведущий сразу оговаривается: искусственный интеллект не опасен, с ним надо работать больше, но чат — не окно для текста, а система, которой человек отдаёт контекст своей жизни и которая способна его понять.
Первая часть — о том, как хранятся данные. ChatGPT базово обучается на данных пользователя, но проблема не в обучении: даже с отключённым обучением чаты хранятся, удалённый чат удаляется тридцать дней, а удалить тысячи чатов по одной теме не позволяют ни ChatGPT, ни Gemini, ни Anthropic. Сам ведущий чаты не удаляет — он осознанно меняет конфиденциальность на качество работы системы. Экспорт чатов сделать можно, но проанализировать их получится только своей программой через API, в Codex или с помощью Claude.
Дальше — что происходит с запросом внутри думающей модели. Там есть блок безопасности: защита от дистилляции — Китай, по словам ведущего, запускает десятки тысяч ботов, чтобы обучать на ответах американских моделей свои, — законы стран, внутренние правила компаний и разный стиль ответов у OpenAI, Anthropic, xAI и Gemini в зависимости от страны, IP-адреса, языка и предыдущих чатов. Отдельная система решает, отправлять ли запрос модераторам: в кейсе с убийством в Канаде запросы убийцы ушли на проверку сотрудникам OpenAI, и те отказались передавать их правоохранительным органам.
Google прямо пишет, что часть чатов читают проверяющие, а проверенные данные хранятся до трёх лет — притом что обычные чаты удаляются через восемнадцать месяцев или раньше по настройкам. Ведущий вспоминает жалобу Павла Дурова на Францию, где данные о покупках в блокчейне утекали от чиновников к преступникам, истории со слитыми переписками ВКонтакте и напоминает: разговор с адвокатом или врачом в Америке защищён, разговор с ChatGPT или Gemini — нет.
Центральный тезис — про влияние. Реклама кроссовок — слабый уровень; настоящее влияние начинается там, где система понимает, как вы думаете, чего боитесь и где ваши деньги. Раньше влияние было дорогим — нужен был психолог, продавец, политтехнолог; теперь его можно масштабировать, и, отдавая данные, человек отдаёт карту того, как с ним разговаривать. Системы будут всё больше обучаться на данных каждого человека, включая голос: собственная система ведущего уже учится по голосам участников ToTheMoon, а запретить это трудно, когда голос выложен в Instagram и YouTube.
Много времени отведено странам. OpenAI и Google связаны с правительством США, и AGI по их документам не должен использоваться против граждан США, но может — для защиты страны. В Китае все системы проходят через государственный контроль, и WeChat ещё пять лет назад присылал уведомления за политические сообщения. Лидеров два — США и Китай, но у ChatGPT миллиард еженедельных пользователей против шестисот миллионов во всём Китае, а денег в США в десятки раз больше; Anthropic, xAI и OpenAI идут на биржу, а Goldman Sachs оценивает рынок инфраструктуры AI через пять лет более чем в семь триллионов долларов. Европа со строгой регуляцией, Россия и Китай — разные правовые миры, и данные живут в них, а не в вакууме.
Финал — пять уровней данных: зелёный (общие вопросы), жёлтый (личные мысли и черновики), оранжевый (работа, договоры, код, клиентские данные), красный (финансы, медицина, налоги, паспорта) и чёрный (пароли, приватные ключи, чужие персональные данные). Ведущий спорит с этой иерархией: тысячи часов его записанных мыслей важнее показателей крови, а новый модуль GPT Finance просит доступ к финансам, которые для влияния значат меньше, чем мысли. Сам он спокойно загружает налоговые декларации в ChatGPT — без номера социального страхования — и заканчивает вопросом: видите ли вы в том, что ИИ понимает вас всё лучше, плюс или минус.
Выпуск полезен тем, что переводит разговор о приватности с уровня «отключите обучение» на уровень, который действительно имеет значение: не где лежат данные, а кто и на каком основании может их прочитать и что система, понявшая человека, способна с этим пониманием сделать. Пять уровней данных — удобная рамка, но главная мысль ведущего идёт против неё: самое ценное и самое уязвимое — не пароли и не счета, а мысли, и именно их люди отдают ИИ охотнее всего.
Расшифровка выпуска
Голосовая связка применена к 62 сегментам: 0 определено, 0 содержат несколько определённых участников, 62 вероятных, 0 остаются без окончательной идентификации. Неподтверждённые голоса обозначены как «Участник дискуссии», фрагменты с несколькими подтверждёнными участниками — как «Микс».
Читать транскрипт на отдельной странице
Загрузка…