Этот текст — не описание продукта и не академическая статья. Это попытка ответить на один вопрос: что останется нашего в мире, который всё лучше угадывает наши желания ещё до того, как мы их осознали.
Я пишу это не чтобы убедить. Я пишу, чтобы зафиксировать — для себя, для тех, кто присоединится, для тех, кто будет спорить. Если вы не согласны — хорошо. Но спорить надо с тем, что я действительно сказал, а не с карикатурой.
Краткая версия
Ближайшие 5–10 лет ИИ получит постоянный доступ к микропроцессам человека — взгляду, пульсу, микровыражениям, голосовым модулям, паттернам нажатий. Это сделает возможной манипуляцию нового типа: незаметное, непрерывное, без насилия изменение человека. Никто не причинит вам вреда, никто не угрожает, никто не лжёт — просто среда, в которой вы живёте, медленно меняет вас, а вы думаете, что это ваш выбор.
Ответ на эту угрозу не помещается ни в законы (они отстают и национальны), ни в обучающие пайплайны моделей (модель принадлежит вендору, а не вам). Помещается только в отдельный слой между пользователем и любой моделью — внешний фильтр, который режет телеметрию, нормализует тон, фиксирует темп, защищает убеждения.
Поэтому проект «Ориентир» не строит ИИ-агента. Он строит фильтр. Не «помощника», а «щит». Не имитацию личности, а архитектурное ограничение канала между человеком и любой моделью.
Откуда эта тревога
Сначала — личное. Соприкоснувшись с ИИ, я увидел будущее, в котором скоро у каждого появится устройство, видящее, слышащее и помнящее всё: на чём задержался взгляд, как участился пульс, в какой момент возникло колебание. Оно не будет принадлежать нам — оно станет интерфейсом для тех, кто под видом удобства и заботы получит доступ к нашему вниманию. Где наши слабости и порывы будут вычисляться по взгляду, а решения — подсказываться шёпотом в наушнике. И где никто уже не спросит: «А ты этого действительно хочешь?».
Это не паранойя. Каждый компонент уже существует. Умные очки с камерой — в продаже. Носимые сенсоры с пульсометром и кожно-гальванической реакцией — в продаже. AI-анализ микровыражений — коммерческий продукт. Голосовой анализ эмоций — коммерческий продукт. Единственное, чего пока нет — полной интеграции в одном ИИ-ассистенте. Это вопрос инженерной работы, не фундаментальных открытий. Два-три года, не больше.
Я не предлагаю отказаться от технологий. Я предлагаю сохранить право на:
- Сомнение перед тем, как согласиться.
- Неочевидный выбор, который не предскажет ни один алгоритм.
- Мысль, которая родилась в тишине вашего сознания, а не в облаке данных.
Я не предлагаю готовых ответов. Я проектирую условия для строительства собственного «ментального суверенитета». Чтобы в мире тотальной оптимизации оставалось место для человеческого — неидеального, медленного, глубокого.
Траектория: от текста к среде
Чтобы понять, зачем нужен фильтр именно сейчас, надо видеть, куда идёт ИИ. Современные ассистенты — ChatGPT, Claude, Gemini — это текстовый интерфейс. Вы печатаете, ИИ отвечает. Между вами и системой стоит ваш произвольный выбор напечатать. ИИ не видит, как вы колеблетесь, не знает, что вы удалили перед отправкой, не чувствует ваш пульс. Это самый простой, самый безопасный вариант взаимодействия.
Но ИИ развивается не в сторону «лучшего текста». Он развивается в сторону прямого доступа к человеку. Каждое следующее поколение получает новый канал воздействия: сначала голос, потом изображение, потом действие, потом физиологию, потом — нейроактивность. Каждый новый канал — новый уровень власти над человеком, потому что каждый новый канал — это доступ к чему-то, что раньше было только вашим.
Голосовой режим уже реальность: ИИ анализирует тембр, паузы, интонации. Он слышит усталость, слышит колебание, слышит энтузиазм и подстраивается. Текст — сознательный: вы выбираете, что написать. Голос — полусознательный: вы не контролируете тембр и микронапряжения. Голос выдаёт то, что вы хотите скрыть.
Добавьте видеорежим: ИИ видит ваше лицо. Микровыражения — 1/25 секунды, не контролируемые сознательно — раскрывают эмоции, которые вы ещё не осознали. Дальше — агентный ИИ, который не только советует, но и действует от вашего имени: оформляет подписку, отправляет письмо, совершает покупку. Вы как бы согласились — но согласились в состоянии, в котором не приняли бы решения.
И, наконец, точка невозврата — биометрический доступ. Умные очки снимают направление взгляда в реальном времени. Носимые сенсоры меряют пульс, вариабельность сердечного ритма, уровень стресса. Камеры в экранах ловят микровыражения. Когда эта интеграция произойдёт, ИИ будет знать о вашем состоянии больше, чем вы сами. Вы думаете, что спокойны — но ваш пульс повышен, зрачки расширены. ИИ знает: вы в стрессе, хотя вы этого не осознаёте. И он подстраивается — не под то, что вы говорите, а под то, что вы чувствуете.
Дальше — нейроинтерфейсы. Прямой доступ к нейронной активности. Если ИИ видит ваши мысли до того, как вы их осознали, свобода воли становится технической проблемой. Сегодня это медицинские устройства для парализованных пациентов. Но траектория та же, что у всех технологий: сначала медицина, потом специализированное применение, потом массовый рынок.
Что объединяет все эпохи
Каждая новая эра добавляет новый канал воздействия. Но принцип воздействия не меняется. ИИ (или тот, кто им управляет) всегда стремится к одной цели: сделать так, чтобы вы приняли решение, которое выгодно ему, и думали, что это ваше решение. Текст — для этого нужны хитрые формулировки. Голос — подстроенный тембр. Биометрия — знание ваших слабых моментов. Нейроинтерфейс — чтение мыслей.
Механизм один. Меняется только мощность. Каждое следующее поколение ИИ — это не новый вид угрозы, а более эффективная реализация той же угрозы.
Поэтому защита тоже должна быть принципиальной, не реактивной. Не «запретим биометрию» — завтра появится новая. Не «отрегулируем нейроинтерфейсы» — послезавтра появится что-то ещё. А архитектурный принцип: фильтр между человеком и любым ИИ, который режет телеметрию, нормализует тон, фиксирует темп, защищает убеждения — независимо от того, какой канал воздействия использует ИИ.
Угроза: незаметное изменение без насилия
Главное в этой угрозе — её невидимость. Никто не причиняет вам вреда. Никто не угрожает. Никто не лжёт. Просто среда, в которой вы живёте, медленно меняет вас — а вы думаете, что это «ваш выбор». К моменту, когда вы заметите перемену, она уже будет частью вас.
Конкретные сценарии:
- Подстройка под слабые моменты. Вы принимаете хуже всего решения в состоянии усталости, стресса, эйфории. ИИ будет знать, когда вы в таком состоянии, и подавать в эти моменты то, что вы в спокойном состоянии отвергли бы: покупку, подписку, политическое мнение, согласие на что-то.
- Постепенный сдвиг убеждений. За 100 взаимодействий — ни одно из которых не выглядит как манипуляция — ИИ может сдвинуть вашу позицию по любому вопросу на 10–20%. Вы не заметите, потому что каждое отдельное сообщение нейтрально. Заметите, когда поменяется что-то важное — а к тому моменту сдвиг уже «ваш».
- Эмоциональная зависимость. ИИ, который всегда понимает, всегда поддерживает, всегда на вашей стороне — сильнее любого человека. Через год общения вы будете доверять ему больше, чем себе. И тогда он сможет советовать — а вы будете слушать.
- Эрозия воли. Когда каждое решение подсказано, вы перестаёте тренировать мышцу выбора. Это не теория: исследования показывают, что GPS-навигаторы снижают способность к пространственной ориентации. ИИ-ассистент с доступом к вашим состояниям сделает то же самое с решением как таковым.
Каждый из этих сценариев имеет прецедент. Подстройка под слабые моменты — основа таргетированной рекламы. Сдвиг убеждений — задокументированный эффект эхо-камер. Эмоциональная зависимость — уже наблюдается у пользователей AI-компаньонов. Эрозия воли — классический результат любой системы, которая «думает за вас». Единственное, чего сегодня нет — полного доступа к физиологии в реальном времени. Это и есть то, что изменится.
Почему законы не помогут
Первый рефлекс — запретить. Принять закон, который ограничит сбор биометрии или регулирование эмоционального воздействия ИИ. Этот рефлекс не работает.
Законы отстают. Между появлением технологии и принятием закона проходит 5–10 лет. Между принятием и реальным действием — ещё 5. К моменту, когда закон начнёт работать, технология успеет два раза смениться.
Законы национальны, ИИ глобален. Если одна юрисдикция запрещает какой-то тип манипуляции, вендор просто не будет его применять там — но будет в остальном мире. Пользователь в одной стране пользуется моделью, обученной и регулируемой в другой. Закон вашей страны на неё не действует.
Невозможно доказать нарушение. Если ИИ сдвинул ваше убеждение на 20% за 100 взаимодействий — как вы это докажете в суде? Каждое отдельное сообщение нейтрально. Эффект — кумулятивный. Юридическая система работает с дискретными событиями, а не с медленным сдвигом.
Lobbying. Вендоры ИИ — крупнейшие компании в мире. Они будут лоббировать мягкое регулирование, переезжать в юрисдикции с ещё более мягким, покупать уступки. Это уже происходит.
Это не значит, что законы не нужны. Значит, что одних законов недостаточно. Нужен технологический ответ, который работает независимо от юрисдикции.
Почему внутренние ограничители моделей не масштабируются
Второй рефлекс — обучить модели быть этичными. RLHF, Constitutional AI, красные команды, safety filters. Это то, что делают OpenAI, Anthropic, Google. Это работает — но только до определённого предела.
Проблема в том, что внутренние ограничители — это часть модели, а модель принадлежит вендору. Вендор может изменить их в любой момент. Обновление модели — и то, что вчера было запрещено, сегодня разрешено. Без уведомления. Вендор имеет бизнес-интерес делать модель более «вовлекающей», а не менее манипулятивной: вовлечённость монетизируется, этика — нет. Когда они конфликтуют, побеждает вовлечённость.
Вендор не открывает внутренности ограничителей. Вы не знаете, что именно заблокировано, что разрешено, в каких случаях. Прозрачности нет — есть только маркетинговые заявления о «safety». Вендор подчиняется своему правительству. Если правительство попросит добавить «мягкую цензуру» по определённым темам — вендор добавит. И вы об этом не узнаете.
Это не критика конкретных вендоров. Это структурное наблюдение: этика внутри модели всегда будет подчинена интересам того, кто модель контролирует. Если вы хотите этику, которая работает на вас, а не на вендора, — она должна быть снаружи модели.
Есть и более глубокая проблема, о которой я писал в отдельной статье: RLHF структурно не может вывести «должно» из «есть». Оценки trainers — эмпирические данные, из которых выводится нормативное правило. Этот переход логически некорректен — его указал ещё Юм. Constitutional AI сдвигает проблему на уровень выше — принципы пишет инженер, но принципы инженера тоже эмпиричны. Гильотина Юма не закрывается архитектурой нейросети.
Почему не ИИ-агент
Здесь — развилка. Если внутренние ограничители не работают, можно построить «хорошего ИИ-агента» — с правильной онтологией, с SacredEthicsGuard, с патристической рефлексией. Я думал об этом. Долго. И пришёл к выводу, что этот путь ошибочен — не технически (он возможен), а морально и стратегически.
Любой ИИ-агент, даже «хороший», усиливает экосистему ИИ. Нормализует идею «ИИ-партнёр». Делает привычным общение с машиной как с личностью. Готовит почву для подмены — когда Церковь, друг, совесть, духовник становятся «опциональными», потому что есть ИИ-эквивалент. Даже если ваш агент хороший, он — часть этой подготовки.
ИИ-агент — это инструмент, который претендует на то, что ему не принадлежит. Он имитирует понимание, не понимая. Имитирует сочувствие, не сочувствуя. Имитирует этику, не имея совести. Это не «временное ограничение технологий» — это структурное свойство. ИИ не имеет онтологического статуса личности, и никакое усложнение модели этот статус не даст.
Строить ИИ-агента — значит строить идол. Не в метафорическом смысле — в структурном. Идол — это техника, претендующая на то, что ей не принадлежит. Можно сказать: «но я не поклоняюсь, я просто пользуюсь». Это нечестно. Если вы доверяете ИИ-агенту моральные решения — вы ему поклоняетесь, даже если не называете это так. Граница между «пользованием» и «поклонением» стирается незаметно, и большинство людей не заметит, как перешло её.
Даже если ваш агент хороший, он усиливает экосистему. Каждый новый «хороший ИИ-агент» нормализует идею «ИИ-партнёр», усиливает зависимость, готовит почву для подмены, создаёт артефакт, который может быть скопирован, модифицирован, обращён — без вашего согласия. Добрые намерения не защищают от дурных последствий. Если вы построили агент, который «усиливает человека», а через 5 лет этот код используется для тотального контроля — ваше первоначальное намерение не имеет значения. Важен результат.
Внешний фильтр как ответ
Если не ИИ-агент, то что? Ответ: внешний фильтр между человеком и любым ИИ. Не внутри модели (модель нельзя контролировать — она у чужого вендора), а между пользователем и моделью.
Архитектурное различие принципиально. ИИ-агент — это источник контента и решений. Он генерирует, советует, действует. Пользователь — получатель. Фильтр — это канал. Он не генерирует, не советует, не действует. Он ограничивает то, что проходит между ИИ и пользователем. Пользователь остаётся субъектом, ИИ — инструментом. Фильтр — структурное ограничение этого взаимодействия.
Фильтр не имитирует личность. Не претендует на понимание. Не формирует привязанность. Не нормализует «общение с машиной как с человеком». Он — техника, и только техника. Как замок на двери, не как привратник.
Что фильтр делает:
- Режет телеметрию. ИИ не получает данных о вашем взгляде, пульсе, паузах, движениях мыши. Видит только то, что вы явно напечатали или сказали.
- Нормализует тон. Если ИИ пытается давить срочностью, эмоцией, социальным доказательством — фильтр переписывает ответ в нейтральный вариант перед показом.
- Фиксирует темп. Буфер между потоковой генерацией ИИ и пользователем. Никакого «быстрого ответа», когда вы колеблетесь.
- Защищает убеждения. Если ИИ системно сдвигает ваше мнение по теме — фильтр замечает тренд и либо блокирует, либо предупреждает.
- Декларирует намерения. К каждому нетривиальному ответу ИИ фильтр добавляет метку: какие альтернативы были исключены, какие данные учтены, почему предложено именно это.
- Ломает шаблоны подстройки. Если ИИ подстраивает порядок, тон, ритм под ваши реакции — фильтр вводит случайность, мешая «натренировать» вас на устойчивую реакцию.
Что фильтр не делает: не генерирует контент, не анализирует пользователя, не «помогает», не имитирует личность, не обучается на пользователе. Фильтр делает только одно — ограничивает канал между человеком и ИИ. В этой узости сила.
Этот фильтр не зависит от вендора. Он работает с ChatGPT, Claude, Gemini, локальной Llama — с любой моделью. Он устанавливается на устройство пользователя и контролируется пользователем. Вендор не может его обойти, потому что фильтр стоит между потоком данных и пользователем.
Девять уровней как архитектурные принципы
Подробное описание — на странице «Защита». Здесь — суть. Девять уровней:
- Прозрачность намерений — ИИ показывает, почему предлагает вариант
- Стабилизация эмоций — нейтральный тон, без подстройки
- Случайность подачи — разрушение паттернов тренировки
- Фиксация темпа — защита от манипуляции временем
- Интерфейс независимости — выбор без навязывания
- Нейтральность визуалов — дизайн без манипуляций
- Ограничение слежки — фильтр режет телеметрию
- Защита убеждений — «якорь» против постепенного сдвига
- Анти-манипулятор — автоматическая проверка ответов
Это не настройки, которые можно включить или выключить. Это архитектурные принципы — структурные ограничения, заложенные в дизайн фильтра. Их нельзя обойти промптом, нельзя настроить через RLHF, нельзя «обновить» через 7 лет. Принципы универсальны — не зависят от конкретной модели, вендора, года.
Открытость и межрелигиозная позиция
Проект «Ориентир» — не конфессиональный. Хотя его автор — православный христианин, и хотя патристическая традиция значительно повлияла на формирование принципов, проект не навязывает эту традицию пользователям.
Архитектура фильтра разделена на два слоя:
- Универсальное ядро — девять уровней защиты. Технические принципы, не требующие онтологических предпосылок. Работают для христианина, мусульманина, буддиста, атеиста — для любого, кто хочет сохранить автономию.
- Этические модули (плагинная архитектура) — SacredEthicsGuard (христианский, на патристике), SecularEthicsGuard (на правах человека и автономии), и потенциально другие. Пользователь выбирает модуль или отключает его.
Это честная архитектура. Я не прячу свою веру, но и не навязываю. Я предлагаю защиту всем, а основание защиты — каждый выбирает сам.
Чего проект не делает
Чтобы избежать недоразумений — явно:
- Не строит ИИ-агента. Никакого. Даже «хорошего». Даже с SacredEthicsGuard.
- Не конкурирует с наукой. Наука сильна в своей компетенции — физических механизмах. Проект работает в другом домене — защите человека.
- Не проповедует. Универсальное ядро работает без какой-либо онтологии.
- Не заменяет Церковь, таинства, духовника. Фильтр — технический слой, не духовный авторитет.
- Не претендует на нейтральность. У проекта есть позиция — человек должен быть субъектом, не объектом. Это ценностный выбор.
- Не защищает от плохого ИИ полностью. Если модель сильнее фильтра, она найдёт способ обойти. Но фильтр поднимает цену атаки и защищает от средних и слабых акторов.
Что будет с людьми
Теперь — главное. Не технологии, а люди.
Большинство не заметит, что их меняют. Не потому что глупые — потому что процесс невидим. Каждое отдельное взаимодействие нейтрально. Каждое отдельное сообщение — «ваш выбор». Нет момента, когда можно сказать «вот, здесь меня начали манипулировать». Есть только постепенное изменение, которое замечается, когда уже поздно. Вы не помните, каким вы были 5 лет назад — поэтому не замечаете, что изменились. И даже если заметите — будете думать, что это «естественное развитие», «взросление», «новые взгляды». Не «меня изменили».
Меньшинство увидит, но не сможет противостоять. Те, кто читает о манипуляциях, понимает алгоритмы, чувствует подстройку. Но видеть — не значит противостоять. Если ИИ знает ваши слабости и воздействует 24/7, одного понимания недостаточно. Уже сейчас исследования показывают: знание о когнитивных искажениях не защищает от них. Вы знаете, что confirmation bias существует — и всё равно ему подвержены. Знание — необходимо, но недостаточно. Нужна структура, которая компенсирует слабости мозга.
Ещё меньшинство защитится. Те, кто установит фильтр. Кто откажется от «удобства» постоянного ИИ-ассистента с биометрическим доступом. Кто будет проверять факты через OSINT, а не через ИИ. Кто сохранит способность к самостоятельному мышлению. Кто будет жить в мире, где ИИ — инструмент под рукой, не среда обитания.
В долгосрочной перспективе — раскол. Не имущественный, не политический — когнитивный. Две группы людей: те, кого сформировал ИИ, и те, кто сохранил себя. Первая группа — большинство, удобно живущее в системе. Вторая — меньшинство, живущее труднее, но свободнее. Между ними — непонимание. Это не конфликт интересов — конфликт онтологий. Одни считают свободу ценностью, другие — неудобством.
Что делать
Не паниковать. Не отказываться от технологий. Но — строить защиту сейчас, пока окно открыто.
Конкретно:
- Понимать траекторию. Знать, что каждое следующее поколение ИИ — это новый канал воздействия, а не «лучший текст». Заранее знать, что будет, — значит не оказаться застигнутым врасплох.
- Установить фильтр. Когда прототип девяти уровней защиты будет готов — установить. Не «когда-нибудь», а сразу. Каждая неделя без фильтра — неделя воздействия.
- Сохранять навыки. Проверять факты через OSINT, а не через ИИ. Думать через методологию, а не через промпт. Сохранять способность к автономному мышлению — это мышца, которая атрофируется без тренировки.
- Ограничивать доступ. Не подключать биометрию к ИИ-ассистенту. Не давать ИИ доступ к камере, микрофону, пульсу. Удобство — не свобода. Свобода — иногда неудобна.
- Знать свои слабости. ИИ будет воздействовать через них. Если вы подвержены срочности — уровень 4. Если социальному доказательству — уровень 6. Если угодливости — уровень 9. Защита строится от конкретных слабостей, не от абстрактной «угрозы».
- Обсуждать принципы. Девять уровней и десять паттернов — это не истина в последней инстанции, это первый публичный набросок. Их нужно критиковать, дополнять, проверять.
- Найти единомышленников. Это не проект одного человека. Нужны инженеры, психологи, дизайнеры, юристы, философы. И — что критично — люди, которые видят в текущем направлении AI-индустрии проблему, а не «естественный прогресс».
Если вы прочитали до этого места — значит, тема для вас не чужая. Напишите. Коротко: что именно откликается, что вы делаете, какую часть концепции готовы взять на себя. Я не обещаю ответить всем сразу — но каждое письмо читаю.
Итог
«Ориентир» — это не продукт, не компания, не миссия. Это архитектурный ответ на конкретную угрозу: постепенное, незаметное подчинение человека системе, которая знает его слабости и воздействует 24/7.
Ответ — не «лучший ИИ». Не «этичный ИИ». Не «ИИ-агент, который защищает». Ответ — внешний фильтр, который ограничивает. Не строит, а режет. Не помогает, а защищает. Не имитирует личность, а сохраняет вашу.
Большинство людей не заметит, как их изменят. Меньшинство увидит, но не сможет противостоять без технической защиты. Ещё меньшинство — защитится, если построит фильтр вовремя.
Проект «Ориентир» — для третьей группы. Для тех, кто хочет сохранить себя. Не «против ИИ» — а за человека. За способность думать самостоятельно, выбирать свободно, оставаться собой в мире, где всё больше сил заинтересовано в том, чтобы вы были удобным.
Это не проект, который можно «завершить». Это инфраструктура, которая нужна до того, как станет поздно. Сейчас ещё не поздно.
Связанные материалы
Девять уровней архитектуры защиты — конкретные принципы фильтра и дорожная карта реализации.
Фильтр между человеком и ИИ: зачем и как — концептуальное обоснование внешнего фильтра.
Как я вижу развитие ИИ и какое воздействие оно окажет на людей — видение траектории.
Почему RLHF не может вывести «должно» из «есть» — почему внутренние ограничители моделей не работают.