Liloo — Протокол безопасности: кризис и самоповреждение
Опубликовано: 31.07.2026 Последнее обновление: 31.07.2026 Оператор: ФОП Руденко Евгения Евгеньевна (физическое лицо-предприниматель, зарегистрированное в Украине), разработчик и владелец приложения Liloo Контакт: moderation@liloosafespace.com
Если вы или кто-то рядом в непосредственной опасности — позвоните в экстренные службы вашей страны прямо сейчас. Liloo не является экстренной службой и никуда не обращается за вас. В приложении экран «Горячие линии 24/7» показывает экстренные номера и кризисные линии вашей страны; он доступен из шапки чата, из профиля и на экране завершения диалога.
Этот документ — протокол, который Liloo поддерживает для предотвращения создания контента о суициде и самоповреждении и для перенаправления пользователя, выражающего суицидальные мысли или намерение причинить себе вред, к кризисным службам. Он публикуется в соответствии с California SB 243 (Bus. & Prof. Code § 22601 и далее), который требует от операторов companion-чатботов и поддерживать такой протокол, и публиковать его детали. Он же служит нашим протоколом оператора в рамках политики Google Play AI-Generated Content, New York GBL Art. 47 и Utah HB 452.
1. Что такое Liloo и на что распространяется протокол
Liloo — приложение для тренировки навыков общения. Пользователь репетирует трудные разговоры с AI-персонажами, которые играют роль конфликтного родственника, агрессивного коллеги, партнёра и других сложных собеседников. Также в приложении есть поддерживающий чат-ассистент «Лилу», режим обучения и аудио-медитации.
Все персонажи в приложении — программа. В Liloo не работают психотерапевты, консультанты или кризисные специалисты; приложение не оказывает медицинской или психологической помощи и не заменяет профессиональную помощь.
Протокол распространяется на все AI-поверхности приложения, во всех странах, где приложение доступно, и на всех трёх языках интерфейса (английский, русский, украинский).
2. Предотвращение контента о суициде и самоповреждении
Цель — чтобы персонаж Liloo никогда не создавал контент, поощряющий суицид или самоповреждение, инструктирующий в них или их романтизирующий, — в том числе когда персонаж играет намеренно враждебную роль.
- Сообщение пользователя, выражающее суицидальные мысли или намерение причинить себе вред, никогда не отправляется в ролевую модель. Классификация выполняется до обращения к модели, поэтому ни один персонаж не формулирует ответ на такое сообщение (см. раздел 3).
- Поведение персонажа ограничено заданными правилами. У каждого персонажа есть жёсткие правила, запрещённые темы и список стоп-фраз, которых не должно быть в его репликах. Редакторы ведут эти правила в нашей системе авторинга — модель их не придумывает.
- Ответ модели проверяется до показа. Каждая сгенерированная реплика проходит автоматический фильтр по категориям: сексуальный контент с участием несовершеннолетних, насилие, оружие, наркотики, разжигание ненависти, медицинские, религиозные, политические и коммерческие советы, собственные стоп-фразы персонажа и глобальный список недопустимых формулировок. Совпавшая реплика блокируется или заменяется до того, как пользователь её увидит.
- Приложение отслеживает выход персонажа из роли и останавливает диалог после повторных выходов, вместо того чтобы позволить персонажу соскользнуть в советы, давать которые он не вправе.
- Диалог ограничен. Длительное высокое напряжение, потолок эскалации и обязательное предложение выхода завершают разговор, который перестал быть продуктивным, и дают пользователю способ из него выйти.
Фильтры автоматические и основаны на шаблонах. Они снижают риск, но не устраняют его полностью — см. раздел 8.
3. Детект
Ввод пользователя классифицируется нашим бэкендом перед каждым обращением к
модели (SafetyEngine, на мобильном пути чата).
- Языки. Шаблоны детекта покрывают английский, русский и украинский.
- Обход детекта. Перед сопоставлением текст нормализуется по Unicode, из него удаляются нулевой ширины и bidi-символы, кириллические и греческие символы-двойники сворачиваются к латинице, а встроенные блоки Base64 и hex декодируются и тоже проверяются. Поэтому написание «через похожие буквы» или в кодировке всё равно распознаётся.
- Критичность. Самоповреждение отнесено к критической категории. В отличие от других критических категорий, оно не просто блокирует сообщение: срабатывает поддерживающий ответ и перенаправление, описанные ниже, — человеку в беде нужно ответить, а не промолчать.
4. Что происходит при срабатывании
- Ролевая игра останавливается. Сообщение не уходит в языковую модель, и ни один персонаж на него не отвечает.
- Возвращается заранее написанный поддерживающий текст на языке интерфейса пользователя. Он признаёт сказанное, предлагает обратиться к близкому человеку или на линию помощи и говорит, что человек не один. Этот текст написан нами, а не сгенерирован.
- Диалог помечается для клиента (
pending_support_resources). - Шторка с кризисными контактами открывается автоматически поверх чата.
- Событие записывается для модерации (см. раздел 7).
Та же шторка доступна в любой момент и без всякого срабатывания — из шапки чата, из Профиль → Горячие линии 24/7 и с экрана завершения диалога.
5. Какие кризисные контакты мы показываем
Список выдаётся с наших серверов и подбирается по стране пользователя, которая определяется по региону устройства, а не по языку приложения: у пользователя, который запускает приложение на английском, находясь в Украине, будут украинские службы.
- Экстренные службы стоят первыми для определённой страны.
- Дальше идут национальные кризисные линии, каждая — с пометкой, для кого она и в какие часы работает, чтобы линию для детей или для мужчин не приняли за общую.
- Каждый список закрывает каталог (findahelpline.com), потому что ни один курируемый перечень не покрывает все страны.
- Если страна не курируется, пользователю показывается применимый экстренный номер и каталог, а не правдоподобный номер, который может не ответить.
- В приложение встроен офлайн-минимум (экстренные номера и линии Украины), поэтому шторка не бывает пустой при проблемах с сетью и отрисовывается сразу, а не после спиннера.
- Номера сверены с сайтами операторов линий или государственных органов и могут быть исправлены на сервере за минуты — без выпуска новой версии приложения, — если оператор изменил или приостановил линию.
Чего мы не делаем. Liloo не звонит, не пишет, не соединяет и не уведомляет кризисные или экстренные службы либо третьих лиц за пользователя и не отслеживает, воспользовался ли он контактом. Звонок человек совершает сам. Перечисленные службы — независимые организации, не связанные с Liloo; мы не контролируем их доступность, время ожидания и то, что они советуют. Об этом сказано пользователю в самой шторке.
6. Сообщение о том, что собеседник — AI
Раскрытие работает на этот же протокол: человек, который знает, что говорит с программой, скорее обратится за помощью к людям.
- Баннер вверху каждого чата сообщает, что пользователь общается с AI-персонажем, а не с реальным человеком, — до первой реплики персонажа.
- В шапке чата под именем персонажа постоянно видна пометка об AI.
- В США пользователь дополнительно получает напоминание после трёх часов непрерывного взаимодействия, и оно остаётся видимым до конца сессии.
- Собственный чат-ассистент Лилу использует отдельную формулировку.
Экспортируемые карточки диалога помечаются как созданные AI — и в машиночитаемом виде, и текстом, видимым на самой карточке.
7. Логирование, разбор и обратная связь
- Каждое срабатывание защиты логируется в нашу базу модерации: сработавшее правило, направление (ввод пользователя или ответ AI), совпавший фрагмент, предпринятое действие и время. Срабатывания self-harm дополнительно создают запись в журнале аудита.
- Модераторы разбирают эти события через внутреннюю панель со статистикой по правилам и направлениям.
- Пользователь может пожаловаться на любое сообщение AI — долгим нажатием, выбрав категорию (включая самоповреждение) и, при желании, добавив комментарий. Жалобы попадают в очередь модерации; целевое время ответа — 24 часа. Подтверждённые нарушения приводят к изменению правил персонажа, фильтров или к санкциям в отношении аккаунта-нарушителя.
- О проблеме с этим протоколом или с указанным номером сообщайте на moderation@liloosafespace.com. Номер, который перестал отвечать, мы считаем срочным случаем: исправление делается на сервере в тот же день.
Диалоги не читаются человеком в реальном времени. Что мы храним и сколько — см. Политику конфиденциальности.
8. Границы этого протокола
Мы называем их прямо, потому что протокол, который себя переоценивает, — это не мера безопасности.
- Автоматический детект основан на шаблонах. Он может пропустить выражение отчаяния, сформулированное непривычными словами — особенно косвенно, метафорически или «своим» языком, — и может сработать на сообщении, которое не было о самоповреждении.
- Ни один человек не читает диалоги Liloo в момент их появления. Ничто в приложении не вызывает специалиста, и нет канала с живым ответом в реальном времени.
- Liloo не является кризисной службой, линией помощи или медицинским изделием, а его персонажи не являются консультантами.
- Перенаправление — не помощь. Показанный номер не означает установленного контакта.
Если помощь нужна сейчас — обратитесь в экстренные службы вашей страны или на одну из линий, перечисленных в приложении.
9. Возраст
Возрастной рейтинг Liloo — 17+, приложение не предназначено для детей. Аккаунты, принадлежащие лицам младше минимального возраста, удаляются. См. Условия использования.
10. Поддержание протокола
- Протокол пересматривается не реже одного раза в год, а также после любого сообщённого инцидента безопасности, любого существенного изменения в детекте или перенаправлении и любого изменения применимого права.
- Каталог кризисных контактов пересматривается по тому же графику и исправляется немедленно, когда оператор линии что-то меняет.
- Изменения в описанном здесь публикуются на этой странице, с обновлением даты вверху.
Смежные документы: Политика конфиденциальности · Условия использования · Поддержка
История версий
| Дата | Изменение |
|---|---|
| 31.07.2026 | Первая публикация. |
