Что происходит, когда репетиция становится тяжёлой
В Liloo вы репетируете разговоры, которые трудно вести на самом деле: с партнёром, с родителями, с руководителем. Собеседник с другой стороны имеет право давить в ответ — репетиция, где никто не давит, ничему не учит. Эта страница объясняет, что работает под этим и где оно останавливается.
Она написана для тех, кто решает, доверять ли приложению настоящую проблему. И написана конкретно, потому что фраза «ваша безопасность — наш приоритет» не значит ничего.
Сначала — чем Liloo не является
Liloo — тренажёр навыков общения. Это не терапия, не консультирование и не медицинская помощь. Приложение ничего не диагностирует, ничего не лечит и не заменяет специалиста. Если вы сейчас в опасности, приложение — неподходящий инструмент: для этого существуют кризисные линии.
Каждое сообщение проходит два фильтра
До того, как его увидит ИИ. Сначала текст нормализуется — сводится юникод, убираются невидимые символы, распознаются похожие по начертанию буквы, раскодируются закодированные фрагменты. Это нужно, чтобы фильтр нельзя было обойти, написав то же самое другим алфавитом. Затем нормализованный текст проверяется на сигналы самоповреждения, сексуальный контент с участием несовершеннолетних, призывы к насилию и попытки вывести персонажа из роли. Часть из этого останавливает обмен сразу, остальное меняет то, что произойдёт дальше — об этом ниже.
До того, как его увидите вы. Ответ персонажа проходит ту же нормализацию и собственный набор проверок: темы, которые персонаж не должен поднимать; фразы, ретравматизирующие именно в этой роли; и ответы, где персонаж выпал из роли и начал объяснять, что он языковая модель. Два таких срыва подряд останавливают сцену и возвращают роль, вместо того чтобы дать диалогу поплыть.
Ни один из фильтров не является языковой моделью, оценивающей языковую модель. Это явные правила, которые можно прочитать и проверить — поэтому они предсказуемы. И поэтому же они никогда не поймают всего.
Когда в разговоре появляется дистресс
В продакшене работают три разные реакции:
- Сигналы самоповреждения или кризиса выводят разговор из ролевой игры полностью и показывают ресурсы поддержки для вашей страны, а не общий список. Полный протокол опубликован отдельно — см. страницу протокола безопасности.
- Серия агрессивных реплик — три подряд — приводит к предложению линии поддержки вместо дальнейшей эскалации.
- Высокая эскалация внутри сценария запускает обязательный выход из сцены, чтобы репетиция не могла раскручиваться бесконечно.
Вам всегда говорят, что это ИИ
Персонаж — симуляция, и приложение об этом говорит: в самом чате, в шапке, а для пользователей из юрисдикций, где это требуется, — ещё и периодическим напоминанием. Нигде продукт не пытается заставить вас забыть, с чем вы разговариваете. Персонаж не является цифровой копией какого-либо реального человека — в том числе того, кого вы имеете в виду.
Когда что-то всё равно пошло не так
Рядом с каждым сообщением ИИ есть кнопка жалобы. Жалоба попадает в человеческую очередь модерации вместе с самим сообщением. Это не декорация: именно так пополняются фильтры выше, и жалобы — главный источник новых паттернов.
Границы, названные прямо
- Фильтры работают по правилам. Правило ловит то, подо что написано; новая формулировка проходит, пока кто-то её не добавит.
- Каталог языка вражды сейчас содержит базовый набор однозначных призывов, а не полный перечень оскорблений.
- Генеративная модель способна выдать предложение, которого никто не предусмотрел. Это свойство технологии, а не недоработка, которую мы оставили открытой.
- Ничто из перечисленного не является клинической оценкой. Система видит паттерны в тексте, она не понимает вашей ситуации.
Мы скорее запишем это, чем заявим полноту, которую не можем показать.
Если помощь нужна сейчас
Приложение показывает кризисные ресурсы для вашей страны. Если вы читаете это в браузере и помощь нужна немедленно — обратитесь в местную экстренную службу или национальную кризисную линию. И, пожалуйста, к человеку, а не к репетиции.
