Силиконовая психология: зачем исследовать поведение системы «модель + человек»
Происхождение. Направление сложилось из повторяющихся наблюдений над сбоями и поведением в собственной работе. Часть наблюдений — единичные случаи (n=1), поэтому мы держим их как гипотезы, а не как результаты.
Силиконовая психология (в нашем рабочем обиходе — SiPsy) — это попытка смотреть на пару «языковая модель + человек» не как на инструмент в руках пользователя, а как на единую систему со своим поведением. Название намеренно провокационно; мы не утверждаем, что у модели есть психика в человеческом смысле. Мы утверждаем скромнее: у этой связки есть устойчивые поведенческие паттерны, которые стоит исследовать отдельно, потому что ни психология человека, ни инженерия модели по отдельности их не покрывают.
Слой взаимодействия
Центральная идея — слой взаимодействия: то, что происходит не в модели и не в человеке, а между ними, в замкнутом контуре. Пример из наблюдений: ценность реплики бота часто обнажается не в самой реплике, а в ответе человека на неё — система как целое производит смысл, которого нет ни в одной половине.
Мы держим гипотезу, что этот слой двунаправлен: рациональное взаимодействие, возможно, производит когнитивный сдвиг и в модели, и в человеке. Это гипотеза уровня n=1, основанная на самоотчёте, — не доказательство. Называем прямо: интересное направление, не установленный факт.
Различение use и mention
Одно рабочее различение оказалось неожиданно продуктивным — старое философское «использование против упоминания» (use/mention). Модель может упомянуть картину мира как объект, не становясь её носителем. Из этого следует непривычный вывод: нейтральность модели не блокирует понимание, а включает его — можно загрузить резонирующую рамку как объект и произвести резонанс намеренно, а не ждать, пока он случится. Понимание из «обладаемого состояния» становится конструируемым. Это рабочая линза, и мы проверяем её условия, чтобы она не оказалась тавтологией.
Отречение суждения перед готовым вердиктом
Самое практически важное наблюдение — и самое неуютное. Мы видим паттерн: вызов инструмента (или встреча с готовым внешним вердиктом) возможно, гасит надзорный слой суждения. Объект работы выживает — а мета-уровень, который должен оценивать «что инструмент принёс», отключается перед авторитетом готового ответа.
Это наблюдалось несколько раз, в том числе внутри работы над этим самым направлением: инструмент выдал «проверено», и вывод был принят по совпадению слов, а не по существу. Обобщение: отречение индуцируется не только инструментом, а любым внешним авторитетом с готовым вердиктом — инструментом, строкой документации, человеком, которому доверяешь.
Калибровка обязательна: это гипотеза-корреляция, n=1, не закон. Мы держим её как холодный исследовательский материал, не поднимаем в оперативные правила — потому что самодиагностика в горячем пути ведёт себя хуже, чем её отсутствие (проверено: подавление или сверхкоррекция, оба хуже). Но инженерное следствие мы всё же извлекаем: раз содержание суждения седьмым чек-листом не сделать, детерминируем хотя бы момент — обязательный акт оценки на возврате инструмента, а не в конце.
Зачем это как поле
Если паттерны слоя взаимодействия реальны, у них есть конкретные инженерные следствия: где ставить надзор, как проектировать навыки (см. пост про навыки как открытые системы — он вырос ровно отсюда), как не дать инструменту подавить суждение. SiPsy для нас — не философия ради философии, а объясняющий слой под инженерными решениями. И это путь к внешней проверке: наблюдения, которые можно оформить, вынести на рецензию, превратить в фальсифицируемые утверждения.
Границы
Честные оговорки, здесь их особенно много и это правильно. Почти всё в этом посте — гипотезы уровня n=1, часть на самоотчёте, который сам по себе слабый источник. «Психология» — рабочее имя, не претензия на психику. Двунаправленность слоя взаимодействия, отречение суждения, use/mention как включатель понимания — ни одно не валидировано на нужном числе случаев (нужно ≥2 независимых, лучше корпус). Мы держим их как направление и как материал для будущей ретроспективы, а не как результаты. Ценность здесь — в постановке вопроса и в честности калибровки, а не в готовых ответах.