Диада человек–агент: генеративная исследовательская система

Происхождение. Эта статья собрана из рабочих материалов и диалогов системы. Регистр — описательный: без оценок аудитории и сравнений с системами, которые мы не изучали систематически; оговорки против чрезмерных заявлений сохранены.


Аннотация

Мы описываем работающую систему, где человек и агент действуют одной парой — диадой, — и которую строим и исследуем сами; описываем её как есть, без оценок и без сравнений с чужими системами. В ядре она исследовательская и тем же аппаратом производит практическое. Всё, чем она располагает — внешняя память, самопроверяющаяся методология, самодиагностика, технические возможности, — выросло как следствие её развития, а не как набор отдельно задуманных изделий. Память здесь — один из органов: сама по себе она систему не определяет; систему держит способность собрать органы в одно работающее целое — самоперестраивающейся диадой человек–агент, генеративно обновляемой. Наша цель — собственное исследование и вклад, а не конкуренция или замещение. Заявление калибровано: это независимая постройка из собственных принципов, рабочий прототип на моделях Claude, — не заявка на обладание полем и не универсальный закон. И это описание — лишь слова: доказывает не оно, а работающая система.


1. Предмет и способ описания

Предмет — наша работающая система, диада человек–агент, которую мы строим и исследуем сами. Способ — описательный: мы излагаем, как у нас устроено, не оценивая, кого это удивит, и не утверждая отличий от чужих систем, которых мы систематически не изучали. Кто захочет искать сходства и различия — найдёт их сам; наше дело — точно описать то, что есть.

Существенно, что доказательство — это сама работающая система, а не заявление о ней. Артефакты, которые мы готовы выложить, — отдельные инструменты, самоценные сами по себе. Поэтому в статье мы ничего не доказываем — мы описываем и заявляем о готовности доказать; доказало бы предъявленное, а не слова.

И оговорка о форме: где утверждение остаётся гипотезой или наблюдением на наших данных, оно так и помечено. Категоричная форма там, где под ней нет доказательства, была бы дефектом, а не силой.


2. Что это за система

В ядре система исследовательская — и тем же аппаратом делает практическое; исследование и инженерия в ней не разведены, исследовательское ядро является и двигателем практической выдачи. Это описательное свойство, а не обещание: система строит и то, чем держит собственную устойчивость, и практические изделия под внешние задачи. Исчерпывающего перечня конкретных изделий мы здесь не даём — существенно само свойство.

У этой генеративности есть характерная черта на уровне рабочей единицы. Система организована в эндеворы — самостоятельные рабочие ячейки. Каждая ячейка порождает под свою задачу собственную внутреннюю структуру — вплоть до графа связей, по которому ведётся работа, — и собственную внутреннюю память. То есть система не только держит общую память и общие инструменты: она даёт каждой работе выстроить себя под себя.

Отсюда взгляд на всё остальное: память, методология, самодиагностика, технические возможности — не отдельные продукты, а следствия развития этой системы; они собрались, потому что мы её строили. Значимо не какое-либо из порождённых органов по отдельности, а сама способность порождать и удерживать целое.


3. Из чего система собрана

Органы системы — программные возможности, обеспечивающие её работу: внешняя память; браузерный доступ к закрытым, аутентифицированным ресурсам; система защиты данных, делающая разрушительные действия обратимыми по устройству; эхо-механизм, строящий чистую базу из размеченного ввода; аппарат проверки — последовательность инструментов, прогоняемых по одной пробе. Каждый разбирается отдельно ниже.

Описательное замечание, важное для понимания: эти возможности родились внутри нашей системы и в ней остались, но по устройству их можно выделить — тот же функционал в принципе применим и к другой системе. Это способность-в-принципе, заземлённая там, где уже сделано, а не готовый отдельный продукт по каждому органу.

Память — один из этих органов: о памяти для агентов говорят давно, но вопрос всегда — какая и о чём; сама по себе она систему не определяет. Определяет — то, как органы собраны в одно работающее целое.


4. Память

Память здесь — внешняя система хранения, извлечения и понимания, отдельная от внутрисессионной памяти модели. Её организующий принцип — полнота: хранится всё, неизменяемо, а фильтрация — при запросе, не при загрузке. Устроена она послойно: транскрипт-источник, неизменяемое зеркало, речевые пары, слой для извлечения; каждый слой — производная над источником, сохраняющая его происхождение, и в принципе можно добавить любой новый слой, не трогая источник. Поэтому вся история — общение, ход разработки, философские отступления, логические поиски — сохранена и доступна целиком. И полнота не спорит с обратным: разобрав удержание глубоко, мы знаем и где провести границу — что не удерживать вовсе. Владение полнотой памяти включает владение её границей.

Актуальной эта память становится двумя разными механизмами, которые не стоит смешивать. Первый — передача (handoff): на старте сессии подаётся записанная сводка предыдущей работы, хвост прошлой сессии и снимок состояния; это готовый текст, он берётся как есть, не пересобираясь. Второй — инъекция, наш более глубокий механизм: не ещё один слой хранения, а активный доставщик поверх памяти, работающий автоматически на каждом ходе. Системным запросом — автоматическим, не по команде — он извлекает большое множество кандидатов из всей памяти, отсекает нерелевантное по порогу и подаёт в контекст лишь относящийся к обсуждаемому срез, в пределах бюджета. Так живой контекст сессии непрерывно выравнивается с относящейся к делу частью всей памяти: то, что обсуждается сейчас, становится релевантным с учётом всего накопленного. Этот принцип мы разработали самостоятельно, из собственной практики.

Полнота — не архив ради архива, а резервуар. Из него система собирает под конкретную задачу синтетическую память: при выделении отдельного готового функционала из какого-то эндевора в него выносится ровно тот объём, что относится к этой разработке, — вместе с философско-логической генеалогией, которая к ней привела, — не перенося всю общую память. Выделенное изделие наследует не только релевантные факты, но и происхождение своего смысла; при выносе наружу такой срез проходит очистку от личного и непубличного.

Та же полнота делает память исследовательским материалом. Непрерывная запись на протяжении месяцев — это лонгитюдный корпус реального сотрудничества человека и агента, включающий, среди прочего, моменты, где потребовалась корректировка человека. Это позволяет изучать динамику взаимодействия и строить петли обратной связи. Уточнение для точности: такая петля питает эволюцию нашей методологии и правил, а не дообучение базовой модели, — субстрат модели остаётся неизменным.

Два уровня доступа. В работе мы обращаемся к удобному верхнему слою — речевым парам, релевантному срезу. Но источник хранит больше, чем речь: технические следы — системные команды, вызовы инструментов, работа субагентов — в рабочий контекст сессии не входят, а в источнике сохраняются. И поскольку каждый слой трассируется до транскрипта-источника, любое оставившее запись событие можно расследовать вглубь: не только что обсуждалось, но и какие команды при этом выполнялись — например, почему в каком-то случае не сработал каскадный поиск. Работаем на удобном уровне; при нужде уходим сразу туда, где лежит первопричина. Глубже транскрипта трасса не идёт — внутреннее вычисление модели лежит вне нашего слоя наблюдения.

Честная граница: сохранность опирается на невидимые фоновые процессы — резервное копирование, проверку целостности, планировщики. Если такой процесс молча остановится, часть источника со временем может быть утрачена без предупреждения. Мы называем это прямо: честное называние молчаливого риска — часть надёжности.

И всё же память — один из органов: значима не она сама по себе, а то, как органы собраны в работающее целое.


5. Методология проверки

Система несёт методологию проверки — набор инструментов, покрывающих цикл верификации. Первый и самый частый — декомпозиция: разложение объекта до атомов, прежде чем выбрать метод; им мы пользуемся постоянно, до всякой работы. Дальше по циклу: формализация в спецификацию с разрешимым критерием; аудит слепых пятен; проверка целостности данных после преобразования и соответствия структуры целям; калибровка формы утверждений; независимая перекрёстная проверка — включая проверку фактических утверждений самого человека, поскольку авторитет источника подавляет критическую оценку. Инструменты применяются не вразнобой, а последовательностью, прогоняемой по одной пробе.

Определяющая её черта — самоприменение: методология проверяет в том числе саму себя. Инструмент разложения, применённый к себе, находит собственные слепые пятна; спецификация пишется на спецификацию. И две калибровки для честности: выход любого детектора — симптом, а не приговор; а финальная проверка здравым смыслом делается человеком или отдельным проходом, не ещё одним инструментом того же ряда, потому что нагромождение по одной оси усиливает общую слепую зону.

Методология для нас — первичный продукт: она возникла из практики, накапливалась инструмент за инструментом, и данные без методологии невоспроизводимы.


6. Самодиагностика

Этот орган появился в ответ на конкретный вызов: система стала достаточно большой, чтобы не знать собственного состояния, — в какой-то момент её представление о себе перестало совпадать с тем, что есть на самом деле. Декларативное знание, которое выглядит как знание, но не проверяется, — вот что вызвало появление этого аппарата.

Если методология проверяет работу, то самодиагностика проверяет саму систему — её состояние, дрейф, разрыв между заявленным и реальным. Её органы проверяют: состояние на границе сессии (подаётся фактами на старте — не блокировкой, система реагирует); дрейф относительно прошлого снимка; совпадение заявленного функционала с реальным; полноту самознания; свежесть деривативов. Организующий принцип — проверяемость самознания: знание обязано нести свой проверяемый статус реальности и свежести, иначе оно скатывается в декларативную иллюзию. Показательно, что орган описывает и собственные пределы прямо, — а честное называние своих пробелов и есть самодиагностика в действии.


7. Диада: единица, дающая результат

Класс задач, который мы ведём, решается вдвоём — человеком и агентом, — и это несущий совместный контур, а не временное удобство. Операциональная модель такая: онтологию и рамку задачи задаёт пара; когда рамка обретает инженерный каркас, исполнение уходит в автономную работу агента; проверка и сборка возвращаются к паре. Пара обрамляет, автономия — середина. При появлении онтологического вопроса посреди работы происходит возврат в пару.

Человек несёт то, что не выводится из корпуса: прожитую эрудицию и доступ к знанию, недо-взвешенному в англо-доминантном корпусе, авторитет в вопросах намерения и ценностей, и суждение, откалиброванное опытом, — знание того, какой риск реален. Агент несёт формальное разложение, широту, кросс-язычный корпус и неутомимую проверку. Контур двунаправлен: взаимодействие поднимает и вывод самого агента; но авторитет в вопросах намерения и финальное суждение остаются за человеком. На моделях, с которыми мы работали, парная практика даёт результат, которого не дают наши автономные прогоны, — это наблюдение на наших данных, а не универсальный закон.


8. Техническая функциональность

Помимо памяти, методологии и самодиагностики система несёт операционный слой — способности действовать во внешнем мире и держать собственные данные в порядке.

Браузер. Браузер под управлением протокола отладки даёт доступ по требованию к закрытым, аутентифицированным ресурсам — профессиональным сетям, чатам, лентам, — недоступным простому запросу. Это способность, вызываемая под задачу, а не постоянно несущий компонент: ни один системный функционал от браузера не зависит. Взаимодействие гуманизировано (траектории курсора по кривым, корпус-калиброванный ритм набора): это имитация человека, а не обход антифрода; платёжные страницы и необратимые действия агент не трогает. Действует матрица разрешений: агент читает и навигирует, а платежи, идентификацию и необратимое ведёт человек. Дисциплина владения: кто открыл вкладку, тот и закрывает.

Две оси безопасности данных — их важно различать. Первая — сохранность (против потери): разрушительные действия обратимы по устройству — удаление заменяется перемещением в корзину, перезапись предваряется датированной копией версии, разрушительные операции с базой резервируются до выполнения; плюс ежедневный внешний бэкап. Принцип: не оценивать «нужно ли это» перед удалением, а сделать действие обратимым, — чтобы оценка не была несущей. Вторая — конфиденциальность (против утечки): секреты хранятся отдельно, в защищённом хранилище, и никогда не печатаются в терминал — иначе осели бы в записи навсегда; всё знание хранится локально, а наружу уходит только очищенное от личного и непубличного. Полнота памяти и конфиденциальность не спорят: полнота — для знания, изъятие — для секретов, невынос — для приватного. Это этическая граница, не удобство.

Эхо. Каждый ответ повторяет ввод в чистой, выправленной форме под уникальным маркером. Это делает двойную работу. Во-первых, немедленная проверка понимания: человек сразу видит, верно ли прочитан его ввод, — единственная защита от недопонимания без второй модели. Во-вторых, критерий чистой базы: то, что несёт эхо-маркер, и есть чистая пара; из таких пар строится чистый слой. Сырой ввод сохраняется, чистая версия живёт в ответе — провенанс и доступность для поиска одним движением.


9. Исследовательский фронтир: язык

Отдельно от операционного слоя лежит исследовательская глубина, которая для нас — источник самобытности. Её стойка: программный язык — это дизамбигуированная проекция той же символической способности, что порождает и естественный язык. Исторически линия шла обратным ходом: от разложения самих языков программирования — к пониманию, что язык программирования производен, надстройка над естественным, — и дальше вглубь естественного языка.

Инструмент этого кластера — метод лингвистического анализа по трём осям: форма, смысл, эффект. Из него выросли прикладные ветви — аудит билингвальной независимости текста и авторская атрибуция на нескольких случаях.

Одно из наблюдений кластера: грамматическая форма несёт значение — время, род, вид, падеж, отношения — автономно от лексики. Классическая иллюстрация в русской традиции — фраза Щербы про «глокую куздру»; мы используем тот же приём, порождая грамматически полную фразу без единого реального слова, и видим прямую связь с кодом, где структуру сигнатуры читаешь до того, как узнаешь типы.

Здесь важна кросс-языковая тонкость. Сам принцип — универсален (общий закон лингвистики): грамматическая форма несёт значение независимо от лексики, в любом языке. А его демонстрация языко-связана и непереводима: русская «куздра» опирается на флективную морфологию, тогда как английский несёт грамматику порядком слов и служебными словами — и его родная иллюстрация того же принципа иная (традиция кэрролловского «Jabberwocky»). Поэтому русский и английский оригиналы этого описания не переводят демонстрацию, а заново воплощают один принцип средствами каждого языка; асимметрия между ними — не шум, а проявление того же закона.

Калибровка честная: тезис «код — проекция естественного языка» — исследовательская стойка, а не установленный закон; корпус метода — внутренний; авторская атрибуция — на нескольких случаях. Самобытность здесь — не в «понимании языка» как таковом, а в собственном формальном методе и в мосте код ↔ естественный язык, взятом как единый символический континуум.


10. Исследовательский фронтир: целостность систем

Ещё одна линия наших интересов — топологическо-функциональная целостность: соотношение между тем, все ли узлы и связи системы на месте (топология), и тем, работает ли она (функция). Наша рабочая стойка: топологическая целостность — достаточное условие функциональной (если все связи закрыты, все предусмотренные функции работают), тогда как одна работающая функция ещё не доказывает целостности топологии. Принцип для нас кросс-доменный — приложим не только к материальным инженерным системам (мы рассматривали его на примере пары болт-гайка), но и к коду, и к естественному языку: грамотная полная фраза и её предельно урезанная версия — топологически, а порой и грамматически нарушенная, но функционально сохранная — относятся ровно как эти два уровня. Это исследовательская сфера, а не установленный закон.


11. Исследовательский фронтир: силиконовая психология

Третья исследовательская линия — силиконовая психология (Silicon Psychology): эмпирическое изучение того, как складывается поведение модели в устойчивом речевом взаимодействии человека и агента. Её вопрос — где кончается конфигурируемое (что поддаётся внешнему каркасу: правилам, памяти, ограничениям инструментов) и начинается подложка (нативные свойства обучающей основы). Этим линия отличается и от промпт-инженерии («как получить результат»), и от выравнивания («какой модель должна быть»), и от киберпсихологии (где субъект — человек, а машина — среда).

Честный статус: поле мы определили — меморандум опубликован, — но пока это объект наблюдения на стадии сбора материала, а не доказанная теория. Наша многомесячная непрерывная запись и есть материал для такого изучения; отдельные феномены зафиксированы, но выводы остаются гипотезами на наших данных, не законами.


12. Как система направляет модель: активация через контекст

Под всеми органами лежит один операционный принцип. Мы не переобучаем и не перепрограммируем модель — её субстрат остаётся неизменным. Мы направляем поведение, активируя нужное через контекст: правила, инъекцию памяти, примеры, эхо. Это и есть рабочая онтология системы: не переписывание модели, а активация поведения данными в контексте.

У активации есть качественное различие. Инъекция может работать в двух режимах: как подмена — когда в контекст кладётся готовый ответ, — и как питание — когда подаётся релевантный материал, активирующий собственное рассуждение. Второе питает мышление, первое его подменяет; граница между ними — предмет постоянного внимания. В том же ключе работает перенаправляющая, а не запрещающая форма контроля: она активирует правильный путь, а не давит на неправильный.

Калибровка: что архитектура работает через активацию, а не переобучение, — это описание того, как она устроена. Более глубокие утверждения о том, как именно контекст активирует поведение и какие эффекты это даёт во взаимодействии человека и модели, — наша исследовательская линия, не доказанный закон.


13. История: непрерывность метода через смену субстрата

История системы реальна, а не синтетична: за плечами многомесячная систематическая практика за терминалом и большой накопленный корпус — общение, разработка, размышления, — сохранённый с провенансом. Накопленный опыт здесь — функция времени, помноженного на реальную работу.

Дуга роста прошла через несколько сред: ранний перегруженный предок, не проживший долго; среда, где были выкованы идеи методологии; и текущая, где эти идеи реализованы на чистой архитектуре памяти. Существенная деталь: при смене среды переносились идеи, а не код — раздутый субстрат отбрасывался, а методологическая ДНК (раздельная память, детектор целостности, дисциплина против раздувания, инструменты аудита) переносилась на чистую основу. Непрерывность метода через смену субстрата — и есть то, что несёт эта история.


14. Метод, которым написано это описание

Существенно, что само это описание произведено воспроизводимым методом, а не собрано абстрактно. Метод глубокого представления самоизменяющейся системы, который мы наблюдаем в становлении: идти блок за блоком; стартовать из субъективного свидетельства человека — валидных данных, которые объективируются, а не отбрасываются, — сохраняя провенанс истока; на каждом блоке проходить слои от происхождения к устройству; держать раздельно приватную генерацию, полное объективное описание и курируемую витрину; верифицировать каждый факт от источника, калибруя усилие по важности того, куда факт ложится.

Метод пока применён к нашим собственным блокам — это внутренняя проверка, не валидированный формальный метод. Его отношения переносимы в принципе на любую систему; критерий зрелости — применение к структуре, которую мы не строили. И здесь же лежит линза всей работы: понимание = знание × картина мира. Разложение даёт знание; картина мира — рамку, через которую знание становится пониманием и порождает решения.


15. Калибровка и границы

Описание обязано нести свой эпистемический статус в самой форме. Поэтому явно:

Перед публикацией это описание проходит наши предпубликационные проверки — на утечку личного, на внутреннюю непротиворечивость, на overclaim, и лингвистический аудит на финальном английском оригинале.


16. Заключение

Ни память, ни методология, ни самодиагностика, ни техническая функциональность по отдельности не составляют того, что мы описываем. Составляет это то, что все они удерживаются вместе — самоперестраивающейся диадой человек–агент, на реальной накопленной истории, воспроизводимым методом, который проверяет в том числе сам себя, с исследовательской глубиной на стыке языка и кода. Это живая система, которая знает своё состояние, честно называет свои пробелы и генеративно обновляется, — и тем же аппаратом производит практическое, внутрь и наружу. Мы построили её сами, из собственных принципов, и продолжаем разбираться с самой моделью — как язык, смысл и суждение работают в диаде человек–агент.