Ещё один инструмент?

Разговор об ИИ в искусстве или дизайне почти всегда начинается одинаково: «это просто ещё один инструмент». Тело в некотором смысле можно назвать продолжением души, руку — (о)конечностью тела, кисть улучшает руку, фотошоп имитирует кисть и так далее; и вот в конце этой цепочки появилась нейросеть — и она первая , кто может сопротивляться — интерпретировать вводные данные, принимать сотни микрорешений и возвращать результат, никогда не сводимый к прямой воле пользователя, а иногда ей попросту противовоположный. Обнаруживается, что субъект авторства расщеплён между несколькими людьми (тем, кто пишет промпт, тем, кто оценивает ответ, — и это не всегда один и тот же человек; разработчиками и так далее), обучающими данными и самой системой как актором.
Всё это означает, что привычная схема «автор делегирует намерение инструменту, который возвращает запрошенный результат» больше не работает. Точнее, работает, но её онтология существенно изменилась: инструмент, выражаясь по-хайдеггериански, перестаёт быть zuhanden — «подручным», то есть существующим и интересующим нас как сущее лишь в той мере, в которой он решает задачу; теперь он ещё и «наличен» (vorhanden), то есть его присутствие избыточно в отношении того, чего мы хотим от него получить, и эта избыточность проявляется, например, в том, что возвращает он нечто, запрошенный результат превосходящее или просто запросу не соответствующее. Что это за избыток? Избыточна тут — агентность инструмента. Если кто-то дорожит антропоцентричной картой реальности, можно приписать к этой агентности приставку «квази-», но это мало что изменит.
Обратный коллапс

Привычная модель авторства хорошо описывается «квантовой» метафорой: ещё-не-воплощённый замысел существует в некоей идеальной суперпозиции и схлопывается, будучи реализованным в определённой фиксированной форме, — тем самым все остальные формы становятся теперь невозможными и попросту утрачивают бытие в обоих модусах: и актуального, и потенциального, оставаясь в статусе не более чем «события в тексте», «воспоминания» или «несбывшегося».
Грэм Харман называл объекты, ещё-не-вступившие в реляции, «дремлющими»; воплощение художественного замысла убивает во сне — делает «мёртвыми объектами» — все возможные формы, кроме одной-единственной.
У Карен Барад, кстати, это почти даже не метафора: нож, которым мы наносим смертельный удар, совершает agential cut — акт, который из неопределённости производит определённость. До разреза нет никаких отдельных «объектов» и «субъектов» — именно разрез создаёт и наблюдаемое, и наблюдателя одновременно.
Но в генеративном процессе суперпозиция — внешняя, так как она сидит не внутри моего «авторского субъекта», а в латентном пространстве модели, и она не «моя». Я имею дело с чужой полнотой — гиперархивом, который бесконечно богаче любого индивидуального замысла (статистически, а не экзистенциально).
Итак, до-генеративный (забавный получился неологизм, не так ли?) автор при материализации идеи всегда теряет, так как замысел всегда шире конкретного воплощения, — тогда как человек, работающий с генеративной моделью, при генерации иногда приобретает, когда модель возвращает то, чего в его замысле не было. То есть коллапс суперпозиции идёт в обе стороны: это и утрата, и приращение. Это другая онтология, и она дезориентирует именно потому, что упраздняет привычный сценарий (у меня в голове всегда больше, чем воплощено): на выходе получается больше, чем было на входе, причём этот избыток — не мой, не от меня исходящий и мне не принадлежащий (во всех значениях слов «исходить» и «принадлежать»).
Эксперимент 1. Коллапс аффекта
Опишите устно образ, который вы хотели бы сгенерировать. Говорите свободно — с жестами, междометиями, оговорками; чем больше, тем лучше. Не стесняйтесь противоречий. Фиксируем ключевые слова.
Теперь запишите промпт. Одно предложение, как если бы вы вводили его в MidJourney прямо сейчас. Что происходит? От облака аффектов осталась строчка из нескольких слов. Вот он, коллапс вашего аффекта и замысла — вы видите его и переживаете как травму.
Генерируете четыре варианта. Это то, что вы имели в виду? Почти наверняка — нет, но что-то из результатов может вас зацепить. И тут — ключевой вопрос: «Вот эта деталь, которая вам понравилась, — вы её просили? Нет. Откуда она взялась? Кто автор этого решения?»
Каскад коллапсов
Интересно, что даже фиксация замысла в форме промпта — тоже ведь агентный разрез и схлопывание неопределённости. И это сдвигает всю схему: получается не один разрез, а каскад разрезов.
Первый коллапс — когда замысел («внутреннее искусство», полнота неоформленного) фиксируется в промпте, я уже потерял: из облака ощущений, аффектов, визуальных предчувствий я вынул цепочку конкретных слов (например, я пишу в промпте cathedral, а не temple). Каждое слово — отсечение, а промпт — это уже руина замысла.
Второй коллапс происходит, когда промпт интерпретируется моделью. Но модель схлопывает не мою суперпозицию, а свою. Я написал «cathedral», подразумевая готику, холод, вертикаль и какие-то свои связанные с этими тегами аффекты; модель прочитала «cathedral» — и, обученная на миллионах изображений соборов, достала из латентного пространства своё усреднённое представление.
Вот мы уже имеем два коллапса из двух разных суперпозиций; но это ещё не всё. Третий — конвергентный отбор из сгенерированного. Четвёртый — постобработка в Nano Banana Pro, пятый — в Photoshop и так далее.
Что здесь важно для нас: обычно весь разговор об агентности крутится вокруг второго и третьего коллапса — «модель решает» и «я выбираю». Первый остаётся невидимым. Но именно он — самый драматичный: момент, когда я ещё не нажал Enter, а замысел уже повреждён. Вербализация — первое насилие над суперпозицией.
Хайдеггер, которого мы уже вспоминали, точен: язык — «дом бытия», но дом — это и ограничение. Войти в дом — значит перестать быть снаружи. Мой промпт — это вхождение в дом языка модели, который устроен иначе, чем твой. Я формулирую замысел на своём языке, а модель читает его на своём. В узкой улочке меж двумя домами, в этом зазоре копошится самая интересная живность.
Эксперимент 2. Собор посредственности
Запишите три ассоциации к слову cathedral. Первое, что приходит в голову. Кто-то напишет «готика, тишина, свечи», кто-то — «Гауди, Барселона, жара», кто-то — «руина, мох, заброшенность». Не думайте долго.
Теперь смотрим, что выдаёт модель на голый промпт cathedral без единого уточнения. Сравните со своими ассоциациями. Где совпало? Где разошлось? Что модель «додумала» за вас — и откуда она это взяла?
MidJourney 7
Результат — усреднённое представление модели. Сравните его с вашими ассоциациями. Зазор виден мгновенно: у человека — свой дом; у модели — свой. Промпт — одно слово, а суперпозиции — разные. Для опытного пользователя генеративных нейросетей это не банальность, а остранение: вы привыкли дописывать к промптам стилевые уточнения, но, скорее всего, редко задумываетесь, что каждое уточнение — это попытка перетащить модель из её дома в свой.
В латентных пучинах
Генеративный процесс — это не производство объекта, а настройка диапазона. Ни один промпт никогда не описывает будущий объект в точности и никогда ему не гомеоморфен. Скорее имеет смысл говорить о проектировании силовых полей и их напряженностей в пространстве, внутри которого объект может возникнуть. Работа происходит в гиперархиве культурной памяти, где образы существуют не дискретно, а непрерывно: между «китайской акварелью» и «глитч-артом» нет резкой границы — это градиент. Латентное пространство — это пространство до различий, пространство чистой потенции.
Любая активность тут больше похожа на блуждание в потёмках, точнее, даже на ситуационистский дрейф «куда глаза глядят», только не по улицам города, а по складкам латентного пространства. Критик Николя Буррио называет это «семионавтикой», то есть навигацией в мире знаков; впрочем, лоции у нас нет, и наше плавание практически неуправляемо, хотя мы и пытаемся с помощью промптов «подобрать пароли» к пульту управления нашим кораблём. Как писал Пушкин:
И мысли в голове волнуются в отваге, И рифмы легкие навстречу им бегут, И пальцы просятся к перу, перо к бумаге, Минута — и стихи свободно потекут. Так дремлет недвижим корабль в недвижной влаге, Но чу! — матросы вдруг кидаются, ползут Вверх, вниз — и паруса надулись, ветра полны; Громада двинулась и рассекает волны.
Плывет. Куда ж нам плыть?..
Нейрофотограф, ИИ-дизайнер, вайб-философ — это просто другие профессии, с другой онтологией и с другой ответственностью — не большей и не меньшей, просто другой. Это ответственность лоцмана, а не капитана: лоцман знает фарватер, но не выбирает порт назначения и не отвечает за груз. И (ключевое) лоцман — временная функция: поднялся на борт, провёл, сошёл. Капитан же остаётся с кораблём.
Тёмный рой
Хотя, конечно, каждый сгенерированный объект технически уникален, вероятностный характер происходящего подразумевает, что модели по умолчанию тяготеют к статистическому центру датасета, который, по-видимому, пополняется уже за счёт сгенерированного материала, а значит, влияние «среднего» кумулятивно усиливается, а что-то маргинальное и экстраординарное уползает всё дальше во мглу маловероятного, где вяло шевелятся хвосты нормальных распределений. За эти хвосты можно ухватиться по специальному запросу, но это будет скорее имитация странного (weird), а не само странное.
Беньямин писал о кризисе определяемой через уникальность произведения «ауры» в эпоху массовой воспроизводимости копий; теперь же этот кризис приобретает новую конфигурацию: инфляция обеспечивается не многочисленностью изображений, а снижением различимости: не имея перед глазами откалиброванной по разнообразию артефактов шкалы мы принимаем «нормальное» за «хорошее» — «конвенциональное» за «единственно возможное».
Иными словами, аура теперь разрушается не потому, что мы научились делать идеальные копии, а потому, что уникальность стала тривиальной: сейчас уникальных объектов — бесчисленное и стремительно растущее количество, а вот различимых больше не становится.
Это, по-видимому, и есть структурно-онтологический эффект генеративного искусства и дизайна. Мы имеем дело с чем-то вроде инвертированного мортоновского гиперобъекта: перед нами клубится непостижимо огромный и неразличимый рой, и если у Мортона гиперобъект несхватываем из-за своих несоизмеримых с человеком масштабов, то здесь — из-за недифференцируемости. Безусловно, это отличающаяся особым коварством и гибельностью форма возвышенного — unheimliche, которое притворяется уютным.
Эксперимент 3. Хороший, плохой, мой
Перед вами шестнадцать вариантов, сгенерированных по одному и тому же промпту:
a pair of hands carving absence out of a luminous marble block with a big knife, the removed fragments dissolving into swarm of translucent particles, dark studio, single overhead light, chiaroscuro --stylize 100 --chaos 0
Двадцать секунд на просмотр.
- Какой лучший? Запомните свой ответ.
- Какой худший?
- Среди шестнадцати спрятан один, доработанный позже. Найдите его.
Если нашли, то объясните, по какому признаку (и это уже подводит к разговору о критериях). Если нет — ещё лучше: только что сработало unheimliche, которое притворилось heimliche.
Этот эксперимент — мост к следующему тезису, потому что ставит вопрос: обнаружи́м ли агентный разрез, если он был сделан?
Резать!
Постструктуралистская деконструкция (Фуко, Барт, Умберто Эко и другие), бессубъектные онтологии (Латур, Харман) и нейронаука (например, Метцингер) давно показали, что субъект не может считаться сувереном: произнося «мыслю, следовательно, существую», я уже не знаю точно, кто этот мыслящий — мозг? эго-галлюцинация? модель самости, которую мозг строит для служебных целей? нейромедиаторы? язык? культура? живущие в моём кишечнике микробы?
В этой компании ИИ — новейший, зато наиболее откровенный участник. Но юридическая и этическая агентности довольно ригидны и её не учитывают: если что-то подписано моим именем, ответственность — на мне, даже если мой жест сводится к акту разреза, отделяющего то, что я решаю оставить, от того, что навсегда безвозвратно уничтожается.




