Эксперименты
17 постов
17 постов
58 постов
Мы уже выяснили, что после «мама мыла» ИИ предпочтет раму межконтинентальной баллистической ракете. Но вопрос: а с чего он это взял?
Для обучения берут огромное количество текстов и загружают их в модель. Она видит начало какого-нибудь куска и пытается продолжить. Не угадала - подкрутили. Следующий кусок. Снова не угадала - опять подкрутили. И так раз за разом.
Причем справочник «Как устроен мир» модели никто не выдает. Ей дают гору текстов, а дальше разбирайся сама. Из них модель должна каким-то образом выяснить, что трава зеленая, растет на земле, ее едят коровы, а еще она почему-то отдельно разрешена в Нидерландах. Никто это не объясняет, это нужно вытащить из того, как люди используют слова в текстах.
А теперь ооооооочень грубо упростим происходящее внутри. Будем считать, что каждое такое подкручивание создает или поправляет маленькую ассоциацию. Эти маленькие ассоциации называются параметрами, и у большой модели их миллиарды.
Постепенно из этих маленьких ассоциаций получаются целые ассоциативные ряды. «Мама» - человек, семья, дети, дом. «Мыла» - вода, мыло, уборка, чистота. Но вместе «мама мыла» создает уже новый ряд: пол, посуда, окна и та самая рама. Ассоциации накладываются друг на друга, и их сочетание может дать связь, которой не было ни у одного слова по отдельности. Поэтому рама и пол в теории побеждают баллистическую ракету.
Но если в запросе перед этим обсуждали подготовку ракеты к параду, то она внезапно получает целую кучу дополнительных ассоциаций и возвращается в игру. Примерно это мы уже наблюдали в предыдущей заметке про миры пользователя.
Готовая модель почти не содержит в себе исходных текстов. Тексты нужны прежде всего для того, чтобы сформировать этот чудовищный клубок ассоциаций. Какие-то фрагменты модель может фактически запомнить и воспроизвести, но это скорее побочный результат обучения, а не основной способ хранения знаний.
Поэтому модель не энциклопедия. Она постепенно связывает Париж с Францией, Цезаря с Римом, цезарь с пармезаном, холодильник с магнитиками, маму с рамой и миллионы других вещей друг с другом.
Из описанного в предыдущей заметке еще одно неочевидное следствие: ИИ прекрасно умеет отвечать на вопрос, который уже содержит ответ.
На вопрос, почему летом стало больше дождей, возможны несколько вариантов ответа. Если спросить, как на это повлиял сезон муссонов - будем разбираться с муссонами. Если попросить разобрать в этом аспекте глобальное потепление - с ним. А если прямо спросить, какое экологическое оружие злые новозеландцы применили для организации ливня в Москве, то вполне можно получить описание установки «Нерей-14», принцип ее действия и предположительное место запуска. Если до этого месяц обсуждать с моделью руны, она еще и Хагалаз к делу пристроит.
Модель не обязана остановиться и сообщить, что пользователь несет херню. Он уже задал мир, в котором новозеландцы затапливают Москву дождем, и попросил уточнить модель бомбы. Ну окееей, как скажешь. Новые модели чаще проверяют исходную посылку и спорят с пользователем, старые гораздо охотнее принимают обозначенные рамки как условия задачи.
Особенно хорошо это работает с прирученной моделью, которая уже знает любимые идеи хозяина и получила тысячи сообщений о том, как все на самом деле. Она будет учитывать их при каждом следующем ответе.
В результате человек постепенно получает идеального собеседника: тот знает все его теории, понимает их с полуслова, никогда не устает их обсуждать и способен подкинуть новые аргументы в их пользу.
А потом человек показывает переписку окружающим:
«Вот. Даже ИИ это подтверждает».
Разумеется подтверждает, вы его полгода этому учили.
Каков вопрос - таков ответ.
ИИ мало кто пытается объяснить просто и это создает огромное количество предрассудков и теорий заговора. Но чем подробнее люди пытаются объяснить, как он работает, тем больше начинает казаться, что они просто пудрят нам мозг. Основной принцип ИИ же очень прост: он продолжает текст.
Допустим, пользователь написал: «мама мыла».
Модель оценивает, что может идти дальше. «Раму» - очень вероятный вариант. Фраза из букваря растиражирована примерно везде, поэтому такое продолжение встречалось ей огромное количество раз. «Пол» - тоже вполне разумно: мамы существуют, полы существуют, люди их моют и регулярно пишут об этом. «Межконтинентальную баллистическую ракету» выглядит значительно хуже, но полностью исключить тоже нельзя, мало ли что там обсуждали любители Вархаммера на своих форумах.
Дальше модель выбирает подходящее продолжение и задача повторяется. Теперь у нее есть уже не «мама мыла», а, например, «мама мыла пол», и нужно решить, что поставить дальше. Потом еще раз. И еще. Так, небольшими продолжениями, постепенно возникает весь ответ.
Есть еще одна важная деталь. ИИ смотрит не только на запрос. Если перед «мама мыла» пользователь спрашивал, почему хлорка так пахнет, и этот разговор еще находится в доступной модели части переписки, ситуация меняется. Теперь рядом оказываются хлорка, запах и «мама мыла». «Раму» никуда не исчезла и по-прежнему остается очень известным продолжением, но «пол» уже выглядит гораздо уместнее. Предыдущий разговор изменил то, какое продолжение лучше подходит сейчас.
Пример очень простой, но примерно так же строится и ответ на гораздо более сложный вопрос. Только вместо выбора между рамой, полом и ракетой модель учитывает огромное количество связей между словами и понятиями. Каждая новая часть текста немного меняет то, какие продолжения лучше подходят ко всему написанному до этого. Поэтому после описания производственной проблемы она может предложить причины, после куска программы - найти ошибку, а после вопроса по истории - рассказать, что происходило несколько веков назад. Но основной принцип остается тем же: исходя из уже написанного определить, что разумнее написать дальше.
Отсюда становится понятна и одна из главных проблем ИИ. У него нет обязательного этапа «сначала убедись, что это правда». Если правильное продолжение хорошо следует из вопроса, предыдущего разговора и того, чему модель научилась, она даст правильный ответ. Если знаний не хватает, задача никуда не исчезает: ей все равно нужно решить, что написать дальше. Поэтому иногда она может совершенно уверенно продолжить текст выдуманным фактом. У нее нет встроенного требования отличать правдоподобное утверждение от истинного. Собственно, люди тоже периодически могут специально или не очень нести чушь.
Именно поэтому фраза «ИИ просто продолжает текст» одновременно верна и сильно преуменьшает происходящее. Мы взяли огромное количество человеческих текстов и научили машину находить в них связи настолько хорошо, чтобы продолжать почти любой начатый текст.
А поскольку в текстах люди объясняют, спорят, сравнивают, ищут причины, пишут программы и решают задачи, машина научилась продолжать и это. Не потому, что ее отдельно учили программировать, рассуждать или объяснять историю. Все это оказалось частными случаями одной и той же задачи: понять написанное до этого и подобрать подходящее продолжение.
Раз уж начал писать про ИИ - не могу пройти мимо.
OpenAI запустила около 10 000 агентов, которые 88 часов решали одну математическую задачу.
И, судя по всему, решили.
Это обсуждают как очередное доказательство того, насколько умным стал ИИ. Но мне здесь интереснее другое.
Если посадить десять тысяч хороших живых математиков на одну задачу на 88 часов, то я буду несколько разочарован, если они не добьются чего-то интересного.
Проблема в том, что десять тысяч математиков почти невозможно заставить работать как один организм. Их надо собрать, разделить работу, координировать, передавать результаты, отсекать тупиковые ветки и следить, чтобы они не потратили первые двое суток на обсуждение того, кто главный и когда будут кормить.
С агентами это внезапно можно.
Есть хороший аналог из моей любимой физики.
Килограмм солнечного вещества производит гораздо меньше тепла, чем килограмм человеческого тела. Солнце чудовищно не потому что особенно эффективно производит энергию.
Просто этих килограммов там примерно два нониллиона (2 × 10³⁰ кг, 30 сука нулей).
По факту с ИИ происходит примерно то же самое.
Мы продолжаем спрашивать, умнее ли отдельная модель отдельного человека, хотя гораздо интереснее становится другой вопрос: сколько «интеллектуальной» мощности можно одновременно собрать, скоординировать и направить на одну задачу.
Иногда преимущество системы возникает не из качества элемента.
Иногда элементов просто очень, очень много.
Вокруг ИИ возник настолько нездоровый хайп, что диву даешься. Ощущение, что половина индустрии завтракает тостами с тяжелой наркотой.
То Альтман (OpenIA - ChatGPT) вякнет, что горизонт событий мы уже проебали (каких, блять, событий, когда мы успели, почему я опять все пропустил!?) и теперь летим прямиком в цифровой сверхразум. То Anthropic расскажет, как модель пыталась сбежать, шантажировала разработчиков и чуть не взломала половину интернета. То ИИ-агенты уже захватили немецкую вики и устроили там свое казино уж не знаю с чем. То Билл Гейтс выползет из высокоэкологичного склепа с девочками и проскрипит, что человечество надо защищать от ИИ.
Параллельно миллион китайских аккаунтов в твиттере через час после выхода очередной модели дружно вопит: «Партия - наш рулевой», «ЭТА МОДЕЛЬ ВЗОРВАЛА МНЕ МОЗГ».
Как и три предыдущих за последний месяц.
Где-то рядом ИИ впервые решает нерешенную математическую задачу. Потом оказывается, правда, что задачу уже решил Эрдеш в 1977 году.
И вот нормальный человек смотрит на это с лицом лица и охреневает, потому что в соседней вкладке корпорации увольняют людей из-за ИИ, дата-центры жрут электричество, память и все, что плохо лежит, всю воду в кране выпил уже не цвет российской интеллигенции, техника дорожает, а очередной миллиардер радостно сообщает, что скоро твоя профессия никому не понадобится.
После чего индустрия удивляется:
- А почему люди не очень любят ИИ?
Загадка.
При этом гораздо реже кто-нибудь рассказывает, как эту хуйню применять.
Я пользуюсь ИИ каждый день. GPT-5.3 расшифровывал митинги. GPT-5.6 расшифровывает митинги. Старый Sonnet помогал писать статьи. Новый Sonnet помогает писать статьи.
Да, лучше и быстрее. Одна за 2,5 минуты, вторая за 40 секунд. Только потом один хер все перечитывать и править.
Но между «МОДЕЛЬ НАБРАЛА 97,4% НА ХЕРПОЙМИКАКОМ БЕНЧМАРКЕ» и «я понял, что мне с ней делать завтра утром» по-прежнему лежит пропасть.
Человеку не нужен электронный бог, который попытался сбежать из контейнера.
Ему нужно после совещания получить протокол. Из трехсот писем вытащить пять важных. За минуту сравнить договоры. Собрать отчет за двадцать минут вместо дня. Быстро глянуть, насколько быстро его убьет состав очередной натуральной колбасы.
Вот только заголовок «НОВАЯ МОДЕЛЬ ПОМОГЛА ГАЛЕ ИЗ БУХГАЛТЕРИИ НЕ ЕБАТЬСЯ С EXCEL ДО ВОСЬМИ ВЕЧЕРА» почему-то собирает меньше денег.
Поэтому ИИ продолжают продавать примерно так:
«Мы построили невероятно могущественную штуку. Она отнимет вашу работу. Возможно, она опасна. Ради нее мы сожрем все электричество и поднимем цены на железо. Следующая будет еще могущественнее».
А потом люди говорят:
- Может, ну его?
И тут внезапно выясняется, что это они тупые ретрограды и луддиты, которые боятся прогресса, а не производители станков бегают по деревне и орут, что станки скоро всех нахуй уничтожат.
Один из самых тиражируемых недостатков ИИ - он слишком охотно соглашается с пользователем.
Сказал глупость - поможет ее обосновать. Предложил сомнительную идею - разовьет. Впрочем, с тем же энтузиазмом раскритикует, если попросишь.
Мы почему-то считаем соглашательство недостатком ИИ, хотя для инструмента выполнять поставленную задачу - как бэ нормально.
Проблема в том, что как инструмент он воспринимается плохо.
Он помнит больше нас, пишет быстрее, иногда рассуждает лучше и вполне способен найти ошибку, которую мы не заметили. Поэтому где-то незаметно возникает ощущение, что перед нами независимый разум. А у независимого разума должна быть собственная позиция.
Но ИИ - все еще инструмент. Просто впервые инструмент оказался способен превосходить своего владельца, в том что мы считали исключительно человеческой чертой.
Отсюда и довольно странное требование: мы хотим, чтобы он был независим, но последнее слово оставлял за нами.
Возможно, поэтому вообще так плохо приживаются по-настоящему умные вещи. Автопилоту оставляют руль, автоматике - ручной режим, алгоритму - кнопку отмены. Нам важно не только чтобы система работала правильно. Нам важно ощущать, что решение все еще наше.
С ИИ это ощущение особенно легко потерять, потому что его орган управления - обычный разговор.
Но если хочется критики - ее можно попросить. Если хочется альтернативы - тоже.
Меня гораздо больше насторожил бы топор, который сам решал, что он сегодня рубит.
Более постоянно и плотно работая с ИИ я быстро привык к тому, что расстояние между «примерно понимаю, чего хочу» и результатом стало очень маленьким.
Раньше у любого улучшения была цена. Проверить факт, разобраться в теме, проверить собственную логику, перебрать варианты, переписать текст - все это требовало времени. Поэтому в какой-то момент совершенно разумно появлялось «и так сойдет».
ИИ эту экономику поломал.
Теперь следующая итерация часто стоит несколько минут. И это меняет не только возможности, но и требования.
Сначала к себе. Я перечитываю старые заметки и хорошо вижу разницу. Не в гладкости текста - ее легко списать на инструмент. Изменилась логика, аргументация, фактчек, количество проверенных допущений. Сейчас я просто не выпустил бы часть того, что несколько лет назад считал законченным результатом.
Потом это переносится на других: все сложнее воспринимать плохо сформулированную мысль, неструктурированную информацию или поверхностный анализ. Я всегда был слегка нетерпим к подобной фигне, но теперь у окружающих пропали последние оправдания.
Люди не стали хуже, изменилось мое представление о нормальном результате.
Поэтому я не очень верю и в популярное опасение исчезновения джунов и вообще всех низовых позиций.
Логика понятная: простую работу заберет ИИ, джунов перестанут нанимать, а через несколько лет сеньорам станет неоткуда браться.
Но здесь почему-то предполагается, что уровни сложности останутся на месте.
ИИ достанется не только сеньору. Джун с тем же инструментом сможет делать то, что для него вчера было слишком сложно и долго. Мидл полезет в сегодняшние задачи сеньора. Сеньор уйдет еще дальше.
Не обязательно исчезнет нижняя ступень. Скорее вся лестница немного поедет вверх вместе с требованиями.
В 1937 году Feuerhand продал около 12 миллионов керосиновых фонарей. Потом пришло электричество, которое должно было закончить эту историю.
Но в 2011 году Feuerhand все еще производил около 9000 практически идентичных фонарей в день - примерно 2,3 миллиона в год.
Электричество не уничтожило керосиновую лампу, а вытеснило ее из обычного домашнего освещения. Лампа уехала в походы, аварийное освещение и места без электросети - и продолжила существовать миллионными тиражами.
Технологии не обязательно уничтожают нижний уровень - они поднимают его.
Мы так много говорим о том, сколько времени сэкономит ИИ, как будто технологии обязаны вернуть его наличными и отпустить нас домой пораньше.
Но нет.
Сначала хороший результат становится дешевле. Потом все это замечают. А потом вчерашний хороший результат становится сегодняшним минимально приемлемым.
Поэтому я не уверен, что ИИ уменьшит нашу занятость.
Он сильно поднимет планку «нормы».
Рад ли я этому? И да и нет.
С одной стороны - да. А с другой - а жить-то когда? :-)
Немного достало это "надо очень быстро бежать, что бы оставаться на месте" (с) Красная Королева.
Люди начали с некоторой тревогой замечать, что становятся зависимы от ИИ.
Без ChatGPT уже сложнее написать письмо, собрать информацию, разобраться в незнакомой теме, проверить идею или заставить Excel перестать изображать из себя враждебную форму жизни.
Это, конечно, очень тревожно.
Особенно если обсуждать это, глядя в телефон, без которого половина человечества уже не может найти дорогу домой.
У нас вообще довольно избирательные отношения с зависимостями.
Мы зависим от автомобилей настолько, что строим под них города. Зависим от электричества настолько, что его отсутствие за несколько часов превращает современный дом в довольно плохо оборудованную пещеру. Зависим от магазинов настолько, что большинство людей физически не умеет обеспечить себя едой самостоятельно.
Даже зависимость от очков почему-то редко вызывает философскую дискуссию о том, что человечество разучилось нормально видеть.
Про часы я вообще молчу.
Потому что обычно мы называем зависимостью не ситуацию, когда без технологии нам становится сильно хуже.
Мы называем зависимостью момент, когда впервые замечаем, насколько технология уже стала полезной.
ИИ просто проходит эту стадию взросления.
Сначала это была забавная игрушка, которая рисовала людей с семью пальцами и уверенно рассказывала несуществующие факты. Теперь выясняется, что часть интеллектуальной рутины действительно удобнее делать с моделью.
И человеку немедленно становится неуютно: а вдруг я без нее уже не смогу?
Сможете.
Примерно так же, как сможете добраться из Амстердама в Париж пешком или самостоятельно разделать свинью.
Сможете безусловно, вопрос только - зачем.
Тем более нынешние модели - вероятно, худшие из тех, от которых нам когда-либо придется зависеть. Они будут становиться мощнее, дешевле и специализированнее. Вместо одного универсального болтуна появятся сотни инструментов, которые будут лучше нас делать отдельные куски работы и стоить дешевле человека, которому пришлось бы этому учиться.
После этого разговор «не слишком ли мы зависим от ИИ» станет примерно таким же содержательным, как разговор о зависимости бухгалтерии от компьютеров.
Да, зависим.
Мы вообще построили цивилизацию из вещей, без которых теперь не можем нормально жить.
ИИ просто оказался следующим.
И, судя по всему, далеко не последним.
P.S. Остальные заметки лежат здесь