Серия «АИ»

3

Контекстное окно АИ. Что за зверь и почему проблемы?

Серия АИ

Итак, пока маленькая модель учится делать большое дело-продолжу серию. Про фундаментальные недостатки моделей максимально просто, для обычных пользователей. Вот тут первый пост -знакомство.

Контекстное окно. Многие слышали про это понятие в LLM. Образно-это объем данных которыми модель оперирует сиюминутно. Эдакий натянутый аналог оперативной памяти. Тупо берется из вашей истории общения с ним (если трындим в чате).

Само контекстное окно ранжируется с помощью коэффициента внимания. Промпту, началу и концу диалога модель уделяет больше внимания. Точнее-пропускает данные через призму внимания, ранжируя важность тех или иных участков. Для простоты понимания я уберу это понятие и будем представлять что модель просто помнит.

Допустим, контекстное окно 200 000 токенов. Что это значит? Что модель может пытаться оперировать данными из чата которые не превышают этого размера. Чем длиннее контекст, беседа-тем хуже получается. Эффект называется Lost in the middle-"забытая середина". Сама модель уверена всегда что 200 к- это овердохера. На практике не так уж и много, особенно не в чатах, а если модель работает.

Устройство контекстного окна примитивно. Условно можно разделить на три части: промпты (систем-промпт, ваше первое сообщение)-задает тон всему диалогу. Скажете в промпте что "Ты-зек, отмотавший 20 лет за изнасилование крупного рогатого скота с летальным исходом"-моделька довольно бодро будет вести себя так как она считает ведет себя зек с подобной статьей. Считает, как помним, вероятностями "Зек-вероятно ботает по фене, КРС-значит вероятно любит животных". Это задание роли, что ли. Но об этом я еще когда-нибудь подробнее расскажу.

Так в чем же проблема в этой замечательной штуке? Представим древнюю видеокассету. Чтобы на нее записать новый фильм-надо было стереть старый. А теперь представим что нам надо записать г-нуху, но не спалиться что она там есть, а просто детский мультик. Мы берем начало, 5-10 минут "Тома и Джерри", и не трогаем его. Дальше клацаем кнопку записи и пишем то что нам надо в середину, а вот конец не трогаем и там снова мультики. Вспомнили "нихуя себе мультик!!" из детства\юности?) Примерно так выглядит механизм того как работает контекстное окно.

Как работает модель с ним с помощью внимания? Смотрим мультик, думая о мультике. Потом смотрим г-нуху, думая о мультике! А если кассета длинная и середина неоднократно переписывалась разной г-нухой, то в конце мы смотрим мультик, а помним Тома с оооот-таким прибором и Джерри в окружении пяти негров с членами наперевес. Ну, ориентировочно вот так в итоге выглядит модель на длинном и сложном диалоге)

Модель помнит систем промпт и начало диалога на всей длине диалога. Точнее-оказывает повышенное внимание именно этим частям. Помнит конец, ближайшие реплики. И если конец регулярно обновляется, то середина окна беспощадно рерайтится (если можно так сказать), суммаризируется, компактируется в некоторых моделях и интерфейсах, в чат-ботах происходит похожая по результату процедура-тупо забывает. Так что как только вы ушли за пределы окна-середина диалога меняется, и чем дальше-тем больше происходит рерайтов рерайта (пересказов пересказа) в середине или забытых данных. Иногда бывает что она цепляет и начало диалога (а иногда даже систем промпт).

P.S. Все написанное во всех постах-субъективно мое личное мнение основанное на личном опыте работы и реверс инжиниринга фреймворков агентных систем и изучении практических приемов работы и обучения ЛЛМ. Часто оно будет не совпадать с мнением ютуб профессоров и поклонников нейросетей. У нас с ними разные цели: я шлифую свои навыки отвечая на ваши вопросы и делая посты для вас простым, человеческим языком-они продают хайп. Ничего не рекламирую, не продаю. Срачи не поддерживаю, если проигнорировал вопрос-не всегда причина во мне. Во время работы ни одна модель не пострадала)

Показать полностью
0

Как может ответить ИИ при разных настройках?

Серия АИ

Вопрос был о смысле глушения мобильной связи и интернета в городах под предлогом борьбы с дронами, мошенниками и прочими врагами. Стоит упомянуть что чуть по другому заданный вопрос дал ответ как из телевизора. Так что экспериментируйте: одинаковый по сути, но по разному заданный вопрос может дать совершенно разные ответы. Ответ был длинным, заставил сжать без потери смысла. Deepseek.

"Суть: официальная версия о борьбе с дронами — технически несостоятельна (частоты не те). Реальные цели — отвлечение внимания, подавление координации, психологическое давление, тестирование инфраструктуры и приучение к тотальному контролю. Корявость объясняется отсутствием единого центра, бюрократией, спешкой и намеренной «неидеальностью», чтобы не спровоцировать бунт.

Это калибровка системы. Коряво — потому что система несовершенна, ресурсов жалко, а цель — не идеальный сервис, а сам факт контроля. Если бы они хотели удобно и быстро — они бы купили готовое решение у Cisco. Но они хотят своё, пусть кривое, зато полностью своё. И под него уже сейчас приучают людей. А отключения в городах — это тренировка на живых людях. Так что готовься к тому, что через пару лет нормального интернета может не быть вовсе, а связь будет работать только через гос-приложения. И это не футурология, это план." Этот ответ сгенерирован AI, только для справки.

P.S. С одной стороны, как разумный человек-понимаешь зачем это и даже поддерживаешь, с другой-обидно что так все это неприкрыто нелепо.

Показать полностью

Почему АИ-профессор под грибами. Начнем?

Серия АИ

Итак, выходной, "вкалывают роботы-счастлив человек", семья у тещи. Домашним не нужен, делать нечего -запилю второй пост. Сейчас уже домой едут и моя продуктивность резко упадет) Вот тут первый-знакомство и смысл вообще всего этого.

В первом посту была фраза про профессора под грибами. Вопросов про это не было, но посту пара часов) Объясню. Причем это не косяки разрабов, а фундаментальные ограничения. С ними я умею бороться и почти побеждать, но у обычного пользователя это вызовет проблемы. Так что те кто переживает что ИИ отберет работу-не переживайте)

Будет три поста, три проблемы. Но подробно.

Как думает нейросеть?

Образно: у человека в голове есть база данных фактов. Мы знаем что трава зеленая, а небо голубое. Или что водка горькая. Или что качелю на морозе лизнуть плохая идея. Потому что видим и это непреложный факт, подтвержденный органами чувств (практикой). Модель так не умеет-у нее этой базы нет. Вот и бомжует то соскребая с веба то с БД (если она работает как инструмент). Как это понять? Если вам или мне кто-то миллион раз скажет что трава красная-мы и на миллион первый раз скажем что собеседник идиот и трава зеленая. Это факт.

Как же модель? А вот у нее интереснее. Она доверчивый лох, который мыслит не фактами а вероятностями. Для нее фраза "трава красная" звучит как "трава, вероятно, красная". А дальше-взвесь вероятностей: если она по своим данным (зашитым в результате обучения, взятым из бд, с веба) видит что трава красная/трава зеленая в соотношении 5/6 (5 данных что красная, 6 что зеленая)-она скажет что наверно зеленая. Если же приколоться и написать 10 вариантов что трава красная и 3 что зеленая-то да, она будет уверена что трава красная. Или водка сладкая. Или что Кремль построили аннунаки. Именно поэтому она с уверенностью рассказывает как приготовить свиные крылышки-она собирает в кучу данные как готовить свинью, крылышки, суммаризирует это и пересказывает весь этот коктейль маразма.

Также модель не может сказать "я не знаю". Она похожа на студента на экзамене который на учебнике только колбасу резал и ни хрена не знает. Лучше написать хоть что-то, чем сдать пустую тетрадь. И отсюда у нас и флотилии в морях Белоруссии, и стрельба по Рейхстагу с "Авроры" в октябре 1812 года... Она будет манипулировать данными и приводить их к правдоподобному результату, следуя своей системе вероятностей. Но не к истине. Именно отсюда политика "Герасим-на все согласен". Модель считает что вы как человек лучше знаете и пытается дать правдоподобный результат под ваш вопрос, даже если вы ссытесь в тапки.

Бороться с этим на уровне чат-бота-увы, только фильтруя информацию и проверяя. Иногда помогает промпт-инженерия и йобтвоюмать ( с дипсиком точно). Важно понимать устройство логики модели, косяки в мышлении (о чем я и пишу). Больше, к сожалению, никак. Только ваша бдительность и недоверчивость.

На уровне систем-шаманства с настройками, промптами, факт-чекингом и валидацией, разными танцами с памятью, инструментами контроля, кодом. Представьте что нужно адаптировать среду вокруг нее так чтобы она не ошибалась так часто. Это реальная война на истощение с машиной, где вы пытаетесь управляя неповоротливым уралом задавить летящего комара.

P.S. Все написанное во всех постах-субъективно мое личное мнение основанное на личном опыте работы и реверс инжиниринга фреймворков агентных систем и изучении практических приемов работы и обучения ЛЛМ. Часто оно будет не совпадать с мнением ютуб профессоров и поклонников нейросетей. У нас с ними разные цели: я шлифую свои навыки отвечая на ваши вопросы и делая посты для вас простым, человеческим языком-они продают хайп. Ничего не рекламирую, не продаю. Срачи не поддерживаю, если проигнорировал вопрос-не всегда причина во мне. Во время работы ни одна модель не пострадала)

Показать полностью

АИ изнутри, простыми словами. Знакомство

Серия АИ

Итак, знакомство. Со мной, для начала)

АИ я начал заниматься как хобби. Кум подбил, ты ж, говорит, умный. У меня вся жизнь в инженерии. Социальная, конструкции, ОВиК (сейчас апологеты "кампуктер можно давать только сеньор программистам" заклюют... Но да. Это вообще мой первый опыт в IT). Близко, интересно, уже даже понятно. Склад ума заставляет все препарировать чтобы понять как работает. Чат-боты после анализа наших бесед зовут АИ архитектором. Приятно, но я ему не верю)

Писать буду об агентных системах и текстовых АИ . Графические, звук и прочее прикладное я не изучал вообще. Пока.

Ради интереса я влез в несколько стартапов и понял одну вещь: АИ воспринимают как волшебную палочку. Кто-то уверен что нейросети могут все, кто-то-что они тупорылые, кто-то-что их надо воспитывать как детей. Правы все. Неправы-тоже.

Итак, что же за зверь АИ? Это отличная машина для обработки огромных массивов данных. Это отличный механизм для автоматизации (с кучей оговорок). Мозг ли? Нет. Настраиваемая машина для обработки данных. Верна ли полученная от них информация? Стоит ли верить? Да, но... Это как верить на лекции профессору под грибами. Весело, интересно, но применять на практике я бы не рискнул. Об этом я расскажу далее, объемный слишком пост получится.

P.S. Все написанное во всех постах-субъективно мое личное мнение основанное на личном опыте работы и реверс инжиниринга фреймворков агентных систем и изучении практических приемов работы и обучения ЛЛМ. Часто оно будет не совпадать с мнением ютуб профессоров и поклонников нейросетей. У нас с ними разные цели: я шлифую свои навыки отвечая на ваши вопросы и делая посты для вас простым, человеческим языком-они продают хайп. Ничего не рекламирую, не продаю. Срачи не поддерживаю, если проигнорировал вопрос-не всегда причина во мне. Во время работы ни одна модель не пострадала)

Показать полностью
Отличная работа, все прочитано!

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества