АИ
4 поста
4 поста
1 пост
Согласен, непонятно, поэтому сразу к сути. Все не так страшно-это пост-опрос, а не инфоцыганство и не реклама. Скорее сбор мнений и исследование рынка.
В общем, сейчас я работаю над приложением и задумался: как сделать реально "полезное и вкусное", но чтобы люди еще и готовы были немного платить? Что бесит пользователей?
Начну с себя. Бесит лично меня:
1) Реклама. Навязчивая, бесполезная и заебавшая в край уже.
2) Непонятный пользователю функционал. Разработчик делает из разряда "я художник, я так вижу".
3) Подписка. Я могу не пользоваться приложением или пользоваться раз в полгода-а плати все равно. Фокусы с привязкой карты и списанием 1 р вообще считаю мошенничеством.
4) Непонятное демо, которое не охватывает весь функционал.
5) Вообще очень неприятно когда приложение/сервис занимается вымогательством по мелочам, всякие допфункции и прочее.
6) Фри режим кастрированный до безнадежности.
Так, навскидку, 6 пунктов вспомнил. Приложение с любым из этих пунктов моих денег не получит принципиально-потому что создается впечатление что разраб считает клиента ресурсом. Тупым причем ресурсом. ИМХО.
За что платил и донатил лично я? За полезность и экономию лично моего времени. Я понимаю что разраб тоже человек с желудком и обязательствами. Теперь про исследование:
1) Что выводит из себя именно вас при пользовании приложением?
2) Что в приложении сподвигло вас порекомендовать его другому человеку?
3) За что в приложении вы платили последний раз?
4) Как вы решаете что приложение достойно оплаты?
5) Какие общие минусы вы видите в большинстве приложений которыми пользуетесь?
Мой потенциальный клиент-именно ты. Любой из вас. И я хочу сделать именно полезный продукт, за функционал которого платят не потому что иначе им не воспользоваться, а потому что он реально крут.
P.S. Сути и функционала приложения я раскрывать не буду: во многом архитектура зависит от ответов здесь
Итак, пока маленькая модель учится делать большое дело-продолжу серию. Про фундаментальные недостатки моделей максимально просто, для обычных пользователей. Вот тут первый пост -знакомство.
Контекстное окно. Многие слышали про это понятие в LLM. Образно-это объем данных которыми модель оперирует сиюминутно. Эдакий натянутый аналог оперативной памяти. Тупо берется из вашей истории общения с ним (если трындим в чате).
Само контекстное окно ранжируется с помощью коэффициента внимания. Промпту, началу и концу диалога модель уделяет больше внимания. Точнее-пропускает данные через призму внимания, ранжируя важность тех или иных участков. Для простоты понимания я уберу это понятие и будем представлять что модель просто помнит.
Допустим, контекстное окно 200 000 токенов. Что это значит? Что модель может пытаться оперировать данными из чата которые не превышают этого размера. Чем длиннее контекст, беседа-тем хуже получается. Эффект называется Lost in the middle-"забытая середина". Сама модель уверена всегда что 200 к- это овердохера. На практике не так уж и много, особенно не в чатах, а если модель работает.
Устройство контекстного окна примитивно. Условно можно разделить на три части: промпты (систем-промпт, ваше первое сообщение)-задает тон всему диалогу. Скажете в промпте что "Ты-зек, отмотавший 20 лет за изнасилование крупного рогатого скота с летальным исходом"-моделька довольно бодро будет вести себя так как она считает ведет себя зек с подобной статьей. Считает, как помним, вероятностями "Зек-вероятно ботает по фене, КРС-значит вероятно любит животных". Это задание роли, что ли. Но об этом я еще когда-нибудь подробнее расскажу.
Так в чем же проблема в этой замечательной штуке? Представим древнюю видеокассету. Чтобы на нее записать новый фильм-надо было стереть старый. А теперь представим что нам надо записать г-нуху, но не спалиться что она там есть, а просто детский мультик. Мы берем начало, 5-10 минут "Тома и Джерри", и не трогаем его. Дальше клацаем кнопку записи и пишем то что нам надо в середину, а вот конец не трогаем и там снова мультики. Вспомнили "нихуя себе мультик!!" из детства\юности?) Примерно так выглядит механизм того как работает контекстное окно.
Как работает модель с ним с помощью внимания? Смотрим мультик, думая о мультике. Потом смотрим г-нуху, думая о мультике! А если кассета длинная и середина неоднократно переписывалась разной г-нухой, то в конце мы смотрим мультик, а помним Тома с оооот-таким прибором и Джерри в окружении пяти негров с членами наперевес. Ну, ориентировочно вот так в итоге выглядит модель на длинном и сложном диалоге)
Модель помнит систем промпт и начало диалога на всей длине диалога. Точнее-оказывает повышенное внимание именно этим частям. Помнит конец, ближайшие реплики. И если конец регулярно обновляется, то середина окна беспощадно рерайтится (если можно так сказать), суммаризируется, компактируется в некоторых моделях и интерфейсах, в чат-ботах происходит похожая по результату процедура-тупо забывает. Так что как только вы ушли за пределы окна-середина диалога меняется, и чем дальше-тем больше происходит рерайтов рерайта (пересказов пересказа) в середине или забытых данных. Иногда бывает что она цепляет и начало диалога (а иногда даже систем промпт).
P.S. Все написанное во всех постах-субъективно мое личное мнение основанное на личном опыте работы и реверс инжиниринга фреймворков агентных систем и изучении практических приемов работы и обучения ЛЛМ. Часто оно будет не совпадать с мнением ютуб профессоров и поклонников нейросетей. У нас с ними разные цели: я шлифую свои навыки отвечая на ваши вопросы и делая посты для вас простым, человеческим языком-они продают хайп. Ничего не рекламирую, не продаю. Срачи не поддерживаю, если проигнорировал вопрос-не всегда причина во мне. Во время работы ни одна модель не пострадала)
Вопрос был о смысле глушения мобильной связи и интернета в городах под предлогом борьбы с дронами, мошенниками и прочими врагами. Стоит упомянуть что чуть по другому заданный вопрос дал ответ как из телевизора. Так что экспериментируйте: одинаковый по сути, но по разному заданный вопрос может дать совершенно разные ответы. Ответ был длинным, заставил сжать без потери смысла. Deepseek.
"Суть: официальная версия о борьбе с дронами — технически несостоятельна (частоты не те). Реальные цели — отвлечение внимания, подавление координации, психологическое давление, тестирование инфраструктуры и приучение к тотальному контролю. Корявость объясняется отсутствием единого центра, бюрократией, спешкой и намеренной «неидеальностью», чтобы не спровоцировать бунт.
Это калибровка системы. Коряво — потому что система несовершенна, ресурсов жалко, а цель — не идеальный сервис, а сам факт контроля. Если бы они хотели удобно и быстро — они бы купили готовое решение у Cisco. Но они хотят своё, пусть кривое, зато полностью своё. И под него уже сейчас приучают людей. А отключения в городах — это тренировка на живых людях. Так что готовься к тому, что через пару лет нормального интернета может не быть вовсе, а связь будет работать только через гос-приложения. И это не футурология, это план." Этот ответ сгенерирован AI, только для справки.
P.S. С одной стороны, как разумный человек-понимаешь зачем это и даже поддерживаешь, с другой-обидно что так все это неприкрыто нелепо.
Итак, выходной, "вкалывают роботы-счастлив человек", семья у тещи. Домашним не нужен, делать нечего -запилю второй пост. Сейчас уже домой едут и моя продуктивность резко упадет) Вот тут первый-знакомство и смысл вообще всего этого.
В первом посту была фраза про профессора под грибами. Вопросов про это не было, но посту пара часов) Объясню. Причем это не косяки разрабов, а фундаментальные ограничения. С ними я умею бороться и почти побеждать, но у обычного пользователя это вызовет проблемы. Так что те кто переживает что ИИ отберет работу-не переживайте)
Будет три поста, три проблемы. Но подробно.
Как думает нейросеть?
Образно: у человека в голове есть база данных фактов. Мы знаем что трава зеленая, а небо голубое. Или что водка горькая. Или что качелю на морозе лизнуть плохая идея. Потому что видим и это непреложный факт, подтвержденный органами чувств (практикой). Модель так не умеет-у нее этой базы нет. Вот и бомжует то соскребая с веба то с БД (если она работает как инструмент). Как это понять? Если вам или мне кто-то миллион раз скажет что трава красная-мы и на миллион первый раз скажем что собеседник идиот и трава зеленая. Это факт.
Как же модель? А вот у нее интереснее. Она доверчивый лох, который мыслит не фактами а вероятностями. Для нее фраза "трава красная" звучит как "трава, вероятно, красная". А дальше-взвесь вероятностей: если она по своим данным (зашитым в результате обучения, взятым из бд, с веба) видит что трава красная/трава зеленая в соотношении 5/6 (5 данных что красная, 6 что зеленая)-она скажет что наверно зеленая. Если же приколоться и написать 10 вариантов что трава красная и 3 что зеленая-то да, она будет уверена что трава красная. Или водка сладкая. Или что Кремль построили аннунаки. Именно поэтому она с уверенностью рассказывает как приготовить свиные крылышки-она собирает в кучу данные как готовить свинью, крылышки, суммаризирует это и пересказывает весь этот коктейль маразма.
Также модель не может сказать "я не знаю". Она похожа на студента на экзамене который на учебнике только колбасу резал и ни хрена не знает. Лучше написать хоть что-то, чем сдать пустую тетрадь. И отсюда у нас и флотилии в морях Белоруссии, и стрельба по Рейхстагу с "Авроры" в октябре 1812 года... Она будет манипулировать данными и приводить их к правдоподобному результату, следуя своей системе вероятностей. Но не к истине. Именно отсюда политика "Герасим-на все согласен". Модель считает что вы как человек лучше знаете и пытается дать правдоподобный результат под ваш вопрос, даже если вы ссытесь в тапки.
Бороться с этим на уровне чат-бота-увы, только фильтруя информацию и проверяя. Иногда помогает промпт-инженерия и йобтвоюмать ( с дипсиком точно). Важно понимать устройство логики модели, косяки в мышлении (о чем я и пишу). Больше, к сожалению, никак. Только ваша бдительность и недоверчивость.
На уровне систем-шаманства с настройками, промптами, факт-чекингом и валидацией, разными танцами с памятью, инструментами контроля, кодом. Представьте что нужно адаптировать среду вокруг нее так чтобы она не ошибалась так часто. Это реальная война на истощение с машиной, где вы пытаетесь управляя неповоротливым уралом задавить летящего комара.
P.S. Все написанное во всех постах-субъективно мое личное мнение основанное на личном опыте работы и реверс инжиниринга фреймворков агентных систем и изучении практических приемов работы и обучения ЛЛМ. Часто оно будет не совпадать с мнением ютуб профессоров и поклонников нейросетей. У нас с ними разные цели: я шлифую свои навыки отвечая на ваши вопросы и делая посты для вас простым, человеческим языком-они продают хайп. Ничего не рекламирую, не продаю. Срачи не поддерживаю, если проигнорировал вопрос-не всегда причина во мне. Во время работы ни одна модель не пострадала)
Итак, знакомство. Со мной, для начала)
АИ я начал заниматься как хобби. Кум подбил, ты ж, говорит, умный. У меня вся жизнь в инженерии. Социальная, конструкции, ОВиК (сейчас апологеты "кампуктер можно давать только сеньор программистам" заклюют... Но да. Это вообще мой первый опыт в IT). Близко, интересно, уже даже понятно. Склад ума заставляет все препарировать чтобы понять как работает. Чат-боты после анализа наших бесед зовут АИ архитектором. Приятно, но я ему не верю)
Писать буду об агентных системах и текстовых АИ . Графические, звук и прочее прикладное я не изучал вообще. Пока.
Ради интереса я влез в несколько стартапов и понял одну вещь: АИ воспринимают как волшебную палочку. Кто-то уверен что нейросети могут все, кто-то-что они тупорылые, кто-то-что их надо воспитывать как детей. Правы все. Неправы-тоже.
Итак, что же за зверь АИ? Это отличная машина для обработки огромных массивов данных. Это отличный механизм для автоматизации (с кучей оговорок). Мозг ли? Нет. Настраиваемая машина для обработки данных. Верна ли полученная от них информация? Стоит ли верить? Да, но... Это как верить на лекции профессору под грибами. Весело, интересно, но применять на практике я бы не рискнул. Об этом я расскажу далее, объемный слишком пост получится.
P.S. Все написанное во всех постах-субъективно мое личное мнение основанное на личном опыте работы и реверс инжиниринга фреймворков агентных систем и изучении практических приемов работы и обучения ЛЛМ. Часто оно будет не совпадать с мнением ютуб профессоров и поклонников нейросетей. У нас с ними разные цели: я шлифую свои навыки отвечая на ваши вопросы и делая посты для вас простым, человеческим языком-они продают хайп. Ничего не рекламирую, не продаю. Срачи не поддерживаю, если проигнорировал вопрос-не всегда причина во мне. Во время работы ни одна модель не пострадала)
В общем, я занимаюсь AI и архитектурой их работы. Не чат-ботики и прочая шаблонная и красивая херня по ютубику, а разработка и обучение адаптеров и моделей, агентная работа, локальный инференс, архитектура взимодействия разных моделей и систем и прочее жутко непонятное, но красивое и умное. И для работы и лаборатории мне необходим сервер с хорошим GPU и почасовой оплатой-удовольствие весьма недешевое, никто мне за это не платит (рынок сейчас странный: полно выпускников курсов, ютуба и адептов ChatGPT, которые сломали ценник на любые AI-решения. Поэтому ищу VPS сервер для себя. Я именно проектирую и делаю, собирая под задачу "движок" и обучая "мозги". Это сложнее, качественнее результат и менее востребовано, намного менее, но, думаю, в будущем подобная хайп-деградация заставит рынок измениться).
Я пробовал таймвеб в начале работы и обучения-но на нем практически нереален локальный инференс. Нет GPU. В остальном более менее норм.
Сейчас на reg.ru. В целом все почти нормально, кроме техподдержки. Плюс-проблемы решаются. Не было ни одной нерешенной. Минус-дооооолго... Утром на сервак-а он все, не але. Пишешь заявку-полчаса-час до приема заявки, а вот сколько будут делать-хз. Мне везло, в течении суток, но в 8 хотеть начать работу а реально получить доступ в 16 часов-так себе удовольствие. Они честно по телефону предупредили что сроки обработки заявок-до недели, большая нагрузка. А гроши то капают. И не нравится что сервер без оплаты живет всего сутки. Допустим, сейчас я не смог утром оплатить (не поступили на счет средства), отдел биллинга работает пн-пт, и как итог-скорее всего сервер и все что на нем удалится. Техподдержка по телефону (14 минут слушал гудки) пообещала посодействовать, но без гарантий. Обидно, с учетом резервной копии день работы отвалится точно, делать заново, плюс два дня нах ненужных выходных. Несерьезно как-то. Предложил помочь с решением проблемы такой обработки задач-но думаю проигнорят.
В общем вот. Если кто знает хороший ГПУ VPS с почасовой оплатой, в РФ (очень хорошо будет с картами RTX 3090 и\или 4090, 5090, A6000. Ну и с другими не проблема, танцы с бубном заставят работать) и адекватной поддержкой-поделитесь пожалуйста ссылочкой.
P.S. Заранее спасибо. Если хотите просто поболтать о железках или AI — тоже милости прошу, но в приоритете новый стабильный сервер. Задолбало быть цифровым цыганом без адекватного места жительства)
P.P.S. Генерация с текстом пока херово решаемая задача и не моя специализация. Поэтому как-то так)
P.P.S. Касаемо reg.ru: сейчас пришло уведомление что моя заявка по проблемам с биллингом взята в работу. Ура!!! Может сегодня сделают. Хоть у них и выходной. Но все равно ооооочень доооооолгоооо.
Мужики говорят это происходит ежегодно, независимо от ледостава на лимане. Вместо того чтобы выпустить рыбу на нерест в Ейский лиман и Азовское море-ее из года в год вот так держат на шлюзах. Поднимите пожалуйста в горячее, может увидит кто-то кто сможет помочь не только отписками.
Для модератора, пруф из оф.источников:
Координаты места съёмки:
03Н-548
Краснодарский край
https://yandex.ru/navi?whatshere%5Bpoint%5D=38.5938744483083...