0

О новом способе разводки лохов

Серия ITшное

Детекторы ИИ в текстах - полная лажа.

Проверено лично , экспериментально - не существует надёжных научно обоснованных и подтвержденных экспериментами средств определения генерации текста с помощью ИИ .

О новом способе разводки лохов

Простой вывод : каждый кто использует ИИ детектор - ламер и лох. Для кого-то печально, но это факт. Глупее и смешнее использования ИИ детекторов только определять на глаз типа - "вот этот текст сгенерирован нейронкой" ;-) Объяснять таким определятелям , что такое психологические паттерны и особенности субъективного восприятия - бесполезно. Они сектанты, а вопросы веры - недискуссиабельны.


Математически достоверно (то есть с абсолютной, 100%-ной гарантией) определить, что текст сгенерирован нейросетью, нельзя. Это ограничение носит принципиальный, фундаментальный и корневой характер.

Теоретический предел: идеальный генератор неотличим

Предположим, у нас есть нейросеть, которая идеально моделирует распределение человеческих текстов. Тогда любое сгенерированное ею предложение с ненулевой вероятностью мог бы написать и человек. Формально, если распределения P_человек и P_нейросеть совпадают, не существует статистического критерия, который бы безошибочно разделял эти два источника — любое решающее правило будет ошибаться с определённой вероятностью.

Иными словами: если ИИ научится абсолютно копировать человеческий стиль, то никакая математическая формула не отличит его текст от нашего. Сейчас это скорее теоретический горизонт, но он показывает, что безусловной детектируемости нет.

Практические методы — всегда вероятностные.

Сегодняшние детекторы используют статистические закономерности:

  • Предсказуемость слов (perplexity, типичные цепочки токенов);

  • Температурные «отпечатки» (неестественно ровная уверенность модели в каждом слове);

  • Водяные знаки, встроенные на этапе генерации (например, смещённый выбор токенов по псевдослучайному ключу).

Однако всё это даёт лишь вероятностный вывод («с высокой долей уверенности»). Любой такой метод можно обойти:

  • Атаки с подстановкой синонимов или перефразированием (сбивают статистику); (проверено экспериментально - работает)

  • Намеренное «зашумление» выдачи;(проверено экспериментально - работает)

  • Намеренные ошибки в тексте;(проверено экспериментально - работает)

  • Обучение генератора специально обманывать детектор (adversarial training).(проверено экспериментально - работает)

Так, что даже самый мощный детектор не способен дать строгое математическое доказательство — всегда остаётся шанс ложного срабатывания или пропуска. Желающие , могут зарегистрироваться на популярных ресурсах для разводки лохов и проверить лично, за свои личные денежки ;-)

Аналогия с криптографией

Единственный сценарий, когда детектирование становится математически достоверным, — это криптографический водяной знак. Если генератор подписывает текст цифровой подписью, то проверяющий с абсолютной уверенностью скажет: «этот текст создан таким-то генератором». Но это требует сотрудничества со стороны генератора (встраивания подписи) и не работает для произвольного текста из интернета. Без такой подписи задача сводится к статистической проверке гипотез, а не к математическому доказательству.

Итог

Математически достоверно (в смысле proof-carrying вывода) определить генерацию текста нейросетью невозможно, если только сам генератор не оставил в нём криптографическую метку. На практике мы можем лишь говорить о статистической уверенности, которая никогда не достигает 100% и может быть снижена целенаправленными атаками.

В общем - кто хочет и кому интересна практическая польза - читает анализирует практическую пользу материалов , без попыток подогреть паранойю охоты на ведьм - "вам шашечки или ехать?"

А параноики и ИИ-веганы , пусть продолжают искать ведьмины знаки в текстах .

0
Автор поста оценил этот комментарий
Твиттер он же переименованный
раскрыть ветку (1)
0
Автор поста оценил этот комментарий

ах это. Не, не то . По массе причин. Во- первых он заблокированный. Остальное уже не важно.

показать ответы
0
Автор поста оценил этот комментарий
Есть такие площадки , как Икс, у нас просто пока таких глобальных нет, но вы можете создать и это будет по настоящему национальный проект , может быть со временем станет международным ...
раскрыть ветку (1)
0
Автор поста оценил этот комментарий

"Есть такие площадки , как Ик" - что за Икс ? А можно подробнее.

показать ответы
0
Автор поста оценил этот комментарий
Банят авторов , ориг. Контента , пусть, авторы будут писать в другом месте , хабр не авторитет , он как раз руководствуется нормами с ии контентом , а не создает их, этого контента будет становится больше , всех не забанят 😅 знаете, как было с газетами или книгами .
— молодёжь совершенно не общается, сидят в своих книгах газетах.
сейчас книги и газеты это норма и даже похвально .
Потом пришли телефоны и было тоже самое.
Так что эти идеи просто интегрируются в общество и у каждого появится свой индивидуальный ии помощник , как когитор... Да и все ))) как считаете?
раскрыть ветку (1)
0
Автор поста оценил этот комментарий

В общем то да , но есть одна проблема - площадок для обсуждения и обмена мнениями между людьми всё меньше. Впрочем это глобальный тренд , вряд ли возможно изменить.

показать ответы
0
Автор поста оценил этот комментарий
Да это для проверки, если чисто ии писал , без участия человека так сказать, как там было , задается вопрос, например тема для рассказа , и если у всех одинаково, то понятно , кто это сделал , ни кто не против ии , но против того, чтобы только ии отвечал на вопросы, потому, что это не способствует тому, чтобы человек разбирался в теме, а анти ии проверки , скорее для устрашения , для привлечения участия человека в собственных проектах, как лежачий полицейский, просто заставляет быть внимательным и "курить" свою тему. Образование нужно человеку. 🧠
раскрыть ветку (1)
0
Автор поста оценил этот комментарий

Благими намерениями дорога в ад выложена. Как известно. Пока , как бы борьба с ИИ не выходила за рамки комментариев и пространных рассуждение это было в общем то ничего особенного, очередной треп в интернете. Но ситуация изменилась - Хабр создал прецедент - на основании совершенно кстати неизвестных ИИ детекторов - вводится цензура и не просто банится аккаунт а удаляются ВСЕ статьи и ВСЕ комментарии этого аккаунта. С одной стороны смешно, с другой стороны как бы грустно. Жаль конечно, но теперь уже врядли получится найти на Хабре , что то кроме рекламы. Хотя в реальности пофиг. ну был ресурс и нет ресурса, эка невидаль. Один фиг Хабр давно уже не торт. Просто довели ситуацию до абсурда и логического конца.

И наверняка так же как на Хабре, студентов гнобят с курсовыми и дипломами , преподы то в области мракобесия дадут сто очков вперед любому модератору и абсолютно неуправляемы в этом смысле . Хотя врать не буду, это мои личные домыслы, может и не гнобят студентов , надо племянника спросить, как курсовые сдавал.

показать ответы
0
Антропоморфный
Автор поста оценил этот комментарий

Ясно-понятно. Если у тебя детектор ошибся, то это инструмент для лохов. Если у кого-то ИИ галюцинировал и написал ахинею, это пользователь лох, данные не те на вход дал и промпт не тот написал.

И вообще, текст идеального, сферического ИИ в вакууме детектировать нельзя, это математика, сучки. Потому каждый кто на мои посты пишет "это нейросеть" - петух.

раскрыть ветку (1)
0
Автор поста оценил этот комментарий

"Если у кого-то ИИ галюцинировал и написал ахинею, это пользователь лох, данные не те на вход дал и промпт не тот написал." - можно ли телескопом забивать гвозди ? Конечно можно , и потом рассуждать - это ваш телескоп дурацкий , криво гвозди забивает.

;-)

0
Антропоморфный
Автор поста оценил этот комментарий

А если инструмент кривой то использовать его могут только чайники, ламеры и лохи(это те кто да детекторы еще и деньки платят).

Все нейросети время от времени галллюцинируют, верно ли утверждение что все кто их используют - чайники, ламеры и лохи (это те кто за ИИ еще и деньки платят)?

раскрыть ветку (1)
0
Автор поста оценил этот комментарий

В огороде бузина - в Киеве дядька.

Вы зачем смешиваете горячее с мягким ?

Проблема галлюцинаций нейросети , уже не проблема - если корректные данные на входе , корректные промпты для анализа . Более того, для некоторых сценариев галлюцинации и недетерминированность ответов это дополнительный полезный фактор.

показать ответы
0
Автор поста оценил этот комментарий
А зачем, кому то ,что то доказывать? 🤔 Можно просто пользоваться преимуществами, это похоже на то, как пытаться обьяснить вкус яблока , человеку который его не пробовал .
раскрыть ветку (1)
0
Автор поста оценил этот комментарий

"А зачем, кому то ,что то доказывать?" - да нет, какие доказательства. Как уже говорилось вопросы маркеров ИИ в тексте это вопросы веры , обсуждать бесполезно. Проблема в другом - то, что лохи платят свои деньги за результаты детекторов это их деньги, свобода выбора как говорится. Проблема в том, что на основании недостоверных выводов предпринимаются реальные действия имеющие последствия . Самый живой пример - вакханалия ИИ-веганов которая сейчас творится на Хабре - они там реально начали охоту на ведьм и реально чистят автором , не просто переводя аккаунты в read-only но и удаляют стать и комментарии . Что творится у современных дипломников, учитывая что на преподов в Вузах вообще никаких рычагов влияния нет , могу только предположить, или что творится в научных журналах, там думаю совсем все грустно и печально. В общем "мракобесие и джаз" (c) ;-) Хорошо, что меня это уже не касается, хотя студент на то и студент - изворачивайся, придумывай , обмани в конце концов - главное подпись в зачетку, остальное не важно.

показать ответы
1
Автор поста оценил этот комментарий
Если дорабатывать ии выдачу , добавить материалы, собственное мнение , подискутировать с ассистентом , то текст не отличим , если его скопировать в ворд только как текст , создать свое форматирование то и подавно не отличим , да и какая разница, как человек свел данные вместе , лишь бы в своей теме разбирался.
раскрыть ветку (1)
0
Автор поста оценил этот комментарий

"какая разница, как человек свел данные вместе , лишь бы в своей теме разбирался." - осталось объяснить этот простой вывод параноикам и ИИ-веганам ;-)

показать ответы
0
Автор поста оценил этот комментарий

Настолько неинтересна что второй пост пилите. Допустим.

раскрыть ветку (1)
0
Автор поста оценил этот комментарий

Дык, Пикабу же ;-) да на память, вечерами почитать улыбнутся. Сейчас уже не успею, может быть завтра опубликую ответы нейросетей на вопрос "Проанализируй утверждение "все процессы в природе носят вероятностный характер, за исключением гравитации." " - очень интересно с чисто познавательной точки зрения. И самое интересное - очень заметна разница в обучении моделей - ну как студенты на устном экзамене - этому 4 - заслужил, этому и 3 много.

0
Автор поста оценил этот комментарий

Вы как-то пытаетесь привязать качество контента к наличию или отсутствию помощи нейросетей?

раскрыть ветку (1)
0
Автор поста оценил этот комментарий

нет. Мне вообще эта тема неинтересна. Мне ехать, мне не шашечки. Я использую нейросеть в работе для реальных практических инженерных задач. И мне глубоко плевать на истерики параноиков выискивающих маркеты в статьях. Жалкие люди тратят время на борьбу с демонами в своих головах. Просто сегодня с утра, чисто по приколу - задач нейросетям вопрос "Проанализируй утверждение "все процессы в природе носят вероятностный характер, за исключением гравитации." и прогнал ответы через детекторы ИИ - облажались ВСЕ. А если инструмент кривой то использовать его могут только чайники, ламеры и лохи(это те кто да детекторы еще и деньки платят). Мне реально все равно кто как использует или боится нейросетей. Для меня это инструмент - эффективный, качественный, мощный и очень сложный. Я его использую в работе и сохраняю свое рабочее время. Если для кого-то нейросети пугают и доводят до истерики и паранойи - пусть обратятся к психологам или психиатрам - если случай перешел в клиническую фазу.

показать ответы
Автор поста оценил этот комментарий

Иишный текст палится на раз-два, потому что нейронка просто надергивает предложения из разных источников и сваливает их в кучу, никак не модифицируя (человек всегда внесёт изменения, будет использовать синонимы, перефразирует, может расширить текст)

раскрыть ветку (1)
Автор поста оценил этот комментарий

сможете доказать ваше утверждение ? или пустой базар интереснее ? Вот этот текст я написал или ИИ ? Как доказать - С ЦИФРАМИ? Ключевое слово - доказать , с цифрами , а не на уровне чайников-ламеров - "мне кажется". Это для Хабра оставьте, там любят камлать.

показать ответы

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества