Почему программисты не могут понять ИИ

Серия Размышления про ИИ

Часто встречаю среди программистов скептическое отношение к перспективе развития ИИ. “Я прекрасно понимаю как это все работает, поэтому точно знаю, что ничего нового в этом нет и ничего нового оно породить не может. Что в него заложено, то он и будет повторять.” - примерно так они формулирует свое мнение.

Действительно, софт, который используется для обучения и работы ИИ является далеко не вершиной сложности компьютерных программ. Я бы даже сказал, что он довольно примитивен. Работа ИИ представляется простым складывании и умножением цифр. Просто цифр много и это порождает некоторые технические сложности. Это видит и понимает программист.

Проблема в том, что программист не видит того, что стоит за этими примитивными расчетами. 

И это не является чем-то особенным. Программист видит изменения в базе данных, но он не видит за этими изменениями финансовые мошенничества, изменения климата, ухудшение здоровья пациента, близость компании к финансовому краху. Это все видят совершенно другие специалисты, которые часто не имеют отношения к ИТ сфере.

Программист не видит, что примитивные расчеты являются весьма сложной математической моделью мира и процесса осмысления его человеком. Программист не видит, что ИИ порождает новые знания, точно так-же как, например, климатическая модель мира порождает знание о том, что будет в случае взрыва мощного вулкана.

Искусственный интеллект

6.3K постов12.1K подписчика

Правила сообщества

ВНИМАНИЕ! В сообществе запрещена публикация генеративного контента без детального описания промтов и процесса получения публикуемого результата.


Разрешено:


- Делиться вопросами, мыслями, гипотезами, юмором на эту тему.

- Делиться статьями, понятными большинству аудитории Пикабу.

- Делиться опытом создания моделей машинного обучения.

- Рассказывать, как работает та или иная фиговина в анализе данных.

- Век жить, век учиться.


Запрещено:


I) Невостребованный контент

  I.1) Создавать контент, сложный для понимания. Такие посты уйдут в минуса лишь потому, что большинству неинтересно пробрасывать градиенты в каждом тензоре реккурентной сетки с AdaGrad оптимизатором.

  I.2) Создавать контент на "олбанском языке" / нарочно игнорируя правила РЯ даже в шутку. Это ведет к нечитаемости контента.

  I.3) Добавлять посты, которые содержат лишь генеративный контент или нейросетевой Арт без какой-то дополнительной полезной или интересной информации по теме, без промтов или описания методик создания и т.д.


II) Нетематический контент

  II.1) Создавать контент, несвязанный с Data Science, математикой, программированием.

  II.2) Создавать контент, входящий в противоречие существующей базе теорем математики. Например, "Земля плоская" или "Любое действительное число представимо в виде дроби двух целых".

  II.3) Создавать контент, входящий в противоречие с правилами Пикабу.


III) Непотребный контент

  III.1) Эротика, порнография (даже с NSFW).

  III.2) Жесть.


За нарушение I - предупреждение

За нарушение II - предупреждение и перемещение поста в общую ленту

За нарушение III - бан

Вы смотрите срез комментариев. Показать все
5
Автор поста оценил этот комментарий
Автор, ты нормальный? А кто, как не программист, написал эти расчёты и алгоритмы?
раскрыть ветку (27)
0
Автор поста оценил этот комментарий

Автор не понимает разницы попсового ИИ из голивудских фильмов и ИИ, который сейчас в айти (по сути новое название machine learninga). Ну и ещё он не знает, что за с виду простой моделью в инференс стоит обучение, во время которого огого какое программирование бывает.

раскрыть ветку (10)
0
Автор поста оценил этот комментарий

огого какое программирование бывает

Ну расскажите мне про "огого".

Это метод обратного распространения ошибки для вас "огого"? Если так, то у меня для вас плохие новости. Это далеко не огого.

Ааа, ну наверное Tensor Flow вызывает трепет. Ну так обрадую вас, вам там разбираться совсем не нужно, за вас там уже все что нужно сделано.

Методы борьба с переобучением? Ну они все тоже известны, никакого огого там нет, да и все это давно реализовано.

Есть еще какие-то огого?

раскрыть ветку (9)
0
Автор поста оценил этот комментарий

Может Вы мне лучше расскажите, как обучить распознавалку отпечатков пальцев, когда сканы пальцев люди (в отличие от фото лиц) в соцсети в бесконечном количестве не выкладывают?

раскрыть ветку (8)
0
Автор поста оценил этот комментарий

Известная проблема. Масштабирование, поворот скана, зашумление, зеркальное отражение вариации яркости. Так получится побольше сканов, чем есть.

Есть модели, генерирующие правдоподобные отпечатки (http://biolab.csr.unibo.it/research.asp?organize=Activities&select=&selObj=12&pathSubj=111||12&)

раскрыть ветку (7)
0
Автор поста оценил этот комментарий

Поздравляю, Вас можно брать в отдел маркетинга. Будете с умным видом вот это рассказывать, когда конкуренты будут задавать вопрос «как Вы сеть обучили, данных же нет».


P.S. Ган не сгенерирует ничего вне того подпространства, которое образует та выборка, на которой этот ган был обучен. Ещё раз - сгенерируйте ганом хоть триллионы отпечатков, все равно сеть распознавания, обученная на этой базе будет работать не лучше, чем та же сеть, обученная на той базе, на которой был обучен ган.


P.S.S. Про повороты, сдвиги, зашумления даже говорить не хочется - это детский сад какой-то

раскрыть ветку (6)
0
Автор поста оценил этот комментарий

конкуренты будут задавать вопрос

На такие вопросы никто не отвечает, а умные их и не задают. Известно на каких данных обучался chatGPT - нет. Ни одна коммерческая компания не будет раскрывать такие детали.


Ган не сгенерирует ничего вне того подпространства, которое образует та выборка,

Я просто указал, что существуют генераторы изображений. И если сами данные недоступны, то можно использовать сгенеренные изображение.

Даже если вне выборки они ничего не сгенерят, вам то какая разница? Считайте это хакингом который вам позволяет добраться до той выборки, которая использовалась при создании генератора.

Прием этот используется вовсю. Берем ChatGPT и генерим с его помощью обучающую выборку. Получается дешево и вполне приемлемо.


P.S.S. Про повороты, сдвиги, зашумления даже говорить не хочется - это детский сад какой-то

Мне то окуда знать какой у вас уровень. Судя по вопросам - да, детский сад.

раскрыть ветку (5)
0
Автор поста оценил этот комментарий

Предлагаю Вам хотя бы джуном попробовать работать в отрасли, чтобы знать, какие вопросы задают, а какие нет. Вопрос, откуда данные для обучения - первый, который задаст любой покупатель конечного продукта.


Если Вы откроете и прочитаете статью, которую кинули, то увидите, что сгенерированы они на основе базы FVC, в которой примерно 10 000 отпечатков. Этой базы даже для теста нормального алгоритма мало, не то, что обучения.


Выводы о моем уровне Вы хоть как-то сможете делать только после того, как на PFT или Minex появитесь

раскрыть ветку (4)
0
Автор поста оценил этот комментарий

OpenAI не раскрывает конкретные источники данных, использованные для обучения моделей, таких как ChatGPT.

Компания Google не раскрывает подробные сведения о том, на каких именно данных обучалась их модель Gemini.

Компания, стоящая за MidJourney, не раскрывает точные детали о данных, которые они использовали для тренировки своей модели.

Детали о данных, использованных компанией Meta для обучения их ИИ-моделей, не раскрываются публично в полном объеме.

Ну и так далее.


Я не являюсь специалистом в распознавании отпечатков пальцев и в три клика нашел вам базу в 10 000 отпечатков (по вашим словам). Если бы мне это было нужно, я бы потратил на это неделю и нашел бы достаточно данных. Ну и уж точно не спрашивал бы у малознакомого чувака с pikabu, где мне найти данные. А уж если бы и спросил, то сказал бы спасибо за ответ, а не рассказывал бы, что это полная херня (даже если это и полная херня).

раскрыть ветку (3)
1
Автор поста оценил этот комментарий

Давайте так - Вы хоть раз обучали сеточку в рамках работы, после чего результат Вашей работы кто-то купил (не работодатель «купил», заплатив Вам зарплату, а у работодателя потом кто-то купил)?


P.S. Вы нашли 10 000 отпечатков, Вам написали, что этого мало даже для теста, но Вы с гордостью пишете про «три клика»… Поймите, большинство нерешенных задач - это те, где данные найти нельзя в нужном количестве. Даже если у Вас денег, как Илона Маска, Вы не можете приехать в Африку и начать собирать 10 раз на дню у всего населения. Слишком паршивый пиар с этого получится. Вон WorldCoin пытается такое с радужкой делать, и что про них после этого пишут?

раскрыть ветку (2)
0
Автор поста оценил этот комментарий

Вы хоть раз обучали сеточку в рамках работы, после чего результат Вашей работы кто-то купил

Нет. И очень надеюсь, что никогда не придется что-то продавать клиенту.

Поймите, большинство нерешенных задач - это те, где данные найти нельзя в нужном количестве.

Понимаю

раскрыть ветку (1)
ещё комментарии
Вы смотрите срез комментариев. Чтобы написать комментарий, перейдите к общему списку

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества