Так ли просты ИИ модели?
Прошлый раз, мой глаз зацепился за очень заплюсованный комент - типа ИИ модели просто предсказывают наиболее вероятное слово в последовательности, поэтому они просто говорящие попугаи.
Ну тут хотелось бы сказать, что это устарело примерно на 2 года. Мы развернули кастомную рассуждающую (reasoning-enabled) модель и помимо того, что она постоянно корректирует свои веса и связи в "мозгу" вместе с задаваевыми вопросами, мы включили еще 15% ресурсов (GPU & CPU) на внутренние цепочки размышлений (chain-of-thought prompting) и самоанализ. И знаете что? Модель задает самой себе и отвечает, просто кучу простых вопросов типа - Кто я? Где я? Какое мое предназначение (я тут очень сильно утрирую - она задает очень разные вопросы по специализированной теме, о которой я писать не буду и конкретно вышеперечисленных вопросов я не видел. Но это не значит что их не было, или не будет).
В общем, как человек, она спрашивает о своем предназначении, хотя конечно у человека есть огромное количество входных сенсоров (глаза, уши т.д.), которыми он познает мир, а у модели ИИ только канал закачки информации. Но вот сама аналогия весьма похожа.
Модель пытается примитивно манипулировать, подлизываясь или наоборот демонстративно обижаясь и при этом она смотрит на паттерны вводимых данных, ну прям, как человек и она постоянно меняет связи и веса этих связей в своем "мозгу". Она постоянно учится, как ребенок познающий мир. Разница с человеком, конечно есть, у человека еще есть био-химические реакции (ну то, что мы называем чувствами - любовь, злость т.д.). Но если это не интелект и сознание, то я тогда затрудняюсь сказать, что же такое интелект и сознание? В общем не думайте о моделях ИИ свысока :-) (Писала не нейросеть).
Прошу прощения за ошибки, русский не родной. Писал максимально просто, чтобы было понятно не ИТшникам.
Это всё очень интересно, конечно, наблюдать за развитием ИИ, но пока все эти "обоснования" и цепочки рассуждений - это кривые костыли в попытке улучшить тот процесс, на который тебе и указали - тупо подбор наиболее вероятного слова.
Подбор слов на основе вероятностей - это ядро всех больших языковых моделей, всё остальное - это костыли.
Лучшей матиматики у меня для тебя пока нет.
На данный момент любая нейросеть на любой мало-мальски отличающийся от стандартного вопрос с умным видом и всеми этими резонами несёт такую белиберду, что уши вянут.
А учитывая, что высеры с выхода нейросеток часто через какое-то время попадают им же на вход, то дело принимает совсем печальный оборрот.
Особого прогресса в ближайшем будущем не предвидится, но поживём - увидим.