Ответ на пост «"Яндекс" обучил с нуля большую языковую модель Alice AI Foundation LLM и назвал её полностью суверенной»
Типичное для данного жанра сообщение: что-то очень круто разработали, но бездарно (или вовсе никак) внедрили. В пику аналоговнетных танков и самолетов, аналогов которым нет не только у врага, но и в собственных войсках.
Собственно, никакущее внедрение отечественных больших языковых моделей, каково бы ни было их происхождение, может видеть каждый, кто пользуется поиском Яндекса. Алиса AI, нацеленная на суммаризацию результатов поиска, годится только для самых базовых вещей (может сделать выжимку по общеизвестным фактам), но именно тогда, когда от нейросети ждешь интеллектуальности, она полностью пасует. Приведу один яркий пример.
Даю задачу определить, кто изображен в виде бюста, отправляю фотографию бюста из экспозиции Лувра. Получаю импортозамещенный ответ о совершенно другом бюсте.
Допустим, что мне следовало сразу уточнить о том, что это бюст из Лувра, следовательно, скорее всего он изображает француза. Я пытаюсь подтолкнуть Алису к размышлениям в сторону правильного ответа.
Прошу заметить, что Алиса не просто стоит на своем правильном ответе, но пытается подогнать действительность под свой неверный ответ — спорит со мной полужирным начертанием, даром, что не капсом. Замечаю ей, что она рассказывает мне не просто про другого человека, но и о другом бюсте.
От такого верчения на сковороде у меня начинает падать нижняя челюсть на стол. Натягивание совы на Яндекс-глобус продолжается с завидным упорством. Прямым текстом указываю, что мы ведем диалог о разных бюстах.
Прошу обратить внимание, что от исходного задания по определению личности, изображенной в виде бюста, мы пришли к тому, что Алиса уже меня стала спрашивать, кого изображает сей бюст. Это, конечно, не могло не вывести меня из себя. Авторы нейросетевых чат-ботов постоянно предлагают общаться с ними, как с живыми людьми (мол, они так могут, и это эффективная форма), ну я и предположил чисто по-человечески.
Алиса запуталась во всем, кроме своего первоначального упорства. Я бросил это гиблое дело, и занялся поиском по-старинке. Нашел этот бюст на сайте экспозиции музея Лувра, и решил посмотреть на реакцию Алисы.
Ура! Ну слава богу, вместе мы справились! Сколько-то там миллиардов параметров, и теперь я у этих миллиардов могу спросить прогноз погоды и в каком году произошел первый раздел княжества Мекленбург (но это не точно).
Вывод таков. Сколько бы ни было миллиардов параметров в нейросети, на каких бы наборах данных ее не обучали, кто и при помощи какого инструментария это не делал бы, наиболее важно, как этот инструмент применяется на практике. Если при применении нейросетевой бабе не выделить контекста, она и свое прошлое предложение не будет помнить, не то что весь предыдущий диалог. Если ее еще и ограничить доступом только к белому списку сайтов (если дать Алисе ссылку на англоязычный сайт, например Реддит, она отвечает, что не может обращаться к сайтам в интернете; хотя потом содержимое ровно с того же сайта анализирует), получается и вовсе какая-то квасная химера.
В этом я вижу полную аналогию и с материальным производством. Так прекрасно у нас разрабатывают все самое лучшее в мире, но оно либо лежит разработанным на полке, либо, в лучшем случае, применяется для имитации бурной деятельности.
В дальнейшем я хочу осветить еще несколько примеров работы суверенных импортозамещенных духоскрепных нейросетей, и сравнить их с примерами работы мерзких гейских вражеских нейросетей, не являющихся импортными аналогами.






