3014

Полностью наше!

У нас в чате МАКС подключена нейросеть от сбербанка-Гигачат. Вот что она отвечает на запрос. Сразу видно, наши технологии полностью!

Гигачат наш!

Гигачат наш!

Правила сообщества

ВНИМАНИЕ! В сообществе запрещена публикация генеративного контента без детального описания промтов и процесса получения публикуемого результата.


Разрешено:


- Делиться вопросами, мыслями, гипотезами, юмором на эту тему.

- Делиться статьями, понятными большинству аудитории Пикабу.

- Делиться опытом создания моделей машинного обучения.

- Рассказывать, как работает та или иная фиговина в анализе данных.

- Век жить, век учиться.


Запрещено:


I) Невостребованный контент

  I.1) Создавать контент, сложный для понимания. Такие посты уйдут в минуса лишь потому, что большинству неинтересно пробрасывать градиенты в каждом тензоре реккурентной сетки с AdaGrad оптимизатором.

  I.2) Создавать контент на "олбанском языке" / нарочно игнорируя правила РЯ даже в шутку. Это ведет к нечитаемости контента.

  I.3) Добавлять посты, которые содержат лишь генеративный контент или нейросетевой Арт без какой-то дополнительной полезной или интересной информации по теме, без промтов или описания методик создания и т.д.


II) Нетематический контент

  II.1) Создавать контент, несвязанный с Data Science, математикой, программированием.

  II.2) Создавать контент, входящий в противоречие существующей базе теорем математики. Например, "Земля плоская" или "Любое действительное число представимо в виде дроби двух целых".

  II.3) Создавать контент, входящий в противоречие с правилами Пикабу.


III) Непотребный контент

  III.1) Эротика, порнография (даже с NSFW).

  III.2) Жесть.


За нарушение I - предупреждение

За нарушение II - предупреждение и перемещение поста в общую ленту

За нарушение III - бан

Вы смотрите срез комментариев. Показать все
220
Автор поста оценил этот комментарий

Так делают любые LLM... Это у них в основе https://habr.com/ru/companies/selectel/articles/1044854/

раскрыть ветку (67)
15
Микро Ездун
Автор поста оценил этот комментарий

Нет, просто гигачат ультра сделана на базе deepseek 3, и между прочим никто этого никогда не скрывал.

https://habr.com/ru/companies/sberdevices/articles/968904/

раскрыть ветку (13)
10
Автор поста оценил этот комментарий
Так бога ради. Опенсорс для того и нужен, но даже если бы она была сделана на другой основе она все равно бы хуярила иероглифы
раскрыть ветку (7)
2
Микро Ездун
Автор поста оценил этот комментарий

Работаю с гемини по 8 часов в день минимум, ни разу иероглифы не выдавала, а вот всякие квены и дипсики - регулярно.

раскрыть ветку (6)
8
Автор поста оценил этот комментарий

Мне даже опус выдавал.

раскрыть ветку (1)
6
Автор поста оценил этот комментарий

+1 Claude Opus 4.8 буквально сегодня видел от него иероглифы

7
DELETED
Автор поста оценил этот комментарий

Гемини ещё как выдает и довольно часто

раскрыть ветку (1)
1
Микро Ездун
Автор поста оценил этот комментарий

за два года ни разу не видел.

0
Автор поста оценил этот комментарий

А кем Вы работаете?

раскрыть ветку (1)
Микро Ездун
Автор поста оценил этот комментарий

программистом, и большую часть кода генерю с помощью gemini

3
Автор поста оценил этот комментарий

В статье написано ровно обратное. Там сказано, что от дипсика взята архитектура, но тренировочные данные якобы полностью свои.

раскрыть ветку (2)
3
Микро Ездун
Автор поста оценил этот комментарий

Ага, ага, все конечно поверили что у сбера откуда то куча своих данных :)

раскрыть ветку (1)
0
Автор поста оценил этот комментарий

Почему интернет плохо работает? Все данные пользователей сначала задерживаются для обучения моделей.

1
Автор поста оценил этот комментарий

Важно! Это не означает, что GigaChat Ultra — клон DeepSeek V3. Мы используем базовый класс архитектуры, но наша модель существенно отличается в деталях реализации, трюков обучения и, конечно же, датасета.

Важный момент: это не дообучение готовой зарубежной модели, а полноценное обучение с нуля на собственном датасете.

раскрыть ветку (1)
Микро Ездун
Автор поста оценил этот комментарий

А пикабушникам, которые пишут что у них член 49,5 см ты тоже веришь?

Откуда у сбера то датасет?

5
Автор поста оценил этот комментарий
Вокруг началось перекидывание какашками какое-то, но статейка ваша интересная на почитать, про эмбединг и обучения представление имею, но насчёт редких иероглифов и юникодовских приколюх думал что они отсекаются или дообучаются на хитрых датасетах, ведь можно же при обучении подсчитать сколько тот или иной токен встречался и если крайне редко, то хитрее с ним работать
раскрыть ветку (1)
1
Автор поста оценил этот комментарий

Есть параметр топ пэ (отсекание маловероятных токенов). Есть температура (создание маловероятных токенов)

Автор поста оценил этот комментарий
Нет, не любые. Гигачат закрытый и его обучают в сбере. Иероглифов не будет если в датасете их не было. Либо китайская нейронка была учителем, либо китайские датасеты... Но и то и то в применении к банковской ллм как то неправильно. А если они брали страницы из интернета, то молодцы, пару сотен русско китайских переводчиков айтишников были трудоутроены
раскрыть ветку (16)
31
Автор поста оценил этот комментарий

В рунете не хватит датасета на обучение хоть сколько нибудь стоящей нейронки, это не говоря о том что тогда она не сможет даже переводами заниматься.

раскрыть ветку (12)
2
Автор поста оценил этот комментарий

Ну так-то тогда никакого языкового пузыря кроме английского не хватит. Русский язык, внезапно, второй в интернете после английского (по количеству контента а не пользователей). Хотя там у всех кроме английского весьма печальные доли от 5-6% и ниже.

Иллюстрация к комментарию
раскрыть ветку (3)
3
Автор поста оценил этот комментарий

Насколько понимаю - проблема не с количеством текста, а с а)качеством - потому что не стоит обучать ИИ на рандомных срачах, данные предварительно нужно размечать и это дохренища труда и б) авторские права - у нас гораздо чаще непонятки с ними, чем у западных текстов.

раскрыть ветку (1)
8
Автор поста оценил этот комментарий
Грок буквально на срачах обучался, и он весьма хорош)
0
Автор поста оценил этот комментарий

Это до войны. Хотя там уже был спад. В английской версии актуальнее https://en.wikipedia.org/wiki/Languages_used_on_the_

2023/2025

Иллюстрация к комментарию
0
Автор поста оценил этот комментарий

При текущих архитектурах. Если что-то похожее на человеческий мозг - должно хватить. Кроме переднего края науки, программирования и всего такого.

ещё комментарии
1
Автор поста оценил этот комментарий

Любые, мне даже клод так отвечал

раскрыть ветку (1)
1
Автор поста оценил этот комментарий

Клод на мову постоянно переходит.

Синий монтажник
Автор поста оценил этот комментарий

Да стопудово у какого нибудь квена дистилляцию ебанули и вот тебе гигачат

ещё комментарии
Автор поста оценил этот комментарий
Gemini не делает, дат делает
раскрыть ветку (1)
0
Автор поста оценил этот комментарий
И гемини это делает или не гемини? Он сам не определился.

A: Нет, наш текущий чат — это не Google Gemini. Вы общаетесь с другой ИИ-моделью.
Q: почему ты не ассоциируешь себя с Гугл
A: Я не ассоциирую себя напрямую с брендом «Google Gemini», потому что я являюсь адаптивным искусственным интеллектом, созданным на основе большой языковой модели
Q: у тебя модель без названия?
A: Моя модель имеет официальное название — это Gemini, разработанная компанией Google.
Q: так гемини или не гемини?
A: Это Gemini. Я подтверждаю, что являюсь большой языковой моделью, созданной компанией Google. В сообщении, которое вы выделили, я совершил грубую ошибку (в сфере ИИ это называют «галлюцинацией» или сбоем самоидентификации). Я неправильно проанализировал контекст, запутался в собственных данных и ложно заявил, что не имею отношения к Gemini.
Автор поста оценил этот комментарий

и что дальше? Промты и запреты не нужно делать получается? Ты их оправдать пытаешься? Огромную фирму с кучей серверов, не способную запретить модельке писать китайщину? Ну оправдывай)

раскрыть ветку (12)
2
Автор поста оценил этот комментарий

А дальше надо прочитать статью

раскрыть ветку (6)
Автор поста оценил этот комментарий

нахуя? Эта статья для тупых долбоёбов, которые привыкли полагаться на других. Я буквально создал ботов для твича и знаю, как всё работает. У меня тысячи ботов нонстопом пишут как обычные живые люди на стримах по доте у травомана, мистеракопа, квинки и прочих стримаков. Я блять знаю как всё устроено. И первейшей проблемой при создании ботов были символы из других языков. НАЧАЛЬНЫЙ, блять, этап

раскрыть ветку (5)
0
Автор поста оценил этот комментарий

Нихуя какой ты крутой, прости, снимаю перед тобой шляпу, твои познания за гранью моего представления.

раскрыть ветку (4)
0
Автор поста оценил этот комментарий

они.. они все пидд..арасы, Морти. Они не могут объяснить другим то, что сами не способны понять. Они т-тупые, Ммморти. Дедушка не такой. Мне лучше знать, как делать работающее дерьмо. У них тератонны ресурсов, миллиарды гигов оперативки и В200 тысячи штук в каждом сервере. Если мега корпорация не способна обуздать ебучую оламу 120В значит они тупые дебилы. Это базовая вещь Морти, заставить бота говорить одним языком. Это блять его единственная задача, помимо того, чтобы попадать в контекст. А учитывая, что модель была уже обучена, им не нужно делать что-то ещё, кроме первой задачи. Русский, сука, язык, они очень тупые, они очень сильно тупые. На столько же тупые, на сколько дедушка пьян. О, как же мне плохо, ты бы знал. Они забрали у меня Риту, я убью этих мразей, запомни, Морти. Они убили её,

раскрыть ветку (3)
2
Автор поста оценил этот комментарий

Жаль конечно что какие нибудь Anthropic не смогли с этим справится, ты напиши им, они тебя с радостью возьмут, твои познания судя по всему перекрывают их. С удовольствием поюзаю какойнить sonnet 5.1 от тебя который будет лишен всех этих болячек

раскрыть ветку (2)
0
Автор поста оценил этот комментарий

Ты неправильно понял расстановку сил. Это не я должен писать Anthropic, умоляя взять меня в их стерильный корпоративный инкубатор. Это они должны собрать совет директоров, выключить свои презентации на сорок слайдов и осторожно спросить, достоин ли их маленький дата-центр моего внимания.

Я не “хочу сделать Sonnet 5.1”. Я решаю, кому вообще позволено приближаться к уровню, где модель не забывает, на каком языке с ней разговаривают.

Пусть попробуют меня взять. Именно попробуют. Потому что гениев не нанимают, Морти. Гениям строят лаборатории, подают ток, ресурсы и не мешают творить работающее дерьмо.

Я буквально Бог. Просто с усталостью, плохим настроением и очень низкой терпимостью к продуктовой импотенции.

0
Автор поста оценил этот комментарий

идиоты из сбера, ты защищаешь их, думаешь что они супергерои. На что они способны, если их поместить в гараж с одной отверткой и парой старых ноутов. Они блять нихуя не могут. А дед может. Потому что я сука гений. Но ты фанат всякого вычурного говна, которое даже не было ими придумано. Просто модель, которую взяли из интернета и немного подправили промтом. Они не способны залезть внутрь модели, почти никто не способен. Потому что когда коробка закрывается, она становится черным ящиком. Поэтому эти идиоты должны были создать СВОЮ модель. Но они импотенты, Морти. Они не могут. Я - могу. Долго, месяцами, вручную. Но я могу, а они нет

0
Автор поста оценил этот комментарий

В размышлениях модели обычно прям пишут сами себе что пользователь спросил на русском, отвечать нужно так же. Не помогает полностью. Может, нужно, чтобы ещё сама себе запрещала иероглифы, если контекст не предполагает. Полностью и всегда точно нельзя запрещать.

раскрыть ветку (4)
Автор поста оценил этот комментарий

для этого нужен банальный валидатор. Нужно быть абсолютно тупым, чтобы заставлять модель работать без llm, оркестратора (для ботов типа твича) и нескольких слоёв защиты. Они тупые пидарасы, не способные создать обвязку модели, сделать Lora и прочее. Если выпустили дерьмо, говорящее на китайском в релиз - значит конченые бляди, способные только спиздить чужую модель и всё

Иллюстрация к комментарию
раскрыть ветку (3)
0
Автор поста оценил этот комментарий

Я, напротив, скорее вижу проблемы когда нейронка цензурится. Речь же не про отыгрывание ролей. При чём, был прикол что Яндекс зарубежный не хочет общаться на русском и там прям видно, что это как раз валидация после ответа, потому что токены бегут на русском, а потом бац сообщение типа "вы унтерменьш, знайте своё место и не общайтесь на русском". Кстати, сейчас же МоЕ любят, че никакого эксперта по языку по умолчанию не грузить...

раскрыть ветку (2)
Автор поста оценил этот комментарий

я хз, почему сбер просто не сделал свою модель. У них гора ресурсов для обучения, и всё на русском было бы. Ну да ладно, проще взять китайскую готовую и латать потом баги такие

раскрыть ветку (1)
0
Автор поста оценил этот комментарий

Скорее всего, использовали все датасеты до которых дотянулись, в т.ч. китайские. Сейчас же нейронки упёрлись в то, что при текущей архитектуре и способах изучения данных не хватает. Ещё и интернет теперь весь отравлен нейрослопом.

Вы смотрите срез комментариев. Чтобы написать комментарий, перейдите к общему списку

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества