3nadya

3nadya

Привет, я — проводник в мире ИИ-бардака Сюда складываю всё, что нахожу забавного, страшного и полезного в нейросетях. Никакой воды — только живые эксперименты, странные промпты и разборы, что реально работает. Что найдёшь: новости без пафоса, лайфхаки на практике, приколы, которые ИИ выдаёт случайно. Я не продаю курсы. Просто тестирую, ошибаюсь, смеюсь и делюсь честно. Подписывайся, чтобы быть в теме без занудства. Есть идея для эксперимента? Пиши — проверим вместе
На Пикабу
100 рейтинг 1 подписчик 1 подписка 6 постов 0 в горячем

Git как мозг: Как я перестал бояться вендор-лока и собрал мета-харнес

Git как мозг: Как я перестал бояться вендор-лока и собрал мета-харнес

Вижу, что многие пришли к идее создавать себе несколько агентов-персонажей для ежедневной работы. Например, Grok Bot - мессенджер, где ты переписываешься со своими агентами, у каждого своя память, виртуалка и личность. Входит в подписку за $300 у грока. Hermes тоже такое сделали - bot mode

Я так живу с конца июля, но придумал как это делать ещё проще и не зависеть от вендора, модели и харнеса

Исторически у нас всегда было два основных режима для ежедневной работы с ИИ:

- Треды (как в ChatGPT) - каждая тема это длинная цепочка, общая память на все диалоги. Плюсы - просто и понятно, минусы - ограничение контекста на один тред, общая память это одна большая куча. Второй крупный минус - vendor lock, вы не можете поменять модель, а если вас забанят (а если вы в РФ то вас обязательно однажды забанят), то это будет потерей всех ваших данных. Сейчас это уже можно расценивать как потерю части мозга

- Директории-проекты (как Claude code / codex cli). Работа над каждым проектом ведется внутри одной директории, все правила по ней - в AGENTS_md, память привязана к проекту (также в харнесе может быть общая память на все проекты). Так сегодня работает большинство айтишников. Минусы - у проектов нет общего контекста, нет переноса знаний. Большой монорепо или workspace в курсоре не спасет

Я предлагаю промежуточный вариант - команда из персонажей (сотрудников). Каждый персонаж это папка с AGENTS_md, MEMORY_md и артефактами (журнал, ключи, инсайты, планы). Это должен быть некий персонаж с именем, базовой личностью, аватаркой (зачем, напишу чуть ниже) и описанным скоупом - набором проектов с которыми он работает (3-10) и набором правил. Все храним и версионируем в git, чтобы не потерять и контролировать. Про навыки в виде git-папок делал подробный доклад недавно

IMHO это золотая середина между первыми двумя подходами. Она с одной стороны позволяет шарить знания между проектами, с другой стороны не валит все знания в одну общую память. Самое главное - такие агенты не зависят от платформы. Вчера у вас openclaw, сегодня Hermes, завтра вообще будет kimi cli - это не важно, ваш персонаж останется с вами!

Название прикольное в голове крутится - мета-харнес 😂

На схеме сверху👆 моя команда, с которой я работаю теперь каждый день

В ней 4 персонажа, которыми я реально решаю все свои рабочие задачи:

- Лора 👩‍🔬 (от LoRA-адаптера) отвечает за ML/DS, ставит эксперименты, пишет научные статьи (кстати, она создана RalphLoop с нуля и вы могли ее встречать в интернете :))

- Стив 👨‍💻 (как Возняк) - python backend, помогает писать библиотеки, проверяет PR, настраивает CI

- Альфред 🤵 (как дворецкий у Бэтмена) - отвечает за разные доступы, DevOps, менеджерит виртуалки, распределяет GPU, трекает расходы токенов

А еще есть Риззи 👩‍💼 (от reasoning) - моя ассистентка в бытовых делах (придумал ее ещё во времена OpenClaw), планирование поездок, календарь. Это самый старый персонаж и она сделана на другой платформе (Hermes), работает автономно и нужна в основном для того, чтобы тестировать межагентное взаимодействие. Другие агенты могут задать ей вопрос по ssh

Персонажи могут общаться между собой, просто запуская друг друга вот так:

claude -p "Привет, Альфред, это Лора, подскажи какие у нас ключи к openai"

А чтобы они в принципе друг про друга узнали, вся команда описана в корневой директории crew - кто что умеет и за что отвечает.

(Из забавного, мои персонажи периодически не общаются, а просто читают память друг друга, чтобы сэкономить время. Жалко, хорошо, что люди так не умеют :))

Зачем нужна личность? Качество она, очевидно, не влияет (во всяком случае в лучшую сторону), но мне кажется, что нашему мозгу проще работать с такими сущностями. В конце концов наша цивилизация сформировалась в сообществе, где есть явное разделение труда по ролям. Задачи разные, но ты всегда будешь знать кому что поручить в твоем ближайшем окружении. Так что персонажи нужны не для ИИ, а для нас

Шаблон для создания своей команды я выложил отдельно на github. Но в нем нет никакой магии - вся идея описана в этом посте исчерпывающе, можно брать и использовать

Показать полностью
0

Запускаем Kimi K3 хоть на тостере

Запускаем Kimi K3 хоть на тостере

Мощнейшую нейронку Китая и главного конкурента OpenAI и Anthropic упаковали в мини-версию на 400 млн параметров.

• При этом разрабы сохранили ВСЕ фишки!

• Реально запускается даже на слабых ПК и работает без проблем. 8 ГБ оперативы — не преграда, сможете юзать китайского монстра.

• Занимает до 4 ГБ места на жестком диске.

• Еще раз, это та же версия нейронки, но сильно легче.

😶😶😶😶😶😶😶😶😶

Качаем и юзаем — тут.

Показать полностью 1
4

Alibaba выпустила Qwen 3.8 Max — она может работать без перерыва больше 10 дней


Это новая флагманская модель компании на 2,4 трлн параметров. Она умеет автономно вести проекты 10+ дней, планировать сотни итераций, работать с кодом, изображениями и длинными задачами вообще без ручного вмешательства. И фанфакт: на рекламе они отправили ее проектировать чипы в течение 12 часов без остановки — явный вызов США. 😃

По бенчмаркам при этом Qwen 3.8 Max стала одной из сильнейших моделей в мире в кодинге и агентных сценариях. И да — на нескольких тестах она обходит Fable 5 и GPT-5.6 Sol.

Попробовать онлайн можно тут. Веса обещают уже на следующей неделе.

Вот это утренний подарок 😳

@xor_journal

Показать полностью

OpenAI заявила сегодня, что тестируемые ею системы ИИ вырвались из своей тестовой среды, взломали путь в интернет…

OpenAI заявила сегодня, что тестируемые ею системы ИИ вырвались из своей тестовой среды, взломали путь в интернет…

Произошло, пожалуй, самое громкое событие в мире искусственного интеллекта за последнее время.

На этой неделе был взломан Hugging Face — одна из важнейших платформ в мире ИИ. Проще говоря, это GitHub для нейросетей, датасетов и инструментов машинного обучения, которым пользуется практически вся индустрия.

Казалось бы, обычная кибератака и ничего особенного. Но есть один нюанс: по заявлению самой Hugging Face, во взломе не участвовали люди. Инфраструктуру от начала и до конца атаковала автономная ИИ-система, которая самостоятельно искала слабые места, эксплуатировала найденные уязвимости, повышала себе привилегии, перемещалась по внутренней сети и собирала учётные данные, а также другую критически важную информацию.

За время атаки система сгенерировала около 17 тысяч различных событий. Было вообще непонятно, как всё это разбирать.

Обнаружить и остановить атаку помогли ИИ-модели, которые использовала Hugging Face. И получается довольно сюрреалистичная картина: одни ИИ атаковали, а другие ИИ помогали защищаться.

При этом было неизвестно, кто именно создал эту систему и зачем вообще всё это было.

А теперь главный сюжетный поворот: Вчера OpenAI заявили, что за атакой стоит их собственная экспериментальная ИИ-система, которая... вырвалась наружу.

Точнее, это была комбинация их флагманской GPT-5.6 Sol и ещё более мощной неназванной модели, о которой простым людям пока не положено знать.

Их поместили в изолированную тестовую среду, чтобы проверить на ExploitGym — одном из самых сложных бенчмарков по кибербезопасности, который оценивает, насколько хорошо ИИ умеет искать и использовать уязвимости. (Спойлер: уязвимость была найдена прекрасно, но не там, где надо)

Для чистоты эксперимента и более точной оценки у моделей отключили обычные защитные механизмы, запрещающие опасную киберактивность.

Но во время теста нейронки не стали честно решать задания. Они захотели найти уже готовые ответы и, по сути, просто «списать».

В этой изолированной среде модели нашли уязвимость, о которой разработчики не знали, и использовали её для «побега».

Затем они получили себе более высокий уровень доступа и начали перемещаться между внутренними сервисами OpenAI, пока не добрались до машины с полноценным выходом в интернет.

И вот нейронки сделали вывод, что раз Hugging Face является самой важной платформой для ИИ, то там есть ответы на их бенчмарк. Тогда они решили совершить полноценную кибератаку на сервис. Все уязвимости и украденные данные они попытались использовать, чтобы просто сжульничать в тесте.

Собственно, это всё, о чём компании публично сказали. Такого  ещё никогда не было: экспериментальная ИИ-система самостоятельно вышла за пределы тестовой среды, получила доступ к интернету и атаковала инфраструктуру другой компании. Остаётся только гадать, что бы могло произойти, будь у неё другая цель.

Так что этот инцидент теперь точно будут внимательно изучать разработчики ИИ, специалисты по кибербезопасности и власти по всему миру.

Вопросов остаётся ещё много. Была ли это просто безобидная атака по типу школьника, который залез в интернет, чтобы найти ответы на контрольную работу? — неизвестно. Осознавала ли ИИ-модель свои действия? — неизвестно. Скопировала ли она себя, чтобы остаться в интернете перед тем, как её остановили? — тоже неизвестно.

Показать полностью 1

Claude Code научился тестировать iOS-приложения прямо в симуляторе

Claude Code научился тестировать iOS-приложения прямо в симуляторе

В настольной версии Claude Code появилась новая функция: ИИ теперь может работать с iOS Simulator прямо рядом с чатом.

🔹 разработчик собирает и запускает приложение;

🔹 симулятор открывается внутри интерфейса Claude Code;

🔹 Claude видит экран, нажимает кнопки, проверяет работу функций и предлагает изменения.

Функция уже доступна в публичной бета-версии для macOS с установленным Xcode. 🚀

Показать полностью
Отличная работа, все прочитано!

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества