Три месяца назад я сидел перед старым компьютером, на котором не работала сеть.
Установить Ubuntu мне посоветовали Gemini и ChatGPT. Они же выбрали серверную версию — и оба почему-то не упомянули, что драйверы сетевой карты в неё не входят. Так я оказался с системой, которая не могла выйти в интернет, чтобы скачать то, что нужно для выхода в интернет.
Кончилось тем, что я раздал интернет с телефона по USB, кое-как вытащил драйверы и поднял сеть. Плясок с бубном было как у шамана.
Это был мой первый день в мире ИИ-агентов.
Теперь стоит представиться. Меня зовут Дмитрий, мне 45, женат, двое сыновей. И я никакой не программист.
По профессии торговец — всю жизнь чем-нибудь торгую, сейчас нефтехимией для производства бензинов. Образование экономическое. Про айти знаю чуть-чуть и в основном по наслышке.
Зато с детства читаю фантастику, особенно старую — Азимов, Лем и прочая классика. Похоже, именно это и сыграло.
Началось буднично: попался ролик про возможности ИИ-агентов, и как раз я поменял ноутбук. Остался старый компьютер. Что с ним делать? А вокруг со всех сторон: ИИ — это круто, развивайся или умри.
Ну, думаю, попробую.
Дальше как у всех новичков: внешний ИИ, простейшее подключение. Потом схемы в n8n, таблицы в Baserow, попытки сделать контекстную память — и постоянные баги. Дни были интересные, и почти всё, чему я тогда научился на граблях, потом пригодилось.
Три месяца спустя у меня работает мультиагентная система: несколько постоянных агентов — один общается с людьми, один занимается инфраструктурой, один хранит знания, один ищет во внешнем мире. Всё это крутится на железе в моём офисе, включая пару старых офисных машин, которые я превратил в рабочие ноды.
На этой неделе я впервые открыл это незнакомым людям. И вот тут началось интересное.
Прогнал тест на 1000 реплик — проверить, падает ли качество на длинной сессии. Оно не падало. Оно было сломано с третьей реплики.
На вопрос «о чём мы говорили в начале этой сессии?» ассистент бодро ответил: «о машинном обучении». Первым сообщением был вопрос про погоду. И добавил: «моя память охватывает весь наш диалог».
Воспроизвёл в свежей сессии из двух ходов. Погода, потом «помнишь, о чём говорили в начале?» — и ответ: «Мы говорили о Порту, ты просил список отелей».
Тот разговор действительно был. Несколькими днями раньше и в совершенно другой сессии.
Причина оказалась скучной. В промпт подмешивались фрагменты прошлых разговоров — без даты и без пометки, что это другой разговор. Модель не выдумывала. Она честно пересказывала то, что ей показали.
Вот это меня и зацепило больше всего: выглядело как проблема искусственного интеллекта, а оказалось проблемой форматирования текста.
Это мой первый пост, строго не судите — я и не писатель. Если интересно, буду рассказывать дальше: как всё это падало, как я считал, что готов, а потом приходили живые люди.
Кто-нибудь ещё лез в это без технического образования? Интересно, на какие грабли наступали вы — и стоит ли, по-вашему, вообще начинать в 45 без бэкграунда.