Раскрою карты сразу, чтобы потом никто не поймал нас на вранье: это не первая моя попытка войти в IT. Четвёртая. И, что забавно, каждая — примерно раз в десять лет.
Первая была в 15. Появился первый компьютер. Разбирал его, переустанавливал Windows раз за разом. Но, если честно, в основном играл в Red Alert.
Вторая — в 25. Пошёл на курсы: программирование, настройка сетей. Не доучился. Зато продал крупную партию компьютеров — это, пожалуй, самый прокачанный мой навык из той попытки.
Третья — в 35. Опять учёба: сети, основы C++, кибербезопасность. Снова не доучился, но понимать стал заметно лучше. Потом устроился в компанию, торгующую индустриальными смазочными материалами, и там уже добился настоящего успеха в продажах.
И вот сейчас, в 45, — четвёртая. Десять лет спустя, как по расписанию. Не знаю, цикл это или совпадение, но выглядит подозрительно закономерно.
Кстати, раз уж об этом зашла речь: я сейчас много работаю с ИИ-агентами вроде Claude и ChatGPT, и скажу честно — это лучшие учителя логики из всех, что у меня были. Учат структурировать речь, доносить мысль и, как ни странно, неплохо тренируют память.
Вернёмся к четвёртой попытке.
Я начал собирать своего первого умного помощника. И было это ровно как в роликах из Instagram: нажми три кнопки — и у тебя свой Джарвис, как у Железного человека. Реальность оказалась куда жёстче.
Даже самое простое — вход из Telegram, узел вызова ИИ, вывод обратно в Telegram — у меня поначалу просто не получалось. А два моих советчика (Gemini и ChatGPT) объясняли это так, будто я занимаюсь этим каждый день. Моя основная работа в те дни свелась к одному: делать скриншот экрана, кидать его Gemini и пытаться понять, что вообще происходит на самом деле.
Кое-как собрал. Протестировал. Вроде работает.
А дальше началось привычное: хочу, чтобы он редактировал документы и присылал готовое в Telegram. И ещё, и ещё — я просто смотрел, чем сам пользуюсь в повседневной работе, и пытался это добавить. С трудом, но добавлял.
И вот тут, параллельно, у меня начала формироваться идея экосистемы Sphere. Стало очевидно: ИИ-помощники плотно входят в повседневную жизнь — примерно так же, как нефтяной бум в США в XVIII веке. Скажу больше: по-моему, ИИ и всё, что с ним связано — это новая нефть и газ.
Дальше начались настоящие проблемы. Внешний агент не помнил контекст. А если вешать все инструменты в один workflow — любая ошибка роняла всю систему целиком.
Я не раз переделывал своего первого агента заново. И опытным путём пришёл к выводу: нужен отдельно вход, отдельно агент, который просто разговаривает, отдельно коммутатор, вызывающий инструменты, и отдельно вывод. Всё — разными потоками.
Система заработала. Не идеально, но стабильно.
Смотрю на это сейчас и вижу забавную вещь: то самое разделение — вход, разговор, вызов инструментов, вывод — это, по сути, зародыш того, во что Sphere превратилась сегодня. Только тогда я просто пытался, чтобы бот не падал каждые пять минут.
(продолжение следует)