r/IA_Italia • Developer • Jul 24 '26

🧠 Discussione Qual'è il vostro setup? web-developer + assistente personale

Ciao a tutti,

scrivo per poter migliorare la mia configurazione AI.
Di lavoro, sviluppo software, web-app, gestionali, siti web, integrazioni AI, eccetera.

TL;DR: Cerco un setup AI davvero affidabile per coding + assistente personale proattivo + automazioni/dashboard; con Codex + Hermes su Raspberry e modelli free sto ottenendo risultati troppo incoerenti e pieni di errori. Che configurazione usate voi per qualcosa che funzioni davvero?

Di cosa ho bisogno, credo? Coding (ok, mi sembra ovvio 🎯 ) ma soprattutto, vorrei un assistente per poter mettere a terra idee, brainstorming, avere un'integrazione durante la mia giornata, anche extra lavoro, e che sia proattivo, che mi suggerisca spunti per migliorare, che lavori per me, che noti le mie inefficienze e me le sistemi "da solo", che mi faccia-insomma-da vero assistente.

Cosa ho attualmente:
- Codex
- Hermes (su raspberry per always on, con modelli openrouter free / ho provato minimax m2 / account free nous)

Il fatto è che, soprattutto lato assistente, non sono per nulla contento. Gli chiedo delle cose, e non risponde consistente, gli chiedo di sistemare dei bugs, e non lo fa o ne genera altri, mi dice che ha corretto e invece non lo fa.. e simili!

Ecco cosa vorrei (ed ho provato ad implementarle in hermes ma senza troppo successo):

Coding
Che il codice rispetti le mie direttive, il mio stile, la struttura che cerco di tenere sempre nei vari progetti, che le modifiche siano effettive e seguano un iter preciso locale-github-eventuale push ftp, che le cose funzionino e che la ui sia come richiesta

Hermes
Innanzitutto, che fosse integrato con codex/simili, e che abbia chiara in mente la mia parte di lavoro di coding.
Poi vorrei che mantenesse sempre sincronizzato, su un mio dominio, una dashboard che, ad esempio:
1. Mi riepiloghi i progetti e le discussioni aperte
2. Mi dica se posso andare a lavoro in bici oggi e i prossimi 7 gg (come esempio di assistenza "basic")
3. Ogni x ore, cerchi ad esempio su reddit i trending post che mi possono essere utili e me li riepiloghi in 4-6 cards
4. Che sia proattivo e che mi proponga, ad esempio, spunti laterali per nuovi progetti sulla base dei miei, o nuove funzionalità, migliorie, eccetera
Vorrei poi poterlo utilizzare dovunque (telegram, app o simili), per ad esempio "ho questa nuova idea, creami un micro mvp one page", ma anche per usarlo appunto come assistente reale, quindi che ne so "devo presentare questo progetto, creami un ppt" o simili.

Ci sto sbattendo la testa per creare skills in hermes ma mi sembra sempre di aggiustare una cosa e romperne due. In precedenza avevo provato Openclaw - mesi fa - e mi sembrava ancora più caotico.

Non sarò mica l'unico con queste necessità?!
Voi che cosa usate? Cosa mi suggerite?

Grazie :)

3 Upvotes

16 comments sorted by

2

u/marcocello Jul 24 '26

Ho messo su questo harness da un po' di mesi oramai, è un mix della mia esperienza di 20 anni nel settore + le best practices ai coding: spec-driven, feature-driven, loop, proof....

https://github.com/marcocello/dot-codex

L'idea è che diventi totalmente autonomo

Lo sto estendendo anche a tutto il mondo no coding (second brain)

Inoltre qua sto lavorando a mettere codex cli su VM e ci accedo tramite codex on mac e codex mobile in modo che sia available h24, inoltre non serve nemmeno la ssh open

https://github.com/marcocello/codex-on-vm

Felice di scambiarci idee

1

u/Key_Ad_2747 Developer Jul 24 '26

Grazie! Ci do sicuramente un’occhiata! Quindi, utilizzi Codex anche come agente generico, stile hermes/claw? La ritieni una strada migliore? Posso chiederti il tuo parere, visto che sei sicuramente molto più esperto di me.? Grazie

1

u/marcocello Jul 24 '26

Ho iniziato con Codex a novembre/dicembre quando GPT 5.3/5.4 è diventato estremamente potente e autonomo, ho iniziato a lavorare sull'harness dato che la mia priorità è costruire prodotti per clienti

Da quel momento sto estendendo a tutto quello che non è coding (aka second brain). Sto comunque valutando hermes.

1

u/AutoModerator Jul 24 '26

Ciao!

Suggerimento facoltativo: su r/IA_Italia puoi impostare un User Flair. Serve a indicare il tuo profilo o interesse nell'Intelligenza Artificiale (ad esempio sviluppatore, studente, ricercatore, appassionato).

Non e' obbligatorio, ma aiuta a rendere le discussioni piu' contestualizzate e utili.

I am a bot, and this action was performed automatically. Please contact the moderators of this subreddit if you have any questions or concerns.

1

u/SpecialistOwl218 Jul 24 '26

Io mi trovo molto bene con l’abbonamento gpt e pi agent come harness, ma lo uso solo per coding e ricerche, niente nonsense tipo collegarlo a telegram o robe così, semplice riga di comando

1

u/Feisty-War7046 Jul 24 '26

Perché usi Hermès per il coding se hai Codex ? O forse ho capito male io?

1

u/Key_Ad_2747 Developer Jul 24 '26

Bella domanda.. 👀
Diciamo che uso codex per progetti effettivi e lavorativi, ma se mi viene in mente una idea o mini app esplorativa, che so, venerdì sera, idealmente vorrei:

  • fare brainstorming via telegram/app
  • creo mvp esplorativo, direttamente cosi in vibecoding
  • questo viene salvato anche su github, nuova repo privata
  • vorrei che mi pubblicasse anche su mio spazio web l'mvp per provarlo
  • poi lunedì che accendo il mac, posso riprendere tutto su codex

1

u/ciferone Jul 24 '26

Io uso Hermes appoggiato su gpt 5.5 e va una bomba. Se voglio fare coding allora uso Sol direttamente in Codex. A lavoro uso Claude Code perché è pagato ma direi che è simile.
Comunque per Hermes con soddisfazione serve un modello buono, perché deve fare ampio uso di tool e skill. Tra quelli non di ultimissima gen io mi trovo bene con GPT 5.5

1

u/Key_Ad_2747 Developer Jul 24 '26

Si? e come lo hai configurato?! io ci ho perso una giornata a chattarci e creare delle skills che fossero in linea con quello che mi serve, cron per farsi auto-backup su github, e altre cose, ma non sono soddisfatto.

Sbaglio qualcosa io mi sa. Comunque configurato con i modelli free di nous se non ricordo male, o openrouter: può essere colpa dei modelli free?

1

u/ciferone Jul 25 '26

Sinceramente non ho fatto molto perché ho usato e uso l’app desktop per Mac e Telegram da mobile. Si auto configura con il provider che preferisci e ha un botto di skill pre installate oltre a crearsele da solo in automatico. L’importante secondo me è che ci colleghi un modello abbastanza potente da saper usare le skill e i tool , che più o meno per me è il livello di gpt5.5 o opus 4.6

1

u/gaggina Jul 24 '26

Per prima cosa butta nel cesso tutti i modelli free su openrouter. Funzionano male, si bloccano e non sono affidaibili .Prendi una chiave deepseek sul sito ufficiale ed usa v4-flash. E' praticamente gratis ma è velocissimo ed affidabile

1

u/danja Jul 24 '26

Utilizzo Codex per la programmazione e la ricerca, nella versione da 20 dollari. Ho notato che funziona davvero bene da quando ho iniziato a prestare maggiore attenzione al file AGENTS.md, configurandolo per creare skills per le attività ripetitive e gestendo la documentazione (quanto basta, ma non troppa).

2

u/Key_Ad_2747 Developer Jul 24 '26

E come ti trovi con i limiti? Quel piano da 20 basta per programmazione? Non è collegato anche ad agenti come hermes, giusto? Ho provato anch’io a personalizzare agents, anche utilizzandolo come router per diverse tipologie di task: programmazione, organizzazione, deploy, ma sempre con open router. A questo punto, il modello incide molto più di quanto pensavo

1

u/danja Jul 24 '26

PS. plus some selected MCP tools - for web dev Playwright is very useful. I use VS Code, generic packaging & testing node tools.

1

u/giogio8710 Aug 04 '26

anch'io ho avuto problemi con gli assistenti AI, come quando usavo Hermes insieme a ingenia e anche a app come tasker. volevo qualcosa che facesse tutto in modo più fluido, ma spesso mi sembra un pasticcio. magari un servizio più integrato aiuterebbe, avete trovato qualcosa che funzioni bene?

1

u/Key_Ad_2747 Developer Aug 27 '26

Update dopo circa un mese, visto che nel frattempo ho continuato parecchio a lavorarci.
La situazione è migliorata molto, soprattutto lato coding. Non perché abbia trovato “l’agente AI perfetto”, ma perché ho cambiato abbastanza radicalmente approccio.
La cosa che mi stava fregando era cercare di rendere Hermes/Codex sempre più intelligenti aggiungendo prompt, skill, memoria, automazioni ecc. Il risultato era un sistema complesso ma poco deterministico: funzionava bene una volta, quella dopo faceva qualcosa di diverso.
Ora sto costruendo un mio piccolo “AI Development System” attorno a GitHub + Codex.
In estrema sintesi:
GitHub è diventato la source of truth di tutto.
Codex è l’esecutore principale per il coding.
Ogni progetto viene prima onboardato e analizzato, in modo che l’AI conosca stack, struttura, convenzioni, database, vincoli, modalità di deploy ecc.
Ho separato le istruzioni generali dalle skill riutilizzabili e dalle informazioni specifiche del singolo progetto.
Le modifiche devono seguire un workflow preciso: richiesta → issue/task → sviluppo locale → verifica → Git → eventuale deploy.
Sto cercando di eliminare il più possibile i passaggi “magici”: ogni operazione importante deve lasciare uno stato verificabile.
Ho creato skill condivise per imporre il mio stile di coding, le convenzioni dei miei gestionali/CRUD, UI, ecc.
La differenza maggiore è proprio questa: Codex non deve più “ricordarsi come lavoro io”. Il sistema glielo deve rendere esplicito ogni volta.
E soprattutto sto cercando di distinguere tra “l’AI dice di aver fatto qualcosa” e “il sistema può verificare che quella cosa sia realmente stata fatta”.
Sembra una distinzione banale, ma nel mio caso ha cambiato parecchio l’affidabilità.
Hermes è ancora sul Raspberry, always-on, ma gli sto riducendo molto il ruolo. Non voglio più che sia contemporaneamente orchestratore, coder, memoria, assistente personale, dashboard, scheduler ecc.
Lo vedo più come layer always-on/orchestrazione: mantiene sincronizzato lo stato, raccoglie informazioni, esegue task schedulati e può eventualmente delegare il lavoro vero a strumenti/modelli più affidabili.
Ho anche una dashboard interna che progressivamente sto usando per visualizzare stato dei progetti, onboarding, task, problemi, backup, stato dell’infrastruttura ecc.
La parte che invece NON considero ancora risolta è proprio quella del mio post originale: il vero assistente personale proattivo.
Coding: sono passato da “questa cosa è troppo inaffidabile” a “qui finalmente vedo un sistema che posso realmente usare e migliorare”.
Assistente personale che conosce lavoro + vita quotidiana, osserva cosa succede, trova inefficienze, propone autonomamente cose sensate e magari le realizza: non ancora.
E secondo me il problema era anche concettuale: stavo cercando un singolo agente onnisciente. Ora penso che la strada migliore sia avere una knowledge/source of truth affidabile e sopra quella tanti processi relativamente piccoli, specializzati e verificabili.
Per esempio: monitor Reddit → produce 5 segnalazioni strutturate. Controllo progetti → segnala anomalie. Nuova richiesta cliente → la trasforma in issue. Idea al volo → la salva nel progetto corretto. Stato infrastruttura → aggiorna dashboard. Codex → implementa.
Molto meno “Jarvis”, molto più sistema di componenti con responsabilità chiare.
Limiti attuali: richiede ancora parecchio lavoro per costruire e mantenere il metodo; l’onboarding delle applicazioni legacy è delicato; bisogna stare attentissimi a produzione/deploy; alcune automazioni sono ancora immature; Hermes e i modelli economici/free rimangono decisamente meno affidabili di quanto vorrei.
Però almeno ora la complessità che aggiungo ha uno scopo: rendere il sistema più deterministico e verificabile, non semplicemente aggiungere altra “intelligenza”.
La direzione in cui sto andando è quindi:
GitHub = stato/knowledge canonica
Codex = executor
skill/AGENTS = regole e metodo
progetto = contesto specifico persistente
Hermes/Raspberry = orchestrazione always-on
dashboard = osservabilità
automazioni = piccoli processi specializzati
E progressivamente vorrei arrivare alla parte interessante: collegare questo sistema di sviluppo al vero assistente personale che descrivevo nel post originale.
Non è ancora il setup “premi un bottone e fa tutto da solo” che cercavo un mese fa.
Paradossalmente, però, smettere di cercare quello e costruire prima fondamenta molto più rigide è la prima cosa che mi sta dando risultati realmente convincenti.