AgentForge

Infraestructura per muntar un agent d’IA per client sense construir-lo cada cop des de zero.

IA i automatització · TypeScript · Codi de l’MVP publicat

El problema

Moltes empreses volen un «empleat d’IA» i no saben construir-lo ni operar-lo. Qui sí que en sap —una consultora— no té producte amb què lliurar-lo de manera repetible: cada encàrrec torna a començar pel principi i el marge se’l menja el muntatge.

Què fa

  • L’agent es configura un cop —instruccions, eines, memòria i marca— i es lliura al client com una adreça de xat pròpia.
  • La conversa viatja de la interfície a Firestore, d’allà a un flux d’n8n autoallotjat i d’allà al model.
  • Memòria persistent: els fets de llarg termini sobre el client es carreguen a cada torn i es consoliden cada nit en un màxim de vint.
  • Sense cost per instància: la infraestructura és la mateixa per a tots els agents.

El que es va decidir en construir-lo

La memòria penja de l’agent, no de la conversa
Cada agent té la seva pròpia col·lecció de fets, que es reinjecta al prompt a cada torn. Desar-la a la conversa la faria desaparèixer en obrir un xat nou, que és exactament el que converteix un assistent en una cosa que cal posar al dia cada matí.
El motor escriu amb compte de servei, i per això les regles són estrictes
El pla gratuït no té funcions al núvol, així que l’orquestració viu en un n8n autoallotjat que parla amb la base de dades per la seva interfície d’administració. Aquesta via no passa per les regles de seguretat, i per això les regles del client són restrictives: el que el navegador pot escriure es limita al que un usuari final ha de poder escriure.
La consolidació nocturna avorta abans que espatllar la memòria
Cada matinada es fusionen els fets acumulats en un màxim de vint. Com que el pas esborra els vells i escriu els nous, va en una sola operació atòmica, i si el model no retorna alguna cosa vàlida el flux talla abans de tocar res. Una memòria a mig esborrar és pitjor que una memòria sense consolidar.
L’historial s’ordena i es neteja abans d’enviar-lo
La consulta retorna els missatges del més nou al més vell, així que s’inverteixen abans d’armar el prompt, i els torns que van fallar es descarten. Un model a qui se li lliura la conversa del revés contesta amb una coherència raonable i respon una altra cosa.

Fins on arriba

  • És un producte mínim sense desplegar: els fluxos estan inactius, les credencials sense emplenar i no hi ha cap projecte al núvol creat. El que es pot llegir és l’arquitectura completa, no un servei en marxa.
  • Els fets de la memòria avui s’introdueixen a mà des del panell. L’extracció automàtica en tancar una sessió és al disseny, no al codi.
  • L’identificador de client és un camp informatiu: no intervé en cap consulta ni en cap regla de seguretat. L’aïllament real és per agent, i en aquesta versió la col·lecció de missatges és llegible sense autenticar.
  • Les eines que es configuren al panell es desen però el flux encara no les fa servir: la crida al model porta instruccions, memòria i historial, i res més.

Construït amb

  • React
  • Firebase
  • n8n
  • Claude

Dona suport a aquest servei

Automatitzar processos amb intel·ligència artificial

Llegir el codi · Obrir la demo