Guida all’architettura · iaFlux Studio
Su 181 agent con contratto attivo, contati il 24 agosto 2026 e pubblicati il 26, la regola scritta nella nostra policy interna dice che un compito normale ne convoca uno solo, o nessuno: la risposta diretta viene prima dell’agente, l’agente singolo prima della squadra. Il cantiere da 69 agenti del 14 giugno 2026 è l’eccezione documentata, non il modo in cui lavoriamo ogni giorno.
Correzione del 3 ottobre 2026. Dal 17 settembre questa pagina diceva che i testi arrivati ai controlli erano sedici, che tre agenti erano stati fermati a mano e che a riparare era tornato chi aveva scritto. Ricontando i registri grezzi abbiamo trovato 8 testi, ognuno giudicato due volte nello stesso cantiere, sulla bozza e dopo la riparazione. I tre agenti «fermati a mano» erano tentativi bloccati, interrotti e rilanciati da capo dal motore del cantiere; a riparare sono state istanze nuove dello stesso ruolo. Il resto è in fondo all’articolo, prima delle domande frequenti.
Questa guida la firma chi tiene in produzione quell’architettura e la usa per decidere quanti agenti convocare: è per CTO, responsabili innovazione e team di prodotto che devono sceglierne una e giustificarla. I numeri del roster sono del 24 agosto 2026, pubblicati il 26; quelli del cantiere del 14 giugno 2026. Se la domanda a monte è ancora “conviene automatizzare?”, parti da Quando conviene automatizzare i processi aziendali (e quando no).
Un agente o una squadra: la risposta in 60 secondi
Quattro situazioni, quattro risposte. La colonna di destra dice da dove viene ogni regola: senza provenienza è un’opinione.
| Situazione | Cosa convochiamo | Perché | Da dove viene la regola |
|---|---|---|---|
| Spiegare, editare, rispondere | Nessun agente: risposta diretta | Il lavoro sta già dentro una conversazione sola: un agente aggiunge contesto da ricostruire. | Policy interna, 11 agosto 2026 (nostra applicazione) |
| Compito dentro un dominio solo | 1 agente + 1 gate | A reggere il risultato è il controllo indipendente, non il numero di esecutori. | Policy interna, 11 agosto 2026 (il gate è nostra applicazione) |
| Il compito tocca macchine, obblighi di legge, minori, stati persistenti o difetti muti | La catena completa, fino a 4 gate; 2 gate se il lavoro è piccolo | Qui l’errore non si vede subito e non si rifà in due minuti. | Policy interna, 11 agosto 2026 · pagina sistema multi-agente |
| Molte consegne indipendenti, nessuna aspetta l’altra | Cantiere: agenti in parallelo, gate in fondo | Qui il parallelo produce davvero. Si paga in token. | Anthropic, giugno 2025 · cantiere del 14 giugno 2026 |
Sintesi grezza, tre righe.
- Lavoro che sta in una conversazione sola: nessun agente.
- Lavoro dentro un dominio solo: un agente e un gate.
- Molte consegne che non si aspettano fra loro: la squadra, ed è l’unico caso in cui accorcia i tempi. Sul rischio la catena si attiva per un altro motivo.
Cos’è davvero un sistema multi-agente (e cosa non è)
Un sistema multi-agente non è un parco di processi accesi. Il roster pubblico lo scrive con una frase che vale come definizione: “Non sono processi in esecuzione permanente: sono ruoli che l’orchestratore convoca quando una richiesta rientra nel loro dominio.”
Quei ruoli sono 181, distribuiti su 19 domini, contati il 24 agosto 2026 e pubblicati il 26. La ripartizione, riconfermata sui contratti il 17 settembre 2026, è 23 di coordinamento, 136 operativi, 22 gate: nel roster pubblico si ricontano il totale e i gate, marcati uno per uno con il criterio scritto lo stesso giorno. Il numero si riconta invece di darlo per buono: questa volta la somma torna.
Un agente è un contratto scritto: un dominio, un compito, dei limiti. Un gate è un agente che può fermare una consegna. Sul sito ci sono le definizioni di agent specializzato, gate e verificatore; l’architettura completa, livello per livello, sta sulla pagina del sistema.
Cosa non è: un modo per fare le stesse cose più in fretta. Un cantiere non accelera un compito indivisibile, lo spezza in pezzi da ricucire — e la ricucitura è lavoro che prima non c’era.
La regola scritta: un task, un agente (11 agosto 2026)
La regola è scritta e datata. Vincola anche noi, nei giorni in cui la squadra sembrerebbe più comoda.
Policy interna, 11 agosto 2026. Documento non pubblicato; la stessa regola è pubblica sulla pagina del sistema. Un task = risposta diretta o un solo agente. La catena multi-agente solo su richiesta esplicita, oppure se il task tocca macchine, legge, un minore, stati persistenti o difetti muti (regola “due gate per le cose piccole”).
La ragione è economica: il limite settimanale di token è la risorsa scarsa e si spende come tale. La pagina pubblica del sistema lo dice così: “Il sistema non lancia 181 agenti su ogni richiesta: sarebbe costoso e più lento del lavoro.”
Le cinque categorie che fanno scattare la catena completa non si negoziano: macchine che si muovono o si alimentano, obblighi di legge, minori, stati persistenti (dati che restano scritti), difetti silenziosi, che la policy chiama “difetti muti” (errori che non producono alcun messaggio di errore). Per i lavori piccoli vale una regola intermedia, adottata dopo una misurazione e non per principio: due gate invece di quattro.
Il numero 181 non è un totem: è un conteggio, e dipende dal criterio. Su questo blog uscirà più avanti un pezzo su come si ricontano i 181 senza fidarsi del numero prima.
Quando la squadra vince: il compito si scompone in filoni indipendenti
Il criterio non è nostro. Anthropic lo ha scritto in “How we built our multi-agent research system” (Engineering at Anthropic, giugno 2025): il multi-agente conviene quando il lavoro si scompone in filoni paralleli indipendenti, e costa molto di più in token di una conversazione singola. La seconda metà della frase è il prezzo della prima.
Abbiamo due casi in cui quella condizione era vera. Il primo è il cantiere da 69 agenti del 14 giugno 2026: il lavoro nasceva diviso in testi che non si parlavano, ognuno scritto per conto suo e giudicato da tre controlli indipendenti; a riparare, solo dove i controlli avevano contestato, sono state istanze nuove. Nel cantiere nessun umano ha approvato un testo, e sette su otto erano da far rivedere a una persona.
Il secondo è una consegna per un cliente e-commerce del settore moda: 21 landing page pubblicate in 24 ore su 3 mercati (US, IT, ZH). Anche lì il lavoro nasceva diviso: pagine diverse, lingue diverse, nessuna che aspettasse l’altra. Di quella consegna non abbiamo pubblicato né la data né un registro: il numero è nostro, la prova no.
| Misura | Valore | Da dove viene |
|---|---|---|
| Agenti nati nel cantiere | 69 | registro del cantiere wf_85678eac |
| Tempo di orologio | 35,1 min | dalle 14:10:32 alle 14:45:35 |
| Durata cumulata | 229 min | somma delle durate |
| Istanze aperte in media | 6,5 | 229 diviso 35,1, ferme comprese |
| Picco nello stesso minuto | 21 | un gesto entro il minuto, alle 14:15 |
| Consegne firmate | 66 | registro del cantiere |
| Testi arrivati ai controlli | 8 | giudicati due volte da ogni controllo: 48 giudizi |
Quanto sia costato in token, però, la tabella non lo dice: non lo abbiamo contato.
Quando la squadra perde: tre compiti che lasciamo a un solo agente
Questi tre compiti perdono per lo stesso motivo: lo stato da toccare è uno solo, e più mani sullo stesso stato aggiungono lavoro di riconciliazione.
Un testo singolo: uno scrittore e un gate, non un cantiere
Un articolo, una pagina, una risposta lunga: il testo è indivisibile, e il filo lo tiene chi scrive. Due agenti sullo stesso testo consegnano due testi da fondere, e la fusione è la parte peggiore del lavoro. Un agente che scrive, un gate che giudica.
Un fix dentro un dominio solo
Un difetto dentro un componente si diagnostica leggendo quel componente. Distribuire quella lettura su tre agenti significa ricostruire tre volte lo stesso contesto, con tre letture parziali da mettere d’accordo. Un agente sul dominio giusto, più un secondo gate se il fix tocca dati che restano scritti.
Una risposta a un cliente
Chi risponde deve tenere in testa il rapporto, non solo la domanda: cosa è già stato promesso, cosa è aperto, con che tono si è parlato l’ultima volta. Qui il contesto conta più della potenza, e una squadra somma versioni invece di sommare capacità.
La domanda che viene dopo è sempre la stessa: di che cosa risponde l’agente convocato. La risposta sta in un file, e un altro pezzo di questa serie lo apre riga per riga e mostra cosa dichiara il contratto di quell’agente.
Il vincolo nascosto: togli la squadra, il gate resta
Un agente solo più un gate non è un sistema multi-agente. Sull’agente singolo la pagina del sistema è esplicita: “Il default è una risposta diretta o un solo agente”; il gate accanto a quell’agente ce lo mettiamo noi. Non si taglia per risparmiare: è quello che rende il risultato verificabile da chi non lo ha prodotto.
Il numero dei gate lo abbiamo chiuso con un criterio scritto, perché due modi di contare ne davano due diversi. Sono 22 gate con potere di blocco, contati con il criterio scritto il 17 settembre 2026 (con il criterio più stretto sono 14: il primo conteggio si riconta dal roster, il secondo è spiegato nel README del repository). Tredici nomi coincidono; nove ruoli bloccano per contratto senza dichiararlo nella prima riga.
Un buco c’è: dei tre controlli che hanno giudicato i testi del 14 giugno 2026, due — as-editor e as-compliance — portano nel roster la marcatura di gate; claim-check no: non ha un contratto pubblico. Ha funzionato lo stesso, ma un controllo senza contratto pubblicato non è verificabile da fuori.
Dal 17 settembre 2026 i verdetti dei gate hanno un registro pubblico, compreso il verdetto negativo del red team sul piano di questo blog. Si aggiorna quando c’è un verdetto nuovo, non a scadenza fissa; il tasso continuo dei verdetti resta non misurato.
I sistemi che questi agenti costruiscono girano su un’infrastruttura che paghiamo ogni mese: lo stack delle nostre automazioni, con i costi mensili.
Come decidiamo noi: quattro domande prima di convocare più di un agente
Prima di aprire un cantiere passiamo da quattro domande, in quest’ordine. Basta un no alle prime tre e il cantiere non si apre; la quarta decide quanti gate mettere.
- Il lavoro si scompone in filoni che non hanno bisogno l’uno dell’altro?
Sì: si passa alla domanda due.
No: un agente solo, con il suo gate. Un compito indivisibile non si accelera dividendolo. - Le consegne separate sono abbastanza numerose da ripagare il coordinamento?
Sì: cantiere. Il 14 giugno 2026 erano otto testi, giudicati due volte da tre controlli.
No: un agente in sequenza. Dove stia la soglia, non lo abbiamo misurato. - C’è un ruolo che giudica il risultato intero, e non solo i pezzi?
Sì: cantiere, con quel gate in fondo.
No: niente cantiere. Senza un giudice dell’insieme il parallelo consegna pezzi coerenti e un risultato incoerente. - Se sbaglia, costa caro?
Sì (macchine, legge, minori, stati persistenti, difetti muti): la catena completa; se il lavoro è piccolo, due gate invece di quattro.
No (si rifà in due minuti): un agente, un gate, avanti.
Queste quattro domande sono la nostra posizione, non il risultato di una misura: il criterio viene da Anthropic (giugno 2025), le soglie con cui lo applichiamo sono nostre.
Cosa non abbiamo misurato
Tre cose che questa guida non può dimostrare. Chi dice quando fidarsi di un’architettura deve dire dove non si fida dei propri numeri.
Cosa abbiamo corretto in questa pagina
Corretto il 3 ottobre 2026, oltre a quanto detto nella nota in apertura. Altre frasi che questa pagina diceva e che i registri non reggono, ognuna con quello che è vero:
- «Lavoro cumulato», 229 min: i 229 minuti sono la somma delle durate di tutte le istanze, e circa 128 sono attese del risultato di un comando o tentativi bloccati
- «Tempo moltiplicato», 6,5 volte: il 6,5 è il numero medio di istanze aperte insieme, comprese quelle ferme
- «Nessun umano ha approvato un testo»: vale nel cantiere, dove nei registri non c’è nessun messaggio di una persona, ma i controlli hanno fatto passare un solo testo, e gli altri sette erano da far rivedere a una persona; i registri non dicono se qualcuno abbia autorizzato i comandi degli agenti
Domande frequenti
Quando conviene un sistema multi-agente e quando basta un solo agente?
Conviene quando il lavoro si scompone in filoni indipendenti con molte consegne separate: è l’unico caso in cui la squadra accorcia i tempi. Il criterio dei filoni indipendenti è di Anthropic, giugno 2025. Fuori da lì basta un agente con il suo gate, salvo quando il compito tocca macchine, legge, minori, stati persistenti o difetti muti: allora la catena si attiva per il rischio, non per la velocità. La soglia oltre la quale il coordinamento si ripaga non l’abbiamo misurata.
Quanti agenti servono per un compito normale?
Uno, oppure nessuno: lo dice la nostra policy interna dell’11 agosto 2026, che mette la risposta diretta prima dell’agente singolo. I 181 agent contati il 24 agosto 2026 e pubblicati il 26 sono ruoli che l’orchestratore convoca quando servono, non processi accesi. Quante volte al giorno valga questa regola non è registrato.
Un agente solo ha comunque un controllo indipendente?
Sì: il gate resta anche quando la squadra non c’è. I gate con potere di blocco sono 22, contati con il criterio scritto il 17 settembre 2026; con il criterio più stretto sono 14, spiegati nel README del repository; il primo conteggio si riconta dal roster. Il tasso continuo dei verdetti non è misurato.
Cosa succede se si usa una squadra dove bastava un agente?
Si paga due volte: il contesto va ricostruito dentro ogni agente e i pezzi vanno ricuciti alla fine, senza guadagno di parallelismo perché il compito non era divisibile. Quanto costi in token sul nostro sistema non lo abbiamo contato: è una lacuna dichiarata, non una stima.
I 181 agent lavorano tutti insieme?
No. Il picco documentato è di 21 agenti nello stesso minuto, il 14 giugno 2026, in un cantiere che ne ha visti nascere 69 in 35,1 minuti. Il roster elenca ruoli disponibili, contati il 24 agosto 2026 e pubblicati il 26, non processi in esecuzione.
Se devi decidere l’architettura di un sistema tuo, i quattro criteri con cui distinguiamo un sistema in produzione da un pilota, e i nostri sistemi elencati con numero e data, sono in Agenti AI in Italia: chi li costruisce e chi li documenta.
Per discutere un caso concreto scrivi a studio@iaflux.it oppure usa la pagina contatti: rispondiamo per iscritto entro un giorno lavorativo.
Antonio Santoro
Lo stesso metodo, sui tuoi numeri?
Scrivici cosa deve fare e con quali dati lavora: rispondiamo per iscritto entro un giorno lavorativo, con una proposta e un preventivo fisso.
Scrivici →