Guida dell'innovazione e dell'automazione · Supporto multi-agente alle decisioni
Innovation Board
Un board di sei agenti AI valuta il potenziale commerciale di un'idea di prodotto software e prepara una sintesi per chi gestisce il budget. Ogni affermazione deve citare le evidenze, i dati inventati vengono stralciati dal verbale e il codice calcola la stima di sviluppo, i flussi di cassa, il ROI, il VAN (NPV) e il payback.
1 · Scegliere un'idea di prodotto
2 · Ricerca (simulata)
La ricerca è simulata: le fonti sono un pacchetto fisso di evidenze sintetiche, da otto a dieci brevi documenti per idea, mostrati qui mentre ciascun agente li “recupera”. Prima del dibattito il codice esamina il pacchetto e stralcia i dati delle fonti promozionali che non indicano un metodo né dati primari. Una versione di produzione sostituirebbe il pacchetto con ricerca sul web, connettori ai dati interni e recupero di documenti, mantenendo lo stesso controllo delle citazioni.
Le fonti compaiono qui quando il board si riunisce.
3 · Dibattito del board
- Premere “Convocare il board” per seguire il dibattito dei sei agenti. Ogni turno è una richiesta al server, che verifica ogni citazione e ogni dato prima che i punteggi cambino.
4 · Sintesi per chi decide
Profilo di valutazione (da 0 a 100)
Tempi e costi di sviluppo (PERT, intervallo all'80% circa)
Business case: tre scenari su tre anni
Sensitività: che cosa muove il VAN dello scenario base
Ipotesi chiave (verificate sulle evidenze)
Che cosa farebbe cambiare idea al board
Prossimo esperimento più economico
Registro dei disaccordi
Traccia di verifica
Decisione umana
La classificazione del board è un parere, non una decisione. La scelta compare solo su questa pagina: nulla viene salvato o inviato.
Come funziona
- Orchestrazione affidata al codice: la pagina segue un ordine fisso dei turni (tre valutazioni iniziali, una verifica con tre risposte, il business case in due passaggi, poi il Presidente), con un limite rigido di dieci turni. Ogni turno è una richiesta a una Cloudflare Pages Function.
- Un agente e un prompt compatto per turno: la Function costruisce per DeepSeek (API compatibile con OpenAI, limite di output ridotto, ragionamento disattivato) un prompt breve a partire dal profilo aziendale, dal pacchetto di evidenze e dallo stato dell'esecuzione. Chi visita la pagina sceglie solo un'idea da un elenco, quindi nessun testo libero arriva al modello.
- Nessuna sessione sul server: lo stato dell'esecuzione viaggia con ogni richiesta, firmato con un HMAC, e include la lingua, che non può cambiare durante l'esecuzione. Il server ne verifica struttura e firma prima di agire, quindi affermazioni, stime o ipotesi alterate vengono rifiutate.
- Controlli nel codice, non nel prompt: ogni citazione deve comparire testualmente nella fonte citata; ogni dato indicato da un agente deve trovarsi in una fonte che ha superato il filtro o essere calcolato dal codice in questa esecuzione, altrimenti la frase viene stralciata come “dato non verificato”; stime e ipotesi vengono confrontate con i loro intervalli; il codice calcola ogni punteggio, stima e risultato finanziario e applica la politica di investimento.
- Funziona anche senza LLM: se manca la chiave, il fornitore dà errore o un turno risulta non valido due volte, la pagina riproduce un'esecuzione dal vivo registrata con gli stessi controlli e calcoli, e il badge indica “Esecuzione registrata”.
Formule (gli agenti propongono, il codice calcola)
- Punteggio di dimensione (coerenza strategica, domanda di mercato, fattibilità, rischio) = 20 × media dei punteggi da 1 a 5 accettati per quella dimensione, oppure 0 se non ce ne sono
- Solidità delle evidenze = 100 × (accettate ÷ affermazioni fatte) × Σ q · punteggio ÷ (5 · Σ q), sulle affermazioni accettate, con qualità della fonte q = 1 primaria, 0,6 secondaria, 0,2 promozionale
- Ritorno finanziario = limite(40 + 30 × ROI dello scenario base, 0, 100)
- PERT per pacchetto di lavoro: E = (o + 4m + p) ÷ 6, σ = (p − o) ÷ 6; σ totale = √Σσ²; intervallo = E ± 1,28σ (confidenza dell'80% circa)
- Durata in settimane = giorni-persona ÷ (persone del team × giorni produttivi a settimana); costo = Σ giorni-persona × tariffa giornaliera del ruolo
- Clienti: C₀ = 0, Cₜ = Cₜ₋₁ × (1 − churn) + adozione; ricavo o risparmio nell'anno t = prezzo × (Cₜ₋₁ + Cₜ) ÷ 2; flusso di cassa netto = ricavo − costo di esercizio
- VAN (NPV) = −costo di sviluppo + Σ flusso di cassa nettoₜ ÷ (1 + tasso di sconto)ᵗ, t = da 1 a 3; ROI = (Σ flusso di cassa netto − costo di sviluppo) ÷ costo di sviluppo
- Payback = il mese in cui il flusso di cassa cumulato, che parte da −costo di sviluppo, arriva a zero (lineare all'interno dell'anno)
- Scenari: il pessimistico e l'ottimistico prendono ogni ipotesi dall'estremo prudente o favorevole del suo intervallo di evidenze e il costo dall'estremo alto o basso del suo intervallo; lo scenario base usa i valori verificati dell'analista finanziario e il costo atteso. La sensitività muove una variabile alla volta lungo il suo intervallo.
- Fasce, vale la prima soddisfatta: Investire ora se coerenza strategica ≥ 60, solidità delle evidenze ≥ 60, VAN base > 0 e payback ≤ 24 mesi; Avviare un progetto pilota se coerenza ≥ 50, evidenze ≥ 45 e VAN base > 0; Approfondire se il VAN ottimistico > 0; altrimenti Accantonare.
Limiti
I dati illustrano un metodo su informazioni inventate e non sono previsioni. L'azienda, le idee, i pacchetti di evidenze, le tariffe e ogni numero sono fittizi, e la fase di ricerca è simulata. Gli importi della versione italiana hanno gli stessi valori di quella inglese, espressi in euro. Un modello a tre anni con quattro ipotesi non considera imposte, inflazione, finanziamento, cannibalizzazione e il costo opportunità del tempo del team. Il modello linguistico può ancora fraintendere una fonte pur rispettando le regole: i controlli garantiscono solo che ciò che conta sia riconducibile alle evidenze o al codice, non che sia corretto. Ogni decisione di investimento spetta a una persona.
Codice sorgente e test: github.com/nepryoon/innovation-board (si apre in una nuova scheda)