Skip to content

AI-RESIDENCY · Percorso 4: Costruire e gestire

Sovereign AI Architecture Residency

Cinque giorni nel Lab, alla fine dei quali non ci sono slide, ma il Suo progetto di architettura, validato su hardware reale.

Durata
5 giorni nel Lab
Gruppo
da 4 a 8 persone
Formato
Nel lab
Lingua
Tedesco o inglese
Preavviso
da 6 settimane
Prezzo
44.500 € forfettario, IVA esclusa

Erogazione a partire da quattro partecipanti effettivamente iscritti. La data viene confermata per iscritto dopo aver concordato contenuti, prerequisiti e disponibilità.

Per chi è questo track

Il team centrale di un’organizzazione che pianifica concretamente una piattaforma AI sovrana: architetti, responsabili di piattaforma e la persona che deve sostenere l’investimento. Fino a 8 partecipanti di una sola azienda, non è un evento aperto con pubblico misto.

Per chi no

Non per team che stanno ancora costruendo le basi o vogliono confrontare fornitori diversi. Per questo ci sono Sovereign AI Platform Engineering (AI-PLATFORM) come corso e il Sovereign AI Executive Briefing (AI-EXEC) per il livello decisionale.

Situazione di partenza

Nella Sua organizzazione è sul tavolo una decisione di investimento che può diventare a sei o sette cifre: piattaforma GPU propria, sizing, modello di esercizio, make or buy. Di concetti su carta ce ne sono abbastanza, ma le ipotesi critiche non sono mai state verificate su hardware reale. Prima di ordinare, il progetto deve essere pensato per intero, calcolato e testato davvero nei punti decisivi.

Questo esiste dopo il track

  • Un progetto di architettura ed esercizio per la Sua piattaforma, nella Sua struttura e con i Suoi requisiti, non come modello generico
  • Ipotesi centrali validate: sizing, throughput e tempi di risposta dei Suoi workload target, misurati su sistemi GPU del nostro Lab da L40S a H100
  • Uno slice testato: un caso d’uso prioritario della Sua organizzazione gira a fine settimana in modo continuo sull’ambiente Lab
  • Un backlog prioritizzato per la realizzazione con classi di impegno, dipendenze e rischi nominati
  • Un Executive Readout il Giorno 5: progetto, valori misurati e quadro di investimento in 90 minuti per il Suo livello decisionale, con documento da portare via

Prerequisiti

Un’iniziativa vicina alla decisione e un team che la sostiene: almeno un architetto o responsabile di piattaforma con profondità infrastrutturale. La partecipazione precedente ad AI-PLATFORM aiuta, ma non è una condizione.

Preparazione prima del track

Due settimane prima della Residency conduciamo un colloquio preliminare di 90 minuti: visione d’insieme, workload candidati, quadro regolatorio, documenti esistenti. Lei nomina le tre ipotesi da cui dipende la Sua iniziativa e fornisce dati di esempio anonimizzati per lo slice, per quanto autorizzabile.

Contenuto della fornitura

  • 5 giorni di lavoro esclusivo nell’Enterprise Lab con Dino Bordonaro, nessun esercizio parallelo con altri clienti
  • Sistemi GPU riservati di più classi per misure comparative, dal complesso con 2.516 core, 24 TB di RAM e 3.400 TB di storage
  • Colloquio preliminare di 90 minuti e preparazione dei Suoi documenti prima della settimana
  • Progetto di architettura ed esercizio, protocolli di misura e backlog come documenti pronti alla consegna
  • Documento di Executive Readout per il Suo livello decisionale
  • Due appuntamenti di follow-up di 60 minuti nelle 8 settimane dopo la Residency

Agenda

Giorno 1

09:00

Visione d’insieme e le tre ipotesi critiche

La Sua iniziativa su una parete: workload, utenti, classi di dati, quadro regolatorio. Le ipotesi nominate nel colloquio preliminare vengono affinate e tradotte in criteri di verifica misurabili.

10:45

Requisiti con diritto di veto

Protezione dei dati, sicurezza ed esercizio formulano i loro limiti duri prima che nasca l’architettura: cosa il sistema non deve mai fare, quali prove fino a VS-NfD devono poter essere predisposte, chi porta l’esercizio?

13:00

Scelta dello slice: un caso che dimostra qualcosa

Dai Suoi workload candidati viene scelto il caso d’uso che testa l’ipotesi più rischiosa, non il più comodo. Fissazione dell’asticella: da cosa riconosciamo venerdì che lo slice regge?

15:00

Prima serie di misure: baseline su hardware Lab

I Suoi modelli target girano per la prima volta sui sistemi GPU riservati. Misura di baseline di throughput e latenza come riferimento per tutte le decisioni della settimana.

16:15

Risultato della giornata: visione verificata e piano di misura

Visione d’insieme, limiti duri, slice scelto e un piano di misura per le tre ipotesi critiche sono per iscritto e condivisi dall’intero team.

Giorno 2

09:00

Progetto di architettura: le decisioni portanti

Compute, rete, storage, identity, registry, stack di inferenza: il progetto nasce alla parete, ogni strato con motivazione e alternativa. Azure Local e Azure Arc vengono previsti dove reggono, nella versione di volta in volta disponibile.

10:45

Calcolo di sizing contro la baseline

Il modello di capacità viene ricalcolato con i valori di baseline del Giorno 1: quante schede di quale classe, da L40S a H100, per i Suoi picchi di carico? La differenza tra dato del produttore e misura propria viene quantificata.

13:00

Validazione: ipotesi uno e due alla prova

Le prime due ipotesi critiche vengono verificate sull’hardware, per esempio gli effetti della quantizzazione sul Suo requisito di qualità o il comportamento in concurrency sotto carico realistico. I risultati rientrano subito nel progetto.

15:30

Il bivio del modello di esercizio

Connesso, separato a tratti o avviare la verifica Disconnected: decisione sul catalogo di criteri, con inquadramento onesto dei requisiti di Eligibility per Azure Local Disconnected Operations.

16:15

Risultato della giornata: progetto di architettura v1 solido

Il progetto è in versione 1, con calcolo di sizing basato su valori misurati in proprio e una decisione documentata sul modello di esercizio con i punti di verifica aperti.

Giorno 3

09:00

Costruzione dello slice: il fondamento

Costruzione dello slice sull’ambiente Lab lungo il progetto: collegamento identity, segmento di rete, collegamento alla registry con verifica delle firme. Il Suo team costruisce, il trainer tiene insieme progetto e realtà.

13:00

Costruzione dello slice: dati e logica applicativa

I Suoi dati di esempio anonimizzati incontrano lo stack: preparazione, indicizzazione o collegamento a seconda del caso, in più lo strato applicativo. Dove il contenuto lo consente entrano pattern da Sovereign Assistant o VOXA come riferimento.

15:30

Primo passaggio completo

Lo slice risponde per la prima volta in modo continuo: dalla richiesta autenticata alla risposta documentata con le fonti. Ciò che si inceppa viene protocollato e prioritizzato invece di essere abbellito.

16:15

Risultato della giornata: slice continuo

Il caso d’uso gira end-to-end sull’ambiente Lab. Gli scostamenti dal progetto sono protocollati e messi in agenda per il Giorno 4.

Giorno 4

09:00

L’ipotesi tre e il test di carico

L’ipotesi critica rimanente viene verificata, poi test di carico dello slice contro l’asticella del Giorno 1: throughput, latenza, comportamento al limite di capacità. Ogni scostamento riceve una causa o una voce di backlog.

10:45

Prova di esercizio e sicurezza

Lo slice viene trattato come produzione: vista di monitoring costruita, un rollback del modello provato, un tentativo di prompt injection condotto contro lo strato di protezione. I risultati confluiscono nel progetto di esercizio.

13:30

Prioritizzazione del backlog

Tutto ciò che è aperto diventa un backlog con classi di impegno, dipendenze e rischi: il percorso dallo slice validato alla piattaforma produttiva, prioritizzato dal team, non dal trainer.

15:30

Quadro di investimento e make or buy

Sizing, modello di esercizio e backlog vengono condensati in un quadro di investimento: autocostruzione, Sovereign AI Appliance o via mista, con numeri e incertezze nominate per il Readout.

16:15

Risultato della giornata: progetto validato con backlog

Progetto di architettura ed esercizio sono in versione verificata, tutte e tre le ipotesi critiche hanno risposta con valori misurati, il backlog è prioritizzato.

Giorno 5

09:00

Indurimento del progetto

Ultimo giro di review a ruoli invertiti: il team attacca il proprio progetto, il trainer lo difende e viceversa. Ciò che non sopravvive all’attacco viene cambiato o documentato come rischio.

10:30

Prova del Readout

L’Executive Readout viene provato una volta per intero: messaggi chiave, valori misurati, quadro di investimento, raccomandazione. Il team decide chi sostiene quale parte davanti al proprio livello decisionale.

13:00

Consegna dei documenti

Progetto, protocolli di misura, backlog e documento del Readout vengono riuniti in versione finale e consegnati. Tutti gli artefatti appartengono a Lei e restano utilizzabili senza BORDONARO.

14:30

Executive Readout

90 minuti davanti al Suo livello decisionale, sul posto nel Lab o collegato da remoto: il progetto validato, la dimostrazione dal vivo dello slice, il quadro di investimento e la raccomandazione con i rischi aperti. Alle domande risponde il team, non solo il trainer.

16:15

Risultato finale: base decisionale consegnata

Il Suo livello decisionale ha visto un progetto validato con valori misurati, slice testato e backlog prioritizzato. I prossimi passi e i due appuntamenti di follow-up sono fissati.

Esercitazioni e quota lab

L’intera settimana si svolge nel Lab: misure di baseline e comparative su più classi di GPU, l’intera costruzione dello slice, test di carico, prova di rollback e un tentativo di prompt injection girano su sistemi riservati del complesso.

Piattaforme

Svolgimento esclusivamente nell’Enterprise Lab su hardware riservato. Azure Local, Azure Arc e Foundry Local vengono impiegati nella versione di volta in volta disponibile, gli stati Preview vengono contrassegnati come tali, Disconnected Operations viene trattato come offerta ad accesso limitato con verifica di Eligibility. I Suoi dati di esempio restano su sistemi dedicati e dopo la settimana vengono cancellati in modo dimostrabile.

Prova di transfer

La prova di trasferimento è l’Executive Readout stesso: il Suo team presenta progetto, valori misurati e raccomandazione davanti al proprio livello decisionale e risponde alle sue domande. Tutte le validazioni sono documentate come protocolli di misura e fanno parte della consegna.

Artefatti che porta con sé

  • Progetto di architettura ed esercizio in versione pronta alla consegna
  • Protocolli di misura delle ipotesi validate inclusi i valori comparativi GPU
  • Slice testato come implementazione di riferimento documentata sull’ambiente Lab
  • Backlog di realizzazione prioritizzato con classi di impegno e rischi
  • Documento di Executive Readout con quadro di investimento

Estensioni opzionali

  • Sovereign AI Platform Engineering (AI-PLATFORM) per formare il team più ampio lungo il progetto
  • LLMOps per ambienti connessi, separati e Air-Gap (AI-OPS), se viene scelto il modello di esercizio separato
  • Sovereign AI Appliance e accompagnamento alla realizzazione come prestazioni separate, se il Readout porta alla decisione di buy

Delimitazione

La Residency produce e valida un progetto, non è un’implementazione nel Suo data center né un mandato di consulenza continuativa. Realizzazione, accompagnamento all’acquisto ed esercizio sono prestazioni autonome e vengono incaricate separatamente.

Domande frequenti

Cosa giustifica 44.500 € rispetto al corso AI-PLATFORM?

Il corso trasmette competenza trasferibile su uno scenario di riferimento. La Residency lavora cinque giorni in esclusiva sulla Sua iniziativa: il Suo progetto, i Suoi dati, i Suoi valori misurati, hardware riservato di più classi GPU e un Readout davanti al Suo livello decisionale. Misurato su un acquisto GPU sbagliato o su un progetto concettuale di pari profondità, il prezzo di 44.500 € IVA esclusa è calcolato con sobrietà.

La nostra direzione deve essere presente tutti e cinque i giorni?

No. La settimana la porta il Suo team specialistico con fino a 8 persone. Il livello decisionale serve per l’Executive Readout di 90 minuti il Giorno 5, sul posto o collegato da remoto. Chi vive in più il Giorno 1, per esperienza capisce il Readout molto più in fretta.

Quanto sono riservati il nostro progetto e i nostri dati?

Prima della Residency firmiamo un accordo di riservatezza. Lei fornisce solo dati di esempio anonimizzati e autorizzati, che restano su sistemi dedicati e dopo la settimana vengono cancellati in modo dimostrabile. Tutti i risultati appartengono a Lei, BORDONARO non li usa come referenza senza la Sua autorizzazione scritta.