In primo luogo, dare conclusioni che possono essere utilizzate per il processo decisionale
Il lato della piattaforma deve considerare se i servizi Web e API, i processi di lavoro, i database, le cache, l'archiviazione degli oggetti, il recupero del vettore, la risoluzione dei documenti e il monitoraggio dei registri sono separati. Il lato del modello dipende dall'utilizzo di cloud-end API, i piccoli modelli locali o il ragionamento multi-model.
Quali condizioni devono essere identificate prima che il giudizio sia fatto?
La stessa domanda può avere risposte diverse in diverse fasi di business, dati e progetti, e si suggerisce che le seguenti condizioni siano controllate e che i risultati comuni sul web siano incorporati nei propri progetti.
Ordine consigliato di anticipo
Prima di tutto, saremo chiari sul bersaglio e sul confine.
b) Collare della linea di base degli utenti, delle attività, dei documenti, delle interfacce e dei tempi di risposta.
Validazione della dipendenza chiave
La piattaforma, il trattamento delle conoscenze e il ragionamento del modello saranno utilizzati separatamente.
Sviluppo dei risultati valutabili
I test di pressione e capacità vengono eseguiti utilizzando file reali e flussi di lavoro.
Assicurati di decidere il prossimo passo con i risultati reali.
Specifiche di produzione basate su P95 ritardi, code, risorse e risultati di guasto.
Come lo capisci nel vero affare?
Un'impresa con 30 utenti interni, ma con un grande volume di flussi di lavoro quotidiani e multi-step importati in PDF, l'analisi della conoscenza e le attività back-office possono essere più intensivi di centinaia di utenti che solo occasionalmente fanno domande e risposte. Se è richiesto il ragionamento del modello locale, i test separati dovrebbero essere condotti su diversi modelli, lunghezze di contesto, e la co-disposizione e l'isolamento, e un server dimostrativo non può essere considerato direttamente una configurazione di produzione.
Il pozzo più semplice da fare.
Solo stimati per numero di utenti registrati, senza compiti reali e carichi di documenti
Il successo della distribuzione di Diffy equivale al raggiungimento della capacità produttiva
Nessuna crescita di code, database, dischi e indici vettoriali monitorati
Come dovremmo finire per ricevere e confermare?
L'accettazione e l'ispezione devono essere eseguite nell'ambiente di destinazione con domande e risposte concordate e poste, caricamenti di documenti, aggiornamenti di conoscenze e attività di flusso di lavoro, registrazione P50, risposte P95, coda attesa, tasso di errore, CPU, memoria, disco e risorse di modello; e completo ripristino di backup, allarme disco, riavvio di servizio e l'esercizio di versione posteriore.
In primo luogo, gli elementi sconosciuti sono chiaramente marcati, e poi la decisione è fatta per usare la diagnostica, PoC, progetti a banda fissa o la ricerca e lo sviluppo in corso, che è solitamente più affidabile di una domanda diretta per un prezzo e una durata senza frontiere.