Ten eerste, geef conclusies die kunnen worden gebruikt voor de besluitvorming
De kant van het platform moet overwegen of Web- en API-services, werkprocessen, databases, caches, objectopslag, vectorophaling, documentresolutie en logmonitoring gescheiden zijn. De zijkant van het model hangt af van het gebruik van cloud-end API, lokale kleine modellen of multimodel redenering. De pieken worden tegelijkertijd geregistreerd, de grootte van het single upload-bestand, het toenemende volume documenten, de frequentie van kennisupdates, het aantal workflow-knooppunten en de aanvaardbare responstijd. De productieomgeving moet ook worden gereserveerd voor back-ups, schijfgroei, component-upgrading en falen om ruimte te wisselen.
Welke voorwaarden moeten worden vastgesteld voordat een oordeel wordt uitgesproken?
Dezelfde vraag kan verschillende antwoorden hebben in verschillende bedrijfs-, data- en projectfasen. Er wordt voorgesteld de volgende voorwaarden te controleren en de gemeenschappelijke bevindingen op het web in hun eigen projecten op te nemen.
Voorgestelde volgorde van de voorschotten
Eerst zullen we duidelijk zijn over het doel en de grens.
b) Het combineren van de basis van gebruikers, taken, documenten, interfaces en responstijd.
Validatie Zeer belangrijke afhankelijkheid
Het platform, de kennisverwerking en de modelredenering worden afzonderlijk gebruikt.
Ontwikkeling van de te beoordelen resultaten
De druk- en capaciteitstests worden uitgevoerd met behulp van echte bestanden en workflows.
Zorg ervoor dat u de volgende stap met de echte resultaten te beslissen.
Productiespecificaties gebaseerd op P95 vertragingen, wachtrijen, middelen en mislukkingsresultaten.
Hoe begrijp je dat in de praktijk?
Een onderneming met 30 interne gebruikers, maar met een groot volume van PDF geïmporteerd dagelijks en multi-stap workflows draait, de kennisanalyse en back-office taken kunnen meer resource-intensief dan honderden gebruikers die slechts af en toe vragen en antwoorden. Als lokaal model redeneren wordt gevraagd, moeten afzonderlijke tests worden uitgevoerd op verschillende modellen, context lengtes, en de co-dispositie en isolatie, en een demonstratie server kan niet worden beschouwd als een productie-configuratie direct.
De makkelijkste put om op te stappen.
Alleen geschat op het aantal geregistreerde gebruikers, zonder werkelijke taken en documentladingen
Een succesvolle inzet van Diffy is gelijk aan productiecapaciteitsprestaties
Geen groei van wachtrijen, databases, schijven en vectorindexen gecontroleerd
Hoe moeten we uiteindelijk ontvangen en bevestigen?
De acceptatie en inspectie worden uitgevoerd in de doelomgeving met overeengekomen en gestelde vragen en antwoorden, documentuploads, updates van kennis en workflowtaken, opname van P50, P95 antwoorden, wachtrij, foutsnelheid, CPU, geheugen, schijf en model resources; en volledige back-upherstel, schijfalarm, service herstart en versie back oefening.
Bij de voorbereiding op communicatie met leveranciers of interne teams, wordt aanbevolen om huidige processen, representatieve monsters, bestaande systemen, planningstijd en budgetniveaus worden gebracht. Eerst, de onbekende items zijn duidelijk gemarkeerd, en dan wordt besloten om gebruik te maken van diagnostiek, PoC, vaste-range projecten of lopende onderzoek en ontwikkeling, die meestal betrouwbaarder is dan een directe vraag naar een prijs en duur zonder grenzen.