Primero, dé conclusiones que puedan utilizarse para la adopción de decisiones
El lado de la plataforma debe considerar si los servicios Web y API, procesos de trabajo, bases de datos, caches, almacenamiento de objetos, recuperación de vectores, resolución de documentos y monitoreo de registros son separados. El lado del modelo depende de usar API de extremo nublado, modelos pequeños locales o razonamiento multimodelo. Los picos se registran al mismo tiempo, el tamaño del archivo de carga única, el volumen creciente de los documentos de recuperación de los números de copia de copia de seguridad
¿Qué condiciones deben determinarse antes de que se haga el juicio?
La misma pregunta puede tener diferentes respuestas en diferentes fases de negocios, datos y proyectos. Se sugiere que se revisen las siguientes condiciones y que los resultados comunes en la web se incorporen en sus propios proyectos.
Orden de anticipación propuesta
Primero, seremos claros sobre el objetivo y la frontera.
b) Cotejar la base de datos de los usuarios, las tareas, los documentos, las interfaces y el tiempo de respuesta.
Dependencia de la clave de la validación
La plataforma, el procesamiento de conocimientos y el razonamiento modelo se utilizarán por separado.
Desarrollo de resultados evaluables
Las pruebas de presión y capacidad se realizan utilizando archivos reales y flujos de trabajo.
Asegúrese de decidir el siguiente paso con los resultados reales.
Especificaciones de producción basadas en retrasos, colas, recursos y resultados de fracasos P95.
¿Cómo lo entiendes en el negocio real?
Una empresa con 30 usuarios internos, pero con un gran volumen de flujos de trabajo diarios y multi-pasos importados en PDF, el análisis de conocimientos y las tareas de back-office pueden ser más intensivos en recursos que cientos de usuarios que sólo ocasionalmente hacen preguntas y respuestas. Si se solicita un razonamiento de modelo local, se deben realizar pruebas separadas en diferentes modelos, longitudes de contexto, y la co-desposección y aislamiento, y un servidor de demostración no se puede considerar directamente una configuración de producción.
El pozo más fácil de seguir.
Sólo se calcula por número de usuarios registrados, sin tareas y cargas de documentos reales
El despliegue exitoso de Diffy equivale a la consecución de la capacidad de producción
No se ha observado ningún crecimiento de las colas, bases de datos, discos e índices vectoriales
¿Cómo terminaremos recibiendo y confirmando?
La aceptación e inspección se realizará en el entorno objetivo con preguntas y respuestas acordadas y hechas, subidas de documentos, actualizaciones de tareas de conocimiento y flujo de trabajo, grabación de P50, respuestas P95, espera de cola, tasa de error, CPU, memoria, disco y recursos modelo; y restauración completa de copia de seguridad, alarma de disco, reinicio de servicio y ejercicio de la versión posterior.
Al prepararse para comunicarse con proveedores o equipos internos, se recomienda que se introduzcan procesos actuales, muestras representativas, sistemas existentes, tiempo de planificación y niveles presupuestarios. En primer lugar, los elementos desconocidos están claramente marcados, y luego se toma la decisión de utilizar diagnósticos, PoC, proyectos de alcance fijo o investigación y desarrollo continuo, que generalmente es más fiable que una demanda directa de un precio y duración sin fronteras.