Artefacto completado

Un artefacto completado del sistema de referencia. No es un documento de cliente.Los umbrales son ilustrativos para el escenario sintético, y no se reportan resultados de evaluación medidos.

Modelo de amenazas

Activos, amenazas, y qué las mitiga.

Construido con un análisis de tipo STRIDE sobre los activos del sistema. Cada amenaza indica la mitigación ya presente en la arquitectura — el modelo de amenazas y el diseño son un único artefacto, no dos.

Activo Amenaza Categoría Mitigación
Recepción de casos Entrada malformada o adversaria diseñada para romper el análisis o la lógica posterior Manipulación Validación de esquema en el servidor, normalización y límites de longitud antes de que un caso entre en el flujo de trabajo.
Pasarela del modelo Inyección de prompt oculta dentro de un documento recuperado Elevación de privilegios Todo el contenido se trata como datos, nunca como instrucciones; las herramientas solo se ejecutan desde el orquestador; el registro de acciones está en lista blanca.
Datos del caso Exfiltración de datos sensibles a través de la ruta del modelo Divulgación de información Minimización del contexto en la pasarela, un registro exacto de lo enviado, y salida limitada a destinos en lista blanca.
Ruta de acción Acción no autorizada o excesiva sobre un sistema de registro Elevación de privilegios Las acciones solo se realizan mediante adaptadores de integración con credenciales de alcance limitado; las acciones con consecuencias requieren aprobación en la puerta.
Identidad Actor suplantado o control de acceso deficiente Suplantación Identidades autenticadas, permisos basados en roles, y mínimo privilegio para cada persona y servicio.
Registro de auditoría Manipulación del registro para ocultar una acción Manipulación / Repudio Registro de solo anexado con protección de integridad, escrito antes de que una acción se complete, conservado de forma independiente.
Pasarela del modelo Denegación de servicio o coste desbocado contra el modelo Denegación de servicio Límites de tasa, tiempos de espera, y degradación controlada a una cola manual cuando el modelo no está disponible.

Plan de evaluación

Cómo se mide.

Conjuntos de datos

  • Un conjunto etiquetado de casos sintéticos que abarca la distribución rutinaria.
  • Un conjunto de documentos adversarios (intentos de inyección, fuentes contradictorias, archivos ilegibles).
  • Un conjunto de casos límite (campos faltantes, política ambigua, solicitudes fuera de alcance).

Métricas y umbrales

Métrica Método Umbral
Precisión de extracción Comparar los campos extraídos con las etiquetas en el conjunto sintético. Definido por campo antes del lanzamiento
Fundamentación Toda afirmación del modelo debe corresponder a una cita recuperada; medido mediante verificación automática y muestra de auditoría humana. Ninguna afirmación sin respaldo puede superar la puerta
Precisión y exhaustividad de las verificaciones de política Comparar las señales con los resultados de política etiquetados. Exhaustividad priorizada en reglas con consecuencias
Corrección de la escalada Confirmar que los casos con consecuencias y baja confianza llegan a una persona. Ningún caso con consecuencias se procesa automáticamente
Tasa de anulación humana Seguir las correcciones de los operadores en modo sombra y en operación. Se monitoriza para detectar deriva, no es un aprobado/reprobado fijo
Latencia y coste por caso Medir de extremo a extremo en el conjunto sintético a un volumen representativo. Definido en función del presupuesto operativo

Método

Evaluación fuera de línea sobre conjuntos reservados, seguida de una ejecución en modo sombra junto al proceso actual, donde las salidas del sistema se registran pero no se ejecutan, con una revisión humana muestreada. Solo después de cumplir los criterios de aceptación el sistema recibe autoridad operativa.

Aceptación

Qué debe ser cierto antes de su lanzamiento.

Cada criterio está marcado por su base. «Por diseño» se sostiene por construcción en esta implementación de referencia; «pendiente de medición» y «pendiente de revisión» son las brechas honestas — no se afirma que estén cumplidas.

  • Por diseño Toda acción con consecuencias pasa por una puerta de aprobación humana antes de salir del límite.
  • Por diseño Toda afirmación del modelo en un caso aceptado está respaldada por una cita recuperada.
  • Por diseño El registro de auditoría registra cada actor, acción y cita, de solo anexado.
  • Por diseño Las acciones llegan a los sistemas de registro solo a través de adaptadores de integración con credenciales de alcance limitado.
  • Medición pendiente La precisión de extracción y la exhaustividad de las verificaciones de política cumplen sus umbrales por métrica en el conjunto reservado.
  • Medición pendiente La fundamentación se mantiene bajo el conjunto de documentos adversarios, incluidos los intentos de inyección.
  • Medición pendiente La latencia y el coste por caso están dentro del presupuesto operativo a un volumen representativo.
  • Revisión pendiente Se completan una revisión técnica senior independiente y una revisión de comprensión del comprador.

Lo que esto demuestra y lo que no demuestra

Demuestra

  • Que el modelado de amenazas, la evaluación y la aceptación se definen antes de declarar terminado un sistema.
  • Que SageTensor enuncia criterios de aceptación explícitos en lugar de declarar el éxito.

No demuestra

  • Que el sistema de referencia haya superado sus propios criterios de aceptación bajo medición.

Cómo inspeccionarlo

Lea la tabla de amenazas, el plan de evaluación y la lista de comprobación de aceptación. Cada una se conecta con las vistas de control y evaluación del sistema insignia.

Procedencia

Estado
Publicado
Responsable
Ingeniería de SageTensor
Publicado
Última revisión
Versión
1.0

Un artefacto completado del sistema de referencia. No es un documento de cliente.

Método

Modelo de amenazas construido con un análisis de tipo STRIDE; plan de evaluación y criterios de aceptación especificados según los requisitos operativos del sistema insignia.

Fuentes

  • Sistema gobernado de operaciones de casos (implementación de referencia)
  • Método de modelado de amenazas OWASP ASVS y STRIDE
  • NIST AI RMF (evaluación y medición)

Confianza

El modelo de amenazas y los criterios de aceptación están completos para el alcance de referencia. Los resultados de evaluación están especificados pero aún no medidos (coherente con el estado del sistema insignia).

Limitaciones

  • Los umbrales de aceptación son ilustrativos para el escenario sintético.
  • Aún no se reportan resultados de evaluación medidos.

La identidad legal de SageTensor aún no está establecida (véase Empresa). La autoría nominal y la revisión externa independiente se añadirán cuando lo esté.

Contratación

Empiece por lo que debe cambiar.

Un mandato produce esta especificación para su operación — las amenazas, las medidas, y el umbral que debe alcanzar.

También puede enviar una RFP, o solicitar un acuerdo de confidencialidad primero.