El framework BLYNT

Seis pasos, un Score, cinco pilares y diez principios.

Es el método con el que trabajamos y la base de BLYNT Platform, nuestro software. Lo publicamos para que sepas exactamente cómo llegamos a cada cifra antes de confiar en ella.

1 · El ciclo

Cada caso de uso recorre seis pasos

Un caso de uso es un proceso concreto que se quiere mejorar: clasificar reclamaciones, revisar contratos, preparar informes. Todos pasan por el mismo camino y ninguno se salta pasos.

PasoQué pasaQué queda
1 · DefinirFicha de negocio: problema, objetivo, responsables, volumen mensual y minutos humanos por unidad de trabajo. Se describe cómo está construido el sistema y se prepara la batería de pruebas con su rúbrica.Ficha del caso, sistema versionado y suite de pruebas
2 · BaselineSe ejecuta la suite completa sobre el proceso actual y se bloquea como referencia. Una persona de la empresa cliente la firma.Baseline firmado, inmutable
3 · AnalizarEl Analyzer aplica reglas deterministas (sin IA, cero tokens) sobre el baseline, el flujo de trabajo y las trazas, y prioriza hallazgos.Hallazgos con evidencia y confianza
4 · MejorarCada hallazgo útil se convierte en una mejora concreta. El paquete de mejoras se prueba con la misma suite.Mejoras y evaluaciones candidatas
5 · ValidarLa candidata se compara con el baseline contra los guardarraíles acordados: caída máxima de calidad, errores críticos, reducción de tokens y de tiempo. Si cumple, la empresa firma.Validación firmada o rechazo motivado
6 · ImpactoProyección de horas liberables y gasto de IA evitado, con todos los supuestos visibles. Reporte de caso, equipo y portafolio.Reporte PDF trazable hasta la prueba de origen

¿Aún no usas IA?

El ciclo arranca igual: se mide el proceso manual y se firma como baseline. Así, cuando llegue la IA, habrá con qué compararla.

¿Usas un chat con licencia?

Si no hay tokens medidos, el coste sale del Score y su peso se reparte entre las demás dimensiones. Se indica siempre.

¿Quién hace qué?

BLYNT Labs prepara, mide, analiza y propone. Tu empresa aporta el conocimiento del proceso, firma y decide.

2 · BLYNT Score

Una nota de 0 a 100 para el rendimiento de un caso

El Score resume cuatro dimensiones con pesos fijados antes de probar. Cambiar los pesos crea una nueva versión de la política y deja fuera de comparación lo anterior.

DimensiónPesoCómo se normaliza
Calidad40 %Calidad media según la rúbrica de la suite
Coste25 %Coste por resultado aceptado frente a un techo acordado
Tiempo20 %Minutos de proceso frente a un techo de 60
Feedback15 %Valoración media de las personas, sobre 5

Score = 0,40·Calidad + 0,25·Coste + 0,20·Tiempo + 0,15·Feedback

  • Primero se promedian las repeticiones de cada prueba; después se pondera por el peso del escenario.
  • Cada dimensión se acota entre 0 y 100.
  • Dos evaluaciones solo se comparan si comparten suite, evaluador y política de Score.
  • El desglose muestra peso, valor y contribución de cada dimensión.
El Analyzer

Diagnóstico sin IA, reproducible

Un motor de reglas deterministas lee el baseline, el flujo de trabajo y las trazas por paso. Detecta, por ejemplo, pasos que usan un modelo más caro del necesario, reintentos excesivos o demasiadas vueltas para llegar al resultado.

Sus señales son hipótesis con evidencia, no causas probadas. La confianza indica la fuerza de la evidencia, no la probabilidad de éxito.

Impacto económico

Tres categorías que nunca se mezclan

  • Medido: lo que salió de las pruebas.
  • Proyectado: lo que resultaría al volumen real, con los supuestos a la vista.
  • Realizado: cero mientras no haya evidencia operativa.

Horas liberables y gasto evitado se muestran por separado. Su suma es "oportunidad bruta", nunca ROI ni ahorro neto.

3 · BLYNT Maturity

Cinco pilares para que la mejora se sostenga

El Score mide un caso. Maturity mide a la organización. Nunca se mezclan. Cada pilar tiene una lista de criterios con evidencia; su cobertura es el porcentaje cumplido.

PILAR 1

AI Engineering & Harness

Cómo está construido el sistema y cómo se cambia sin romperlo.

PILAR 2

Modelos & Evaluación

Qué modelos se aprueban y cómo se evalúan de forma continua.

PILAR 3

Gobernanza & Seguridad

Controles documentados con evidencia e historial.

PILAR 4

Personas & AI Champions

Quién impulsa la adopción y cuánta gente está formada.

PILAR 5

Medición & Mejora continua

Si los resultados se miden, se validan y se revisan.

Pilar 1 · AI Engineering & Harness — criterios
  • Inventario de flujos de trabajo
  • Harness versionado
  • Prompts versionados
  • Fuentes de contexto inventariadas
  • Conexiones MCP catalogadas
  • Pasos deterministas fuera del modelo
  • Política de reintentos
  • Pruebas de contexto
  • Procedimiento de marcha atrás
  • Revisión de los cambios
Pilar 2 · Modelos & Evaluación — criterios
  • Catálogo de modelos aprobado
  • Suite de pruebas por caso
  • Casos límite cubiertos
  • Rúbrica versionada
  • Política de Score acordada
  • Baseline por caso
  • Comparación de modelos documentada
  • Presupuesto de evaluación
  • Evaluación periódica
  • Criterios de retirada de modelos
Pilar 3 · Gobernanza & Seguridad — criterios
  • Los controles de gobernanza de la organización
  • Cumplido = documentado con evidencia
  • Cada evidencia con su historial
  • El catálogo se adapta a cada empresa
Pilar 4 · Personas & AI Champions — criterios
  • Champions designados
  • Champion de respaldo
  • Ruta de formación
  • Objetivo de personas formadas
  • Formación en calidad
  • Comunidad de práctica
  • Champions en las mejoras
  • Reconocimiento
  • Materiales reutilizables
  • Seguimiento de la adopción
Pilar 5 · Medición & Mejora continua — criterios
  • Baseline con referencia versionada
  • Indicadores con fórmula trazable
  • Tiempo humano medido aparte
  • Coste de IA por resultado aceptado
  • Proyección con supuestos visibles
  • Separación medido / realizado
  • Validación humana
  • Reporte ejecutivo
  • Revisión trimestral
  • Medición en operación
4 · Principios

Diez reglas que no se negocian

Si algo de nuestro trabajo contradice uno de estos principios, se corrige el trabajo, no el principio.

Lo medido no es lo realizado

Cada cifra se etiqueta como medida, proyectada o realizada, y nunca se suman entre categorías.

El histórico no se reescribe

Evaluaciones, baselines y validaciones son inmutables. Cambiar algo crea una versión nueva.

Solo se compara lo comparable

Misma suite, mismo evaluador y misma política de Score. Si no, no se calcula mejora.

El éxito se acuerda antes de probar

Criterios, pesos y umbrales se fijan antes de ver resultados.

Decisión humana explícita

Baseline y validación los firma una persona identificada del cliente. Quien prepara no firma.

Tus datos no salen de tu empresa

BLYNT Platform no llama a modelos ni se conecta a tus sistemas. Nunca guarda claves ni prompts en claro.

Trazabilidad de extremo a extremo

Toda cifra del reporte se abre hasta la prueba de origen. Toda acción queda registrada.

Honestidad

Lo que se puede calcular con código se calcula con código. Lo informativo se rotula como tal.

Aislamiento entre clientes

Cada empresa trabaja en un espacio aislado. Nadie ve datos de otra organización.

Especificación antes que código

Nada se construye sin una especificación aprobada, y cada criterio tiene su prueba automática.

BLYNT Platform

El framework, convertido en software

Nuestro equipo trabaja con BLYNT Platform, nuestro propio software, que aplica el framework paso a paso. El acceso va incluido en cada trabajo: tu empresa entra para consultar, firmar y descargar reportes.

  • Casos de uso, suites de pruebas y sistemas versionados
  • Importación controlada de resultados, salidas y trazas
  • Cronómetro para medir el tiempo humano real por paso
  • Analyzer, mejoras, validación y reportes en PDF
  • Gobernanza, personas, madurez e historial de auditoría
  • Español e inglés, con la moneda de cada cliente
Siguiente paso

Aplica el framework a un proceso real

Empieza por un diagnóstico de cuatro semanas y termina con un baseline firmado y una recomendación por escrito.