Capacidad y consecuencias¶
El número que define el diseño¶
Tres o cuatro ofertas preparadas por trimestre. Doce a dieciséis al año.
Todo lo demás en este sistema se deriva de ahí.
La aritmética¶
Dato faltante
No tenemos registrada nuestra tasa histórica de adjudicación. Es el primer número que la tabla de decisiones debe empezar a acumular.
Sin conocer la tasa exacta, la conclusión se sostiene en cualquier escenario: si de catorce ofertas ganamos una o dos, y tres de esas catorce estaban especificadas para un fabricante desde el primer borrador, desperdiciamos aproximadamente el 20% de la capacidad anual en ejercicios decorativos.
Cada slot gastado en una licitación que nunca íbamos a ganar cuesta más que cualquier licitación que el sistema no nos muestre.
Consecuencia 1: el sistema es un filtro, no un buscador¶
El trabajo principal del pipeline no es encontrar. Es descalificar barato y temprano.
Eso invierte la prioridad habitual: precisión sobre cobertura. Un sistema que nos muestra cinco cosas al mes de las cuales tres merecen lectura completa es mejor que uno que nos muestra cincuenta de las cuales cinco son buenas.
Consecuencia 2: el normalizador extrae campos de decisión¶
No campos descriptivos. Ver Contrato de normalización.
Los dos campos que más deciden:
categoria_adquisicion es el filtro más potente y es gratis. Los bancos
multilaterales separan estructuralmente bienes, obras, servicios de no consultoría y
servicios de consultoría, y el método de contratación viene como campo en los datos.
Filtrar servicios frente a bienes es un WHERE en SQL, sin LLM, sin PDF, y quita de
encima la mayor parte del volumen.
id_proyecto_padre es el campo que más predice si ganamos. Es el join entre carriles.
Un aviso ya vigilado desde el carril B significa que tuvimos meses para hablar con el
organismo ejecutor. Un aviso huérfano significa que llegamos en frío.
Regla operativa
Aviso en frío + ventana corta = descarte automático, salvo excepción manual explícita y registrada. Es el escenario que estructuralmente no ganamos.
Consecuencia 3: no hay scoring aprendido¶
Con doce a dieciséis decisiones al año no habrá datos para entrenar un modelo en esta década. Cualquier modelo ajustado a esa muestra estará sobreajustado.
Score de reglas con pesos explícitos que tuneamos a mano. Ver Scoring.
Lo que sí construimos es la tabla de decisiones: cada ítem que vemos se registra con
bid | no_bid | ignorar y un código de razón. En un año habrá un par de cientos de
decisiones etiquetadas y podremos revisar patrones nosotros mismos. Esa tabla vale más
que el modelo que no vamos a poder entrenar.
Consecuencia 4: dos salidas, no una¶
Un digest semanal no basta para el carril A. Si una licitación que califica aparece con 18 días de ventana y el reporte sale en cinco, perdimos el 28% del tiempo disponible.
| Salida | Disparo | Contenido | Frecuencia esperada |
|---|---|---|---|
| Alerta | Por evento | Solo ítems que pasan filtros duros con ventana corta | 2–3 al mes |
| Reporte | Programado | Resto del carril A, carril C, movimientos de cartera | 1–2 por semana |
Calibración
Si la alerta suena más de tres o cuatro veces al mes, los filtros duros están flojos y la alerta se va a convertir en ruido que nadie mira. Es el modo de fallo más probable de todo el sistema.
Criterios de aceptación del sistema¶
Fijados antes de escribir código para no "mejorar" arbitrariamente después:
- Volumen accionable — máximo cinco ítems del carril A por edición del reporte. Si sale más, el filtro falla.
- Precisión — al menos la mitad de lo que aparece merece lectura completa del pliego.
- Decisión, no triage — cada ítem sale con recomendación y razón. Un digest que obliga a clasificar solo movió el trabajo de lugar.
- Anticipación — mediana de días entre primera detección y fecha límite, medida y creciente trimestre a trimestre.
- Recall auditable — cada trimestre, consultar los avisos de adjudicación de RA IV en las mismas APIs y contar cuántos de nuestro nicho el sistema nunca vio. Las adjudicaciones se publican por los mismos endpoints que los avisos, así que la auditoría es barata y es la única medida honesta de cobertura disponible.
Alcance geográfico del carril B¶
Conocemos de memoria el parque de radares de cinco o seis de los 27 Miembros y Territorios de la AR IV. Los otros veintiuno son ignorancia real, y ahí el carril B sí aporta información nueva.
Decisión: el carril B cubre toda la AR IV, no se recorta. Pero el esfuerzo relacional (sesión anual del Comité de Huracanes, Punto Focal de Radar Meteorológico Operativo) se concentra en los países donde el carril B detecte movimiento, no en los que ya conocemos.