Un solo ejemplo de una muestra caducada puede demostrar que “este tipo de fallo ocurrió”, pero no puede responder “con qué frecuencia ocurre”. Para calcular la tasa de fiabilidad de los proveedores de Trustless Bitcoin Vaults (TBV), se necesitan al menos dos cantidades: el número de fallos y el número total de intentos.

Explorer publicó una bóveda sBTC de 0.07199256: el proveedor no completó el keeper ACK dentro de la ventana y finalmente expiró. Contarlo como fallos 1 no es un problema; pero el material no proporcionó, bajo el mismo criterio de medición, el total de activaciones de intentos, el periodo de observación y la distribución de cada proveedor. Por tanto, el denominador sigue vacío.

Sin denominador, no se puede escribir ese 1 como porcentaje; tampoco se puede afirmar a partir de este evento que un proveedor en particular sea poco fiable a largo plazo, y mucho menos inferir la estabilidad general del protocolo. En la página del 24 de julio de 2026 se listaron 4 proveedores, pero solo era una instantánea del número de roles: no fueron cuatro intentos, y tampoco constituye un conjunto de muestras de fiabilidad.

Este registro sigue siendo valioso: confirma que la testnet no solo tiene rutas exitosas; la disponibilidad de la cooperación puede funcionar como punto de parada del proceso. La conclusión debería quedarse en que el modo de fallo existe, en lugar de convertir un contraejemplo verificable en una estadística general.

El control de activos es otra variable independiente. En la testnet actual, los BTC permanecen en el Bitcoin Signet Taproot UTXO; en Sepolia solo hay registros de garantía que no pueden transferirse libremente para que Aave v4 los lea. Que el proveedor exceda el tiempo límite indica un problema de vivacidad (liveness), pero no equivale a que haya obtenido la custodia de los BTC.

Así que, al citar casos de este tipo, escribe juntos la unidad de observación, la ventana temporal, el evento de fallo y el denominador faltante. Un N=1 puede abrir un problema de riesgo, pero no puede cerrar una evaluación de fiabilidad; es más útil que dar un porcentaje sin base estadística.

@BabylonLabs_io $BABY #baby