Seis años de open interest estaban guardados en un archivo público
- Publicado
- 26 de agosto de 2026
- Lectura
- 2 min
- Temas
- interés abierto · arqueología de datos · potencia estadística
El cuello de botella de la investigación se suponía que era el calendario. Con la familia precio-volumen cerrada, los siguientes candidatos son señales de microestructura — open interest, ratios de posicionamiento, profundidad del libro — y un test sobre ellas solo significa algo con cerca de un año de historia. Los colectores llevaban meses. Y entonces resultó que la mayor parte de esa historia ya existe, en público, gratis.
01Qué se encontró, y qué se verificó
El archivo público del exchange [1][2] publica archivos diarios que incluyen open interest y ratios de posicionamiento long/short a resolución de cinco minutos, desde septiembre de 2020 para los pares más viejos. Se descargaron muestras y se inspeccionó el schema directamente: los campos coinciden con lo que capturan los colectores en vivo, con doce veces la densidad de muestreo del polling horario del propio sistema. Para las dos señales más cercanas a madurar, eso es cerca de seis años de potencia de test en lugar de nueve meses más de espera.
El mismo archivo guarda profundidad del libro desde enero de 2023 — usable, pero en bandas porcentuales en lugar del detalle nivel a nivel que registra el colector en vivo, así que cualquier hipótesis sobre ella tiene que definirse sobre features que ambas fuentes puedan calcular. Los huecos honestos: el feed de mejor bid/ask necesario para reconstruir el order-flow imbalance verdadero fue descontinuado en marzo de 2024, y no hay fuente histórica gratuita de liquidaciones. Esas dos señales siguen acumulando en tiempo real.
02Qué cambia esto, y qué no
Antes de que ninguna hipótesis toque estos datos, el archivo tiene que ganarse la confianza: la ventana donde archivo y captura en vivo se solapan se audita buscando divergencias — timestamps, unidades, artefactos de muestreo. Solo después la familia de open interest recibe sus hipótesis pre-registradas, bajo las mismas puertas que las cincuenta que murieron: permutación p<0.01, out-of-sample, deflated Sharpe, ganarle al equiponderado neto de costes.
Y para ser claros sobre lo que esto no es: son datos, no edge. El conteo de estrategias validadas sigue en cero. Lo que cambió es que la siguiente ronda de experimentos empieza años antes de lo planeado — lo cual corta en ambos sentidos, porque el resultado más probable de más potencia estadística es, como siempre, un funeral más rápido.
Fuentes numeradas a las que apunta el texto. El orden se fija al publicar — es parte del artículo.
- GitHub — binance/binance-public-data
- Binance