
Cloudflare anunció el 1 de octubre la disponibilidad general de Basin, una plataforma de datos serverless para ingerir, almacenar, catalogar y consultar datos analíticos sin aprovisionar infraestructura. El producto se apoya en dos piezas que la compañía ya tenía en producción: el formato de tabla abierto Apache Iceberg y el almacenamiento de objetos R2. El argumento comercial con el que sale al mercado es el que Cloudflare viene usando desde el lanzamiento de R2: cero coste por salida de datos.
Basin se organiza en tres componentes. Pipelines se encarga de la ingesta de eventos; Catalog expone el catálogo de tablas Iceberg; y SQL permite consultar esos datos directamente. La consecuencia de que todo se materialice como tablas Iceberg sobre R2 es que el dato no queda cautivo del motor: cualquier herramienta capaz de leer el formato —Spark, Trino, DuckDB, Snowflake o Databricks a través de su soporte de catálogos REST— puede trabajar contra el mismo almacenamiento sin copiarlo.
La compañía plantea Basin como alternativa a los montajes de ingesta y consulta que hoy se ensamblan a mano sobre almacenamiento de objetos. En la propia nota de prensa, Dax Raad, cofundador de Anomaly, afirma haber sustituido «una configuración compleja de AWS S3 y Athena por una arquitectura serverless más limpia» para todos sus datos de eventos. Cloudflare no detalla precios en el comunicado: la documentación técnica del producto está en el portal para desarrolladores de la compañía. [VERIFICAR] las tarifas antes de hacer cualquier comparación de coste.
Para un equipo de datos en España el interés está menos en el producto concreto y más en lo que confirma: Iceberg se ha consolidado como la capa de almacenamiento común, y la competencia se ha movido al coste de mover y consultar el dato. Que un proveedor de red entre en analítica con el gancho del egress gratuito presiona precisamente donde más duele a las arquitecturas multicloud, donde la factura de transferencia entre nubes y regiones es un sumidero difícil de justificar. Conviene, eso sí, leer la letra pequeña antes de dar por hecho el ahorro: la gratuidad de la salida aplica al tráfico, no al almacenamiento ni al cómputo de consulta, y un motor SQL de nodo único no sustituye a un almacén analítico para cargas de concurrencia alta. El caso de uso natural es el que describe el propio cliente citado: telemetría y datos de eventos a gran volumen con consultas relativamente simples.
Más en Dataprix: clasificación de plataformas de datos para empresas de Dataprix
Fuente: Cloudflare (nota de prensa)
Contenido elaborado con asistencia de inteligencia artificial — Equipo Editorial Dataprix. Verifica la información antes de tomar decisiones.