Cloudflare maakt Basin algemeen beschikbaar op 1 oktober: het serverloze analyseplatform verwerkt data via Pipelines, beheert Iceberg-tabellen in Catalog en laat teams die met SQL doorzoeken, meldt het bedrijf.
Voor een Nederlandse ondernemer die een bestaand datawarehouse vergelijkt, verandert vooral de keuzevrijheid rond opslag en query-engine. Basin gebruikt de open Apache Iceberg-tabelindeling, zodat dezelfde data met compatibele engines kan worden gelezen en geschreven. Daardoor kan een team onderdelen van Basin naast zijn huidige systeem proberen, zonder meteen het hele warehouse te vervangen.
Een open formaat, drie onderdelen
Basin bundelt drie producten. Pipelines ontvangt events via Workers, HTTP of Cloudflare Logpush, kan ze met SQL omvormen en schrijft ze als Iceberg-tabellen of JSON- en Parquetbestanden naar R2. Cloudflare zegt dat één stream tot 3 GB per seconde kan verwerken. Catalog beheert de Iceberg-tabellen; Basin SQL voert analyses uit zonder dat een team zelf queryclusters beheert. DuckDB, Snowflake, Apache Spark en PyIceberg kunnen met dezelfde Iceberg-data werken.

Gratis egress, betaalde verwerking
Gratis data-egress betekent niet dat elke stap in de pijplijn gratis is. Pipelines rekent na inbegrepen maandvolumes voor SQL-transforms en afleveringen naar opslag. De streaminvoer is onbeperkt gratis. Voor SQL-transforms is 50 GB per maand inbegrepen; daarboven kost verwerking $0,04 per GB. Voor data-aflevering is een gedeelde bundel van 50 GB inbegrepen. Daarna kost schrijven naar JSON $0,03 per GB en naar Parquet of Iceberg $0,06 per GB. De tarieven voor afleveringen worden berekend over de onbewerkte hoeveelheid data die aankomt.
Basin SQL heeft een eigen teller: de eerste 10 GB aan gecomprimeerde data die queries per maand lezen is inbegrepen. Daarna rekent Cloudflare $0,0025 per gescande GB, met een minimum van 10 MB per query. R2-opslag en lees- en schrijfbewerkingen komen daar nog bij. Catalog rekent apart voor metadatahandelingen en optionele bestandscompactie. Ook betaalde diensten die aan een R2-bucket hangen kunnen extra kosten veroorzaken, schrijft The Register.
Cloudflares voorbeeld maakt de rekensom tastbaar: bij 500 GB maandelijkse streaminvoer, 300 GB Iceberg-uitvoer, 50 GB aan SQL-scans, 500.000 Catalog-handelingen en 20 GB compactie komen de Basin-kosten uit op $33,15 per maand. Dat bedrag omvat de transforms, data-aflevering, Catalog en Basin SQL, maar niet de R2-opslag en -bewerkingen. De werkelijke totaalprijs hangt dus ook af van wat een bestaand datawarehouse voor dezelfde hoeveelheid werk rekent.
Een locatiehint is geen jurisdictie
Bij het maken van een R2-bucket kan een locatiehint worden gekozen. Catalog ondersteunt momenteel geen R2-buckets in een niet-standaardjurisdictie, staat in de Basin Catalog-documentatie. Dat maakt een locatiehint niet gelijk aan een bevestigde EU-jurisdictie voor Basin-data.
Basin maakt data minder afhankelijk van één query-engine, maar de kosten en datalocatie blijven afzonderlijke onderdelen van dezelfde keuze. Het open formaat geeft teams meer ruimte om later van query-engine te wisselen; het maakt data-analyse niet kosteloos.
Veelgestelde vragen
Data van bron tot inzicht
Ik denk met je mee over de juiste data-opzet, ontwerp de koppelingen en bouw ze van eerste bron tot bruikbare analyse. Waar het kan kies ik voor een self-hosted inrichting, zodat je grip houdt op je data.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

