Cloudflare a mis fin le 1er octobre 2026 à plus d’un an de rumeurs sur sa stratégie de données. L’entreprise californienne a lancé Basin, une plateforme analytique serverless construite sur Apache Iceberg et son service de stockage R2, et l’a rendue disponible en version générale dès le jour de l’annonce. Le message commercial est simple : ingérer, cataloguer et interroger des données à grande échelle sans gérer de cluster, sans copier les données dans un format propriétaire, et surtout sans payer les frais de sortie qui plombent les factures cloud depuis vingt ans.

L’annonce arrive cinq ans après le lancement de R2 et dans un marché du data lakehouse qui pèse déjà plusieurs dizaines de milliards de dollars. Pour les équipes data en France et en Europe, confrontées à des coûts de sortie cloud souvent supérieurs au coût de stockage lui-même, Basin pose une question directe à Snowflake, Databricks et AWS : pourquoi continuer à payer pour déplacer des données qui n’ont jamais quitté le même continent ?

Cloudflare Basin : ce que l’entreprise a annoncé le 1er octobre

Basin remplace ce que Cloudflare appelait en interne le “Cloudflare Data Platform”. Le produit regroupe trois briques déjà connues des développeurs de l’écosystème Cloudflare, mais jamais packagées ensemble sous une même offre commerciale. Basin Pipelines gère l’ingestion et la transformation des événements via SQL. Basin Catalog, l’ancien R2 Data Catalog renommé pour l’occasion, maintient automatiquement des tables Apache Iceberg propres et optimisées. Basin SQL permet d’interroger directement ces tables sans sortir de l’écosystème Cloudflare, tout en restant compatible avec les moteurs tiers.

Selon la documentation technique publiée par Cloudflare, chaque flux Basin Pipelines peut désormais ingérer jusqu’à 1 Go par seconde, contre une limite de 5 Mo par seconde auparavant. C’est un bond de facteur 200 sur la capacité d’ingestion annoncée, un chiffre que l’entreprise met en avant pour cibler les charges de travail IoT, les journaux applicatifs et la télémétrie à très haut débit.

Le lancement s’est fait sans grand show marketing. The Register a qualifié le nom “Basin” de choix de marque plutôt terne, tout en reconnaissant que la mécanique économique derrière l’annonce méritait l’attention des équipes data. Le site a résumé l’argument central de Cloudflare ainsi : l’absence de verrouillage grâce à Apache Iceberg, combinée à l’absence de frais de sortie, permet de faire circuler les données librement entre régions cloud.

Apache Iceberg, le format qui redessine le marché de la donnée

Pour comprendre pourquoi Basin change la donne, il faut revenir sur Apache Iceberg. Ce format de table ouvert ajoute une couche de métadonnées transactionnelles au-dessus de fichiers Parquet classiques stockés dans un stockage objet. Il permet l’évolution de schéma, le versionnement des partitions, les lectures par snapshot, le voyage dans le temps et des commits atomiques, sans jamais obliger l’entreprise à migrer ses données vers un format propriétaire.

Snowflake, Databricks et AWS ont chacun ajouté une forme de support Iceberg à leur catalogue ces deux dernières années, un signe que le format s’impose comme référence commune plutôt que comme une alternative marginale. Selon une étude de marché publiée par MarketIntelO, environ 38 % des grandes entreprises disposant de plateformes de données de plus de 10 To évaluaient ou avaient déjà déployé Apache Iceberg en juin 2026, contre 12 % seulement en 2024. Le triplement de ce taux d’adoption en deux ans explique en grande partie pourquoi Cloudflare a choisi de parier sur ce format plutôt que de construire un entrepôt propriétaire fermé.

Il faut toutefois nuancer ce chiffre : Delta Lake et Apache Hudi restent des formats actifs et largement déployés chez certains grands comptes, notamment ceux déjà engagés dans l’écosystème Databricks historique. Iceberg gagne du terrain, il n’a pas encore éliminé ses concurrents directs.

R2 et la fin annoncée des frais de sortie

Le deuxième pilier de Basin, c’est R2, le service de stockage objet compatible S3 que Cloudflare a lancé en 2022. Depuis son lancement, R2 ne facture aucun frais de sortie directe, que les données transitent par l’API Workers, l’API S3 ou un domaine r2.dev. Cette politique tarifaire reste l’argument commercial numéro un de Cloudflare face aux hyperscalers, dont les frais de sortie peuvent représenter une part significative de la facture cloud annuelle d’une entreprise qui déplace régulièrement de gros volumes entre régions ou entre fournisseurs.

Cloudflare précise cependant que l’absence de frais de sortie sur R2 ne rend pas Basin entièrement gratuit. La facturation s’appuie sur plusieurs dimensions : l’ingestion et le traitement des données, l’exécution des requêtes, et la livraison des pipelines vers des destinations externes, que Cloudflare appelle “sinks” dans sa documentation tarifaire. Cette dernière ligne peut représenter un coût caché si une entreprise multiplie les destinations de livraison en dehors de l’écosystème Cloudflare.

À la date de publication, Cloudflare n’a pas communiqué de grille tarifaire complète avec un prix au gigaoctet ingéré ou un coût par unité de requête. L’entreprise promet une facturation à l’usage sans coût d’infrastructure fixe, un modèle qui favorise mécaniquement les petits projets et les équipes qui démarrent, mais dont le coût réel à grande échelle reste à vérifier projet par projet.

Basin face à Snowflake, Databricks et AWS : le tableau comparatif

Basin n’entre pas dans un marché vide. Snowflake et Databricks dominent depuis plusieurs années le segment de l’analytique cloud, et AWS a lancé ses propres tables S3 pour répondre à la même demande de formats ouverts. Le tableau ci-dessous résume les positionnements respectifs à partir des informations publiques disponibles en octobre 2026.

PlateformeModèle principalFormat de tableFrais de sortieDifférence clé avec Basin
Cloudflare BasinIngestion et catalogue serverlessApache Iceberg (ouvert)Aucun sur R2 directRéférence de comparaison
SnowflakeEntrepôt de données managé intégréPropriétaire + support IcebergVariable selon contratSuite complète mais plus fermée historiquement
DatabricksLakehouse avec IA et gouvernanceDelta Lake + support IcebergVariable selon cloud sous-jacentPérimètre bien plus large (ML, orchestration)
AWS S3 Tables / AthenaStockage objet + requêtage serverlessApache Iceberg (ouvert)Frais de sortie AWS standardsArchitecture proche, mais sans gratuité d’égress
Google BigQueryEntrepôt serverless entièrement managéPropriétaireFrais de sortie Google standardsPlus intégré verticalement, moins ouvert

Ce tableau illustre une différence structurelle plutôt qu’une hiérarchie de performance brute. Databricks et Snowflake proposent un périmètre fonctionnel bien plus large, couvrant le machine learning, l’orchestration de pipelines complexes et des outils de gouvernance avancés comme Unity Catalog chez Databricks. Basin, à l’inverse, reste volontairement étroit : il s’agit d’ingérer, de stocker en Iceberg et de permettre l’accès par des moteurs tiers, sans prétendre remplacer un écosystème analytique complet.

Les limites déjà pointées par les observateurs du secteur

Aucune plateforme ne lance un produit sans zones d’ombre, et Basin n’échappe pas à la règle. The Register a relevé que la promesse de frais de sortie nuls ne couvre pas la livraison de pipelines vers des destinations externes, une ligne de facturation que Cloudflare classe à part. L’entreprise ne fournit pas non plus un moteur de requête propriétaire complet : les clients doivent connecter un moteur compatible Iceberg pour interroger réellement leurs données, ce qui ajoute une couche de coût et de complexité hors du périmètre direct de Cloudflare.

La portabilité promise par Iceberg ne garantit pas non plus une performance identique entre moteurs. La compaction des fichiers, la gestion des partitions et la maintenance des métadonnées influencent directement la rapidité des requêtes, et ces opérations dépendent de la qualité d’implémentation de Basin Catalog sur la durée. Enfin, Basin reste un produit tout juste généralement disponible : son historique de fiabilité, sa couverture régionale complète et sa maturité face à des charges critiques restent à prouver sur plusieurs trimestres, contrairement à Snowflake ou BigQuery qui cumulent une décennie de retours d’expérience en production.

Ce que disent les premiers utilisateurs de Basin

Un représentant de Cloudflare a décrit l’ambition du produit en ces termes, repris par The Register : “Avec Cloudflare Basin, nous apportons à l’analytique le même modèle serverless que les développeurs attendent déjà de Cloudflare : aucun cluster à gérer, aucun déplacement de données inutile, et des standards ouverts qui laissent les clients garder le contrôle de leurs données.”

Julien Grobbelaar, responsable de la plateforme chez Bobsled, a illustré l’intérêt concret du produit pour une entreprise qui distribue des données entre plusieurs clouds. Il a déclaré, toujours cité par The Register : “Basin nous permet de construire des produits de données accessibles dans n’importe quelle région, sur toutes les grandes plateformes de données et d’IA, avec une fiabilité de niveau production et à une fraction du coût grâce à l’absence de frais de sortie.”

Ce témoignage pèse davantage qu’un simple argument marketing, puisqu’il vient d’une entreprise dont le métier consiste précisément à distribuer des données entre partenaires sur des infrastructures hétérogènes. C’est exactement le scénario où les frais de sortie cloud pèsent le plus lourd, et où un gain de coût mesurable a du sens pour justifier un changement de fournisseur.

Le contexte financier : Cloudflare accélère au bon moment

Le lancement de Basin intervient après un trimestre solide pour Cloudflare. Pour la période close le 30 juin 2026, l’entreprise a déclaré un chiffre d’affaires de 696,1 millions de dollars, en hausse de 36 % sur un an, un résultat publié le 6 août 2026 qui a largement dépassé les attentes des analystes financiers. L’action Cloudflare avait alors bondi de plus de 15 % en séance après-marché, un mouvement que Investor’s Business Daily a attribué à la montée en puissance des produits liés à l’intelligence artificielle agentique dans le portefeuille Cloudflare.

Deux analystes cités par ts2.tech ont salué cette dynamique sans détour. Peter Weed, analyste chez Bernstein, a qualifié ce trimestre de plus forte accélération de croissance en pourcentage depuis la période Covid, en l’attribuant à la modernisation d’infrastructure et à la montée des agents de codage IA. Jonathan Ho, de William Blair, a de son côté souligné que la position de Cloudflare à la croisée des modèles d’IA et des créateurs de contenu pourrait devenir centrale pour la prochaine phase d’internet, tout en avertissant que les hyperscalers répliqueraient probablement avec vigueur.

Basin s’inscrit directement dans cette trajectoire. En ajoutant une couche de données analytique à son offre Workers, R2, Queues et D1, Cloudflare consolide sa transformation d’un simple réseau de diffusion de contenu vers ce qu’elle appelle elle-même une “connectivity cloud” complète, capable de rivaliser frontalement avec les hyperscalers sur des segments où elle était jusqu’ici absente.

De R2 à Basin : la chronologie d’une stratégie data

Basin ne sort pas de nulle part. Il clôture quatre années de constructions successives autour du stockage objet de Cloudflare, chaque étape ajoutant une brique sur la précédente jusqu’à former une offre analytique complète.

DateÉtapeSignification
Septembre 2022Lancement de R2 Object StorageStockage objet compatible S3, sans frais de sortie directe
2023-2024Expansion de R2 et des services développeursMontée en puissance de Workers, Queues et D1 autour de R2
2024-2025Lancement de R2 Data Catalog en version bêtaPremier catalogue Iceberg managé directement intégré à un bucket R2
1er octobre 2026R2 Data Catalog renommé Basin CatalogIntégration dans l’offre Basin globale
1er octobre 2026Disponibilité générale de Cloudflare BasinLancement de la plateforme complète : Pipelines, Catalog, SQL

Cette progression montre une logique d’itération plutôt qu’un pivot brutal. Cloudflare a testé chaque composant séparément avant de les assembler sous une marque unique, une méthode qui limite le risque produit mais qui explique aussi pourquoi l’annonce de Basin a surpris peu d’observateurs habitués à suivre les changelogs de l’entreprise plutôt que ses conférences de presse.

Un marché du data lakehouse en pleine expansion

Cloudflare arrive sur un marché qui croît vite. Selon Market Research Future, le marché mondial de l’entrepôt de données cloud était évalué à 12,49 milliards de dollars en 2025 et devrait atteindre 15,84 milliards de dollars en 2026, avec une croissance annuelle composée projetée de 25,2 % jusqu’en 2035. Le même cabinet évalue séparément le marché plus large des lacs de données à environ 17,6 milliards de dollars en 2025, avec une trajectoire vers 148,5 milliards de dollars d’ici 2035 à un taux de croissance annuel de 23,5 %.

Ces deux chiffres mesurent des périmètres différents, l’un centré sur l’entrepôt structuré, l’autre sur le stockage brut de données à grande échelle, mais ils convergent sur un même constat : la demande pour des architectures de données ouvertes et peu coûteuses à faire évoluer progresse à un rythme à deux chiffres chaque année. Dans ce contexte, l’arrivée d’un acteur comme Cloudflare change l’équilibre concurrentiel en apportant une distribution géographique que peu de spécialistes purs de la donnée peuvent revendiquer.

Pourquoi cela compte pour les entreprises françaises et européennes

Pour les équipes data basées en France et dans le reste de l’Union européenne, la promesse de Basin touche un point sensible depuis plusieurs années : le coût de la souveraineté des données. Beaucoup d’entreprises hésitent encore à répartir leurs charges entre plusieurs clouds, précisément parce que les frais de sortie rendent cette répartition coûteuse dès que les volumes dépassent quelques téraoctets mensuels.

Un format ouvert comme Iceberg, combiné à une politique de sortie gratuite, réduit mécaniquement le coût de changer de fournisseur ou de répartir ses charges entre un hyperscaler américain et une infrastructure européenne. Cela ne règle pas à lui seul les questions de souveraineté juridique posées par le Cloud Act américain, puisque Cloudflare reste une entreprise de droit américain soumise aux mêmes obligations extraterritoriales que ses concurrents. Mais la portabilité technique facilitée par Iceberg donne aux équipes européennes une option supplémentaire pour limiter leur dépendance à un fournisseur unique, un sujet déjà au centre des discussions autour de la souveraineté cloud en Europe cette année.

Cinq prédictions pour les douze prochains mois

  • Cloudflare publiera une grille tarifaire complète pour Basin d’ici début 2027, après avoir recueilli les retours des premiers clients sur les coûts réels de livraison vers des destinations externes.
  • Snowflake et Databricks renforceront leur propre interopérabilité Iceberg pour limiter les départs de clients tentés par le modèle sans frais de sortie de Cloudflare.
  • AWS ajustera sa communication autour de S3 Tables pour mieux répondre frontalement à l’argument de gratuité de sortie porté par R2 et Basin.
  • Les entreprises européennes de taille moyenne seront les premières à adopter Basin à grande échelle, davantage motivées par le coût que les grands comptes déjà engagés dans des contrats pluriannuels avec un hyperscaler.
  • Le taux d’adoption d’Apache Iceberg en entreprise continuera de croître au-delà du seuil de 38 % mesuré en juin 2026, porté par ce type de lancement commercial grand public plutôt que par les seuls projets internes de modernisation.

Ce que Basin révèle de la stratégie à long terme de Cloudflare

Basin n’est pas un produit isolé, c’est la pièce qui relie les investissements successifs de Cloudflare dans le calcul, le stockage et désormais l’analytique. L’entreprise a construit méthodiquement les briques d’un cloud complet, service par service, en partant d’un réseau de diffusion de contenu pour arriver à une offre capable de concurrencer les trois plus grands fournisseurs cloud sur un segment où elle était absente il y a seulement cinq ans.

La vraie bataille ne se jouera pas sur l’annonce elle-même, mais sur la capacité de Cloudflare à tenir sa promesse de simplicité à mesure que les volumes de données augmentent chez ses premiers clients. Les hyperscalers ont bâti leur avantage sur des décennies d’optimisation à très grande échelle, et Basin devra prouver sa fiabilité sur plusieurs trimestres avant de convaincre les directions informatiques les plus prudentes de lui confier des charges de travail critiques.

Foire aux questions sur Cloudflare Basin

Qu’est-ce que Cloudflare Basin ?
Basin est une plateforme de données analytique serverless lancée par Cloudflare le 1er octobre 2026. Elle combine ingestion d’événements, catalogue de tables Apache Iceberg et requêtage SQL, en s’appuyant sur le stockage objet R2.

Basin remplace-t-il R2 Data Catalog ?
R2 Data Catalog a été renommé Basin Catalog et intégré dans l’offre Basin globale. Il conserve sa fonction de catalogue Apache Iceberg managé directement rattaché à un bucket R2.

Basin facture-t-il vraiment zéro frais de sortie ?
L’égress direct depuis R2, via l’API Workers, l’API S3 ou un domaine r2.dev, ne génère aucun frais de transfert de données chez Cloudflare. La livraison de pipelines vers des destinations externes, appelées sinks, peut en revanche être facturée séparément.

Quelle est la différence entre Basin et Snowflake ou Databricks ?
Snowflake et Databricks proposent des suites analytiques complètes incluant le machine learning, l’orchestration avancée et des outils de gouvernance comme Unity Catalog. Basin reste plus étroit : ingestion, stockage Iceberg et accès via des moteurs tiers, sans moteur de requête propriétaire complet intégré.

Faut-il un moteur de requête externe pour utiliser Basin ?
Oui. Basin stocke et catalogue les données au format Iceberg, mais l’interrogation réelle nécessite un moteur compatible, que ce soit Basin SQL ou un outil d’analyse tiers déjà utilisé par l’entreprise.

Quel débit Basin Pipelines peut-il ingérer ?
Selon la documentation Cloudflare, chaque flux Basin Pipelines peut ingérer jusqu’à 1 Go par seconde, contre une limite antérieure de 5 Mo par seconde pour le service précédent.

Basin est-il adapté à une entreprise européenne soucieuse de souveraineté des données ?
Le format ouvert Iceberg facilite la portabilité technique entre fournisseurs, ce qui réduit la dépendance à un cloud unique. Cela ne résout pas à lui seul les questions juridiques liées au Cloud Act américain, puisque Cloudflare reste une entreprise américaine.

Quand Cloudflare publiera-t-il une grille tarifaire complète ?
Cloudflare n’a pas communiqué de grille tarifaire détaillée au moment du lancement. L’entreprise promet une facturation à l’usage, sans coût d’infrastructure fixe, mais les tarifs précis par gigaoctet ou par requête restent à préciser sur sa page de tarification officielle.