Apprenez à traiter des données en temps réel à l'aide des mêmes API Spark que celles utilisées pour le traitement par lots.
Archived. This article has not been updated since the publish date above. The dynamic nature of information means that previously accurate content can become outdated or even obsolete over time. Readers are advised to exercise due diligence and cross-check any information found in this blog post before making decisions or adopting any practices based on said information.
Le streaming structuré est une API de haut niveau pour le traitement des flux qui a été mise en production dans Spark 2.2. Le streaming structuré vous permet d’utiliser les API structurées de Spark pour exécuter des opérations en mode streaming, de la même façon que vous le feriez en mode batch. Cela peut réduire le temps de latence et permettre un traitement incrémental. Son atout majeur est qu’il permet d’exploiter les systèmes de streaming pour rapidement créer de la valeur, sans avoir besoin de modifier le code. Il est également facile à comprendre, car vous pouvez écrire votre job par batchs comme un prototype avant de le convertir en un job de streaming. Tout cela fonctionne par traitement incrémentiel de ces données.
Abonnez-vous à notre blog et recevez les derniers articles directement dans votre boîte mail.