StĂ©phane Estevez, consultant en observabilitĂ© EMEA chez Splunk, est lâinvitĂ© de lâĂ©pisode 87 du podcast Data Driven 101.Â
Aujourdâhui, on plonge dans les coulisses de lâobservabilitĂ© moderne.
Au programme de cet Ă©change dense et Ă©clairant :Â
Pourquoi OpenTelemetry est en train de devenir le standard incontournable
Comment transformer des logs et métriques en décisions business stratégiques
Ce que lâIA appliquĂ©e Ă lâIT (AIOps) peut vraiment faire⊠et ce quâelle ne peut pas
Des cas concrets bluffants : de la PlayStation qui ralentit un site Ă lâaĂ©roport de DubaĂŻ qui booste ses revenus grĂące Ă ses capteurs de toilettes (vĂ©ridique !)
đĄ âLa vraie valeur, ce nâest pas juste dâĂ©viter les pannes, câest de mieux traverser les crises pour sortir du lot.â
đ MOTS CLĂS
ObservabilitĂ© : CapacitĂ© Ă comprendre ce qui se passe dans un systĂšme complexe (infrastructure, application, etc.) Ă partir des donnĂ©es quâil produit (logs, mĂ©triques, traces). Lâobjectif est dâanticiper, dĂ©tecter et rĂ©soudre rapidement les incidents.
Logs : Fichiers gĂ©nĂ©rĂ©s automatiquement par les applications ou les systĂšmes, enregistrant des Ă©vĂ©nements (erreurs, accĂšs, actionsâŠ). Ils permettent de reconstituer ce qui sâest passĂ©.
OpenTelemetry : Standard open source pour collecter logs, mĂ©triques et traces avec un agent unique, dans un format interopĂ©rable. Objectif : Ă©liminer les silos de donnĂ©es et standardiser lâobservabilitĂ©.
AIOps (AI for IT Operations) : Utilisation de lâintelligence artificielle et du machine learning pour automatiser la dĂ©tection dâanomalies, identifier les causes racines, et prĂ©dire les incidents dans les environnements IT complexes.