Retour pgday Paris. PostgreSQL : MVCC et Vacuum. PowerBI : Analyser les performances et quelques conseils pour les optimiser. OBT : modélisation One Big Table et le stockage colonne à la rescousse. Clause Non-Sargable et détection d'anti-pattern...
Microsoft Fabric passe en GA : on en parle
Episode 37 : Oracle Database Data Cartbridge ou comment faire une extension dans la base Oracle. SQL Server Journalisation Minimale. L'importance du tri des données pour les performances avec Parquet. Le tableau de bord des bases de données : +900...
Databricks : formation en ligne gratuite et aparté Delta Lake 3.0. Oracle DB : un dashboard sur les features et innovation depuis la 11.2 avec 1608 features. Les tendances des bases de données (Relationnelles et NoSQL). Les bases de données...
DataLakehouse et Architecture Médaillon.
Les nouveautés d'Oracle Database 23c
Dans cette épisode on parle d'un essai d'implémentation de recherche sémantique et vectorielle avec SQL Server. Dans la seconde partie : Approfondissement de Microsoft Fabric.
Microsoft a lancé un nouveau service chapeau : Microsoft Fabric. Senser regrouper tous les services autour de l'analytique, ce service est plein de promesses. Premiers avis sur ce service avec Fabien Beaumont. Romain Ferraton aborde ensuite les...
4 sujets dans cet épisode : Une REX sur un problème de modélisation de données IOT dans SQL Server. L'arrivée des fonctionnalités spatiales sur DuckDB. Discussion sur l'observabilité : théorie et un exemple de log machine friendly avec Serilog...
On discute de l'article Big Data is Dead : de Jordan Tigani.
On discute des avantages de DuckDB.
Puis un on aborde la data gouvernance avec Fabien
Les external tools de powerBI permettent d'augmenter la productivité des développements. Fabien nous explique comment et quels tools choisir
Data Gouvernance : les rôles
Monitoring de bases de données : 3 types d'outillage : les spécialisés, les outils d'APM et les frameworks de monitoring type ELK
Datahub : définition(s) et approche. Data stratégie : comment mieux intégrer et gérer la données dans l'entreprise
Coté Modélisation : les SCD ou Slowly Changing dimensions (dimensions à évolution lente) ==> on discute des SCD1, SCD2, SCD3 et même SCD6.
Eric nous parle API, REST bien sur !
3 parties dans cet épisode : la gestion des plans d'exécution particuliers dans les bases de données, les étapes pour concevoir son datavault et finalement une introduction a Terraform
Le plan d'exécution dans une base de données : la base et quelques outils. L'orchestrateur de containers : pourquoi un orchestrateur et quel orchestrateur choisir en 2022. La multi-temporalité dans le datavault : snapshot or not snapshot !
Dans un datavault les clefs ne sont pas incrémentales, alors quelle technique utiliser : SHA256 ou fonction de hashache vers un entier ? Une partie sur l'indexation et l'ordre des colonnes, une autre sur le InMemory, la compression et le stockage...
Modélisation : Data Vault la suite
DevOps : Docker
PerformanceIndexation dans les bases de données
Performance Database : Partitionnement (Oracle & SQL Server)
DevOps : Les fondements (CALMS)
Modélisation DataVault: définition et utilité
Modélisation en étoile et en flocon : définition et utilité
Gitops : principes et intérêts
Performance Database : Fonctions Utilisateurs (UDF) dans les bases de données, cas d'utilisation et problèmes de performance
Modélisation et formes normales : définition et utilité
Performance Database : Curseur vs Ensemble et notion de Sargable
