Le connecteur natif Power BI vers Databricks a enfin un mode DirectQuery utilisable. Testé sur 40 M de lignes : 3 s au premier rendu, contre 11 s auparavant.
Notes courtes.
Un flux séparé pour ce qui ne mérite pas un article : un test, un chiffre, une lecture. Publié au fil de l'eau, sans relecture longue.
Rappel utile : pandas.read_parquet respecte le predicate pushdown si on passe filters=. J'ai reperdu une heure à le redécouvrir.
Un modèle Dataiku exporté en MLflow se recharge en trois lignes côté Python. Ça change entièrement la conversation avec l'équipe data engineering.
Rapport 2025 sur l'inclusion financière : la densité d'agents y est traitée comme variable structurelle, pas comme détail d'implantation. Cohérent avec ce que j'observe sur mes données.
Les fenêtres de contexte longues ne remplacent pas le chunking. Testé sur 200 pages de documentation interne : la précision décroche après environ 40 k tokens.
Kafka Connect contre un cron Python : au-delà de cinq sources, Connect gagne. En dessous, le cron reste plus lisible et plus rapide à corriger.