INITIALIZING LAKEHOUSE ARCHITECTURE...
00%
Disponible immédiatement · Rouen

Lead Data Engineer & Architecte

Je construis des plateformes de données robustes et des pipelines évolutifs pour transformer la donnée en levier business.

Voir le CV
Paul Tuillet

Paul Tuillet

Lead Data Engineer

DuckDB · dbt · Airflow · Dagster

10+ ans d'expérience
15+ plateformes data livrées
Spécialiste Auto-hébergement
PORTFOLIO

Architecture & Réalisations

Lecture rapide: d'abord les réalisations professionnelles anonymisées, puis les projets personnels R&D.

Infrastructure

Le "Zero-Cost" Lakehouse

Une architecture de données souveraine et découplée. Remplacement d'un monolithe SQL Server coûteux par une stack Docker agile.

  • 0€ de coûts de licence (Open Source stack)
  • Performance x100 grâce à DuckDB (OLAP)
  • Stockage S3 partitionné (Bronze/Silver/Gold)
REST APIs SQL Server JSON / S3 Bronze Silver Gold Dashboards FastAPI
Business Demo

Vortex Markets

An anonymized demo of business-facing data/finance tools designed from real delivery work.

View Demo
Solo Project

Arken OSINT Engine

Browser-based geopolitical intelligence platform: RSS ingestion, entity mapping, event timeline, and weak-signal correlation.

View Demo
Technical Demo

Dashstore

An anonymized operations dashboard demo inspired by a real enterprise delivery context.

Explore Demo
PARCOURS

Professional Journey

Founding Data Engineer

Groupe BZ
April 2025 – Present

Founding role: designed and delivered a sovereign, production-ready, and durable Lakehouse platform. Implemented Python, Dagster, dbt, SQLMesh, DuckDB, and Polars for fast analytical processing. Set up Apache Airflow pipelines and continuous deployment. Defined technical standards, led code reviews, and delivered an autonomous business platform.

dbt Airflow DuckDB Dagster Docker CI/CD

Product Owner

ASAP
Nov 2024 – Dec 2025

Conducted market studies targeting 450k customers. Achieved 42% conversion rate on campaigns. Bridged business requirements with technical feasibility.

Python Teacher

LePont
May 2022 – Oct 2024

Trained 150+ international students from Audencia in Data Visualization (Power BI) and Python coding.

Data Consultant

Wildberries
Mar 2022 – Mar 2024

Built ETL/ELT pipelines with dbt and Dagster orchestration. Developed customer segmentation models (RFM) and logistics performance dashboards. Analyzed 10M+ transactions.

Lead Data Analyst

International Press Comity
Oct 2021 – July 2022

Performed Open-Source Intelligence (OSINT) investigations for international press organizations.

Senior Server Administrator

Keen Software House
Aug 2018 – Feb 2022

Managed high-availability server infrastructure (bare metal & cloud).

Data Miner

Freelance
Sep 2015 – Dec 2020

Extraction de données open source à but de data journalisme.

OUTILS

The Toolkit

Orchestration

Dagster

Orchestration orientée assets avec lignage natif et SLAs.

Apache Airflow

Scheduling par DAG pour workflows complexes et grand écosystème.

Pipeline ETL Mini-Game

Cliquer pour jouer

Transformation & DataFrames

DuckDB

Moteur OLAP embarqué. 100x plus rapide que Pandas.

dbt Core

Transformation SQL versionnée, testable et data contracts.

Polars

Polars

DataFrames Rust très haute performance avec exécution lazy.

Storage & Sovereign DB

MinIO

MinIO (S3)

Object storage S3-compatible. 0€ de licence vs AWS S3.

PostgreSQL

PostgreSQL

Couche de serving avec extensions (pgvector) pour APIs et BI.

Infra, AI & Full-Stack Apps

Docker

Docker & CI/CD

Infrastructure conteneurisée et déployée via GitLab CI / GitHub Actions.

Pinecone

Base de données vectorielle pour RAG et recherche sémantique.

FastAPI

Python Backends

Backends Python sécurisés (FastAPI) et interfaces full-stack (NiceGUI).

MA PHILOSOPHIE

Simple.
Souverain.
Performant.

La plupart des ingénieurs empilent des services Cloud par réflexe. Moi, je choisis l'architecture qui maximise le ROI.

Optimisation des coûts

Alternatives open-source souveraines pour diviser par 10 les coûts d'infrastructure.

De l'Idée au Prod en Jours

Une stack conteneurisée standardisée pour livrer de l'architecture à la prod en une semaine.

Vos Données, Votre Contrôle

Hébergement sur vos serveurs ou cloud privé pour une conformité RGPD native et un contrôle total.

Ce que je recherche aujourd'hui

Des missions long terme ou poste clé pour structurer une plateforme data utile, sobre et maintenable, avec un lien fort au produit.

TÉMOIGNAGES

Retour d'expérience clients

Avec le tableau de bord et le datalake, nous pouvons désormais suivre l'évolution de l'impact dans la commercialisation des producteurs via notre application, ainsi que l'autonomie générée par l'outil auprès de ces derniers.

S

Sacha S. (Responsable Achats, BZ)

L'expertise de Paul sur dbt et l'orchestration de nos pipelines avec Dagster a structuré notre équipe Data. Ses dashboards de performance logistique sont aujourd'hui indispensables au quotidien.

M

Marat K. (Lead Data, Wildberries)