Genève & Vienne · ouvert aux postes data & IA

Daniel Navarro · Data Scientist & Ingénieur IA, GenèveUne IA qui comprend les personnes, pas seulement les données.

Je conçois des systèmes RAG et LLM, des pipelines de données et des analyses quantitatives pour les organisations internationales et l'industrie. Anthropologue devenu data scientist, je travaille là où le machine learning rencontre les politiques publiques et le comportement humain.

Data Engineer & consultant BI, Instrumental Partners Gestion de l'information, OCHA (ONU) Master en politiques publiques, CEU
1M+contrats publics structurés dans une base de connaissances RAG et graphe
25%d'amélioration par rapport à la référence, ML géospatial sur la maladie de Parkinson
9,300dossiers de coopération UE référencés, statut prédit à ~90 % de précision
5pays d'expérience : Suisse, Autriche, Colombie, Salvador, République dominicaine

Profil

Trois regards, une boîte à outils.

La plupart des problèmes de données sont des problèmes humains déguisés. J'associe une ingénierie orientée production aux méthodes de l'analyste de politiques publiques et à la curiosité de l'anthropologue, pour que mes systèmes répondent à la question qui compte vraiment. Je travaille de bout en bout, du scraping et de l'ETL aux modèles, aux tableaux de bord et à la note qui les transforme en décisions.

01 / Ingénierie

IA appliquée & data engineering

Génération augmentée par récupération (RAG), bases de données graphe et vectorielles, embeddings et rapports automatisés, déployés avec Docker sur Azure et AWS. J'utilise des outils de codage agentique comme Claude Code pour passer rapidement du prototype au système opérationnel.

  • RAG
  • LLMs
  • Graphes de connaissances
  • ETL
  • Docker
  • Azure
02 / Preuves

Analyse quantitative des politiques publiques

Évaluation d'impact, régressions et analyses comparatives, prévision de séries temporelles et analyse des marchés publics. Formé à la CEU à Vienne, appliqué avec la Banque mondiale, l'OEA et l'UE.

  • Évaluation d'impact
  • R
  • Économétrie
  • Prévision
  • MEAL / suivi-évaluation
03 / Personnes

Comportement humain & société

Une licence en anthropologie, major de promotion, et du terrain sur les conflits armés, les élections et les migrations. J'y ai appris que les preuves doivent venir à la fois des données et des témoignages, et à expliquer les résultats aux ingénieurs, aux médecins comme aux diplomates.

  • NLP
  • Analyse du discours
  • Méthodes mixtes
  • Conflit & paix

Projets choisis

Systèmes, modèles & preuves.

Une sélection de projets en ingénierie IA, data science et recherche en politiques publiques. Les projets clients sont décrits sans noms ni données confidentiels.

IA humanitaire · 2026UN OCHA

Rapports IA fondés sur des sources pour les crises humanitaires

Un moteur de rapports automatisé, pas un chatbot. À partir d'un modèle standard et des saisies de l'utilisateur, il collecte des actualités et des données d'API, construit un graphe de faits et de relations entre événements, personnes et organisations, et rédige des rapports fondés sur des sources traçables. Livré avec une interface conteneurisée pour Azure.

  • NLP
  • Graph DB
  • Vector DB
  • Embeddings
  • Docker
  • Azure

Résultat : utilisé pour les rapports de crise, dont le séisme de 2026 au Venezuela ; bureaux pays formés aux rapports basés sur le RAG.

Lire l'étude de cas (EN) →
Veille marché · 2025–auj.Conseil

Plateforme d'intelligence des marchés publics avec RAG et ML

Système de bout en bout qui collecte, nettoie et structure des données de marchés publics à grande échelle, puis alimente une base de connaissances RAG et graphe pour l'analyse concurrentielle, des tableaux de bord BI et des modèles de prix et d'offres dans un CRM sur mesure, pour des clients de l'industrie manufacturière et de la sécurité.

  • Python
  • Scraping
  • ETL
  • SQLite
  • Preset
  • ML
  • Apollo API

Échelle : plus d'1 million de contrats et 8 000 concurrents structurés.

Lire l'étude de cas (EN) →
Mémoire de master · 2026CEU

(I'm)Paz Total : la politique de paix colombienne a-t-elle réduit la violence ?

Un panel mensuel construit à partir des données de la Police nationale et d'ACLED pour Buenaventura, Arauca et Tumaco, estimé avec des effets fixes à deux dimensions et des études d'événements, avec tests de robustesse et cartes QGIS.

  • Inférence causale
  • TWFE
  • Étude d'événements
  • R
  • ACLED

Résultat : l'ouverture des pourparlers de paix est associée à une hausse de la violence mensuelle, portée par la violence politique.

Code sur GitHub →
Analyse des marchés publics · 2025CEU

Analyse du risque de corruption pour Rail Baltica

Avec Paula Biša : un indice de risque de corruption au niveau des contrats, fondé sur des signaux d'alerte validés par régression logistique, comparant l'opérateur letton de Rail Baltica au reste du marché national sur les données TED, 2018 à 2023.

  • Signaux d'alerte
  • Régression logistique
  • TED data
  • R

Résultat : aucun signe de risque anormalement élevé ; l'opérateur se situe dans les normes du marché, parfois en dessous.

Code & présentation sur GitHub →
NLP · 2026CEU

Discours sur la migration en République dominicaine

LDA guidée et non guidée, DBSCAN et un modèle de sentiment transformer en espagnol sur 43 discours présidentiels et ~8 800 phrases Reddit. Prolonge un travail de NLP mené à l'OEA à Saint-Domingue.

10,6 pts d'affect plus négatif dans les phrases sur la migration sur Reddit, 4,6 pts dans les discours.

Code sur GitHub →
Recherche · 2025–26Banque mondiale / CEU

Inégalités éducatives dans les Balkans & en Europe

Direction du volet CEU : nettoyage et fusion des données internationales TIMSS, régressions pondérées et analyse comparative des écarts socio-économiques et d'investissement parental.

  • TIMSS
  • Pondérations d'enquête
  • Régression
Prévision · 2024–25Indépendant

Prévision de la qualité de l'air & du climat par satellite

Pipelines ETL sur les données Copernicus et Sentinel alimentant des modèles de séries temporelles ARIMA, XGBoost et NARX, avec tableaux de bord de suivi en Dash, Plotly et Power BI.

  • Séries temporelles
  • XGBoost
  • Copernicus
  • Dash
Recherche en santé · 2023–25Universidad Icesi

ML géospatial pour la maladie de Parkinson

Machine learning et deep learning reliant des attributs géographiques et environnementaux à la progression de la maladie, présentés à des médecins, ingénieurs et designers.

25 % d'amélioration par rapport aux résultats de référence.

Publication · 2025Revista Geographia

Comportement électoral métropolitain à Cali

Un clustering k-means montre comment les comportements de vote dépassent les limites municipales. Article évalué par les pairs, avec Milanese.

  • Clustering
  • SIG
  • Élections
Note de politiqueCali

Blackpolis : inégalités raciales à Cali

Données du recensement et de CaliEnDatos, régressions et clustering par quartier, traduits en une note de politique proposant trois options sur les écarts d'emploi et d'éducation des communautés afro-colombiennes.

Note sur GitHub →

◆ Exemples de code et notebooks sur GitHub.

Expérience

Actif depuis 2018, professionnel depuis 2023.

Des laboratoires de recherche de Cali aux institutions multilatérales et aux clients du secteur privé, souvent en parallèle d'études à plein temps.

  1. Data Engineer & consultant BI

    Instrumental Partners LLC · Genève, à distance

    Base de connaissances RAG et graphe, scraping et ETL sur plus d'1 million de contrats publics fédéraux, tableaux de bord BI, ML de prix et d'offres et enrichissement via l'API Apollo dans un CRM sur mesure. Architecture de données, des ERD aux parcours utilisateurs.

  2. Stagiaire en gestion de l'information

    OCHA (ONU) · Genève

    Conception d'un système de rapports IA automatisé fondé sur un graphe, avec interface Docker pour Azure ; formation des bureaux pays au RAG et aux LLM ; appui à l'analyse des besoins et à la cartographie des populations touchées lors de séismes.

  3. Chercheur, inégalités éducatives

    Banque mondiale / CEU · Vienne

    Direction du volet de recherche CEU, liaison avec la Banque mondiale et analyses comparatives par régression sur les données TIMSS.

  4. Consultant indépendant, data science & SIG

    Indépendant · Bogotá

    Tableaux de bord de data storytelling, modèles de prévision à partir de données satellites et jeux de données GeoJSON pour la couverture radio, le suivi environnemental et la planification d'infrastructures.

  5. Assistant administratif / archiviste

    Délégation de l'UE en Colombie · Bogotá

    Réorganisation de 20 ans d'archives de coopération (environ 8 tonnes, 9 300 dossiers), automatisation Excel et objectif de traitement atteint à 100 %.

  6. Assistant de recherche / analyste de données

    Laboratoire I2T, Universidad Icesi · À distance

    ML et deep learning sur des données de santé géospatiales ; responsable du pipeline d'analyse, de la qualité des données à la reproductibilité.

  7. Observateur électoral & stagiaire au bureau national

    Organisation des États américains · Salvador, République dominicaine

    Observation des élections salvadoriennes de 2024 (volets juridique et genre) ; recherche NLP sur le discours migratoire et appui à des missions de haut niveau.

  8. Assistant de recherche (licence)

    SegLab, Universidad Icesi · Cali

    Recherche sur la sécurité et la consolidation de la paix, tableaux de bord géospatiaux en QGIS et Power BI, co-auteur de notes de politique.

Compétences

Mes outils.

Python et SQL au quotidien, R pour l'économétrie, et une pile cloud et conteneurs pour mettre les outils entre les mains des utilisateurs.

IA & ML

  • Pipelines RAG
  • LLM, Hugging Face
  • Bases graphe & vectorielles
  • Embeddings
  • scikit-learn, XGBoost
  • Deep learning
  • NLP

Ingénierie des données

  • Python, pandas
  • SQL, PostgreSQL, SQLite
  • ETL, scraping, APIs
  • Docker, Azure, AWS
  • Architecture de données
  • Git, Claude Code

Analyse & BI

  • Évaluation d'impact
  • R / RStudio
  • Séries temporelles
  • Power BI, Preset
  • Dash, Plotly
  • Automatisation Excel

Domaines

  • Information humanitaire
  • Marchés publics
  • Paix & sécurité
  • Éducation & santé
  • Environnement, SIG
  • Élections & migrations

Formation

Formé dans les deux mondes.

Master en politiques publiques, analyse quantitative

Central European University, Vienne. Évaluation d'impact, analyse textuelle et NLP, analyse des marchés publics, visualisation de données.

Licence en anthropologie, Magna Cum Laude

Universidad Icesi, Cali. Major de promotion, tableau d'honneur. Mémoire sur les interactions entre civils et guérilla dans l'Urabá.

Échange Erasmus, études régionales & globales

Université de Turin, Italie.

Langues

EspagnolNatif
AnglaisC1 · IELTS 8
ItalienB1
FrançaisA2

Distinctions & publications

1re place, hackathon TechPolítica

FLACSO Équateur, 2e édition.

Beyond municipal boundaries

Milanese & Navarro (2025), Revista Geographia. Ainsi que des contributions aux notes de politique du SegLab sur la sécurité, la paix et la pandémie.

Certifications

MEAL · Traitement d'images satellites · Planification & évaluation de projets en recherche en santé

Contact

Construisons quelque chose d'utile.

Vous recrutez un data scientist, un ingénieur IA ou un data engineer à Genève, à Lausanne, à Vienne ou à distance ? Je serai ravi d'échanger sur des postes, des projets ou des collaborations. Je travaille en anglais et en espagnol, et je progresse en français.

GenèveLausanne · VaudZurichVienneÀ distance / hybride