À propos
Je suis ingénieur staff spécialisé dans les systèmes de recommandation et de recherche. Je construis actuellement une infrastructure de personnalisation à grande échelle, en travaillant avec des embeddings, des pipelines de données et des architectures de recherche vectorielle.
Ce blog est l’endroit où je documente ce que je rencontre en pratique : les benchmarks que j’ai réalisés, les erreurs que j’ai commises et les décisions d’architecture qui n’ont leur place dans aucune documentation officielle.
Ce que vous trouverez ici
- Recherche & Récupération — recherche vectorielle, ANN, erreurs courantes avec les embeddings, comportement réel d’Elasticsearch et OpenSearch en production
- Embeddings & Bases vectorielles — pgvector, Qdrant, Milvus, benchmarks comparatifs, pièges dans la gestion des embeddings
- Systèmes de recommandation — architecture de recommandation en production, démarrage à froid, évaluation qui compte
- Infrastructure de données — PostgreSQL, MongoDB, décisions de migration, ce qui se passe à grande échelle
À mon sujet
Ingénieur logiciel avec de l’expérience en backend, données et systèmes de ML. J’écris d’abord en portugais. Certains articles sont traduits en anglais et en français.
→ GitHub