• Data
  • Conférence
  • Avancé
  • 55 min

Au-delà de la hype : gérer des embeddings à l'échelle du milliard dans Elasticsearch et OpenSearch

  • Date mercredi
  • Horaire 11h30 à 12h25
  • Salle Amphi D

Description

La recherche sémantique promet une révolution : pertinence contextuelle et compréhension du langage naturel en quelques lignes de code seulement. Sur un notebook ou un POC, c'est magique. Mais que se passe-t-il lorsque votre index dépasse le milliard de vecteurs ? La magie cède rapidement la place à la brutalité de l'ingénierie : explosion de la latence, coûts d'infrastructure incontrôlés et défis liés à la RAM. Dans cette présentation, nous laissons le buzz marketing à la porte et plongeons dans les entrailles d'Elasticsearch et d'OpenSearch à très grande échelle. Nous aborderons comment : - Architecturer vos clusters pour gérer un milliard d'embeddings sans flancher. - Optimiser le compromis critique entre précision et latence. - Réduire les coûts en utilisant des stratégies de quantification et de chunking intelligent. Si vous devez passer d'une recherche sémantique « Hello World » à une production massive, cette session est votre guide de survie.

Orateur·ices

Pietro Mele

Italian, adopted by France not long ago, I am a constant learner, dedicated to computer science and discovery—whether uncovering solutions or gaining insights.

Lucian Precup

Lucian Precup is the CTO of [all.site](https://all.site/) - the collaborative search engine developed at [Station F](http://stationf.co) in Paris. With his colleagues at [Adelean](http://adelean.com), Lucian develops solutions for indexing, searching and analyzing data. Lucian regularly shares his knowledge in specialized conferences and organizes the [Search & Data Meetup](https://www.meetup.com/fr-FR/search-and-data/).

Actions rapides

Voir la vidéo

Les sessions futures sur le même thème

    • Data
    • Conférence

    [REX] Une plateforme de données moderne avec Airflow, OpenMetadata, DBT, Google Cloud et Terraform

    Un SI moderne est souvent composé de nombreuses applications hétérogènes, portant chacune ses propres données. Comment dans ce cas vérifier la cohérence des données de ces différents référentiels, et centraliser une donnée fiable, notamment dans un but de reporting aux équipes métier ? Comment mettre en place une gouvernance des données, des tests de qualité sur ces données dans un contexte réparti ? Ce sont les questions que nous nous sommes posées, et auxquelles nous avons répondu par la création d'une plateforme de données utilisant la philosophie ELT (Extract, Load, Transform) basée sur l'orchestrateur Airflow, sur la brique de gouvernance OpenMetadata et sur DBT pour la gestion des transformations "as code", le tout déployé par Terraform sur Google Cloud. Lors de ce talk, nous partagerons notre retour d'expérience sur la création de cette plateforme : - Réflexions initiales et choix des briques technologiques - Prototypages de la solution et apprentissages - Industrialisation - État actuel de la plateforme et réflexions futures Nous zoomerons notamment sur les différentes briques techniques utilisées, sur notre compréhension de leur fonctionnement et sur nos retours d'utilisation. Nous expliquerons également comment nous avons cherché à rapprocher les pratiques Data, Dev, Ops et sécurité pour réduire le "time to insight" (le temps entre la génération d'une donnée et la mise à disposition d'analyses basées sur cette donnée) et augmenter le "data trust" (la confiance dans les données utilisées pour le reporting) tout en assurant la robustesse de la plateforme.

    Vendredi 9h30 à 10h25 - Amphi A