Recherche sémantique dans un PDF

L’outil indexe le texte de votre PDF en passages vectorisés par un modèle multilingue téléchargé une fois (~115 Mio, ensuite en cache navigateur), puis classe les passages les plus proches de votre requête — même sans mots identiques. Le document ne quitte jamais votre navigateur.

FAQ

Qu’est-ce qui est téléchargé ?

Un modèle d’embeddings (~115 Mio) depuis HuggingFace, une seule fois, uniquement si vous activez la recherche IA. Il est ensuite servi depuis le cache du navigateur.

Le PDF est-il envoyé quelque part ?

Non — extraction du texte et calcul des embeddings se font entièrement sur votre appareil.

Et pour un PDF scanné ?

La recherche nécessite une couche texte : lancez d’abord l’outil OCR sur un document scanné.

  1. Déposez votre PDF
  2. Activez la recherche IA (téléchargement du modèle la première fois)
  3. Saisissez votre recherche puis parcourez les passages classés par pertinence