Recherche sémantique dans un PDF
L’outil indexe le texte de votre PDF en passages vectorisés par un modèle multilingue téléchargé une fois (~115 Mio, ensuite en cache navigateur), puis classe les passages les plus proches de votre requête — même sans mots identiques. Le document ne quitte jamais votre navigateur.
FAQ
Qu’est-ce qui est téléchargé ?
Un modèle d’embeddings (~115 Mio) depuis HuggingFace, une seule fois, uniquement si vous activez la recherche IA. Il est ensuite servi depuis le cache du navigateur.
Le PDF est-il envoyé quelque part ?
Non — extraction du texte et calcul des embeddings se font entièrement sur votre appareil.
Et pour un PDF scanné ?
La recherche nécessite une couche texte : lancez d’abord l’outil OCR sur un document scanné.
- Déposez votre PDF
- Activez la recherche IA (téléchargement du modèle la première fois)
- Saisissez votre recherche puis parcourez les passages classés par pertinence