Búsqueda semántica en un PDF

La herramienta indexa el texto de tu PDF en pasajes vectorizados por un modelo multilingüe descargado una vez (~115 MB, luego servido desde la caché del navegador) y clasifica los pasajes más cercanos a tu consulta — incluso sin palabras idénticas. El documento nunca sale de tu navegador.

FAQ

¿Qué se descarga?

Un modelo de embeddings (~115 MB) desde HuggingFace, una sola vez, solo si activas la búsqueda con IA. Después se sirve desde la caché del navegador.

¿Se envía el PDF a algún sitio?

No — la extracción de texto y el cálculo de embeddings se ejecutan por completo en tu dispositivo.

¿Y un PDF escaneado?

La búsqueda necesita una capa de texto: ejecuta primero la herramienta OCR en un documento escaneado.

  1. Suelta tu PDF
  2. Activa la búsqueda con IA (descarga del modelo la primera vez)
  3. Escribe tu consulta y recorre los pasajes ordenados por relevancia