VélinPDF
Fuente, tamaño y color: los del texto de al lado — ajustables una vez puesto el texto

Reconocer el texto de un PDF (OCR)

Un escaneado solo es una imagen: nada se busca en él, nada se copia. El reconocimiento de caracteres añade una capa de texto bajo la imagen — el aspecto no cambia, pero el documento se vuelve buscable.

Gratis · 100 % local — no se envía nada
  1. 1Abre tu PDF escaneado.
  2. 2Lanza el reconocimiento y elige el idioma.
  3. 3Descarga el PDF, ya buscable.

Cómo hacer buscable un PDF escaneado

Un documento escaneado solo es la fotografía de una hoja: Ctrl F no encuentra nada, el ratón no selecciona nada y un buscador únicamente ve gris. Vélin dibuja cada página a unos 216 puntos por pulgada, pasa la imagen por un motor de reconocimiento compilado para el navegador y coloca debajo una capa de texto invisible. El aspecto no se mueve ni un píxel; lo nuevo es que el acta de nacimiento, la escritura ante notario o la factura del proveedor ya se dejan buscar, seleccionar, copiar y convertir a Word o a Excel. Abre el PDF, elige el idioma, decide el alcance — solo las páginas escaneadas que se han detectado, todas, o un intervalo como 2-5, 8 — y lanza el reconocimiento. No hay cola de espera ni cuota, porque el cálculo ocurre en tu equipo: unos segundos por página, y también sin conexión.

El motor duda y te lo enseña, palabra por palabra

Ningún reconocimiento acierta al cien por cien, y lo honrado es señalar dónde falla. Cuando el motor titubea, Vélin abre una lista: a la izquierda el recorte de la imagen original, al lado el texto propuesto en un campo que puedes corregir, y a la derecha su grado de seguridad. Lo que no llega al 25 % sale marcado como «ilegible», y nada por debajo del 45 % viene marcado para entrar, de modo que un clic apresurado no cuela invenciones en tu documento. Una página nítida y derecha, digitalizada a 300 puntos por pulgada, sale casi perfecta; una foto torcida, una letra manuscrita o un sello cruzado sobre el texto dan errores. El idioma se descarga la primera vez y luego se queda en el dispositivo. Después, el texto reconocido se relee en el editor, se extrae a texto plano, o se comprime el escaneado, que suele pesar de más.

Preguntas frecuentes

¿El OCR se hace en un servidor?

No — es raro, y ahí está todo el interés: el motor de reconocimiento se ejecuta en tu navegador. Un documento confidencial escaneado no va a ninguna parte.

¿Qué idiomas se reconocen?

Español, francés, inglés, alemán, italiano y portugués — más un modo francés + inglés para documentos mezclados. El modelo del idioma elegido se descarga la primera vez y luego se queda en el dispositivo.

¿Cambia el aspecto del escaneado?

No. La imagen se queda tal cual; el texto reconocido se coloca debajo, invisible, solo para buscar y copiar.

¿Cuánto tarda el reconocimiento?

Unos segundos por página en un equipo reciente, más en un teléfono: todo el cálculo ocurre en tu dispositivo, sin cola de espera ni cuota.

¿El texto reconocido es fiable al cien por cien?

No, y ningún motor lo es: un escaneado nítido y derecho da un resultado excelente; una fotocopia torcida o tramada, mucho menos. El texto reconocido sirve para buscar y copiar — reléelo antes de usarlo como fuente.

Documento — las demás herramientas

Ver las 42 herramientas