OCR de árabe
Usa este OCR de árabe gratis para sacar texto editable de una imagen o un PDF escaneado: el reconocimiento funciona por completo en tu navegador, así que tu archivo nunca se sube.
GuíasConvierte las fotos de tu teléfono en un documento PDF limpio, sin necesidad de un escáner ni de una aplicación.El motor de OCR se descarga la primera vez que lo usas (unos pocos MB) y luego queda en caché.
Más ajustes preestablecidos
Ve a otro ajuste preestablecido: cada uno abre su propia página listo para usar:
Cómo usar el OCR de árabe
- Suelta una imagen o un PDF escaneado: el idioma ya está preseleccionado para ti.
- Espera mientras se reconoce el texto (el modelo de idioma se descarga una vez y luego queda en caché).
- Copia o descarga el texto reconocido.
Acerca de OCR de árabe
El reconocimiento óptico de caracteres (OCR) convierte las letras de una foto o un escaneo en texto real y editable. Este OCR de árabe usa un modelo de idioma entrenado para esa escritura, así que los caracteres propios del idioma y de la escritura se reconocen con mucha más precisión que con un modelo solo en inglés.
Todo ocurre en tu navegador: la imagen o el PDF se decodifica y se reconoce de forma local y nunca se sube. El modelo de idioma se descarga desde una CDN en el primer uso y queda en caché, de modo que los usos posteriores empiezan al instante. Para obtener los mejores resultados, usa una imagen nítida, bien iluminada y recta.
El árabe se escribe de derecha a izquierda con una escritura cursiva y enlazada en la que la mayoría de las letras adoptan una forma distinta según estén al principio, en el medio o al final de una palabra, o aisladas, así que el modelo tiene que reconocer la forma contextual de cada letra en lugar de un único glifo fijo. Los signos diacríticos opcionales (marcas de vocales breves y tashkeel) añaden otra capa por encima y por debajo de la línea. El OCR de árabe es la forma práctica de sacar texto de libros escaneados, documentos oficiales, señalética y capturas de pantalla en árabe, persa o escrituras tipo urdu y convertirlo en texto editable, buscable y que se puede copiar y pegar.
Preguntas frecuentes
¿Qué idioma reconoce?
Esta página preselecciona el modelo de un idioma, pero puedes cambiar a cualquier idioma compatible —incluidos inglés, chino, japonés, coreano y muchos idiomas europeos— con el selector que hay sobre la zona de arrastre.
¿Se sube la imagen?
No. La imagen o el PDF se reconoce por completo en tu navegador, así que nunca sale de tu dispositivo: seguro para documentos privados.
¿Puede leer PDF escaneados?
Sí. Los PDF escaneados se rasterizan página por página y cada página se reconoce; luego el texto se une todo junto.
¿Por qué el primer uso es más lento?
El motor de reconocimiento y el modelo de idioma se descargan desde una CDN la primera vez que los usas (unos pocos MB) y luego quedan en caché, así que los usos posteriores empiezan enseguida.
¿Mantiene el orden de derecha a izquierda y las marcas diacríticas?
El texto reconocido se devuelve en el orden correcto de derecha a izquierda, y las marcas de vocales breves/tashkeel se captan cuando están impresas con claridad; aunque los diacríticos tenues o añadidos a mano se pasan por alto con facilidad, así que revisa de cerca el texto vocalizado.