Desaparece una negación
La extracción permite algo que el original excluye. Comparar frase completa, nota y contexto. Registrar la corrección y volver a la fuente al citar; una similitud general de palabras no protege el sentido.
Guías prácticas detalladas
Pasar de una página digitalizada a información verificada: revisar caracteres, tablas, orden de lectura e idiomas antes de buscar, calcular o citar texto reconocido automáticamente.
Actualización :

Escáner de libros en las instalaciones de Internet Archive en San Francisco. Fotografía de contexto documental; no representa una misión ni equipos de Alexis Roux ZG. © Dvortygirl · Fuente · CC BY-SA 4.0. Redimensionada y convertida a WebP; visualización recortada.
Un texto seleccionable puede ocultar errores: una negación perdida, un dígito sustituido, columnas mezcladas o un nombre cortado. El OCR facilita encontrar información, pero la página original sigue siendo la referencia. Distinguir una extracción útil para localizar un pasaje de otra suficientemente fiable para citar o calcular. Ninguna tasa universal sustituye la valoración según el uso.
Registrar documento, procedencia, fecha de obtención y paginación. Guardar por separado imagen y texto extraído con versiones. Una extracción nueva no debe sobrescribir pruebas utilizadas anteriormente. Comprobar que las condiciones de acceso y reutilización permiten el trabajo previsto.
Incluir página sencilla, tabla, nota, columna estrecha y escrituras presentes. Añadir todos los valores que sostienen la conclusión: importes, fechas, unidades, nombres y negaciones. Las páginas fáciles no representan bien un corpus variado; indicar la cobertura.
Leer imagen y extracción en paralelo. Revisar cero y O, uno e I, separadores decimales, signos menos y referencias. Comprobar números junto con unidades y periodos. Señalar las correcciones en la transcripción sin modificar silenciosamente el original.
Seguir títulos, párrafos, columnas, notas y celdas. Una fila de tabla no es solo una secuencia de palabras: relacionar valores y encabezados. Revisar tablas repartidas entre páginas. Conservar la página o región de origen de cada dato reutilizado.
Buscar nombre, referencia y expresión en cada escritura. Examinar acentos, caracteres árabes, puntuación y orden de cadenas mixtas. Distinguir reconocimiento de caracteres y traducción del sentido. No corregir automáticamente nombres propios con un diccionario general.
Clasificar pasajes como comprobados, corregidos con registro o no fiables. Una extracción parcial puede ayudar a localizar una página sin ser apta para calcular. Releer las citas directamente y proporcionar un localizador estable. Tras cambiar motor o ajustes, repetir pasajes difíciles, no solo comparar el volumen total.
Situaciones tipo para preparar un control. No describen misiones realizadas ni observaciones reales.
La extracción permite algo que el original excluye. Comparar frase completa, nota y contexto. Registrar la corrección y volver a la fuente al citar; una similitud general de palabras no protege el sentido.
Los títulos se encuentran, pero los párrafos alternan entre columnas. Reconstruir el orden sobre la imagen antes de resumir. Probar una frase completa: las palabras del índice pueden pertenecer a pasajes diferentes.
Un valor perdió su signo o cambió de columna. Revisar cada celda utilizada, encabezados y unidad. Calcular solo con valores verificados y documentar las celdas ilegibles sin completarlas por intuición.
Ayuda a priorizar revisión, pero no sustituye comparar pasajes decisivos. Un solo error puede invertir el sentido de una frase.
Adaptar el trabajo a la decisión. Para una cita, comprobar pasaje y contexto; para un cálculo, todas las celdas utilizadas.
Comparar extracciones nuevas en los mismos pasajes. Conservar la imagen inicial y registrar transformaciones para distinguir fuente y archivos preparados.
No. Reconocimiento y traducción son etapas distintas con errores y controles propios. Conservar el pasaje en su idioma original.