Inicio / Herramientas de Archivos / Extractor de campos de contenido de archivos
Herramientas online gratis

Extractor de campos de contenido de archivos

Extrae coincidencias de expresiones regulares de archivos de texto UTF-8. Defina patrón, ignore mayúsculas y obtenga resultados por archivo. Gratis y local…

Empezar a usar

Qué hace esta herramienta

Esta herramienta extrae coincidencias de expresiones regulares del contenido de archivos de texto. Por ejemplo, si un archivo contiene ID42 id7 y usted usa el patrón id(\d+) con 'Ignorar mayúsculas' activado, el resultado incluye ID42 e id7 (coincidencias completas, no solo los números).

Parámetros y procesamiento

  • Patrón: expresión regular sin delimitadores. El patrón predeterminado es un año de cuatro dígitos, mes de dos dígitos y día de dos dígitos separados por guiones (por ejemplo, 2026-09-07).
  • Coincidencia global: siempre está activa; se devuelven todas las coincidencias en orden de archivo.
  • Ignorar mayúsculas: casilla activada por defecto.
  • Límites: el patrón no puede estar vacío ni superar 256 unidades de código JavaScript. Cada archivo se limita a las primeras 10000 coincidencias; si se alcanza ese límite, las coincidencias posteriores se omiten silenciosamente.
  • Tiempo de espera: cada archivo tiene un límite de 1500 ms en un trabajador separado; si se agota, el proceso se detiene.

Ejemplo práctico

Con el patrón predeterminado y el texto 2026-09-07 2026-09-08, la herramienta devuelve ambas cadenas. Esto reconoce una forma de texto, no valida fechas calendario; si sus fechas están en formato DD/MM/AAAA, debe usar un patrón adecuado.

Limitaciones importantes

  • No es un extractor de PDF, DOCX, OCR ni EXIF; solo procesa texto UTF-8.
  • No convierte formatos de fecha ni interpreta números según la configuración regional.
  • Los resultados se muestran como texto, no como CSV estructurado ni JSON; no hay descarga dedicada.
  • Las coincidencias de longitud cero pueden ser ambiguas en la visualización.
  • El procesamiento ocurre en su navegador; expresiones complejas pueden agotar el tiempo y el rendimiento del dispositivo afecta la finalización.

Preguntas frecuentes

¿Cómo extraigo solo la parte numérica de un ID?

Use un grupo de captura, por ejemplo id(\d+), pero la herramienta devuelve la coincidencia completa (match[0]), no el subgrupo. Para obtener solo el número, use un patrón como \b\d+\b si el número está delimitado por espacios.

¿Qué significa el límite de 10000 coincidencias?

Si un archivo tiene más de 10000 coincidencias, la herramienta solo muestra las primeras 10000 y omite silenciosamente el resto. No es una prueba de que se hayan extraído todas las coincidencias.

¿Puedo usar banderas como 'g' o 'i' en el patrón?

No. No hay casilla para banderas; la coincidencia global siempre está activa y la insensibilidad a mayúsculas se controla con la casilla 'Ignorar mayúsculas'. Escriba solo el patrón, sin delimitadores.

Lista de verificación

  • Seleccione archivos de texto UTF-8.
  • Defina una etiqueta de campo descriptiva.
  • Escriba un patrón válido sin delimitadores.
  • Decida si desea ignorar mayúsculas.
  • Revise los resultados y ajuste el patrón si es necesario.

El procesamiento se realiza localmente en tu navegador.