Los datos sobre el precio de la madera en Europa son técnicamente públicos, pero prácticamente inutilizables. Un país lista los precios del roble en euros por metro cúbico, sin impuestos. Una nación vecina comparte los precios del haya en moneda local, con impuestos incluidos, ocultos dentro de un PDF escaneado sin capa de texto indexable. Para empeorar las cosas, los árboles en pie, los troncos a pie de pista y los lotes de subasta seleccionados a menudo se cotizan unos junto a otros como si fueran productos idénticos.
Los datos sin procesar existen. La inteligencia de mercado, no.
KORENA lanzó el KORENA Timber Index para solucionar esto. El resultado es una referencia diaria y de acceso gratuito para los precios de madera dura, madera aserrada y losas en Europa. A mediados de 2026, el índice monitorea aproximadamente dos docenas de especies y 170 filas de precios regionales en diez países (Rumanía, Alemania, Bulgaria, Polonia, Francia, Austria, Italia, Finlandia, Noruega, Suecia), además de un nivel para el mercado paneuropeo.
Para que un equipo de ingeniería de dos personas pudiera cubrir tanto terreno, KORENA necesitaba resolver una decisión clave: quién gestiona la web. Eligieron FourA y canalizaron todo a través de la plataforma.
Una sola pasarela hacia la web
KORENA tomó una decisión de arquitectura desde el principio: cada request web externa pasa por FourA. Eliminaron scrapers aislados, scripts puntuales y comandos personalizados ocultos en el código base.
No se trataba de conveniencia. Se trataba de consistencia. Los portales forestales se comportan de forma impredecible. Algunos son páginas HTML estáticas. Otros son plataformas de subastas modernas que solo muestran datos después de que un navegador los procesa. Los sitios gubernamentales suelen ser lentos, obsoletos o estar fuertemente protegidos.
Al enrutar todo el tráfico a través de la infraestructura de requests de FourA, KORENA gestiona reintentos, backoff, logging y alertas de la misma manera en todas las fuentes. Además, cada documento recuperado se puede hashear, almacenar y rastrear hasta su precio final para fines de auditoría.
Elegir la estrategia de extracción adecuada por fuente
En lugar de programar la lógica de scraping para cada sitio directamente en el código, KORENA asigna cada fuente de datos a un endpoint específico de FourA directamente en su base de datos (consulta cómo elegir el tipo de tarea correcto para ver el desglose completo). Pueden cambiar de estrategia sin modificar su código principal de procesamiento:
Single (
/single/): páginas HTML estáticas, feeds XML y descargas directas de PDF. Informes estadísticos alemanes, actualizaciones forestales estatales de Bulgaria, tablas de precios de Rumanía. Rápido, ligero, el valor predeterminado correcto para la mayoría de los sitios.Browser (
/browser/): aplicaciones web interactivas que necesitan un contexto de navegador real. La plataforma de subastas e-Drewno de Polonia requiere renderizado antes de que aparezcan los números. El HTML inicial no contiene nada útil.Proxy Finder (
/proxy/): la alternativa para los objetivos más complejos. Rotación más estricta, además deunblocker: truepara comprobaciones a nivel de handshake.
Dado que esta es una configuración por fuente y no un script hardcodeado, KORENA puede mover una fuente de Single a Browser o a Proxy Finder cuando un sitio cambia sus defensas. La capa de parsing nunca lo nota.
PDFs escaneados: la parte más difícil
Las APIs web modernas son directas. El caso más difícil de automatizar son los PDFs que solo contienen imágenes. Listas de precios y resultados de subastas publicados como escaneos, sin ninguna capa de texto. Para un humano es molesto. Para un índice diario, detiene el pipeline.
El pipeline de KORENA los procesa mediante una división clara del trabajo:
Extracción: FourA descarga los bytes del PDF en bruto, a diario, de forma confiable.
Evaluación de texto: KORENA verifica el archivo en busca de una capa de texto nativa utilizable.
Procesamiento y extracción: si el PDF es una imagen plana, KORENA rasteriza las páginas y las pasa por OCR y extracción de documentos mediante IA, aplicando pistas de idioma personalizadas y diccionarios de especies para capturar la terminología forestal local.
Validación de esquema: la salida se valida contra el mismo esquema que cualquier otra fuente.
Nada de esto funciona si no puedes obtener el documento de forma confiable todos los días. Ese es el paso que le corresponde a FourA.
Extracción vs. comprensión: una división clara
El trabajo de FourA es entregar bytes en bruto de manera confiable. No necesita saber nada sobre madera. Eso le permite a KORENA concentrar el 100% de su energía en lo que realmente sabe: transformar datos caóticos en un índice estandarizado. Todo lo específico del dominio se queda en KORENA. El HTML se procesa localmente, los PDFs digitales se leen con pdfjs-dist y los PDFs escaneados se procesan mediante OCR.
El paso de normalización es donde los números en bruto se convierten en un índice. El precio de un árbol en pie no es el precio de una troza de aserrío, y el resultado de una subasta local con IVA incluido no es directamente comparable con una cotización de exportación sin IVA. Para convertir los números en bruto en inteligencia de mercado comparable, KORENA convierte todos los datos a un único estándar: euros por metro cúbico, sin IVA, equivalente entregado.
Para lograrlo con precisión, el sistema toma en cuenta:
- Tipos de cambio diarios del Banco Central Europeo.
- Reglas locales de IVA por país.
- Factores de transporte basados en la etapa de procesamiento de la madera.
El índice también mantiene separados los diferentes niveles del mercado. La madera rolliza a granel, las subastas de madera de alto valor y las listas de venta minorista aparecen como categorías individuales y nunca se mezclan. Un lote de subasta premium no distorsiona la línea base.
La división es el objetivo: FourA resuelve el acceso web, KORENA resuelve la madera. Ninguno se convierte en una caja negra de la que el otro dependa.
Por qué la transparencia en los precios de la madera es de repente urgente
Las normativas europeas más estrictas, como el EU Deforestation Regulation (EUDR), están empujando al mercado maderero hacia una trazabilidad total y una documentación de origen más clara. La transparencia de precios es la otra mitad de esa ecuación. Los productores de madera que comparan valores regionales, los compradores que validan presupuestos y los marketplaces digitales que establecen tarifas base necesitan datos diarios, localizados y comparables. No promedios anuales obsoletos. No cifras locales aisladas.
Para que un equipo de ingeniería reducido de dos personas cubriera diez países y cientos de formatos web impredecibles, no podían permitirse perder el tiempo gestionando infraestructura de proxy, flotas de navegadores y correcciones sitio por sitio (consulta the hidden cost of maintaining your own scrapers para ver el cálculo completo). FourA se encarga de la capa de request. KORENA recupera el tiempo para centrarse en la normalización de especies, el ajuste de OCR, la lógica de precios y las pistas de auditoría, el trabajo que solo ellos pueden hacer.
Antes, consultar los precios diarios de la madera requería una llamada telefónica a tu intermediario regional. Ahora cualquiera puede graficar la curva en timber-index.korena.eu. Los próximos diez productos similares a Index no tendrán tiempo para construir la capa de extracción desde cero. Esa es nuestra apuesta.
¿Estás creando un producto basado en datos de la web pública y te cansaste de mantener tus propios scrapers e infraestructura de proxy? Get started with FourA.