← Todos os posts

Como a KORENA construiu um índice de preços de madeira na FourA

A KORENA construiu um índice diário de preços de madeira na Europa com base em portais florestais, PDFs de leilões e dez moedas. A FourA é a camada de request por trás dele.

Os dados de preços de madeira europeia são tecnicamente públicos, mas praticamente inutilizáveis. Um país lista preços de carvalho em euros por metro cúbico, sem impostos. Uma nação vizinha compartilha preços de faia na moeda local, com impostos inclusos, enterrados dentro de um PDF digitalizado sem camada de texto pesquisável. Para piorar a situação, árvores em pé, toras na beira da estrada e lotes de leilão selecionados são frequentemente cotados lado a lado como se fossem produtos idênticos.

Os dados brutos existem. A inteligência de mercado não.

A KORENA lançou o KORENA Timber Index para resolver isso. O resultado é uma referência diária e de acesso gratuito para preços de madeira de lei, madeira serrada e pranchas europeias. Em meados de 2026, o índice monitora cerca de duas dúzias de espécies e 170 linhas de preços regionais em dez países (Romênia, Alemanha, Bulgária, Polônia, França, Áustria, Itália, Finlândia, Noruega, Suécia), além de uma camada de marketplace pan-europeu.

Para uma equipe de engenharia de duas pessoas cobrir tanto terreno, a KORENA precisava tirar uma decisão da frente: quem cuida da web. Eles escolheram a FourA e rotearam tudo por meio dela.

Um Gateway para a Web

A KORENA fez uma escolha arquitetural logo no início: toda request web externa passa pela FourA. Eles eliminaram scrapers avulsos, scripts pontuais e comandos customizados escondidos dentro da base de código.

Não se tratava de conveniência. Tratava-se de consistência. Portais florestais se comportam de forma imprevisível. Alguns são páginas HTML estáticas. Outros são plataformas de leilão modernas que só exibem dados depois que um navegador os renderiza. Sites governamentais costumam ser lentos, desatualizados ou fortemente protegidos.

Ao rotear todo o tráfego pela infraestrutura de request da FourA, a KORENA gerencia retries, backoff, logging e alertas da mesma forma em todas as fontes. E cada documento recuperado pode ser hasheado, armazenado e rastreado até o seu preço final para auditoria.

Escolhendo a Estratégia de Fetch Certa por Fonte

Em vez de codificar a lógica de scraping de forma rígida para cada site, a KORENA mapeia cada fonte de dados para um endpoint específico da FourA diretamente no banco de dados (consulte como escolher o tipo de tarefa correto para o detalhamento completo). Eles podem mudar as estratégias sem tocar no código principal de parsing:

  • Single (/single/): páginas HTML estáticas, feeds XML e downloads diretos de PDF. Relatórios estatísticos alemães, atualizações florestais estatais búlgaras, tabelas de preços romenas. Rápido, leve, o padrão ideal para a maioria dos sites.

  • Browser (/browser/): aplicações web interativas que precisam de um contexto real de navegador. A plataforma de leilões e-Drewno da Polônia exige renderização antes que os números apareçam. O HTML inicial não contém nada útil.

  • Proxy Finder (/proxy/): o fallback para os alvos mais difíceis. Rotação mais robusta, além de unblocker: true para verificações no nível do handshake.

Como essa é uma configuração por fonte e não um script fixo no código, a KORENA pode mover uma fonte de Single para Browser ou Proxy Finder quando um site altera suas defesas. A camada de parsing nunca percebe isso.

PDFs digitalizados: a parte mais difícil

APIs web modernas são simples. O caso mais difícil de automatizar são PDFs compostos apenas por imagens. Tabelas de preços e resultados de leilões publicados como digitalizações, sem nenhuma camada de texto. Para um humano, isso é irritante. Para um índice diário, isso interrompe o pipeline.

O pipeline da KORENA lida com eles por meio de uma divisão clara de tarefas:

  • Coleta: o FourA baixa os bytes brutos do PDF, diariamente, com confiabilidade.

  • Avaliação de texto: a KORENA verifica se o arquivo possui uma camada de texto nativa utilizável.

  • Processamento e extração: se o PDF for uma imagem simples, a KORENA rasteriza as páginas e as processa via OCR e extração de documentos por IA, aplicando dicas personalizadas de idioma e dicionários de espécies para capturar a terminologia florestal local.

  • Validação de schema: a saída é validada contra o mesmo schema de todas as outras fontes.

Nada disso funciona se você não conseguir obter o documento com confiabilidade todos os dias. Essa é a etapa sob responsabilidade do FourA.

Coleta vs. Compreensão: uma divisão clara

O papel do FourA é entregar bytes brutos com confiabilidade. Ele não precisa entender nada sobre madeira. Isso permite que a KORENA concentre 100% da sua energia no que realmente domina: transformar dados caóticos em um índice padronizado. Tudo o que é específico do domínio permanece na KORENA. O HTML é processado localmente, PDFs digitais são lidos com pdfjs-dist e PDFs digitalizados são processados via OCR.

A etapa de normalização é onde números brutos se transformam em um índice. O preço de uma árvore em pé não é o preço de uma tora para serraria, e o resultado de um leilão local com impostos incluídos não é diretamente comparável a uma cotação de exportação sem impostos. Para transformar números brutos em inteligência de mercado comparável, a KORENA converte todos os dados em um único padrão: Euros por metro cúbico, sem impostos, equivalente a entregue.

Para fazer isso com precisão, o sistema leva em consideração:

  • Taxas de câmbio diárias do European Central Bank FX rates.
  • Regras locais de impostos por país.
  • Fatores de transporte com base no estágio do produto de madeira.

O índice também mantém níveis de mercado distintos separados. Madeira em tora a granel, leilões de madeira nobre e listagens de varejo aparecem como categorias individuais e nunca são misturados. Um lote premium de leilão não distorce a linha de base.

A divisão é o objetivo central: o FourA resolve o acesso à web, a KORENA resolve a madeira. Nenhum se torna uma caixa-preta da qual o outro depende.

Por que a transparência de preços de madeira se tornou urgente de repente

Regulamentações europeias mais rígidas, incluindo o EU Deforestation Regulation (EUDR), estão impulsionando o mercado de madeira em direção à rastreabilidade total e a uma documentação de origem mais limpa. A transparência de preços é a outra metade dessa equação. Produtores de madeira comparando valores regionais, compradores validando cotações e marketplaces digitais definindo taxas de referência precisam de dados diários, localizados e comparáveis. Não de médias anuais desatualizadas. Não de números locais pontuais.

Para uma equipe de engenharia enxuta de duas pessoas cobrir dez países e centenas de formatos web imprevisíveis, eles não podiam se dar ao luxo de gastar tempo gerenciando infraestrutura de proxy, frotas de navegadores e correções site a site (veja o custo oculto de manter seus próprios scrapers para o cálculo completo). O FourA cuida da camada de request. A KORENA ganha tempo de volta para focar na normalização de espécies, ajuste de OCR, lógica de precificação e trilhas de auditoria, o trabalho que apenas eles podem fazer.

Preços diários de madeira costumavam depender de um telefonema para o seu corretor regional. Agora, qualquer pessoa pode traçar a curva por conta própria em timber-index.korena.eu. Os próximos dez produtos no estilo do Index não terão tempo para construir a camada de busca do zero. Essa é a aposta que estamos fazendo.


Está construindo um produto baseado em dados públicos da web e cansou de manter seus próprios scrapers e infraestrutura de proxy? Comece a usar o FourA.