← Todos os posts

FourA aparece no Dawn, e isso é o começo de algo

O Dawn lançou uma integração com o FourA nesta semana. Por trás de cada resposta de agente que acessa a web ao vivo, agora há uma chamada de extração. Aqui está o formato que está surgindo.

Um engenheiro abre o Dawn e pede: "Faça o scrape de https://topstartups.io/ e me dê as primeiras 10 startups, incluindo nomes, descrições, sede, ano de fundação, URLs e páginas de redes sociais, formatado como uma tabela."

O agente pensa por um momento, busca a página, faz o parse das listagens, segue o perfil de cada startup e retorna a tabela. Dez linhas. Todas as colunas preenchidas. Pogo, Auctor, Scalify, Omnea, Rivan, Listen Labs, Doppel, Blossom, Avoca, Traba. Sedes em Brooklyn, Nova York, Londres, São Francisco, Remoto. LinkedIn para a maioria. Anos de fundação de 2020 a 2026.

Essa tabela foi o resultado de um punhado de chamadas da FourA.

Esta semana o Dawn lançou a FourA como uma ferramenta nativa dentro de sua plataforma de agentes. Ela fica na grade de integrações ao lado de Notion, GitHub e Google Drive. Agentes com acesso concedido à FourA podem buscar uma página web pública ou endpoint HTTP, fazer o parse da response (incluindo JSON), enviar um formulário, checar a disponibilidade e extrair texto ou links específicos do retorno. Cada agente tem acesso explícito ou não tem. Governança por agente, sem o risco de "todo agente ganha acesso à internet".

FourA in Dawn's integrations grid, alongside OneDrive, MailJet, Linear, Jira, and Trello FourA in Dawn's integrations grid, alongside OneDrive, MailJet, Linear, Jira, and Trello

O que é interessante não é o fato de um agente poder acessar uma URL. A busca na web já existe em plataformas de agentes há um ano. O interessante é o formato da ferramenta que está surgindo.

Busca na web e extração de URL são tarefas diferentes. A busca serve para "o que a internet diz sobre X?". Informações amplas, generativas e em nível de resumo. A extração serve para "aqui está a URL ou endpoint, faça o fetch e me dê a resposta estruturada". Requisitos de confiabilidade diferentes, perfis de custo diferentes, modos de falha diferentes. Misturar ambos em uma única ferramenta gera uma resposta medíocre para os dois casos.

A integração do Dawn trata essas tarefas como distintas. Eles têm uma capacidade /web-research para a tarefa ampla. O FourA serve para a tarefa direcionada. O agente escolhe a ferramenta certa com base no que realmente precisa. E esse é o padrão de maturação que estamos começando a ver nas plataformas de agentes em 2026: a extração está deixando de ser um "anexo da busca" para se tornar uma primitiva própria.

Para o engenheiro de plataforma que está lendo isto

O Dawn expõe o FourA como oito ferramentas nomeadas, cada uma mapeada para um padrão comum de extração:

  • foura_fetch_page para páginas HTML e texto
  • foura_extract_text para conteúdo limpo e legível
  • foura_extract_links para navegação, formulários, scripts e estilos
  • foura_fetch_json para endpoints de API
  • foura_head_url para headers, status, redirecionamentos
  • foura_probe_site para verificações rápidas de acessibilidade
  • foura_submit_form para envios de formulário sem login
  • foura_single_request para HTTP arbitrário

O agente escolhe com base no que a consulta exige. A consulta topstartups acima usou três delas em sequência: um fetch, um extract, um follow-up.

A integração é direta o suficiente para ser feita em um dia. Há dois tipos de request por baixo: um modo direto com uma assinatura de request de nível de navegador para sites que não impõem bloqueios agressivos, e um modo roteado por proxy para todo o resto. Ambos compartilham o mesmo formato de request: URL, headers e body opcionais, parsing opcional de response. O agente escolhe com base no que o site de destino exige.

O contrato que uma plataforma oferece aos seus agentes costuma ser:

  • Um pequeno conjunto de recursos (fetch / extract / probe / submit), cada um com uma definição de ferramenta focada que o agente pode acionar
  • Padrão em modo proxy, com fallback para direto quando a latência ou o custo forem importantes
  • Permissões por agente para que os clientes da plataforma mantenham a governança
  • Parsing de response estruturada exposto como parâmetro da ferramenta, não escondido em um prompt de sistema

Mas a parte que a maioria dos engenheiros de plataforma subestima é o que acontece na cauda longa. O caso de 80% (um fetch tem sucesso em 200ms, retorna HTML limpo) é a metade fácil. Os outros 20% (sites que bloqueiam pela assinatura do request, que injetam um desafio JS na response, que retornam 403 em um bloco de IPs de nuvem) é o que determina se o seu agente entrega uma resposta correta ou uma alucinação. Reconstruímos nosso caminho de request exatamente para essa cauda, e a diferença entre "parece confiável" e "realmente confiável" representa a maior parte do trabalho.

Portanto, se você opera uma plataforma de agentes e seus clientes vivem perguntando como os agentes deles poderiam "apenas checar esta URL", esse é o padrão. A documentação está em /docs. Teremos prazer em orientar você.

Para todos os outros

Você não verá nada disso. Apenas notará que, ao fazer a um assistente de IA uma pergunta que exige consultar uma página web real agora mesmo, ele responde corretamente em vez de adivinhar ou pedir desculpas.

Esse é o resultado visível para o usuário de uma primitiva de extração confiável o suficiente para ficar ao lado do GitHub e do Google Drive em uma grade de integrações. Deixa de ser um projeto de pesquisa. Passa a ser infraestrutura básica.

Por que isso importa

Seis meses atrás, um agente que precisava ler uma página web exigia desenvolvimento sob medida. Prompts personalizados, scrapers frágeis, retentativas manuais, uma taxa de sucesso de 60% em um dia bom. A estrutura estava errada porque a camada ainda não existia. E os sites que o agente acessava continuavam mudando. A detecção de bots migrou de sinais estáticos para verificações comportamentais, de modo que os scrapers improvisados se degradavam mais rápido do que as equipes conseguiam corrigi-los.

Agora a camada está se formando. A Dawn adotou a solução e lançou uma integração. Esperamos que mais plataformas de agentes sigam o mesmo caminho este ano, e esperamos que o contrato convirja: uma ferramenta dedicada para busca, uma ferramenta dedicada para extração, governança por agente, custo previsível.

Estamos no início. Mas é assim que o surgimento de algo se parece. Quando um recurso deixa de ser um projeto e se torna um plugue.

Se você desenvolve uma plataforma de agentes e deseja disponibilizar o mesmo formato, fale conosco. Se você cria agentes no Dawn, o FourA já está lá. Basta ativá-lo.