Инженер открывает Dawn и пишет запрос: "Собери данные с https://topstartups.io/ и верни первые 10 стартапов, включая названия, описания, штаб-квартиры, год основания, URL и страницы в соцсетях, в виде таблицы."
Агент думает пару секунд, загружает страницу, парсит список, переходит в профиль каждого стартапа и возвращает таблицу. Десять строк. Все колонки заполнены. Pogo, Auctor, Scalify, Omnea, Rivan, Listen Labs, Doppel, Blossom, Avoca, Traba. Штаб-квартиры в Бруклине, Нью-Йорке, Лондоне, Сан-Франциско, Remote. У большинства указан LinkedIn. Годы основания с 2020 по 2026.
Эта таблица была получена в результате всего нескольких вызовов FourA.
На этой неделе Dawn добавили FourA как встроенный инструмент прямо в платформу агентов. Он находится в списке интеграций рядом с Notion, GitHub и Google Drive. Агенты с доступом к FourA могут загружать публичные веб-страницы или HTTP endpoint, парсить ответы (включая JSON), отправлять формы, проверять доступность и извлекать нужный текст или ссылки из полученных данных. Доступ настраивается индивидуально для каждого агента. Четкий контроль прав без риска выдать всему подряд открытый доступ в интернет.
Интересно не то, что агент умеет обращаться к URL. Веб-поиск существует в платформах агентов уже год. Интересна сама форма формирующегося инструмента.
Веб-поиск и извлечение данных по URL выполняют разные задачи. Поиск нужен для ответа на вопрос «что интернет говорит об X?». Это широкая, обобщенная информация обзорного уровня. Извлечение нужно для сценария «вот URL или endpoint, забери данные и верни структурированный ответ». Здесь разные требования к надежности, разные профили затрат, разные сценарии сбоев. Попытка объединить их в одном инструменте дает посредственный результат в обоих случаях.
В интеграции Dawn эти задачи разделены. Для общих запросов у них есть инструмент /web-research. FourA используется для целевых задач. Агент выбирает нужный инструмент в зависимости от текущей потребности. Именно такой паттерн взросления мы наблюдаем на платформах агентов в 2026 году: извлечение данных перестает быть придатком поиска и становится самостоятельным примитивом.
Для платформенных инженеров
Dawn предоставляет доступ к FourA в виде восьми отдельных инструментов, каждый из которых решает свой паттерн извлечения:
foura_fetch_pageдля страниц HTML и обычного текстаfoura_extract_textдля чистого читаемого контентаfoura_extract_linksдля навигации, форм, скриптов и стилейfoura_fetch_jsonдля API endpointsfoura_head_urlдля заголовков, статусов, редиректовfoura_probe_siteдля быстрой проверки доступностиfoura_submit_formдля отправки форм без авторизацииfoura_single_requestдля произвольных HTTP-запросов
Агент делает выбор на основе входящей задачи. В примере с topstartups выше последовательно использовались три из них: получение, извлечение, уточняющий запрос.
Такую интеграцию можно реализовать за один день. На нижнем уровне есть два режима запросов: прямой режим с сигнатурой браузерного уровня для сайтов без агрессивных проверок и режим с маршрутизацией через proxy для всех остальных случаев. Оба варианта используют одинаковую структуру запроса: URL, опциональные заголовки и тело, опциональный парсинг ответа. Агент выбирает режим в зависимости от требований целевого сайта.
Контракт, который платформа предоставляет своим агентам, обычно строится следующим образом:
- Небольшой набор возможностей (fetch / extract / probe / submit), каждая с четким описанием инструмента, доступным агенту
- Режим proxy по умолчанию с переключением на прямой режим, когда критичны задержка или стоимость
- Разграничение прав на уровне агентов, чтобы клиенты платформы сохраняли контроль
- Структурированный парсинг ответа в виде параметра инструмента, а не инструкции внутри system prompt
Но платформенные инженеры чаще всего недооценивают сложные пограничные случаи. 80% типовых ситуаций (запрос выполняется за 200 мс и возвращает чистый HTML) не вызывают проблем. Оставшиеся 20% (сайты, проверяющие сигнатуру запроса, выдающие JS challenge в ответе или блокирующие облачные IP с ошибкой 403) определяют, выдаст ли ваш агент корректный результат или галлюцинацию. Мы переписали наш путь обработки запросов именно под эти 20%, ведь разница между «кажется надежным» и «работает надежно» требует основных усилий.
Поэтому, если вы разрабатываете платформу для агентов, а ваши клиенты постоянно спрашивают, как их агентам «просто проверить этот URL», вот готовый паттерн. Документация доступна на /docs. Мы всегда готовы помочь разобраться.
Для всех остальных
Вы ничего из этого не заметите. Вы просто увидите, что когда задаете ИИ-ассистенту вопрос, требующий проверки реальной веб-страницы прямо сейчас, он отвечает точно, а не гадает и не извиняется.
Это и есть результат для пользователя: примитив извлечения данных, достаточно надежный, чтобы стоять рядом с GitHub и Google Drive в списке интеграций. Это перестает быть исследовательским проектом. Это становится базовой инфраструктурой.
Почему это важно
Полгода назад агента, которому нужно было прочитать веб-страницу, приходилось собирать вручную. Кастомные промпты, хрупкие скрейперы, самодельные повторные попытки и 60% успешных запросов в удачный день. Архитектура была неверной, потому что нужного слоя еще не существовало. А целевые сайты постоянно менялись. Системы защиты от ботов перешли от статических сигналов к поведенческим проверкам, поэтому собранные на коленке скрейперы ломались быстрее, чем команды успевали их чинить.
Сейчас этот слой формируется. Dawn взял его на вооружение и выпустил интеграцию. Мы ожидаем, что в этом году последуют и другие платформы для агентов, а контракт стандартизируется: отдельный инструмент для поиска, отдельный инструмент для извлечения данных, управление на уровне каждого агента и предсказуемая стоимость.
Мы только в начале пути. Но именно так выглядит зарождение нового стандарта. Когда возможность перестает быть отдельным проектом и становится готовым разъемом.
Если вы создаете платформу для агентов и хотите реализовать такой же подход, напишите нам. Если вы создаете агентов на Dawn, FourA уже доступен. Просто включите его.