Инженер открывает Dawn и просит: "Спарси https://topstartups.io/ и выдай мне первые 10 стартапов, включая названия, описания, штаб-квартиры, год основания, URL и страницы в соцсетях, в виде таблицы."
Агент на мгновение задумывается, загружает страницу, парсит списки, переходит по профилю каждого стартапа и возвращает таблицу. Десять строк. Каждая колонка заполнена. Pogo, Auctor, Scalify, Omnea, Rivan, Listen Labs, Doppel, Blossom, Avoca, Traba. Штаб-квартиры в Brooklyn, New York, London, San Francisco, Remote. LinkedIn для большинства. Год основания с 2020 по 2026.
Эта таблица стала результатом нескольких вызовов FourA.
На этой неделе Dawn выпустил FourA как полноценный инструмент внутри своей платформы агентов. Он находится в сетке интеграций рядом с Notion, GitHub и Google Drive. Агенты, получившие доступ к FourA, могут загрузить публичную web-страницу или HTTP endpoint, распарсить response (включая JSON), отправить форму, проверить доступность и извлечь конкретный текст или ссылки из полученного ответа. У каждого агента либо есть явный доступ, либо нет. Управление на уровне агента, никаких выстрелов в ногу в стиле "каждый агент получает доступ в интернет".
Интересно не то, что агент может обратиться к URL. Web-поиск существует в платформах агентов уже год. Интересно то, какую форму принимает этот инструмент.
Web-поиск и извлечение данных по URL, это разные задачи. Поиск нужен для ответа на вопрос "что интернет говорит об X?". Широкая, генеративная, обобщенная информация. Извлечение, это "вот URL или endpoint, загрузи его и дай мне структурированный ответ". Разные требования к надежности, разные профили затрат, разные сценарии сбоев. Смешивание их в одном инструменте дает посредственный результат для обоих.
Интеграция Dawn рассматривает их по отдельности. У них есть возможность /web-research для широких задач. FourA предназначен для целевых задач. Агент выбирает правильный инструмент в зависимости от того, что ему действительно нужно. И это паттерн взросления, который мы начинаем видеть в платформах агентов в 2026 году, извлечение переходит от "прикрученного поиска" к собственному примитиву.
Для инженеров платформ
Dawn представляет FourA в виде восьми именованных инструментов, каждый из которых соответствует общему паттерну извлечения:
foura_fetch_pageдля HTML и текстовых страницfoura_extract_textдля чистого читаемого контентаfoura_extract_linksдля навигации, форм, скриптов и стилейfoura_fetch_jsonдля API endpointsfoura_head_urlдля headers, статусов и редиректовfoura_probe_siteдля быстрых проверок доступностиfoura_submit_formдля отправки форм без авторизацииfoura_single_requestдля произвольного HTTP
Агент делает выбор на основе требований запроса. Запрос topstartups выше использовал три из них последовательно, загрузка, извлечение, последующий переход.
Интеграция достаточно проста, чтобы выполнить ее за день. В основе лежат два типа request, прямой режим с сигнатурой запроса уровня браузера для сайтов без агрессивной блокировки, и режим маршрутизации через proxy для всего остального. Оба имеют одинаковую структуру request, URL, опциональные headers и body, опциональный парсинг response. Агент выбирает в зависимости от того, что требует целевой сайт.
Контракт, который платформа предлагает своим агентам, обычно выглядит так:
- Небольшой набор возможностей (fetch / extract / probe / submit), каждая из которых имеет четкое определение инструмента, к которому может обратиться агент
- Режим proxy по умолчанию, возврат к прямому режиму, когда важны задержка или стоимость
- Разрешения на уровне агента, чтобы клиенты платформы сохраняли контроль
- Структурированный парсинг response, представленный как параметр инструмента, а не скрытый в системном промпте
Но часть, которую недооценивает большинство инженеров платформ, это то, что происходит в сложных случаях. 80% случаев (когда fetch проходит успешно за 200 мс, возвращая чистый HTML) это простая половина. Остальные 20% (сайты, которые блокируют по сигнатуре запроса, которые отправляют JS-проверку в response, которые выдают 403 на облачный блок IP) определяют, выдаст ли ваш агент правильный ответ или галлюцинацию. Мы перестроили наш путь request именно для таких случаев, и разница между "кажется надежным" и "действительно надежным" составляет большую часть работы.
Поэтому, если вы управляете платформой агентов и ваши клиенты постоянно спрашивают, как их агенты могут "просто проверить этот URL", вот вам паттерн. Документация доступна по адресу /docs. Мы будем рады все вам показать.
Для всех остальных
Вы ничего этого не увидите. Вы просто заметите, что когда вы задаете ИИ-ассистенту вопрос, требующий просмотра реальной web-страницы прямо сейчас, он отвечает правильно, а не угадывает или извиняется.
Это видимый пользователю результат примитива извлечения, достаточно надежного, чтобы находиться рядом с GitHub и Google Drive в сетке интеграций. Это перестает быть исследовательским проектом. Это становится базовой инфраструктурой.
Почему это важно
Полгода назад агент, которому нужно было прочитать web-страницу, представлял собой кастомную сборку. Специальные промпты, хрупкие скраперы, самописные повторные попытки, 60% успешных запросов в лучший день. Архитектура была неправильной, потому что этого слоя еще не существовало. А сайты, к которым обращался агент, продолжали меняться. Anti-bot технологии перешли от статических сигналов к поведенческим проверкам, поэтому собранные на коленке скраперы деградировали быстрее, чем команды успевали их чинить.
Теперь этот слой формируется. Dawn подхватил его и выпустил интеграцию. Мы ожидаем, что в этом году за ними последуют другие платформы агентов, и ожидаем схождения контракта, выделенный инструмент для поиска, выделенный инструмент для извлечения, управление на уровне агента, предсказуемая стоимость.
Мы в самом начале. Но именно так выглядит начало чего-то нового. Когда возможность перестает быть проектом и становится модулем.
Если вы создаете платформу агентов и хотите внедрить ту же архитектуру, напишите нам. Если вы создаете агентов на Dawn, FourA уже там. Включите его.