Инженер отваря Dawn и пита: "Извлечи данни от https://topstartups.io/ и ми дай първите 10 стартъпа, включително имена, описания, централа, година на основаване, URL адреси, социални страници, форматирани като таблица."
Агентът мисли за момент, изтегля страницата, анализира списъците, проследява профила на всеки стартъп и връща таблицата. Десет реда. Всяка колона е попълнена. Pogo, Auctor, Scalify, Omnea, Rivan, Listen Labs, Doppel, Blossom, Avoca, Traba. Централи в Brooklyn, New York, London, San Francisco, Remote. LinkedIn за повечето. Година на основаване от 2020 до 2026.
Тази таблица е резултат от няколко заявки към FourA.
Тази седмица Dawn пусна FourA като първокласен инструмент в своята платформа за агенти. Той се намира в мрежата им за интеграции до Notion, GitHub и Google Drive. Агентите с достъп до FourA могат да изтеглят публична уеб страница или HTTP endpoint, да анализират отговора (включително JSON), да изпратят форма, да проверят достъпността и да извлекат конкретен текст или връзки от получения резултат. Всеки агент има изричен достъп или няма. Управление на ниво агент, без опасности от типа "всеки агент получава достъп до интернет".
Интересното не е, че агент може да достъпи URL адрес. Търсенето в уеб съществува в платформите за агенти от година. Интересното е формата на инструмента, който се появява.
Уеб търсенето и извличането на URL са различни задачи. Търсенето е за "какво казва интернет за X?". Широка, генеративна, обобщена информация. Извличането е за "ето този URL адрес или endpoint, изтегли го и ми дай структуриран отговор". Различни изисквания за надеждност, различни профили на разходите, различни режими на отказ. Смесването им в един инструмент води до посредствен резултат и за двете.
Интеграцията на Dawn ги третира като отделни неща. Те имат функционалност /web-research за общата задача. FourA е за целевата задача. Агентът посяга към правилния инструмент въз основа на това, от което реално се нуждае. И това е моделът на съзряване, който започваме да виждаме в платформите за агенти през 2026 г. (извличането преминава от "добавка към търсенето" в собствен примитив).
За инженера на платформата, който чете това
Dawn предоставя FourA като осем именувани инструмента, всеки от които съответства на общ модел за извличане:
foura_fetch_pageза HTML и текстови странициfoura_extract_textза чисто четимо съдържаниеfoura_extract_linksза навигация, форми, скриптове и стиловеfoura_fetch_jsonза API endpointsfoura_head_urlза headers, статус, пренасочванияfoura_probe_siteза бързи проверки на достъпносттаfoura_submit_formза изпращане на форми без входfoura_single_requestза произволен HTTP
Агентът избира въз основа на това, което изисква въпросът. Заявката topstartups по-горе използва три от тях последователно (изтегляне, извличане, последващо действие).
Интеграцията е достатъчно лесна, за да се направи за един ден. Отдолу стоят два вида заявки (директен режим с request сигнатура от ниво браузър за сайтове без агресивно блокиране и режим с proxy рутиране за всичко останало). И двата споделят една и съща форма на заявката (URL, незадължителни headers и body, незадължителен анализ на response). Агентът избира въз основа на това, което изисква целевият сайт.
Договорът, който една платформа предлага на своите агенти, обикновено изглежда така:
- Малък набор от възможности (изтегляне / извличане / сондаж / изпращане), всяка с фокусирана дефиниция на инструмента, до който агентът има достъп
- По подразбиране proxy режим, с преминаване към директен, когато латентността или разходите имат значение
- Разрешения на ниво агент, така че клиентите на платформата да запазят контрола
- Структуриран анализ на отговора, изложен като параметър на инструмента, а не скрит в системен prompt
Но частта, която повечето инженери на платформи подценяват, е какво се случва в края. Случаят от 80% (изтеглянето успява за 200ms, връща чист HTML) е лесната половина. Останалите 20% (сайтове, които блокират въз основа на request сигнатура, които вмъкват JS предизвикателство в отговора, които връщат грешка 403 при облачен IP блок) определят дали вашият агент ще достави правилен или халюциниран отговор. Ние преустроихме пътя на нашата заявка точно за тези случаи и разликата между "изглежда надеждно" и "наистина надеждно" е по-голямата част от работата.
Така че, ако управлявате платформа за агенти и клиентите ви продължават да питат как техните агенти биха могли "просто да проверят този URL", това е моделът. Документацията е на /docs. Ще се радваме да ви преведем през нея.
За всички останали
Вие няма да видите нищо от това. Просто ще забележите, че когато зададете на AI асистент въпрос, който изисква разглеждане на реална уеб страница в момента, той отговаря правилно, вместо да гадае или да се извинява.
Това е ориентираният към потребителя резултат от един примитив за извличане, достатъчно надежден, за да живее до GitHub и Google Drive в мрежа за интеграции. Той престава да бъде изследователски проект. Той се превръща в инфраструктура.
Защо това има значение
Преди шест месеца агент, който трябваше да прочете уеб страница, изискваше персонализирана разработка. Специфични prompt-ове, чупливи скрапери, ръчно написани опити за повторение, 60% успеваемост в добър ден. Подходът беше грешен, защото слоят все още не съществуваше. А сайтовете, към които агентът се обръщаше, продължаваха да се променят. Анти-бот технологиите преминаха от статични сигнали към поведенчески проверки, така че скалъпените скрапери се разваляха по-бързо, отколкото екипите можеха да ги поправят.
Сега слоят се оформя. Dawn го взе и пусна интеграция. Очакваме повече платформи за агенти да последват този пример през тази година и очакваме договорът да се уеднакви (специализиран инструмент за търсене, специализиран инструмент за извличане, управление на ниво агент, предвидими разходи).
В началото сме. Но ето как изглежда възходът на нещо ново. Когато една възможност престане да бъде проект и се превърне в готов компонент.
Ако изграждате платформа за агенти и искате да предоставите същия модел, пишете ни. Ако създавате агенти в Dawn, FourA вече е там. Просто го включете.