工程师打开 Dawn 并提问:“抓取 https://topstartups.io/ 并给我前 10 家初创公司,包括名称、描述、总部、成立年份、URL、社交主页,格式化为表格。”
agent 思考片刻,获取页面,解析列表,跟踪每家初创公司的简介,并返回表格。十行数据。每列均已填充。Pogo, Auctor, Scalify, Omnea, Rivan, Listen Labs, Doppel, Blossom, Avoca, Traba。总部遍布 Brooklyn, New York, London, San Francisco, Remote。大多有 LinkedIn。成立年份为 2020 到 2026 年。
该表格是少数几次 FourA 调用的输出结果。
本周 Dawn 将 FourA 作为一等工具发布到其 agent 平台中。它位于其集成网格中,与 Notion、GitHub 和 Google Drive 并列。获得 FourA 访问权限的 agent 可以获取公共网页或 HTTP endpoint,解析 response (包括 JSON),提交表单,检查可达性,并从返回结果中提取特定文本或链接。每个 agent 都有明确的访问权限,非此即彼。基于 agent 的独立管控,避免了“所有 agent 都能访问互联网”的风险。
有趣的不是 agent 可以访问 URL。网络搜索在 agent 平台中已经存在一年了。有趣的是正在成型的工具形态。
网络搜索和 URL 提取是不同的工作。搜索针对的是“互联网上关于 X 说了什么?”。宽泛、生成式、摘要级别的信息。提取针对的是“这是 URL 或 endpoint,获取它并给我结构化的答案”。不同的可靠性要求,不同的成本特征,不同的故障模式。将它们混合在一个工具中会产生两边都不讨好的平庸结果。
Dawn 的集成将它们分开处理。他们有一个 /web-research 功能用于宽泛的任务。FourA 用于目标明确的任务。agent 根据实际需求选择合适的工具。这就是我们在 2026 年开始在 agent 平台中看到的成熟模式:提取正在从“附加搜索”演变为独立的基元。
致阅读本文的平台工程师
Dawn 将 FourA 暴露为八个命名工具,每个工具映射到一个常见的提取模式:
foura_fetch_page用于 HTML 和文本页面foura_extract_text用于干净可读的内容foura_extract_links用于导航、表单、脚本和样式foura_fetch_json用于 API endpointsfoura_head_url用于 headers、状态和重定向foura_probe_site用于快速可达性检查foura_submit_form用于免登录表单提交foura_single_request用于任意 HTTP 请求
agent 根据问题需求进行选择。上述 topstartups 查询依次使用了其中三个:获取、提取、跟进。
该集成非常直接,一天即可完成。底层提供两种 request 模式:针对没有严格拦截的站点提供带有浏览器级别 request 签名的 direct 模式,以及针对所有其他情况的 proxy 路由模式。两者共享相同的 request 形式:URL,可选的 headers 和 body,可选的 response 解析。agent 根据目标站点的要求进行选择。
平台提供给其 agent 的契约通常如下所示:
- 一小部分功能 (fetch / extract / probe / submit),每个功能都有 agent 可以调用的专注工具定义
- 默认使用 proxy 模式,在对延迟或成本敏感时回退到 direct 模式
- 独立的 agent 权限控制,以便平台的客户保留治理权
- 结构化的 response 解析作为工具参数公开,而不是隐藏在 system prompt 中
但大多数平台工程师低估的是长尾效应中发生的事情。80% 的情况 (获取在 200ms 内成功,返回干净的 HTML) 是容易处理的部分。另外 20% (基于 request 签名进行拦截、在 response 中竞争 JS 挑战、在云端 IP 块上返回 403 的站点) 则决定了你的 agent 是提供正确答案还是幻觉内容。我们专门 针对这个长尾重建了 request 路径,“感觉可靠”和“真正可靠”之间的差距占据了大部分工作量。
因此,如果你运营一个 agent 平台,而你的客户不断询问他们的 agent 如何才能“简单检查这个 URL”,这就是解决方案。文档位于 /docs。我们很乐意为你提供指导。
致其他读者
你不会看到这些底层细节。你只会注意到,当你问 AI 助手一个需要立即查看真实网页的问题时,它能正确作答,而不是猜测或道歉。
这是提取基元达到足够可靠并在集成网格中与 GitHub 和 Google Drive 并列后,面向用户的成果。它不再是一个研究项目。它开始成为基础设施。
为什么这很重要
六个月前,需要读取网页的 agent 必须定制开发。定制的 prompts,脆弱的抓取工具,手动编写的重试逻辑,在状态良好的一天也只有 60% 的成功率。模式不对,因为这一层还不存在。而且 agent 访问的站点在不断变化。反机器人技术 从静态信号转变为行为检查,因此临时修补的抓取工具的退化速度快于团队打补丁的速度。
现在这一层正在形成。Dawn 抓住了它并发布了集成。我们预计今年会有更多 agent 平台跟进,我们预计契约将会趋同:专用于搜索的工具,专用于提取的工具,独立的 agent 管控,可预测的成本。
我们仍处于早期阶段。但这就是某种趋势兴起的样貌。当一项功能不再是一个项目,而开始成为一个插件。
如果你开发 agent 平台并希望发布相同的模式,请联系我们。如果你在 Dawn 上构建 agent,FourA 已经准备就绪。开启即可。