全部文章

FourA 亮相 Dawn,这预示着新趋势的兴起

Dawn 本周发布了 FourA 集成。现在,agent 每次访问实时网络的回答背后,都有一个提取调用。以下是正在形成的新模式。

工程师打开 Dawn 并提问:“抓取 https://topstartups.io/ 并给我前 10 家初创公司,包括名称、描述、总部、成立年份、URL、社交主页,格式化为表格。”

agent 思考片刻,获取页面,解析列表,跟踪每家初创公司的简介,并返回表格。十行数据。每列均已填充。Pogo, Auctor, Scalify, Omnea, Rivan, Listen Labs, Doppel, Blossom, Avoca, Traba。总部遍布 Brooklyn, New York, London, San Francisco, Remote。大多有 LinkedIn。成立年份为 2020 到 2026 年。

该表格是少数几次 FourA 调用的输出结果。

本周 Dawn 将 FourA 作为一等工具发布到其 agent 平台中。它位于其集成网格中,与 Notion、GitHub 和 Google Drive 并列。获得 FourA 访问权限的 agent 可以获取公共网页或 HTTP endpoint,解析 response (包括 JSON),提交表单,检查可达性,并从返回结果中提取特定文本或链接。每个 agent 都有明确的访问权限,非此即彼。基于 agent 的独立管控,避免了“所有 agent 都能访问互联网”的风险。

FourA in Dawn's integrations grid, alongside OneDrive, MailJet, Linear, Jira, and Trello FourA in Dawn's integrations grid, alongside OneDrive, MailJet, Linear, Jira, and Trello

有趣的不是 agent 可以访问 URL。网络搜索在 agent 平台中已经存在一年了。有趣的是正在成型的工具形态。

网络搜索和 URL 提取是不同的工作。搜索针对的是“互联网上关于 X 说了什么?”。宽泛、生成式、摘要级别的信息。提取针对的是“这是 URL 或 endpoint,获取它并给我结构化的答案”。不同的可靠性要求,不同的成本特征,不同的故障模式。将它们混合在一个工具中会产生两边都不讨好的平庸结果。

Dawn 的集成将它们分开处理。他们有一个 /web-research 功能用于宽泛的任务。FourA 用于目标明确的任务。agent 根据实际需求选择合适的工具。这就是我们在 2026 年开始在 agent 平台中看到的成熟模式:提取正在从“附加搜索”演变为独立的基元。

致阅读本文的平台工程师

Dawn 将 FourA 暴露为八个命名工具,每个工具映射到一个常见的提取模式:

  • foura_fetch_page 用于 HTML 和文本页面
  • foura_extract_text 用于干净可读的内容
  • foura_extract_links 用于导航、表单、脚本和样式
  • foura_fetch_json 用于 API endpoints
  • foura_head_url 用于 headers、状态和重定向
  • foura_probe_site 用于快速可达性检查
  • foura_submit_form 用于免登录表单提交
  • foura_single_request 用于任意 HTTP 请求

agent 根据问题需求进行选择。上述 topstartups 查询依次使用了其中三个:获取、提取、跟进。

该集成非常直接,一天即可完成。底层提供两种 request 模式:针对没有严格拦截的站点提供带有浏览器级别 request 签名的 direct 模式,以及针对所有其他情况的 proxy 路由模式。两者共享相同的 request 形式:URL,可选的 headers 和 body,可选的 response 解析。agent 根据目标站点的要求进行选择。

平台提供给其 agent 的契约通常如下所示:

  • 一小部分功能 (fetch / extract / probe / submit),每个功能都有 agent 可以调用的专注工具定义
  • 默认使用 proxy 模式,在对延迟或成本敏感时回退到 direct 模式
  • 独立的 agent 权限控制,以便平台的客户保留治理权
  • 结构化的 response 解析作为工具参数公开,而不是隐藏在 system prompt 中

但大多数平台工程师低估的是长尾效应中发生的事情。80% 的情况 (获取在 200ms 内成功,返回干净的 HTML) 是容易处理的部分。另外 20% (基于 request 签名进行拦截、在 response 中竞争 JS 挑战、在云端 IP 块上返回 403 的站点) 则决定了你的 agent 是提供正确答案还是幻觉内容。我们专门 针对这个长尾重建了 request 路径,“感觉可靠”和“真正可靠”之间的差距占据了大部分工作量。

因此,如果你运营一个 agent 平台,而你的客户不断询问他们的 agent 如何才能“简单检查这个 URL”,这就是解决方案。文档位于 /docs。我们很乐意为你提供指导。

致其他读者

你不会看到这些底层细节。你只会注意到,当你问 AI 助手一个需要立即查看真实网页的问题时,它能正确作答,而不是猜测或道歉。

这是提取基元达到足够可靠并在集成网格中与 GitHub 和 Google Drive 并列后,面向用户的成果。它不再是一个研究项目。它开始成为基础设施。

为什么这很重要

六个月前,需要读取网页的 agent 必须定制开发。定制的 prompts,脆弱的抓取工具,手动编写的重试逻辑,在状态良好的一天也只有 60% 的成功率。模式不对,因为这一层还不存在。而且 agent 访问的站点在不断变化。反机器人技术 从静态信号转变为行为检查,因此临时修补的抓取工具的退化速度快于团队打补丁的速度。

现在这一层正在形成。Dawn 抓住了它并发布了集成。我们预计今年会有更多 agent 平台跟进,我们预计契约将会趋同:专用于搜索的工具,专用于提取的工具,独立的 agent 管控,可预测的成本。

我们仍处于早期阶段。但这就是某种趋势兴起的样貌。当一项功能不再是一个项目,而开始成为一个插件。

如果你开发 agent 平台并希望发布相同的模式,请联系我们。如果你在 Dawn 上构建 agent,FourA 已经准备就绪。开启即可。