Tất cả bài viết

FourA xuất hiện trong Dawn, và đó là sự khởi đầu của một xu hướng

Dawn đã ra mắt bản tích hợp FourA trong tuần này. Phía sau mỗi câu trả lời của agent có tương tác với web trực tiếp, giờ đây luôn có một lệnh gọi trích xuất. Dưới đây là mô hình đang dần hình thành.

Một kỹ sư mở Dawn và yêu cầu: "Scrape https://topstartups.io/ và cung cấp cho tôi 10 startup đầu tiên, bao gồm tên, mô tả, trụ sở chính, năm thành lập, URL, trang mạng xã hội, định dạng dưới dạng bảng."

Agent suy nghĩ một lúc, fetch trang, phân tích các danh sách, theo dõi hồ sơ của từng startup và trả về bảng. Mười hàng. Mọi cột đều được điền dữ liệu. Pogo, Auctor, Scalify, Omnea, Rivan, Listen Labs, Doppel, Blossom, Avoca, Traba. Các trụ sở chính nằm ở Brooklyn, New York, London, San Francisco, Remote. LinkedIn cho hầu hết các công ty. Năm thành lập từ 2020 đến 2026.

Bảng đó là kết quả của một vài lệnh gọi FourA.

Tuần này Dawn đã phát hành FourA như một công cụ cốt lõi bên trong nền tảng agent của họ. Nó nằm trong lưới tích hợp cạnh Notion, GitHub và Google Drive. Các agent được cấp quyền truy cập FourA có thể fetch một trang web công khai hoặc HTTP endpoint, phân tích response (bao gồm JSON), submit form, kiểm tra khả năng tiếp cận và trích xuất text hoặc liên kết cụ thể từ dữ liệu trả về. Mỗi agent có quyền truy cập rõ ràng hoặc không. Quản trị theo từng agent, không có chuyện mắc lỗi cấp quyền "mọi agent đều được truy cập internet".

FourA in Dawn's integrations grid, alongside OneDrive, MailJet, Linear, Jira, and Trello FourA in Dawn's integrations grid, alongside OneDrive, MailJet, Linear, Jira, and Trello

Điều thú vị không nằm ở việc một agent có thể truy cập URL. Tìm kiếm web đã tồn tại trên các nền tảng agent được một năm. Điều thú vị là mô hình của công cụ đang dần hình thành.

Tìm kiếm web và trích xuất URL là các công việc khác nhau. Tìm kiếm dành cho câu hỏi "internet nói gì về X?". Thông tin rộng, mang tính tạo sinh, ở mức độ tóm tắt. Trích xuất dành cho câu lệnh "đây là URL hoặc endpoint, fetch nó và trả về câu trả lời có cấu trúc". Các yêu cầu về độ tin cậy khác nhau, cấu trúc chi phí khác nhau, các kiểu lỗi khác nhau. Việc trộn lẫn chúng vào một công cụ tạo ra một kết quả trung bình cho cả hai.

Bản tích hợp của Dawn xử lý chúng riêng biệt. Họ có một tính năng /web-research cho công việc diện rộng. FourA dành cho công việc có mục tiêu cụ thể. Agent sử dụng đúng công cụ dựa trên những gì nó thực sự cần. Đó là xu hướng trưởng thành mà chúng ta bắt đầu thấy trên các nền tảng agent vào năm 2026: trích xuất đang dần thoát khỏi cái mác "công cụ tìm kiếm đính kèm" để trở thành một primitive độc lập.

Dành cho các kỹ sư nền tảng đang đọc bài viết này

Dawn cung cấp FourA dưới dạng tám công cụ được đặt tên, mỗi công cụ tương ứng với một mô hình trích xuất chung:

  • foura_fetch_page cho HTML và các trang text
  • foura_extract_text cho nội dung sạch dễ đọc
  • foura_extract_links cho điều hướng, form, script và style
  • foura_fetch_json cho các API endpoint
  • foura_head_url cho header, trạng thái, redirect
  • foura_probe_site cho kiểm tra khả năng tiếp cận nhanh
  • foura_submit_form cho việc submit form không cần đăng nhập
  • foura_single_request cho HTTP tùy ý

Agent sẽ chọn dựa trên yêu cầu của câu hỏi. Truy vấn topstartups ở trên đã sử dụng lần lượt ba công cụ: một fetch, một trích xuất, một bước tiếp nối.

Quá trình tích hợp đủ đơn giản để hoàn thành trong một ngày. Hai loại request nằm bên dưới: chế độ trực tiếp với chữ ký request cấp trình duyệt cho các trang web không chặn gắt gao, và chế độ proxy cho mọi thứ khác. Cả hai đều có chung cấu trúc request: URL, header và body tùy chọn, phân tích response tùy chọn. Agent sẽ chọn dựa trên những gì trang web mục tiêu yêu cầu.

Hợp đồng mà một nền tảng cung cấp cho các agent của nó thường giống như sau:

  • Một tập hợp nhỏ các tính năng (fetch / extract / probe / submit), mỗi tính năng có một định nghĩa công cụ tập trung mà agent có thể sử dụng
  • Mặc định sử dụng chế độ proxy, chuyển về trực tiếp khi có yêu cầu khắt khe về độ trễ hoặc chi phí
  • Phân quyền theo từng agent để khách hàng của nền tảng duy trì quyền quản trị
  • Việc phân tích response có cấu trúc được bộc lộ dưới dạng tham số công cụ, không bị ẩn trong system prompt

Nhưng phần mà hầu hết các kỹ sư nền tảng đánh giá thấp là những gì xảy ra ở các trường hợp ngoại lai. 80% trường hợp (một fetch thành công trong 200ms, trả về HTML sạch) là phần dễ. 20% còn lại (các trang web chặn dựa trên chữ ký request, đưa JS challenge vào response, trả về lỗi 403 trên một dải IP cloud) là yếu tố quyết định liệu agent của bạn trả về câu trả lời chính xác hay bị ảo giác. Chúng tôi đã xây dựng lại đường dẫn request chính xác cho các trường hợp ngoại lai đó, và sự khác biệt giữa "cảm giác đáng tin cậy" và "thực sự đáng tin cậy" chính là phần lớn khối lượng công việc.

Vì vậy, nếu bạn chạy một nền tảng agent và khách hàng của bạn liên tục hỏi làm thế nào agent của họ có thể "chỉ cần kiểm tra URL này", thì đó chính là mô hình bạn cần. Tài liệu nằm ở /docs. Chúng tôi rất sẵn lòng hướng dẫn bạn.

Dành cho những người khác

Bạn sẽ không thấy bất kỳ điều gì trong số này. Bạn sẽ chỉ nhận thấy rằng khi bạn hỏi một trợ lý AI một câu hỏi yêu cầu xem một trang web thực ngay lúc này, nó trả lời chính xác thay vì đoán mò hoặc xin lỗi.

Đó là kết quả hướng đến người dùng của một primitive trích xuất đủ đáng tin cậy để nằm cạnh GitHub và Google Drive trong lưới tích hợp. Nó không còn là một dự án nghiên cứu nữa. Nó bắt đầu trở thành cơ sở hạ tầng.

Tại sao điều này lại quan trọng

Sáu tháng trước, một agent cần đọc một trang web là một bản dựng tùy chỉnh. Các prompt chuyên biệt, scraper dễ hỏng, cơ chế thử lại tự viết, tỷ lệ thành công 60% vào một ngày suôn sẻ. Mô hình đó sai vì lớp giao tiếp này chưa tồn tại. Và các trang web mà agent truy cập liên tục thay đổi. Công nghệ chống bot đã chuyển từ các tín hiệu tĩnh sang kiểm tra hành vi, vì vậy các scraper chắp vá xuống cấp nhanh hơn tốc độ các team có thể vá lỗi.

Giờ đây lớp giao tiếp này đang dần hình thành. Dawn đã nắm bắt điều đó và tung ra một bản tích hợp. Chúng tôi dự đoán sẽ có thêm nhiều nền tảng agent tiếp bước trong năm nay, và chúng tôi kỳ vọng hợp đồng sử dụng sẽ hội tụ lại: một công cụ chuyên dụng cho tìm kiếm, một công cụ chuyên dụng cho trích xuất, quyền quản trị theo từng agent, chi phí có thể dự đoán.

Vẫn còn sớm. Nhưng đây là những gì thể hiện sự khởi đầu của một xu hướng. Khi một tính năng không còn là một dự án mà trở thành một công cụ tích hợp sẵn.

Nếu bạn xây dựng một nền tảng agent và muốn phát hành mô hình tương tự, hãy liên hệ với chúng tôi. Nếu bạn xây dựng các agent trên Dawn, FourA đã có sẵn. Hãy bật nó lên.