SAGE Router: định tuyến lại cho mạng A2A khi đang chạy
Khi một nhiệm vụ multi-agent đang chạy dở thì agent nào nên tiếp tục, ai nên hỗ trợ, hay có nên chuyển hẳn sang agent khác? SAGE Router trả lời đúng câu hỏi đó, và đó là lý do nó khác với đa số framework điều phối agent.
SAGE Router là gì
SAGE là viết tắt của State-Aware Graph Exchange — tầng quyết định nằm giữa lớp khám phá agent và lớp thực thi nhiệm vụ. Repo wang2122/sprix-sage-router viết bằng Python 3.10+, giấy phép MIT, là kết quả nghiên cứu mã nguồn mở của Sprix AI, tạo ngày 18/08/2026 và đạt khoảng 4.259 sao.
Điểm khác biệt nằm ở chỗ thời điểm. Agent discovery cho bạn biết những agent nào tồn tại. SAGE giải quyết câu hỏi khó hơn nhiều khi việc thực thi đã bắt đầu: với trạng thái hiện tại thì nên đi tiếp theo hướng nào.
Ba lối định tuyến của SAGE
Toàn bộ logic của SAGE gói trong ba lựa chọn, cùng chia sẻ một hàm mục tiêu để so sánh công bằng:
| Lối | Ai giữ quyền sở hữu | Dùng khi |
|---|---|---|
| SELF | Agent đang giữ | Năng lực sẵn có và ngữ cảnh tích luỹ đã đủ |
| COLLABORATE | Agent đang giữ, có thêm đồng đội | Một nhóm nhỏ bổ sung cho phần yêu cầu còn thiếu |
| HANDOFF | Agent khác nhận toàn quyền | Lợi thế chuyên môn lớn hơn tổn thất khi chuyển ngữ cảnh |
Ba lối dùng chung một không gian hành động, cùng ràng buộc quyền, ngân sách và hạn chót. Điểm này quan trọng: bất kỳ phương án nào của SAGE vi phạm giới hạn cũng bị lo, chứ không phải lối nào cũng được ưu tiên sẵn.
Vì sao lại là định tuyến lại theo checkpoint
Đây là phần khó nhất của SAGE, cũng là chỗ đáng để đọc kỹ. Router ước lượng giá trị phần việc đã xong bằng cách tính cả bốn yếu tố:
- Yêu cầu đã hoàn thành trong DAG.
- Artifact có thể tái dùng được hay không.
- Chất lượng một phần đã quan sát được.
- Công việc còn lại và lỗi đã gặp.
Nhờ vậy SAGE biết chính xác agent mới phải làm lại bao nhiêu việc, thay vì giả định phải chạy lại từ đầu. Với một DAG nhiều nhánh, con số này chênh lệnh rất lớn — nên quyết định bỏ hay giữ agent cũ cũng chênh lệnh theo.
Bằng chứng theo từng yêu cầu
Router của SAGE không dùng một điểm uy tín chung cho mọi agent. Độ tin cậy được theo dõi theo từng agent và theo từng yêu cầu, vì một agent giỏi tóm tắt không có nghĩa nó giỏi viết code.
Đánh giá lại độc lập
Có một evaluator riêng phát lại các checkpoint, chấm điểm tái dùng artifact, chi phí phát sinh, độ trễ hồi phục, công việc lãng phí và chất lượng cuối — mà không gọi hàm quyết định của SAGE. Đây là cách kiểm chứng một tuyên bố kiến trúc: tách người ra quyết định khỏi người chấm điểm.
Khi nào đáng cài SAGE
Repo tự đánh dấu trạng thái là Research Preview, nên hãy hiểu đây là thứ để đọc, học và thử trên bài toán nghiên cứu — chưa phải thứ để đưa thẳng vào đường chính của sản phẩm.
Hợp lý khi bạn đang xây mạng A2A thật, nhiệm vụ chạy lâu, và chi phí chạy lại từ đầu đủ để SAGE phải cân nhắc. Nếu tác vụ chạy vài giây thì toàn bộ phần logic checkpoint trở nên thừa.
Repo có sẵn tài liệu tích hợp A2A, hướng dẫn vận hành, thuật toán chi tiết và phần liên hệ nghiên cứu. Nếu bạn đang xây kiến trúc agent nhiều tác tử, tôi nghĩ nên đọc ALGORITHM.md và RELATED_WORK.md trước khi cài.
Muốn nắm nền tảng điều phối multi-agent trước khi đi sâu, xem bài các mô hình điều phối agent và AOS Community Edition.
Kết luận
Điều đáng nhớ ở SAGE không phải ba nhãn SELF, COLLABORATE, HANDOFF, mà là cách nó biến một câu hỏi vận hành mơ hồ thành một hàm mục tiêu có thể so sánh và kiểm chứng. Đó là hướng tiếp cận đúng cho bài toán định tuyến.
Nếu bạn đang theo dõi chủ đề mạng agent, xem thêm toàn bộ bài viết trên chuanweb.com.
Bài cuối ngày 27/9: agent skill biến lời thoại thành thước phim điện ảnh. 🎬