Giải Pháp Chống Sycophancy & Role Collapse Trong Hệ Thống Multi-Agent Council
Phân tích chuyên sâu cơ chế Un-forked Adversarial Review và phân rã vai trò ngặt nghèo trong Akiflow Agent Council để triệt tiêu hiện tượng AI tự khen code và đồng thuận mù quáng.
Trong các hệ thống AI Agent hiện đại, Sycophancy (hiện tượng AI luôn đồng ý và tự khen kết quả của chính mình) và Role Collapse (sụp đổ vai trò) là hai căn bệnh kinh niên phá hủy tính đúng đắn của phần mềm.
Khi một agent đảm nhận cả việc lập kế hoạch, viết mã và tự kiểm thử, nó lập tức xây dựng một chuỗi tự hợp lý hóa (self-justification chain) và thỏa hiệp tiêu chuẩn chất lượng.
Cạm bẫy Forked Subagent: Tại sao Subagent được Fork vẫn bị lây nhiễm thiên lệch?
[CAUTION] Inherited Prompt Cache Bias: Hầu hết các framework hiện nay khi cần review sẽ Fork một Subagent từ Agent chính. Tuy nhiên, Subagent này kế thừa toàn bộ KV Cache và lịch sử suy luận của Coder Lead, dẫn đến việc nó gật đầu duyệt ("rubber-stamp approval") đoạn mã lỗi mà không hề kiểm tra lại.
Để giải quyết vấn đề này, Akiflow Agent Council giới thiệu cơ chế Un-forked Adversarial Reviewer.
Cơ chế Un-forked Adversarial Review trong Akiflow Agent Council
Nguyên lý của Un-forked Adversarial Review là cắt đứt hoàn toàn chuỗi suy luận cũ:
1. Tách biệt ngữ cảnh tuyệt đối: Spawning một Plain Subagent (agent.B5) hoàn toàn mới, không mang theo bất kỳ prompt cache nào từ luồng Coder.
2. Chỉ truyền nhận Git Diff & Closing Criteria: Subagent auditor chỉ nhận duy nhất bản mã thay đổi (Diff) và bộ tiêu chí chốt bài (coding.B3).
3. Thực thi kiểm thử thực nghiệm (Empiric Verification): Auditor bắt buộc phải chạy lệnh build/test thực tế để xác nhận kết quả trước khi đưa ra phán quyết.
Ma trận phân rã vai trò ngặt nghèo (Strict Role Isolation Matrix)
Roster 3-5 Chuyên gia độc lập: Phân định rõ ràng giữa System Architect (agent.A1), Isolated Coder (agent.B1-B4), và Adversarial Auditor (agent.B5). Không một agent nào có quyền vượt qua ranh giới vai trò của mình.