Chế độ Hội đồng: câu trả lời AI không thiên vị nhờ xếp hạng ẩn danh giữa các mô hình
Mọi cách kết hợp câu trả lời AI đều có vấn đề thiên vị. Yêu cầu các mô hình thảo luận, chúng sẽ trôi dạt về phía đồng thuận. Yêu cầu một mô hình đánh giá các mô hình khác, nó sẽ thiên vị những câu trả lời nghe giống chính nó. Hỏi một con người, chúng ta sẽ chọn thương hiệu mà mình đã tin tưởng sẵn.
Chế độ Hội đồng loại bỏ tên gọi. Mỗi mô hình trả lời câu hỏi của bạn một cách độc lập, sau đó nhận các câu trả lời khác đã được ẩn danh — Câu trả lời A, B, C — và xếp hạng chúng thuần túy dựa trên chất lượng. Một mô hình chủ tọa tổng hợp câu trả lời cuối cùng từ nội dung được xếp hạng cao nhất. Không mô hình nào biết câu trả lời nào là của ai, kể cả của chính mình.
Một phiên Hội đồng diễn ra như thế nào
- Vòng 1 — Trả lời độc lập: mỗi tác nhân tự trả lời câu hỏi của bạn, không nhìn thấy các tác nhân khác. Không có hiệu ứng neo, không có tư duy tập thể.
- Vòng 2 — Xếp hạng ẩn danh: mỗi tác nhân nhận toàn bộ tập câu trả lời đã bị xóa tên và phải xếp hạng chúng từ tốt nhất đến kém nhất theo độ chính xác và tính hữu ích, giải thích lý do cho từng vị trí — một cách trung thực, kể cả với câu trả lời có thể là của chính nó.
- Tổng hợp — Chủ tọa: một lượt cuối cùng tổng hợp các bảng xếp hạng, lấy lập luận được xếp hạng mạnh nhất, loại bỏ những điểm yếu, và đưa ra một câu trả lời có thể bảo vệ được, đồng thời nêu rõ câu trả lời nào được hội đồng xếp hạng cao nhất.
Vì sao tính ẩn danh làm thay đổi kết quả
Các mô hình, giống như con người, có xu hướng dễ dãi hơn một cách đo lường được đối với phong cách của chính mình: khi thấy các câu trả lời có gắn nhãn, một mô hình có xu hướng đánh giá quá cao đầu ra giống với cách diễn đạt của chính nó, và các thương hiệu phổ biến được hưởng hiệu ứng hào quang. Việc loại bỏ danh tính buộc việc xếp hạng chỉ dựa vào thứ duy nhất còn lại — nội dung.
Ý tưởng này bắt nguồn từ thí nghiệm llm-council của Andrej Karpathy, cho thấy rằng khi các mô hình xếp hạng câu trả lời ẩn danh của nhau, chúng thường tạo ra một phán quyết tập thể tốt hơn bất kỳ mô hình đơn lẻ nào — và đôi khi xếp câu trả lời của đối thủ cao hơn câu trả lời của chính mình.
Hội đồng và Tranh biện: khi nào dùng cái nào
Tranh biện mang tính đối kháng và tương tác — phù hợp nhất khi câu hỏi có những đánh đổi thực sự cần bàn luận (định giá, kiến trúc, chiến lược) và bạn muốn chứng kiến các lập trường va chạm nhau.
Hội đồng mang tính độc lập và được đánh giá — phù hợp nhất khi bạn muốn một câu trả lời đáng tin cậy duy nhất cho một câu hỏi khó mà không có sự ồn ào của tranh luận trực tiếp: một câu hỏi kỹ thuật phức tạp, một lời giải thích y tế hoặc pháp lý cần kiểm tra tính hợp lý, một câu hỏi kiểu 'điều gì thực sự đúng ở đây'.
- Tranh biện: các lập trường phát triển bằng cách công kích lẫn nhau, sự đồng thuận được theo dõi theo từng vòng
- Hội đồng: các lập trường hình thành độc lập, chất lượng được đánh giá ẩn danh
- Tranh biện: tuyệt vời cho các đánh đổi và quyết định
- Hội đồng: tuyệt vời cho độ chính xác trong các câu hỏi khó
- Cả hai: đều kết thúc bằng một phán quyết tổng hợp mà bạn có thể xuất ra
Thiết lập một hội đồng tốt
Sử dụng 3–5 tác nhân từ các nhà cung cấp thực sự khác nhau — tính ẩn danh chỉ mang lại lợi ích khi các câu trả lời đến từ những 'bộ óc' khác nhau. Đặt một mô hình mạnh vào vị trí đầu tiên: nó cũng đóng vai trò chủ tọa viết bản tổng hợp cuối cùng. Chế độ Hội đồng là tính năng Pro (Pro có giá 20 đô la/tháng). Mọi gói đều bao gồm các mô hình tích hợp sẵn và tín dụng hằng tháng, nên bạn có thể sử dụng mà không cần bất kỳ khóa nào; tùy chọn, hãy kết nối khóa API của riêng bạn thì bạn thanh toán trực tiếp cho nhà cung cấp, tiêu tốn 0 tín dụng.
Câu hỏi thường gặp
Một mô hình có thể nhận ra câu trả lời của chính mình dù đã được ẩn danh không?
Đôi khi, thông qua phong cách viết — nhưng nó không biết tác giả của các câu trả lời khác, và hướng dẫn xếp hạng yêu cầu sự trung thực ngay cả với câu trả lời của chính mình. Trên thực tế, các mô hình thường xuyên xếp hạng câu trả lời của đối thủ cao hơn câu trả lời của chính mình.
Vì sao Hội đồng chỉ dành cho Pro?
Nó chạy mỗi tác nhân hai lần (trả lời + toàn bộ lượt xếp hạng) cộng thêm bản tổng hợp của chủ tọa, khiến đây là chế độ tốn nhiều token và điều phối nhất. Pro cũng mở khóa tối đa 10 tác nhân cho các hội đồng lớn hơn.
Ý tưởng này đến từ đâu?
Từ thí nghiệm mã nguồn mở llm-council của Andrej Karpathy (2024), chứng minh việc xếp hạng ẩn danh giữa các nhà cung cấp khác nhau. Chế độ Hội đồng là triển khai sản xuất của chúng tôi cho cơ chế đó, với bản tổng hợp của chủ tọa và các phán quyết có thể xuất ra.
Gói miễn phí · dùng khóa API của bạn · 15 ngôn ngữ