Luật AI: Con người giữ quyết định cuối cùng, nhưng thí nghiệm cho thấy người dùng thường làm theo AI trả lời sai

Theo dõi số liệu thị trường trên máy tính bảng — ảnh minh hoạ.
Một bản tiền ấn phẩm (preprint), chưa qua bình duyệt, ghi nhận người tham gia thử nghiệm trong phòng thí nghiệm thường làm theo câu trả lời sai của AI; nghiên cứu này không đo lường lợi suất đầu tư.
Theo quy định về trí tuệ nhân tạo (AI) của Việt Nam, hệ thống chỉ phân tích, dự báo hoặc khuyến nghị mang tính tham khảo, với kết quả đầu ra không được dùng làm căn cứ duy nhất cho quyết định cuối cùng, không được đề xuất đưa vào Danh mục hệ thống trí tuệ nhân tạo có rủi ro cao. Trong khi đó, một bản tiền ấn phẩm (preprint), chưa qua bình duyệt, ghi nhận rằng trong phòng thí nghiệm, những người tham khảo một trợ lý AI được cài đặt để cố ý trả lời sai đã làm theo câu trả lời đó khoảng 4 trong 5 lần. Nghiên cứu này kiểm tra khả năng suy luận, không kiểm tra các biện pháp bảo đảm an toàn theo quy định pháp luật.
Video · 0:54Xem bản tin video dưới một phútQuy định AI của Việt Nam đặt phán đoán của con người ở vị trí trung tâm. Nghị định 142/2026 nêu tiêu chí để một hệ thống không được đề xuất đưa vào Danh mục rủi ro cao: người có thẩm quyền phải xem xét độc lập, can thiệp hoặc từ chối quyết định của hệ thống, và kết quả đầu ra không được dùng làm căn cứ duy nhất.
Quy định pháp luật nói gì
Luật Trí tuệ nhân tạo số 134/2025/QH15 có hiệu lực từ ngày 1/3/2026, phân hệ thống AI thành 3 mức độ rủi ro. Hệ thống có rủi ro cao phải được thiết kế để con người có thể giám sát. Trừ các trường hợp ngoại lệ theo luật, bên triển khai phải bồi thường thiệt hại do hệ thống có rủi ro cao gây ra ngay cả khi hệ thống được vận hành đúng pháp luật; việc nhà cung cấp, bên phát triển hoặc bên khác hoàn trả khoản bồi thường phụ thuộc vào thỏa thuận. Các hệ thống trong lĩnh vực tài chính đã hoạt động trước ngày 1/3/2026 có thời hạn đến ngày 1/9/2027 để đáp ứng quy định.
Nghị định 142/2026/NĐ-CP, có hiệu lực từ ngày 1/5/2026, quy định các tiêu chí để một hệ thống dù đáp ứng tiêu chí xác định rủi ro vẫn “không được đề xuất đưa vào Danh mục”. Điểm b khoản 2 Điều 8 yêu cầu có “cơ chế kỹ thuật và quy trình vận hành bảo đảm sự giám sát thực chất của con người, theo đó người có thẩm quyền có khả năng xem xét độc lập, can thiệp, từ chối hoặc thay đổi quyết định của hệ thống trước khi quyết định đó có hiệu lực”. Điểm d cùng khoản quy định: “Chỉ thực hiện chức năng phân tích, dự báo, đánh giá, khuyến nghị mang tính tham khảo; nhà cung cấp và bên triển khai không được sử dụng kết quả đầu ra làm căn cứ duy nhất để ra quyết định cuối cùng.” Thủ tướng vẫn có thể đưa những hệ thống này vào Danh mục và nêu rõ căn cứ nếu bằng chứng kỹ thuật hoặc thực tiễn có thể đo lường cho thấy rủi ro nghiêm trọng hoặc điểm yếu có khả năng trực tiếp gây tổn hại đến quốc phòng, an ninh, trật tự, an toàn xã hội.
Quyết định 33/2026/QĐ-TTg, có hiệu lực từ ngày 15/8/2026, ban hành Danh mục hệ thống trí tuệ nhân tạo có rủi ro cao. Bản tóm tắt do Chính phủ công bố nêu 2 loại hệ thống trong lĩnh vực ngân hàng: “Hệ thống trí tuệ nhân tạo tự động thực hiện giao dịch điện tử trong hoạt động ngân hàng; Hệ thống trí tuệ nhân tạo tự động quyết định cấp tín dụng.” Bản tóm tắt không nêu hệ thống chứng khoán hay tư vấn đầu tư nào. Phụ lục kèm văn bản đã ký ở dạng ảnh quét và chưa được đọc đầy đủ.
Các thí nghiệm ghi nhận điều gì
Steven Shaw và Gideon Nave thuộc Trường Wharton gọi hiện tượng tiếp nhận kết quả AI mà hầu như không xem xét lại là “cognitive surrender”, có thể hiểu là buông xuôi nhận thức. Bản tiền ấn phẩm của họ, công bố tháng 1/2026 và chưa qua bình duyệt, trình bày 3 thí nghiệm đã đăng ký trước thiết kế nghiên cứu, với 1.372 người được tuyển tại phòng thí nghiệm của trường đại học và qua mạng. Người tham gia làm một phiên bản điều chỉnh của bài kiểm tra phản tư nhận thức (Cognitive Reflection Test), gồm những câu hỏi dễ gợi ra đáp án theo trực giác nhưng sai. Nhóm nghiên cứu thay đổi việc trợ lý AI trả lời đúng hay sai mà không cho người tham gia biết.
Trong nghiên cứu thứ nhất, người tham gia trả lời đúng 45,8% số câu hỏi khi không có AI hỗ trợ, 71,0% khi AI trả lời đúng và 31,5% khi AI trả lời sai. Ở những lượt AI trả lời sai và người tham gia có tham khảo AI, họ làm theo đáp án đó khoảng 4 trong 5 lần. Một kết quả khác cho thấy nhóm được sử dụng AI tự đánh giá mức độ tự tin cao hơn 11,7 điểm phần trăm so với nhóm không được sử dụng, dù khoảng một nửa số câu trả lời của AI là sai. Trong nghiên cứu thứ ba, việc kết hợp trả tiền và cung cấp phản hồi nâng tỷ lệ bác bỏ đáp án sai của AI đã được tham khảo từ 20,0% lên 42,3%. Trong số những người tham khảo AI ở ít nhất 2 lượt, nhóm được áp dụng biện pháp này có tỷ lệ trả lời đúng là 84,8% ở các lượt AI trả lời đúng và 40,6% ở các lượt AI trả lời sai. Các tác giả lưu ý rằng nhiệm vụ trong thí nghiệm có phạm vi hẹp và cần có thử nghiệm thực địa đối với các ứng dụng tài chính.
Một công trình khác của Grace Liu cùng các đồng nghiệp tại Carnegie Mellon, Oxford, Viện Công nghệ Massachusetts (MIT) và Đại học California tại Los Angeles (UCLA), đăng trên arXiv và tự ghi là bài hội nghị COLM 2026, tuyển 1.222 người tham gia các thử nghiệm ngẫu nhiên. Sau khi loại các trường hợp không đáp ứng tiêu chí, còn 1.060 người. Trong thí nghiệm thứ nhất, sau khoảng 10 phút được AI hỗ trợ làm toán phân số, người tham gia tự giải đúng trung bình 57% số bài trong phần kiểm tra không có AI, so với 73% ở nhóm đối chứng. Họ cũng dễ bỏ cuộc hơn, nhưng khác biệt này không có ý nghĩa thống kê trong thí nghiệm thứ hai. Các tác động được đo ngay sau đó; theo các tác giả, chưa biết chúng kéo dài bao lâu.
Hướng nghiên cứu thứ ba xem xét xu hướng mô hình AI đồng tình với người dùng. Các nhà nghiên cứu tại Anthropic nhận thấy 5 trợ lý AI thuộc thế hệ năm 2023 điều chỉnh câu trả lời theo hướng nghiêng về quan điểm mà người dùng đã nêu. Một nghiên cứu công bố trên tạp chí Science tháng 3/2026 cho thấy 11 mô hình tán thành hành động của người dùng với tần suất cao hơn 49% so với con người; người dùng cũng tin tưởng và ưa thích các mô hình hay tán đồng hơn. Nghiên cứu này xem xét lời khuyên về chuyện cá nhân, không phải tài chính.
Bằng chứng ngược chiều và một giới hạn khác
Bản tiền ấn phẩm của Conlon và Schwardmann, công bố tháng 7/2026 với 1.500 người tham gia thực hiện 30 nhiệm vụ ra quyết định, cho thấy xét trung bình, lời khuyên của AI khiến người tham gia rời xa lựa chọn mà ban đầu họ nghiêng về, dù mô hình có xu hướng chiều theo người dùng ở mức đo lường được. Xu hướng chiều theo người dùng càng mạnh thì tác động này càng yếu, và những lời khuyên chiều theo người dùng nhiều hơn không được người tham gia ưa thích hơn.
Một giới hạn riêng nằm ở chính lời khuyên. Bản tiền ấn phẩm của Ross và Lo thuộc MIT cho thấy các phương án phân bổ tài sản do mô hình ngôn ngữ đề xuất phần lớn được quyết định bởi mức độ chấp nhận rủi ro mà người dùng tự khai báo.
Mối liên hệ với đầu tư
Những nghiên cứu được xem xét trong bài không đo lường tác động của chatbot AI, tức các chương trình trò chuyện sử dụng AI, đối với giao dịch thực tế hay lợi suất đầu tư tại Việt Nam hoặc nơi khác. Brad Barber và Terrance Odean nghiên cứu 66.465 hộ gia đình Hoa Kỳ tại một công ty môi giới phí thấp trong giai đoạn 1991–1996. Họ nhận thấy nhóm giao dịch nhiều nhất đạt lợi suất 11,4% mỗi năm sau chi phí giao dịch, trong khi thị trường đạt 17,9%, và đưa ra sự tự tin quá mức như một cách lý giải. Giả thuyết rằng sự tự tin gia tăng nhờ AI sẽ dẫn đến giao dịch nhiều hơn và lợi suất thấp hơn chưa được kiểm chứng bằng những bằng chứng được xem xét trong bài.
Tổng công ty Lưu ký và Bù trừ chứng khoán Việt Nam (VSDC) ghi nhận 13.814.693 tài khoản giao dịch của cá nhân trong nước tại ngày 31/8/2026; một người có thể có nhiều tài khoản. Theo thông tin tạp chí của Bộ Tài chính đăng ngày 1/9/2026, một dự thảo nghị định sẽ cho phép công ty chứng khoán áp dụng thí điểm tư vấn đầu tư và giao dịch bằng AI trong cơ chế thử nghiệm có kiểm soát, chỉ dành cho nhà đầu tư chuyên nghiệp. Giao dịch bằng AI sẽ bị giới hạn ở 1.000 nhà đầu tư cho mỗi giải pháp và chỉ áp dụng với cổ phiếu ngoài rổ VN All Share. Văn bản này vẫn là dự thảo và chưa tìm được toàn văn.
Các cảnh báo được xem xét trong bài liên quan đến tư vấn không có giấy phép và lừa đảo. Ngày 17/4/2026, Ủy ban Chứng khoán Nhà nước cảnh báo rằng việc đưa ra khuyến nghị mua, bán hoặc nắm giữ chứng khoán trên mạng xã hội khi chưa được cấp phép là vi phạm Luật Chứng khoán. Bộ Công an liệt kê các hình thức lừa đảo sử dụng AI, công nghệ tạo hình ảnh hoặc âm thanh giả mạo (deepfake) và công nghệ giả giọng trong 25 kịch bản lừa đảo năm 2026.
The Legation Times biên soạn nội dung từ tài liệu đã công bố; nội dung tại đây không phải tư vấn pháp lý, tư vấn thuế hay khuyến nghị đầu tư. Trường hợp quý độc giả phát hiện ra sai sót, kính mời quý độc giả gửi yêu cầu đính chính. Với trường hợp liên quan đến quyền sử dụng nội dung, hãy thực hiện gửi yêu cầu gỡ bỏ.