OpenAI đang giới thiệu một kỹ thuật suy luận mới gọi là “độ sâu hồi quy” (recurrent depth) cho mô hình Astra của mình. Kỹ thuật này cho phép mô hình hoạt động ngoài tư duy tuần tự thông thường, khiến chuỗi suy nghĩ của nó khó theo dõi hơn. Điều này đã gây ra lo ngại sâu sắc trong cộng đồng các chuyên gia an toàn trí tuệ nhân tạo (AI).
Theo bản tin của The Information, “độ sâu hồi quy”, còn được gọi là “hồi quy mờ đục” (opaque recurrence), có thể làm giảm khả năng giám sát quá trình suy luận của mô hình. Buck Shlegeris, CEO của Redwood, bày tỏ quan ngại rằng nếu OpenAI tiếp tục phát triển kỹ thuật này, nó có thể phá hủy hoàn toàn khả năng giám sát chuỗi suy nghĩ (Chain of Thought – CoT).
Zvi Mowshowitz, một nhà vận động lâu năm về an toàn AI, thậm chí còn cho rằng luật pháp có thể cần thiết để ngăn chặn một “cuộc đua xuống đáy” giữa các phòng thí nghiệm AI. Ông nhấn mạnh kỹ thuật này giống như “chơi với lửa”, có nguy cơ phá vỡ sự cam kết về tính minh bạch và khả năng giám sát mà các công ty như OpenAI và Anthropic đã cố gắng duy trì.
Thông thường, chuỗi suy nghĩ của một mô hình AI cung cấp các bước tuần tự mà nó thực hiện để giải quyết vấn đề, giúp theo dõi các hành vi sai lệch hoặc không nhất quán. Tuy nhiên, với hồi quy mờ đục, mô hình xử lý cùng một truy vấn nhiều lần trong một vòng lặp, để lại ít dấu vết rõ ràng hơn.
Dù vậy, OpenAI khẳng định việc sử dụng kỹ thuật này trên mô hình Astra vẫn còn hạn chế và chuỗi suy nghĩ dự kiến vẫn có thể đọc được. Công ty cũng nhấn mạnh cam kết của mình đối với các hệ thống giám sát chuỗi suy nghĩ toàn diện như một phần của kế hoạch an toàn trong tương lai. Jakub Pachocki, nhà khoa học trưởng tại OpenAI, đã nhấn mạnh tầm quan trọng của việc duy trì giám sát chuỗi suy nghĩ như một mục tiêu cốt lõi trong nghiên cứu hiện tại.
Tuy nhiên, các chuyên gia vẫn lo ngại rằng hồi quy mờ đục có thể làm cho việc giám sát suy luận AI trở nên khó khăn hơn, đặc biệt khi kỹ thuật này ngày càng được sử dụng rộng rãi. Theo một báo cáo sau đó, cả Anthropic và Google DeepMind được cho là cũng đang thảo luận về kỹ thuật tương tự. Ryan Greenblatt, nhà khoa học trưởng tại Redwood Research, cảnh báo rằng kỹ thuật này có thể phát triển nhanh chóng, khiến quá trình suy luận của mô hình hoàn toàn nằm ngoài tầm kiểm soát hữu hình.
Bài báo này, theo TechCrunch, nêu bật những thách thức liên tục trong việc cân bằng giữa sự đổi mới công nghệ AI và việc đảm bảo an toàn, có trách nhiệm.



