
Nói thật với anh em, dạo này lướt đâu cũng thấy các giáo chủ AI "lùa gà" về chuyện bot viết code thay thế dev. Nhưng vứt thử con AI xịn nhất vào một project legacy ngập ngụa code rác xem, nó chả "ngáo ngơ" rồi quay xe gấp ấy chứ. Hôm nay rảnh rỗi ngồi hóng drama trên Hacker News, tôi lụm được quả repository cực kỳ thực tế của mấy pháp sư Humanlayer mang tên SlopCodeBench - nơi mang Claude Opus ra "hành xác" để xem sức chịu đựng của AI tới đâu.
Để tôi giải thích nhanh cho anh em lười đọc. Bình thường, mấy cái bài benchmark AI toàn bắt tụi nó viết thuật toán LeetCode gọn gàng, sạch sẽ. Đời không như là mơ, code thực tế đi làm thuê của anh em mình phần lớn là... "slop code" (code rác, code thừa, copy-paste vô tội vạ).
Thế là mấy ông thần bên Humanlayer nghĩ ra trò:
Đúng như dự đoán, quả benchmark này vừa lên sóng đã nhận về hơn 250 upvote cùng hàng tá bình luận "bốc lửa" từ các lão quái giới lập trình:
Nhìn từ góc độ của Coding4Food, vụ này không chỉ để tấu hài. Nó chỉ ra một thực tế phũ phàng: Garbage in, Garbage out.
Dù AI của các ông có là Opus hay GPT-5 đi chăng nữa, nếu quăng cho nó một đống rác vô định hình, kết quả trả về sẽ là một đống rác công nghệ cao hơn. Muốn bắt AI làm việc hiệu quả, các ông phải học cách "gạn đục khơi trong", lọc bớt thông tin thừa trước khi mớm cho nó nuốt. Đó chính là lý do vì sao kỹ năng Context Engineering dạo này đang hot xình xịch.
Nguồn: Hacker News
Thử thách Claude Opus dọn dẹp đống code rác (slop code) bằng kỹ nghệ ngữ cảnh siêu cấp. Kết quả khiến anh em dev dạo vừa mừng vừa lo.