Boris Cherny: Code AI viết ra sao mà cần kiểm tra gắt gao hơn
Claude cùng các công cụ AI cần siết chặt trước khi code lên production.
TL;DR:
- Code AI làm nhanh cho prototype, nhưng chưa đủ tin cậy đưa thẳng vào production
- Bỏ qua kiểm soát dễ dẫn đến code rối rắm, khó bảo trì và đầy rủi ro bảo mật sau này
- Anthropic kết hợp linting, test, fuzzing và review để giữ chất lượng code
Tiêu đề
Boris Cherny nhấn mạnh code do AI viết muốn đưa vào production thì phải kiểm tra kỹ hơn cả code người viết. Ông lấy cách Anthropic vận hành Claude trong quy trình phát triển làm ví dụ.
Tóm tắt
Cherny cho rằng có thể dùng Claude như một hộp đen để dựng prototype nhanh, miễn là không phải sản phẩm rủi ro cao. Còn với code production thật, doanh nghiệp cần áp chuẩn nghiêm ngặt hơn, nếu không sau này sẽ phải gánh code khó bảo trì và lỗ hổng bảo mật. Tại Anthropic, họ kiểm soát qua nhiều lớp: linting, kiểm thử, để Claude tự viết thêm test, fuzzing, review tự động, quét bảo mật và refactor.
Phân tích
Ngành phần mềm đang nhận ra rằng việc khiến AI sinh code không còn là phần khó. Thách thức nằm ở chỗ đưa công cụ này vào quy trình kỹ thuật chặt chẽ.
Các công ty sẽ cần kết hợp nhiều cơ chế kiểm soát, bao gồm các lớp kiểm thử tự động, review bảo mật, rule tùy biến theo codebase và quy trình review refactor liên tục.
Cherny kể một số cách Anthropic kiểm soát Claude:
- Tính năng review code của Claude
- File CLAUDE.md để đưa quy tắc và ngữ cảnh dự án
- Điều chỉnh mức độ nỗ lực model dùng khi xử lý nhiệm vụ
- Ưu tiên model mới nhất
- Kết hợp linting, test, fuzzing và security scan trong pipeline
Cách này cho thấy Anthropic muốn Claude trở thành một phần của toàn bộ hệ thống phát triển, chứ không chỉ là công cụ chat sinh code theo lệnh. Lợi thế sau này có thể nằm ở khả năng tích hợp và kiểm soát công cụ AI tốt đến đâu, thay vì chỉ dựa vào sức suy luận thô của model.
Đánh giá tác động
Mức độ quan trọng: Trung bình Nhóm chủ đề: Công cụ cho developer, xu hướng ngành, góc nhìn kỹ thuật
Verdict: Người dùng đang ở giai đoạn đầu của narrative này nếu họ xây được pipeline kiểm định AI-native; builder và quỹ đầu tư vào hạ tầng developer sẽ hưởng lợi rõ nhất, còn trader ngắn hạn và holder dài hạn chưa có lợi thế trực tiếp.