Khái niệm về harness trong phát triển AI lập trình
Trong lĩnh vực phát triển phần mềm hỗ trợ bởi trí tuệ nhân tạo, harness là phần mềm tích hợp được xây dựng xung quanh một hoặc nhiều mô hình AI để quyết định cách thức sử dụng chúng. Phần mềm này quyết định mô hình được cấp dữ liệu nào, có thể thực hiện hành động gì và cách tương tác với kho mã hiện hữu của nhà phát triển. Có thể hiểu harness như một lớp trung gian giữa mô hình AI và dự án thực tế của người lập trình.
Mặc dù mỗi sản phẩm có thể có những lựa chọn và công cụ riêng biệt, quan điểm chung của Anthropic là giữ cho harness ở trạng thái lean (gọn nhẹ), tránh xây dựng các tính năng quá phức tạp hay duy ý chí dựa trên các mô hình AI thường xuyên thay đổi nhanh chóng.
Phương thức ngữ cảnh và phân tích từ Vinay Perneti
Vinay Perneti, Phó Chủ tịch Kỹ thuật của Augment Code, cho biết nền tảng của công ty là phát triển một "context engine" (động cơ ngữ cảnh) giúp truy xuất mã nguồn liên quan thông qua embedding và hệ thống cơ sở dữ liệu vector. Họ tập trung vào việc hiểu ngữ nghĩa thay vì chỉ tìm kiếm chuỗi ký tự như phương pháp grep truyền thống được nhiều hệ thống AI khác sử dụng.
Theo Perneti, điểm mạnh của phương pháp này thể hiện rõ khi làm việc với các kho mã nguồn riêng tư dung lượng lớn – nơi mà mô hình AI chưa từng tiếp xúc trước đó và không thể dựa vào việc ghi nhớ dữ liệu công khai giống như các kho mã nguồn mở. Việc sử dụng truy xuất ngữ nghĩa giúp giảm đáng kể thời gian và số token cần thiết cho quá trình tìm kiếm và tạo ra kết quả chính xác.
Tranh luận về hiệu quả và chi phí sử dụng token
Augment Code công bố một số thử nghiệm chứng minh hệ thống của họ có thể tiết kiệm đến 33% số token so với sản phẩm Claude Code của Anthropic mà vẫn duy trì độ chính xác tương đương. Perneti nhấn mạnh rằng không phải tất cả hệ thống truy xuất đều được xây dựng như nhau, và bộ phận xử lý ngữ cảnh cùng sự tối ưu hóa tốc độ kỹ thuật đóng vai trò then chốt cho hiệu quả này.
Trong bối cảnh các mô hình AI ngày càng phát triển, có ý kiến cho rằng không nên xây dựng bất kỳ tính năng cố định nào vào harness vì chúng sẽ nhanh chóng lỗi thời. Perneti cho rằng đây là sự thật nhưng cũng cần cân nhắc yếu tố về ngữ cảnh. Mô hình AI càng thông minh không đồng nghĩa với việc nó có sẵn ngữ cảnh cần thiết cho các tác vụ phức tạp. Do đó, việc thiết kế harness hiệu quả hướng đến sự cân bằng giữa trí tuệ và ngữ cảnh là cách tiếp cận hợp lý để tối ưu chi phí và chất lượng kết quả.
Những lo ngại phổ biến của cộng đồng lập trình viên về AI
Nhiều lập trình viên vẫn tỏ ra nghi ngại về việc tin cậy các hệ thống AI trong phát triển phần mềm do lo ngại về gánh nặng nợ kỹ thuật hoặc chi phí vận hành cao của các luồng công việc tự động hóa bằng đại lý (agentic workflows). Perneti cho biết, cách làm việc lý tưởng là sự hợp tác liên tục giữa đội ngũ con người và đại lý AI chứ không phải giao hoàn toàn công việc cho máy.
Bên cạnh đó, công ty đã nhận thấy tình trạng nhân bản mã nguồn do đại lý gây ra và tổ chức các đợt tập trung xử lý giảm nợ kỹ thuật bằng cách xây dựng các đặc tả rõ ràng và để đại lý thực thi theo đó. Về chi phí token, ông đánh giá khi mô hình AI càng phát triển vượt bậc, việc phân chia tác vụ và lựa chọn mô hình phù hợp sẽ giúp doanh nghiệp tối ưu hóa chi phí đáng kể theo thời gian.
Kết luận từ các chuyên gia
Cả Anthropic và Augment Code đều đồng thuận rằng các mô hình AI sẽ tiếp tục nâng cao năng lực theo cấp số nhân trong thời gian tới, điều này làm thay đổi căn bản cách thức phát triển phần mềm cho nhiều tổ chức. Điểm khác biệt thể hiện ở cách thức quản lý ngữ cảnh: liệu nên tích hợp ngữ cảnh có cấu trúc sẵn hay tìm lại trong từng tác vụ riêng biệt, điều này sẽ ảnh hưởng tới hiệu suất và trải nghiệm người dùng cuối.
Hiện tại, câu chuyện giữa harness gọn nhẹ và harness phong phú về ngữ cảnh vẫn là cuộc tranh luận mở trong cộng đồng phát triển AI hỗ trợ lập trình.
Những điều bổ ích từ bài viết
- Các mô hình AI tiếp tục phát triển nhanh và sẽ ảnh hưởng lớn đến quy trình phát triển phần mềm trong ít nhất một năm tới.
- Harness được hiểu là phần mềm điều phối hoạt động của mô hình AI, quyết định thông tin mô hình nhận và hành động thực hiện.
- Augment Code sử dụng phương pháp truy xuất ngữ nghĩa và cơ sở dữ liệu vector tối ưu để xử lý ngữ cảnh trong kho mã nguồn lớn và riêng tư.
- Phương pháp ngữ cảnh phong phú cho thấy hiệu quả tiết kiệm token và tăng tốc độ so với cách truyền thống dựa vào hạn chế về chuỗi ký tự (grep).
- Việc kết hợp giữa trí tuệ mô hình và ngữ cảnh đầy đủ được coi là chìa khóa để đạt hiệu quả và chi phí tối ưu trong AI hỗ trợ mã hóa.
Đăng ký bản tin QMVN
Nhận tin tổng hợp mỗi sáng - chỉ những bài đáng đọc, không spam.
Bài viết được biên tập với sự hỗ trợ của công cụ trí tuệ nhân tạo (AI), tổng hợp từ các nguồn tin dẫn bên dưới và đã qua kiểm duyệt của toà soạn Quang Minh Việt Nam.








