Bài viết

Codex và Claude Code đang đưa Vibe Coding từ một trào lưu demo thành thay đổi thực tế trong workflow của developer. Theo TechCrunch, cuộc đua mới giữa OpenAI và Anthropic không chỉ nằm ở chất lượng LLM, mà tập trung vào Agent Harness: lớp công cụ cho phép AI Agent tự đọc, sửa và kiểm tra một codebase phức tạp.
Số liệu nội bộ của OpenAI cho thấy mức chuyển dịch này đã đi khá xa: 98% kỹ sư OpenAI sử dụng Codex cho công việc hằng ngày.
Vibe Coding không đơn giản là để AI viết vài hàm boilerplate. Developer mô tả intent, sau đó agent có thể chia nhỏ multi-step tasks, tìm vị trí cần sửa trong repository, viết code, debug và refactor. Đây là hướng đi thường được gọi là AI engineering: con người tập trung nhiều hơn vào yêu cầu, kiến trúc và kiểm tra đầu ra thay vì gõ từng dòng lệnh.
Điểm khác biệt quan trọng là agent cần làm việc liên tục với trạng thái của dự án, không phải trả lời một prompt đơn lẻ. Nếu không hiểu cấu trúc codebase, quy ước của team và kết quả từ các công cụ kiểm thử, một model giỏi vẫn chỉ là chatbot biết code.
Joe Gershenson, Engineering Lead về Harness tại OpenAI, và Mario Zechner, tác giả harness mã nguồn mở Pi, đều nhấn mạnh vai trò của kiến trúc harness. Đây là lớp kết nối LLM với CLI, file system, công cụ test và luồng thao tác trong repository.
Các lựa chọn như Pi, OpenClaw và Claude Code đại diện cho hướng CLI mở, trong khi các Frontier Lab xây hệ sinh thái tích hợp sâu quanh agent của họ. Cuộc cạnh tranh vì vậy không còn là “model nào code hay hơn” trong một benchmark đơn lẻ; vấn đề là agent nào hoàn thành được nhiệm vụ dài, có nhiều ràng buộc, mà không làm hỏng dự án.
Theo tôi, cụm từ Vibe Coding dễ khiến developer đánh giá thấp phần khó nhất: kiểm soát agent. Code sinh ra nhanh hơn không đồng nghĩa code đáng tin hơn.
Với team kỹ thuật, lợi ích rõ nhất là giảm thời gian cho các việc lặp lại như refactor, lần theo lỗi và xử lý thay đổi trải rộng qua nhiều file. Nhưng AI Agent cần được đặt trong workflow có rào chắn: quyền truy cập phù hợp, test tự động và review của con người trước khi merge vào nhánh chính.
Tôi cho rằng các đội ngũ mua Codex hay Claude Code chỉ vì hiệu ứng “tự hành” sẽ thất vọng. Giá trị thực nằm ở việc thiết kế Agent Harness và CI/CD đủ chặt để agent làm được việc mà vẫn bị kiểm soát.
Nguồn tham khảo: TechCrunch
Bài viết là góc nhìn cá nhân của tác giả, mang tính tham khảo — không phải tin tức báo chí.
Đừng bỏ lỡ bài viết tiếp theo. Đăng ký để nhận trong inbox.

Tác giả
Tôi là Cường Nguyễn - Founder của AI Ops Solutions.
Tôi từng là Logistics Operations Manager và đồng sáng lập thương hiệu CATCA - #1 Shopee ngành Pet Care.