Tôi vẫn nhớ cái cảm giác lạc bước vào mê cung ICO năm 2017, đọc từng whitepaper như một cuốn tiểu thuyết phiêu lưu. Khi đó, tôi tin vào những câu chuyện về 'siêu máy tính' và 'Internet of Things' hơn là công nghệ đằng sau. Bây giờ, khi đọc một bài báo từ Crypto Briefing với tựa đề 'Companies test Codex, but Claude Code remains the preferred choice among engineers', tôi lại có cùng một cảm giác ấy. Một câu chuyện được kể rất hay, nhưng thiếu đi lớp vỏ kỹ thuật và chiều sâu phân tích. Là một kẻ đã từng săn lùng những câu chuyện thị trường suốt 19 năm, tôi biết rằng đằng sau mỗi token là một câu chuyện chưa kể, và đằng sau mỗi bản tin PR cũng vậy.
Hãy bắt đầu với bối cảnh. Cuộc chiến AI coding tools đang nóng lên từng ngày. Hai gã khổng lồ là Anthropic với Claude Code và OpenAI với Codex (được tích hợp trong GitHub Copilot) đang giành giật trái tim của các kỹ sư phần mềm. Bài báo kia nói rằng Claude Code đang là lựa chọn ưa thích, đặc biệt cho các tác vụ phức tạp, đòi hỏi nhiều ngữ cảnh. Nghe có vẻ hợp lý, nhưng nếu bạn là một kẻ đã từng nếm trải mùa hè DeFi cháy bỏng năm 2020, bạn sẽ biết rằng những lời tuyên bố như vậy thường chỉ là phần nổi của tảng băng, giống như yield farming vậy: lợi nhuận hấp dẫn nhưng rủi ro tiềm ẩn thì vô hình.

Đi sâu vào phân tích cốt lõi, bài viết đó không hề đưa ra một bằng chứng kỹ thuật nào. Đây là một red flag lớn. Nó giống như một báo cáo thị trường nói rằng 'Ethereum sẽ thống trị' mà không nhắc đến TVL, gas fees hay số lượng developer. Trong giới phân tích, một tuyên bố không có dữ liệu chỉ là một ý kiến. Dựa trên kinh nghiệm audit của tôi từ năm 2005 khi còn là một sinh viên Khoa học Dữ liệu, tôi biết rằng câu chuyện về Claude Code so với Codex không chỉ đơn giản là 'cái nào được ưa thích hơn'. Nó nằm ở cấp độ kiến trúc mô hình và cách thức tương tác.
Claude Code dựa trên các model Claude 3 (Opus/Sonnet) của Anthropic. Một trong những lợi thế kỹ thuật rõ ràng nhất là khả năng xử lý ngữ cảnh siêu dài lên tới 200K tokens. Điều này cho phép nó 'đọc' và hiểu toàn bộ một dự án lớn, từ thư mục gốc cho đến các file cấu hình. Ngược lại, Codex (dùng GPT-4) mạnh về code generation nhanh, nhưng với các tác vụ yêu cầu hiểu sâu về multi-file dependencies và kiến trúc tổng thể, nó thường bị giới hạn bởi cửa sổ ngữ cảnh nhỏ hơn. Có một thử nghiệm nho nhỏ: hãy yêu cầu Claude Code và Copilot (Codex) cùng xây dựng một hợp đồng thông minh DeFi hoàn chỉnh từ đầu, tích hợp nhiều module. Claude Code có thể tự động tạo ra cấu trúc thư mục, viết test, và thậm chí deploy. Codex thì sao? Nó có thể viết từng hàm riêng lẻ, nhưng việc kết nối chúng lại thành một hệ thống đòi hỏi bạn phải 'nhúng tay' nhiều hơn. Đây là lý do kỹ thuật đằng sau 'sự ưa thích'.
Nhưng đây mới chỉ là phần đầu của câu chuyện. Phần phản trực giác (contrarian) mà tôi muốn chỉ ra là: sự ưa thích của các kỹ sư không đồng nghĩa với thành công thương mại. Market cycle là vòng xoay của những câu chuyện, và câu chuyện về 'Claude Code tốt hơn' có thể chỉ là phần nổi trước khi một cơn bão khác ập đến. Hãy nhìn vào khía cạnh chi phí. Claude 3 Opus có API pricing đắt hơn đáng kể so với GPT-4 Turbo (Input $15/M vs $10/M tokens). Trong một thị trường giảm như hiện tại, nơi các công ty công nghệ đang cắt giảm chi phí, việc lựa chọn một công cụ đắt tiền hơn có thể là một rào cản lớn. Hơn nữa, cạnh tranh không chỉ dừng lại ở hai công ty này. Cursor (dùng GPT-4, Claude, hoặc các model khác) hay thậm chí các giải pháp mã nguồn mở như Code Llama từ Meta đều là những ẩn số. Có một điểm mù mà bài báo không đề cập: các doanh nghiệp đang 'test' Codex, nhưng liệu họ có đang dùng thử Claude Code với quy mô lớn không? Nếu không, 'sự ưa thích' chỉ là một hiện tượng của giới developer, chưa lan sang phòng họp của các CTO và CFO.

Cuối cùng, takeaway của tôi là: câu chuyện về AI coding tools vẫn còn rất dài. Lửa chỉ soi đường, nhưng con đường phía trước là một cuộc chiến về chi phí, bảo mật và khả năng tích hợp. Đằng sau mỗi token là một câu chuyện chưa kể, và đằng sau mỗi 'preferred choice' là một khoản chi phí và rủi ro tiềm ẩn. Khi mùa hè DeFi kết thúc, những kẻ sống sót không phải là những giao thức có TVL cao nhất, mà là những giao thức có tokenomics bền vững nhất. Trong ngành AI này, kẻ chiến thắng cuối cùng sẽ là người cân bằng được giữa sức mạnh kỹ thuật và chi phí vận hành. Tôi cá rằng cuộc chơi này còn lâu mới kết thúc, và chúng ta chưa thấy được con át chủ bài của Microsoft hay Google.
