Mở đầu bằng một con số: 80%.
Không phải điểm số trên SWE-bench, không phải tỷ lệ chấp nhận pull request trên GitHub. Mà là tỷ lệ code sản xuất tại Anthropic — công ty mẹ của Claude — được chính Claude viết ra. Con số này, nếu đúng, sẽ xé toang mọi tranh luận về việc AI có thể thay thế lập trình viên hay không.
Nhưng trước khi bạn kết luận, hãy cùng tôi mổ xẻ nó từ gốc rễ. Tôi đã từng đầu tư vào một dự án ICO hứa hẹn “AI sẽ viết smart contract cho bạn”. Đó là năm 2017. Kết quả: 40 ETH bay màu. Từ đó, tôi học được bài học: không bao giờ tin vào một con số duy nhất, nhất là khi nó đến từ chính người trong cuộc.
Context: Khi “Dogfooding” trở thành vũ khí cạnh tranh
Hãy tưởng tượng: bạn là CEO của một công ty bán phần mềm AI. Bạn muốn thuyết phục khách hàng rằng sản phẩm của bạn đủ mạnh để xử lý công việc thực tế. Cách tốt nhất là gì? Không phải benchmark, không phải white paper. Mà là: “Chúng tôi dùng nó cho chính công ty mình.”
Đó gọi là dogfooding. Và Anthropic vừa tung ra một quả bom dogfooding.
Anthropic là một trong những startup AI được săn đón nhất hiện nay. Họ gây quỹ hàng tỷ USD, đối đầu trực tiếp với OpenAI. Claude, model ngôn ngữ lớn của họ, được định vị là an toàn hơn, có kiểm soát hơn. Nhưng thị trường code generation đang chứng kiến cuộc chiến khốc liệt: GitHub Copilot (OpenAI), Codex, Gemini Code Assist, Cursor. Ai cũng có model. Ai cũng có benchmark. Nhưng ít ai dám công bố: “80% code sản xuất của chúng tôi do AI viết.”
Thông tin này được Crypto Briefing — một trang tin về crypto và đầu tư — đưa lại. Không phải TechCrunch, không phải The Verge. Điều đó nói lên điều gì? Mục tiêu của thông điệp này không chỉ là developer, mà còn là nhà đầu tư. Những người đang đặt cược vào vòng funding tiếp theo của Anthropic.
Core: Mổ xẻ con số 80%
Tôi đã từng quản lý quỹ token fund, nơi mỗi ngày tôi phải đọc hàng tá báo cáo từ các dự án. Có một câu hỏi tôi luôn đặt ra: “Con số này được đo như thế nào?”
80% code sản xuất do Claude viết — nhưng:
- Tính theo dòng code? Nếu Claude viết 100 dòng, nhưng mỗi dòng đều là boilerplate (cấu hình, test, import), thì 80% đó không có ý nghĩa gì.
- Tính theo số lượng function? Một function phức tạp do người viết có thể có giá trị gấp 10 lần 10 function đơn giản do AI viết.
- Tính theo pull request? Nếu Claude tạo ra 80% PR, nhưng mỗi PR đều bị review và sửa đổi nhiều, thì “do Claude viết” chỉ là bước khởi đầu.
- Có bao gồm test code, script, config không? Trong một dự án phần mềm, code thực sự (business logic) thường chiếm tỷ lệ nhỏ. Phần còn lại là test, CI/CD, deployment, cấu hình. Đây là những thứ AI rất giỏi viết.
Kinh nghiệm của tôi với DeFi Summer 2020 dạy tôi: đừng bao giờ nhìn vào APY mà không hỏi “tổng thanh khoản là bao nhiêu?”. Tương tự, đừng nhìn vào 80% mà không hỏi “tổng số dòng code là bao nhiêu, và chất lượng ra sao?”
Tuy nhiên, ngay cả khi con số được thổi phồng, bản thân việc công bố nó đã là một tín hiệu.
Nó cho thấy Anthropic đã đạt đến một điểm mà họ tin rằng Claude có thể tham gia vào quy trình phát triển phần mềm thực tế một cách có ý nghĩa. Đây không phải là demo. Đây là code chạy trên production, phục vụ hàng triệu người dùng.
Contrarian: Góc nhìn phản trực giác
Hầu hết mọi người sẽ đọc tin này và nghĩ: “Lập trình viên sắp bị thay thế.”
Tôi nghĩ ngược lại: Lập trình viên giỏi sẽ càng trở nên quan trọng hơn.
Tại sao? Bởi vì 80% code do AI viết không có nghĩa là 80% công việc do AI làm. Nó có nghĩa là 80% bản nháp do AI tạo ra, và 100% công việc còn lại là: xác thực, kiểm tra, tối ưu, tích hợp, và quan trọng nhất — chịu trách nhiệm.
Khi tôi farming trên Compound năm 2020, tôi từng deploy một smart contract có sẵn từ GitHub. Tôi không kiểm tra kỹ audit. Kết quả: pool sập, mất 40% lợi nhuận. Bài học: code có thể do người khác viết, nhưng trách nhiệm là của bạn.
Tương tự, khi Claude viết 80% code, ai sẽ chịu trách nhiệm nếu một bug xuất hiện? Ai sẽ hiểu đủ kiến trúc để biết code nào nên viết lại, code nào nên giữ lại? Developer, chứ không phải Claude.
Điểm mù lớn nhất ở đây là: “AI dependency debt” (nợ kỹ thuật do phụ thuộc AI).
Càng phụ thuộc vào AI để viết code, team càng mất dần khả năng hiểu và sửa code khi cần. Điều này đặc biệt nguy hiểm trong các lĩnh vực đòi hỏi độ chính xác cao như tài chính, y tế, hoặc — như trường hợp của chúng ta — smart contract blockchain.
Một smart contract do AI viết, nếu có lỗi, có thể dẫn đến mất hàng triệu đô la. Và khi đó, việc đổ lỗi cho AI sẽ không lấy lại được tiền.
Takeaway: Câu chuyện tiếp theo là gì?
Con số 80% là một tín hiệu mạnh mẽ từ Anthropic, nhưng nó không phải là bằng chứng về sự vượt trội. Nó là bằng chứng về sự tự tin.
Tự tin rằng họ đã xây dựng được một quy trình mà AI có thể đóng góp đáng kể. Tự tin rằng họ có thể thuyết phục thị trường — và nhà đầu tư — rằng Claude không chỉ là một chatbot, mà là một công cụ sản xuất thực thụ.
Nhưng đối với chúng ta — những người đang sống trong thị trường crypto và blockchain — câu hỏi thực sự không phải là “AI có viết được code không?”. Mà là: “Khi nào thì AI đủ an toàn để viết smart contract cho quỹ của tôi?”
Tôi chưa có câu trả lời. Nhưng tôi biết rằng, trước khi tin vào bất kỳ con số nào, tôi sẽ hỏi: “Anh đo nó bằng cách nào?”
Đó là bài học từ 19 năm săn lùng narrative trong thị trường này.