AI agent đang là trợ thủ đắc lực của dân lập trình: tự đọc code, tự sửa lỗi, tự viết tính năng mới. Nhưng có một sự thật ít ai nói to: mỗi lần agent "suy nghĩ" là tiền của bạn đang chảy. Agent càng thông minh, càng làm nhiều việc, hóa đơn API càng phình to — có khi bạn giật mình khi thấy con số cuối tháng. Tin vui là cộng đồng mã nguồn mở đã tạo ra nhiều công cụ giúp bạn kiểm soát và cắt giảm chi phí này. Dưới đây là 5 cái tên đáng chú ý.
Vì sao hóa đơn AI agent "đốt tiền"?
Hiểu đơn giản thế này: các dịch vụ AI tính phí theo "token" — đơn vị nhỏ của văn bản mà mô hình đọc vào và viết ra. Mỗi lần bạn nhờ agent làm việc, nó không chỉ đọc câu hỏi của bạn mà còn "nuốt" cả đống ngữ cảnh: toàn bộ file code liên quan, lịch sử trò chuyện, log lỗi dài dằng dặc... rồi lại viết ra những câu trả lời cũng dài không kém. Token vào ra càng nhiều, tiền càng nhiều. Vấn đề là phần lớn ngữ cảnh đó thực ra không cần thiết — nó giống như bạn photo cả cuốn sách chỉ để đọc một trang.
5 công cụ mã nguồn mở giúp bạn tiết kiệm
1. caveman — nén câu trả lời của agent
Ý tưởng của caveman rất trực diện: câu trả lời của AI thường dài dòng hơn mức cần thiết. Công cụ này giúp nén gọn output của agent, loại bỏ những phần rườm rà mà vẫn giữ đủ ý. Vì phí API tính cả trên số token mô hình viết ra, việc cắt bớt "lời thừa" đồng nghĩa với việc cắt trực tiếp vào hóa đơn. Đây là kiểu tối ưu "được ngay" mà không cần thay đổi cách bạn làm việc.
2. ccusage — nhìn rõ tiền đang chảy đi đâu
Bạn không thể tiết kiệm thứ mình không đo được. ccusage là công cụ giúp bạn nhìn rõ mức tiêu thụ token của mình: task nào tốn nhất, thời điểm nào "đốt" nhiều nhất, xu hướng chi tiêu ra sao. Khi đã thấy rõ bức tranh, bạn sẽ biết cần tối ưu ở đâu thay vì đoán mò. Nhiều người sau khi dùng mới té ngửa vì phát hiện một vài thói quen nhỏ đang ngốn phần lớn ngân sách.
3. promptfoo — kiểm thử prompt trước khi "đốt tiền" thật
Một prompt dở không chỉ cho kết quả tệ mà còn khiến bạn phải chạy đi chạy lại nhiều lần — mỗi lần chạy lại là một lần trả tiền. promptfoo cho phép bạn viết các bộ test cho prompt của mình: thử nhiều phiên bản prompt, so sánh kết quả, thậm chí kiểm thử tính an toàn trước khi đưa vào sử dụng thực tế. Đầu tư một chút công sức test ban đầu sẽ tiết kiệm rất nhiều chi phí chạy lại về sau.
4. gitingest — biến cả repo thành một prompt gọn nhẹ
Khi nhờ AI hỗ trợ với một dự án code, bạn thường phải "nhét" cả repository vào ngữ cảnh — mà repo thì chứa đủ thứ không liên quan: file cấu hình, thư mục phụ thuộc, ảnh, log... gitingest giúp biến bất kỳ repo nào thành một bản tóm tắt gọn gàng, sẵn sàng để đưa vào prompt cho AI. Ít rác hơn trong ngữ cảnh đồng nghĩa với ít token hơn cho mỗi lần gọi, mà AI vẫn nắm được cấu trúc cần thiết của dự án.
5. Crawl4AI — lấy nội dung web sạch cho LLM
Nhiều workflow AI cần đọc nội dung từ website: tổng hợp tin tức, nghiên cứu tài liệu, theo dõi đối thủ. Nhưng trang web hiện đại đầy rẫy quảng cáo, menu, popup — nếu đưa nguyên trang vào cho AI đọc, bạn đang trả tiền cho cả đống rác. Crawl4AI biến trang web thành văn bản markdown sạch sẽ, chỉ giữ lại nội dung chính để đưa vào mô hình. Kết quả: ngữ cảnh gọn hơn, chi phí thấp hơn, mà chất lượng câu trả lời còn tốt hơn vì AI không bị nhiễu.
Kết hợp chúng thế nào cho hiệu quả?
Bạn không cần dùng cả 5 cùng lúc. Một lộ trình hợp lý cho người mới:
1. Bắt đầu với ccusage để biết mình đang tốn tiền ở đâu — đo trước, tối ưu sau. 2. Dùng gitingest và Crawl4AI để làm gọn đầu vào: ngữ cảnh sạch là cách tiết kiệm đơn giản mà hiệu quả nhất. 3. Thêm caveman để nén đầu ra của agent trong quá trình dùng hàng ngày. 4. Dùng promptfoo khi bạn bắt đầu xây dựng các luồng AI dùng lâu dài, để đảm bảo mỗi lần chạy đều đáng tiền.
Kết luận
Dùng AI agent không nhất thiết phải đắt đỏ — phần lớn chi phí đến từ sự lãng phí mà chúng ta không nhìn thấy: ngữ cảnh thừa, câu trả lời dài dòng, chạy lại nhiều lần vì prompt chưa tốt. Năm công cụ mã nguồn mở trên giúp bạn tấn công đúng vào từng nguồn lãng phí đó: đo lường, làm gọn, kiểm thử. Trong thời đại AI, người chiến thắng không phải người dùng mô hình đắt nhất, mà là người dùng thông minh nhất với từng đồng chi phí.

