Năm 2026, một lập trình viên không cần mười công cụ AI, chỉ cần một stack đúng và đủ: đúng việc, đúng ngân sách, đúng mức độ phức tạp. Bài này tôi chia sẻ bộ công cụ AI đang dùng hằng ngày để viết code, tự động hóa, làm nội dung và vận hành hạ tầng, kèm lý do chọn từng món và chi phí thật lấy từ trang giá chính thức của nhà cung cấp trong tháng 8/2026.
Nguyên tắc chọn công cụ của tôi
Trước khi đi vào từng công cụ, đây là ba nguyên tắc tôi áp dụng khi chọn bất kỳ món đồ nào cho stack:
- Chi phí phải đo đếm được. Không chọn theo cảm tính, không chọn theo trend, mà theo con số trên trang giá chính thức. Nếu không tìm được giá công khai, tôi không đưa vào stack.
- Mỗi tầng chỉ giữ một công cụ chính. LLM API, IDE, agent, automation, voice, hạ tầng, mỗi tầng một lựa chọn, kèm một phương án dự phòng để so sánh.
- Tránh khóa cứng nhà cung cấp. Ưu tiên thứ gì chạy được API chuẩn (OpenAI compatible), tự host được, hoặc xuất dữ liệu dễ dàng, để đổi công cụ không phải viết lại cả hệ thống.
LLM API: DeepSeek V4 Flash là engine mặc định
Tầng quan trọng nhất của stack là lớp model. Tôi dùng DeepSeek V4 Flash cho khoảng 80% số cuộc gọi API, vì ba con số sau đây từ trang chính thức api-docs.deepseek.com/quick_start/pricing (tháng 8/2026):
- Giá 1 triệu token input (cache miss) là $0.14, output là $0.28. Với một cuộc hội thoại lập trình khoảng 10.000 token, chi phí chỉ chưa tới 1 xu.
- Cache hit chỉ $0.0028 cho 1 triệu token input. Khi prompt hệ thống và ngữ cảnh lặp lại nhiều lần, hóa đơn gần như không tăng.
- Context length lên tới 1 triệu token, output tối đa 384K, hỗ trợ cả chế độ thinking và non-thinking, kèm JSON output và tool calls, concurrency limit 2.500.
Cần lưu ý một thay đổi quan trọng: từ 16 giờ UTC ngày 16/8/2026, DeepSeek chuyển sang biểu giá theo khung giờ. Giờ thấp điểm (off-peak) chỉ bằng nửa giá giờ cao điểm (peak): V4 Flash off-peak là $0.22 input và $0.66 output cho mỗi 1 triệu token, trong khi peak là $0.44 và $1.32. Với tôi ở khu vực châu Á, phần lớn công việc chạy vào khung giờ thấp điểm, nên chi phí thực tế còn thấp hơn giá gốc.

Khi nào tôi dùng model đắt hơn? Khi task thực sự cần. DeepSeek V4 Pro (giá $0.435 input, $0.87 output mỗi 1 triệu token) cho những bài toán suy luận nhiều bước, phân tích kiến trúc hoặc sinh tài liệu dài. Claude từ Anthropic xuất hiện trong stack qua Cursor, chủ yếu cho code phức tạp: Claude Sonnet 5 hiện có giá giới thiệu $2 input và $10 output mỗi 1 triệu token (đến 31/8/2026), còn Claude Opus 5 là $5 và $25 theo claude.com/pricing. Chênh lệch so với DeepSeek V4 Flash là từ 7 tới 90 lần, nên tôi chỉ bật khi việc nhỏ chạy bằng model rẻ không đạt yêu cầu.
IDE AI: Cursor Pro với cơ chế credit
Cursor là IDE chính của tôi, gói Pro $20/tháng. Điểm đáng chú ý trong cách tính giá 2026 là mô hình credit: gói Pro kèm khoảng $20 giá trị sử dụng model frontier mỗi tháng, tính theo giá API thực, theo tài liệu chính thức tại cursor.com/docs/models-and-pricing. Nghĩa là bạn không mua một con số request cố định, mà mua một ngân sách token, model nào bạn dùng thì trừ theo giá model đó.

Cách tôi tối ưu chi phí trong Cursor:
- Tab completion và auto mode chạy model rẻ, không đụng tới credit model frontier.
- Chỉ những task multi-file, refactor lớn mới bật model mạnh như Claude Sonnet.
- Theo dõi mức tiêu thụ credit trong dashboard, nếu hết tháng nào cũng vượt thì mới cân nhắc Pro+ ($60) hoặc Ultra ($200, kèm khoảng $400 credit) cho power user.
Agent: AI làm, con người duyệt
Tầng agent là nơi stack trở nên thực chiến. Tôi dùng agent theo ba hình thức:
- Agent mode trong Cursor cho refactor nhiều file: nó đọc toàn bộ codebase, đề xuất thay đổi, tôi review từng diff trước khi chấp nhận.
- Claude Code cho những task dài, cần lập kế hoạch và thực thi nhiều bước trong terminal.
- Một agent tự động hóa chạy workflow lặp lại: thu thập dữ liệu, viết nháp, kiểm tra chất lượng. Chính bài viết này được soạn và publish bằng quy trình agent, từ nghiên cứu giá, vẽ biểu đồ tới đăng bài.
Nguyên tắc bất biến của tôi: agent được phép đề xuất và thực thi trong phạm vi an toàn, nhưng mọi thứ có thể gây hậu quả (deploy, ghi dữ liệu, gửi tin nhắn) đều phải qua bước duyệt của con người. Chi phí tầng này nằm trong gói Cursor và phí API, không phát sinh thêm khoản riêng.
Automation: n8n làm xương sống workflow
Với tự động hóa, tôi chọn n8n. Gói Starter $20/tháng khi trả theo năm, gồm 2.500 lần thực thi (execution) mỗi tháng, theo n8n.io/pricing. Nếu cần nhiều hơn, Pro $50/tháng (trả theo năm) nâng lên 10.000 executions. So sánh nhanh với Make: Make Core $9/tháng và Pro $16/tháng khi trả theo năm, mỗi gói 10.000 credits, theo make.com/en/pricing.

Vì sao tôi chọn n8n dù đắt hơn Make ở tầng khởi điểm?
- Mã nguồn mở, có Community Edition tự host miễn phí, không giới hạn execution, chỉ tốn chi phí server.
- Node AI (gọi LLM, vector store, agent) có sẵn, phối hợp tốt với API DeepSeek chuẩn OpenAI.
- Workflow là file, dễ đưa vào git, dễ di chuyển giữa cloud và self-host.
Với nhu cầu cá nhân hiện tại (tự động tổng hợp tin, publish nội dung, đồng bộ dữ liệu), 2.500 executions của Starter là thừa đủ. Make vẫn là phương án dự phòng tốt nếu cần giao diện kéo thả trực quan hơn cho người không chuyên.
Voice: ElevenLabs cho nội dung âm thanh
Tầng voice tôi dùng cho audio blog và podcast thử nghiệm. Gói Creator của ElevenLabs giá $22/tháng (tháng đầu giảm 50% còn $11), gồm 100.000 credits, tương đương khoảng 100 phút TTS đa ngôn ngữ, kèm professional voice cloning và chất lượng 192 kbps, theo trang chính thức elevenlabs.io/pricing. Nếu chỉ cần thử nghiệm nhẹ, Starter khoảng $5-6/tháng với 30.000 credits là đủ; còn sản xuất âm thanh với API chất lượng phòng thu thì Pro $99/tháng với 500.000 credits.
Lý do tôi dừng ở Creator thay vì Pro: tần suất làm audio chưa tới 100 phút mỗi tháng, và nếu vượt thì mua thêm credits rẻ hơn là trả gấp bốn lần phí cố định. Khi podcast thành đều đặn, tôi sẽ nâng cấp.
Hạ tầng: Cloudflare và EmDash gần như miễn phí
Toàn bộ blog và vài dịch vụ nhỏ của tôi chạy trên Cloudflare Developer Platform. Tầng này có chi phí gần bằng không ở quy mô cá nhân:
- Workers Free $0/tháng, gồm 100.000 requests mỗi ngày; gói Paid từ $5/tháng, 10 triệu requests/tháng đầu tiên, thêm $0.30 cho mỗi triệu request tiếp theo, theo cloudflare.com/plans/developer-platform.
- D1 (SQLite serverless) cho database, R2 cho lưu file với zero egress fee, không tính phí băng thông ra.
- Blog này chạy EmDash, một CMS mã nguồn mở dựng trên Astro, deploy lên Workers với D1 làm database. Ở mức traffic hiện tại, hóa đơn Cloudflare của tôi là $0, chỉ trả $5 khi cần vượt ngưỡng free.

Tổng kết chi phí thực tế
Cộng toàn bộ lại, stack của tôi tốn khoảng $75/tháng: Cursor Pro $20, ElevenLabs Creator $22, n8n Starter $20, Cloudflare Workers $5 (tạm thời $0), cộng phí API DeepSeek ước tính $8 cho một lập trình viên dùng nhiều, tính theo giá chính thức $0.14/$0.28 mỗi 1 triệu token. Cloudflare đang ở mức $0 nên con số thực chi thấp hơn. Nếu tinh giản còn tối thiểu (bỏ ElevenLabs, tự host n8n), stack chỉ còn khoảng $25/tháng.
Lời khuyên cuối cùng: đừng mua toàn bộ gói cao cấp ngay từ đầu. Bắt đầu từ tầng model với DeepSeek V4 Flash và Cursor Pro, đo mức tiêu thụ thật sau một tháng, rồi mới nâng cấp từng tầng khi có dữ liệu. Một stack tốt không phải là stack đắt nhất, mà là stack bạn đo đếm được và đổi được khi cần.
Câu hỏi thường gặp
Tổng chi phí stack này mỗi tháng là bao nhiêu?
Khoảng $75/tháng: Cursor Pro $20, ElevenLabs Creator $22, n8n Starter $20, Cloudflare $5, phí API DeepSeek ước tính $8 theo giá chính thức. Nếu cắt ElevenLabs và tự host n8n, chỉ còn khoảng $25/tháng.
DeepSeek V4 Flash có đủ mạnh để viết code không?
Đủ cho phần lớn công việc hằng ngày: sinh code, sửa lỗi, giải thích, viết test. Giá chỉ $0.14 input và $0.28 output mỗi 1 triệu token, context 1 triệu token. Với task suy luận phức tạp, tôi chuyển sang DeepSeek V4 Pro hoặc Claude qua Cursor.
Nên chọn n8n hay Make?
Chọn n8n nếu bạn muốn mã nguồn mở, tự host được và cần node AI; Starter $20/tháng cho 2.500 executions. Chọn Make nếu bạn thích giao diện kéo thả và ngân sách thấp hơn; Core $9/tháng cho 10.000 credits.
Có cần mua gói Pro của Cursor hoặc ElevenLabs ngay không?
Không. Bắt đầu với Cursor Pro $20 và ElevenLabs Starter khoảng $5-6/tháng, đo mức dùng thật trong một tháng rồi nâng cấp khi chạm giới hạn. Gói Ultra $200 và ElevenLabs Pro $99 chỉ đáng giá khi sản lượng đã ổn định.



No comments yet