Grok 4.6 API: giá, benchmark và cách dùng thực chiến 2026

Grok 4.6 ra mắt 12/8/2026: giá $2/$6 mỗi triệu token, benchmark ngang GPT-5.6 Sol. Đọc bảng giá thật, chi phí ẩn và cách dùng API tiết kiệm nhất tại đây.

Ngày 12/8/2026, xAI (nay vận hành dưới thương hiệu SpaceXAI sau thương vụ SpaceX thâu tóm hồi tháng 2/2026) phát hành Grok 4.6, flagship mới nhất nhắm vào nhóm tác vụ agent chạy dài, lập trình và làm việc với nội dung hình ảnh. Chỉ vài giờ sau, model đã xuất hiện trong Cursor và Grok Build, còn API chính thức mở bán với giá khởi điểm $2 mỗi 1 triệu token input, $6 mỗi 1 triệu token output. Bài viết này tổng hợp bảng giá thật từ tài liệu chính thức, điểm lại benchmark, vạch ra các chi phí ẩn dễ làm đội hóa đơn, và cho bạn một quy trình ra quyết định: khi nào nên dùng Grok 4.6, khi nào nên ở lại với DeepSeek hay GPT-5.6.

Grok 4.6 là mô hình AI flagship của xAI, được thiết kế cho các tác vụ agent chạy dài (long-running agents), lập trình và làm việc với nội dung hình ảnh. Theo thông báo phát hành, model trải qua đợt supplementary training dài hơn hẳn Grok 4.5, dùng dữ liệu engineering chất lượng cao và bắt đầu tự kiểm tra (self-testing) kết quả trước khi chuyển sang bước tiếp theo, điều hiếm thấy ở các bản phát hành trước.

Tóm tắt nhanh trước khi đi vào chi tiết:

  • Giá: $2 mỗi 1M token input, $0,50 cho cached input, $6 cho output; vượt 200K token thì toàn bộ request tính $4/$12.
  • Benchmark: ngang GPT-5.6 Sol trên Artificial Analysis Intelligence Index (61 so với 61), nhưng thua ở DeepSWE v1.1 (65,9% so với 73%).
  • Điểm mạnh: knowledge work, agent dài hơi, tích hợp sẵn Cursor ngay ngày ra mắt.
  • Điểm trừ: không hỗ trợ Batch API, chi phí tool rời có thể tới $5 mỗi 1.000 lần gọi.
  • Verdict: đáng dùng cho agent chất lượng cao, nhưng đắt gấp khoảng 9 lần DeepSeek V4 Flash nếu bạn chỉ cần chatbot hoặc RAG cơ bản.

Grok 4.6 là gì và vì sao nó đáng chú ý nhất tháng 8/2026?

Grok 4.6 là mô hình AI flagship của xAI, nay thuộc sở hữu của SpaceXAI, được phát hành ngày 12/8/2026 với trọng tâm là tác vụ agent chạy dài, coding và visual work. Đây là bản nâng cấp chỉ khoảng một tháng sau Grok 4.5, một nhịp ra mắt nhanh bất thường so với mặt bằng chung của ngành.

Điều khiến bản phát hành này đáng chú ý không chỉ là tốc độ. Theo xAI, Grok 4.6 được train với dữ liệu do chính model sinh ra (curated model-generated data) cho các chủ đề reasoning và kỹ thuật nâng cao, cùng bộ dữ liệu engineering chất lượng cao và một optimizer cải tiến. Trên các trajectory dài, model bắt đầu xuất hiện hành vi tự kiểm tra và xác minh công việc trước khi bàn giao, cũng như tạo bản nháp đầu tiên (first pass) tốt hơn hẳn cho các dự án visual và interactive.

Model có mặt ngay trong Cursor, Grok Build, API chính thức, OpenRouter, Vercel và Cloudflare, theo thông báo phát hành. Tuần đầu tiên, xAI tặng gấp đôi usage trong Grok Build và Cursor để người dùng thử nghiệm. Bối cảnh thương hiệu cũng đáng ghi nhận: SpaceX đã thâu tóm xAI vào ngày 2/2/2026 và công ty nay chính thức mang tên SpaceXAI, tài liệu API hiển thị dưới tên SpaceXAI Docs.

Takeaway: Grok 4.6 là bản phát hành nhắm thẳng vào nhóm developer đang chạy agent dài hơi, không phải bản nâng cấp chat thông thường, nên cách đánh giá nó cũng phải khác.

Grok 4.6 API giá bao nhiêu? Số liệu thật từ tài liệu chính thức

Giá API Grok 4.6 được tính theo token, phân biệt input, cached input và output, tính bằng USD trên mỗi 1 triệu token, theo tài liệu chính thức SpaceXAI Docs cập nhật ngày 21/8/2026. Cụ thể ở mức short context (dưới 200K token):

  • Input: $2,00 mỗi 1M token
  • Cached input: $0,50 mỗi 1M token, rẻ hơn 4 lần so với input thường
  • Output: $6,00 mỗi 1M token
  • Context window: 500.000 token
  • Long context (từ 200K token): toàn bộ request tính $4,00 input, $1,00 cached, $12,00 output

Để hình dung vị trí của Grok 4.6 trong dải sản phẩm, cùng trang tài liệu cho thấy grok-4.3 giá $1,25/$0,20/$2,50 với context lên tới 1 triệu token, grok-4.5 giá $2,00/$0,30/$6,00 giống hệt 4.6 ở mức short context, còn grok-build-0.1 giá $1,00/$0,20/$2,00 với context 256K. Thông báo phát hành cũng nhắc tới một biến thể fast với giá gấp đôi, dành cho tác vụ cần tốc độ.

Takeaway: mức giá khởi điểm $2/$6 chỉ đúng khi request dưới 200K token. Một khi prompt chạm ngưỡng 200K, toàn bộ request bị tính giá gấp đôi, đây là chi tiết dễ bỏ lỡ khi ước lượng chi phí cho agent xử lý tài liệu dài.

Benchmark của Grok 4.6 có thật sự mạnh như quảng cáo?

Benchmark là các bài kiểm tra chuẩn hóa để so sánh năng lực giữa các model, và các con số trong phần này được xAI tự công bố trong thông báo phát hành ngày 12/8/2026, với điểm của model đối thủ lấy từ hệ thống card và leaderboard công khai của chính họ. Kết luận ngắn gọn: Grok 4.6 mạnh thật ở mảng knowledge work, nhưng coding agent thực chiến vẫn chưa vượt được GPT-5.6 Sol.

  • AA Intelligence Index: Grok 4.6 High đạt 61, ngang GPT-5.6 Sol Max 61, kém Fable 5 Max 62 đúng 1 điểm, và bỏ xa Grok 4.5 High chỉ đạt 56.
  • GDPVal-AA v2: 1753 điểm, cao nhất bảng, trên GPT-5.6 Sol Max 1728 và Fable 5 Max 1741.
  • CursorBench v3.2: 69,9%, cao hơn GPT-5.6 Sol Max 67,2%.
  • FrontierCode v1.1 (Extended): 61,3%, cao hơn GPT-5.6 Sol Max 60,6% nhưng kém Fable 5 Max 63,6%.
  • DeepSWE v1.1: 65,9%, thua khá xa GPT-5.6 Sol Max 73% và Fable 5 Max 70%.
  • Terminal-Bench v3.0: 26%, thua GPT-5.6 Sol Max 34,6%.
  • Harvey LAB (Vals): 15,8%, bỏ xa GPT-5.6 Sol Max chỉ đạt 2,5%.
  • AA-Briefcase: 1577 điểm, cao nhất bảng so với 1502 của GPT-5.6 Sol Max.

Cần đọc các con số này đúng cách: xAI tự đo và tự công bố, điểm đối thủ là best-of từ các kết quả công khai, không phải phép đo cùng điều kiện (same harness). Nên xem đây là tín hiệu định hướng, không phải chân lý tuyệt đối.

Takeaway: nếu workload của bạn là phân tích tài liệu, nghiên cứu, tổng hợp thông tin dài hơi, Grok 4.6 đang dẫn đầu. Nếu bạn cần agent tự sửa lỗi trên repo thực tế nhiều vòng, GPT-5.6 Sol vẫn nhỉnh hơn ở DeepSWE và Terminal-Bench.

Grok 4.6 có đắt không khi so với DeepSeek, GPT-5.6 và Claude 5?

So sánh chi phí API cần đặt trên cùng một đơn vị: USD trên 1 triệu token, lấy từ giá chính thức của từng nhà cung cấp ở thời điểm tháng 8/2026. Trên thước đo đó, Grok 4.6 nằm ở phân khúc giá tầm trung, không rẻ như DeepSeek nhưng rẻ hơn hẳn hai flagship lớn nhất của OpenAI và Anthropic.

  • So với DeepSeek V4 Flash: giá off-peak $0,22 input và $0,66 output theo api-docs.deepseek.com, Grok 4.6 đắt gấp khoảng 9 lần ở cả hai chiều.
  • So với DeepSeek V4 Pro: giá off-peak $0,66 input và $1,98 output, Grok 4.6 đắt gấp khoảng 3 lần.
  • So với GPT-5.6 Sol: flagship của OpenAI giá $5 input và $30 output (số liệu từ bài So sánh giá API LLM tháng 8/2026 của blog, lấy từ trang chính thức), Grok 4.6 rẻ hơn khoảng 2,5 lần ở input và 5 lần ở output.
  • So với Claude Sonnet 5: khoảng $2 input và $13 output, Grok 4.6 tương đương input và rẻ hơn khoảng 2 lần ở output.
  • Cached input: Grok 4.6 tính $0,50, trong khi DeepSeek chỉ tính $0,007 (Flash) đến $0,022 (Pro). Với workload lặp lại nhiều, khoảng cách giá càng nới rộng thêm.

Ví dụ tính toán từ bảng giá chính thức: một agent xử lý 100 request mỗi ngày, mỗi request 20K token input và 2K token output, tương đương 2 triệu token input và 200K token output mỗi ngày. Với Grok 4.6, chi phí là $4 + $1,2, khoảng $5,2 mỗi ngày. Với DeepSeek V4 Flash giờ off-peak, con số tương ứng là $0,44 + $0,132, khoảng $0,57 mỗi ngày. Nếu 80% input được cache, Grok 4.6 còn khoảng $2,8, còn DeepSeek chỉ còn khoảng $0,23.

Takeaway: Grok 4.6 hợp lý khi bạn cần chất lượng agent cao và tiết kiệm so với GPT-5.6 Sol, nhưng là lựa chọn lãng phí nếu bài toán chỉ là chatbot, RAG hay xử lý văn bản cơ bản, nơi DeepSeek đang thống trị về giá.

Những chi phí ẩn nào dễ làm đội hóa đơn khi gọi Grok 4.6?

Chi phí ẩn là các khoản phí không hiện trên dòng giá chính, thường bị bỏ qua khi ước lượng budget, và với Grok 4.6 có ít nhất bốn nhóm cần để ý theo tài liệu chính thức.

  • Long-context surcharge: request chạm ngưỡng 200K token thì toàn bộ request tính ở mức $4/$12, gấp đôi giá thường, kể cả phần token dưới 200K.
  • Priority processing: nếu muốn xếp hàng ưu tiên để giảm latency, giá nhân đôi (2x) toàn bộ token, và chỉ tính khi phản hồi xác nhận service tier priority.
  • Tool phí rời: websearch và xsearch đều $5 mỗi 1.000 lần gọi, codeexecution $5 mỗi 1.000 lần, attachmentsearch $10 mỗi 1.000 lần, collections_search $2,50 mỗi 1.000 lần. Agent tự quyết định số lần gọi tool nên chi phí tăng theo độ phức tạp của câu hỏi.
  • Reasoning tokens: token suy nghĩ nội bộ của agent bị tính phí như token thường, cùng với input, output và image tokens.
  • Không có Batch cho Grok 4.6: Batch API giảm 20% chỉ áp dụng cho grok-4.3 và các model grok-4.20; riêng grok-4.6 ghi rõ không hỗ trợ batch trên model page, nên không có đường giảm giá kiểu batch như OpenAI hay Google.
  • Lưu trữ: file lưu $0,025 mỗi GiB mỗi ngày, collections $0,10 mỗi GiB mỗi ngày, tải dữ liệu về $0,20 mỗi GiB.

Takeaway: khi ước lượng chi phí, đừng chỉ nhân bảng giá token. Hãy cộng cả tool calls, reasoning tokens và xác suất request vượt 200K token, nếu không con số thực tế có thể gấp đôi dự tính.

Dùng Grok 4.6 cho agent và coding thế nào cho hiệu quả?

Agent coding là workflow trong đó model tự lập kế hoạch, sửa file, chạy lệnh và kiểm tra lại qua nhiều vòng, và Grok 4.6 là model được train riêng cho kiểu làm việc này. Để dùng hiệu quả, bạn nên kết hợp ba thói quen: bật prompt caching, giới hạn số vòng lặp và chọn đúng loại task.

  • Bật prompt caching: cached input $0,50 rẻ hơn 4 lần so với input thường. Agent session dài có lịch sử hội thoại lặp lại qua mỗi vòng, đây chính là workload lý tưởng cho cache, tương tự phân tích trong bài Prompt caching của blog.
  • Tích hợp sẵn: Grok 4.6 có mặt trong Cursor ngay ngày ra mắt, và nếu không muốn gọi API trực tiếp, bạn có thể dùng qua OpenRouter, Vercel hoặc Cloudflare, theo thông báo phát hành.
  • Kết nối công cụ qua MCP: API xAI hỗ trợ remote MCP tools và tính phí theo token, không tính phí gọi tool, phù hợp để nối thêm dữ liệu riêng, như đã trình bày trong bài MCP của blog.
  • Chọn đúng task: dùng Grok 4.6 cho phân tích tài liệu, nghiên cứu, agent dài hơi; cân nhắc GPT-5.6 Sol cho sửa lỗi repo thực tế sâu vì DeepSWE và Terminal-Bench vẫn nghiêng về phía OpenAI.

Takeaway: đừng chạy agent không kiểm soát. Đặt giới hạn vòng lặp, theo dõi số token input lặp lại và luôn đo chi phí thực tế vài ngày đầu trước khi scale lên production.

Chúng tôi đánh giá như thế nào?

Phần này mô tả nguồn dữ liệu để bạn tự kiểm chứng. Giá API lấy từ trang pricing chính thức SpaceXAI Docs cập nhật ngày 21/8/2026 và model page grok-4.6. Số liệu benchmark lấy từ thông báo phát hành chính thức x.ai/news/grok-4-6 ngày 12/8/2026, do xAI tự công bố. Giá DeepSeek lấy từ tài liệu chính thức api-docs.deepseek.com, giá GPT-5.6 và Claude Sonnet 5 lấy từ bài So sánh giá API LLM tháng 8/2026 của blog vốn tổng hợp từ trang pricing chính thức của từng hãng.

Giới hạn của bài viết: benchmark là số liệu tự báo cáo của xAI, điểm đối thủ là kết quả công khai tốt nhất chứ không phải phép đo cùng điều kiện. Giá API có thể thay đổi bất kỳ lúc nào, hãy kiểm tra lại trang chính thức trước khi build sản phẩm dựa trên các con số này.

Vậy tôi có nên chuyển sang Grok 4.6 API không?

Câu trả lời phụ thuộc vào loại workload của bạn, nhưng có ba điểm chốt để quyết định. Thứ nhất, giá $2/$6 rẻ hơn rõ rệt so với GPT-5.6 Sol ($5/$30) và Claude Sonnet 5, nhưng đắt gấp khoảng 9 lần DeepSeek V4 Flash giờ off-peak. Thứ hai, benchmark cho thấy Grok 4.6 dẫn đầu ở knowledge work và agent dài hơi, trong khi coding agent sửa lỗi repo thực tế vẫn thuộc về GPT-5.6 Sol. Thứ ba, hãy tính đủ chi phí ẩn: ngưỡng 200K token nhân đôi giá, tool phí rời, và việc không có Batch discount cho riêng model này.

Nếu bạn đang chạy agent nghiên cứu, tổng hợp tài liệu hoặc xây sản phẩm cần chất lượng cao với ngân sách tầm trung, Grok 4.6 là lựa chọn đáng thử ngay. Nếu bài toán của bạn là chatbot, RAG hay tiết kiệm tối đa, DeepSeek vẫn là vua giá, và bạn có thể tham khảo thêm bài viết về giá peak/off-peak của DeepSeek để tối ưu thêm.

Bạn đã thử Grok 4.6 API chưa? Bình luận bên dưới chia sẻ loại task bạn đang chạy và chi phí thực tế bạn quan sát được, mình sẽ tổng hợp thành bài so sánh tiếp theo.

Câu hỏi thường gặp

Grok 4.6 API giá bao nhiêu?

Giá chính thức là $2 mỗi 1 triệu token input, $0,50 cho cached input và $6 mỗi 1 triệu token output, theo SpaceXAI Docs cập nhật ngày 21/8/2026. Khi request vượt 200K token, toàn bộ request bị tính ở mức $4 input, $1 cached và $12 output.

Grok 4.6 có rẻ hơn GPT-5.6 Sol không?

Có. Grok 4.6 giá $2/$6 trong khi GPT-5.6 Sol giá $5/$30, nên Grok rẻ hơn khoảng 2,5 lần ở input và 5 lần ở output. Tuy nhiên Grok vẫn đắt gấp khoảng 9 lần DeepSeek V4 Flash (off-peak $0,22/$0,66).

Grok 4.6 có hỗ trợ Batch API không?

Không. Model page chính thức ghi rõ grok-4.6 không hỗ trợ Batch API. Mức giảm 20% hiện chỉ áp dụng cho grok-4.3 và các model grok-4.20.

Grok 4.6 có mạnh hơn GPT-5.6 Sol ở coding không?

Không hoàn toàn. Grok 4.6 thắng ở CursorBench v3.2 (69,9% so với 67,2%) và FrontierCode (61,3% so với 60,6%), nhưng thua ở DeepSWE v1.1 (65,9% so với 73%) và Terminal-Bench v3.0 (26% so với 34,6%). Số liệu do xAI tự công bố ngày 12/8/2026.

Cập nhật lần cuối: 08/2026.

No comments yet