Bảng giá và trạng thái model

Giá dưới đây lấy trực tiếp từ hệ thống tính tiền, không phải bảng viết tay — bạn thấy đúng con số sẽ bị trừ. Dải màu là kết quả gọi thử thật trong một giờ gần nhất.

34 model 6 hãng Tương thích OpenAI API Điểm cuối /v1/chat/completions

Cách tính tiền: giá theo một triệu token, không phải mỗi lần gọi. Token đầu ra đắt hơn đầu vào — công thức hệ thống dùng là (token vào + token ra × 5) × hệ số model. Bản -thinking sinh nhiều token đầu ra hơn nên tốn tiền hơn dù giá mỗi token như nhau.

Anthropic

Claude — mạnh nhất cho việc lập trình phức tạp

18 model

claude-opus-5

Mạnh nhất

Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó.

Đầu vào
$5.00/1M
Đầu ra
$25.00/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

claude-opus-5-thinking

Mạnh nhất

Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$5.00/1M
Đầu ra
$25.00/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

claude-sonnet-5

Cân bằng

Cân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn.

Đầu vào
$2.00/1M
Đầu ra
$10.00/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

claude-sonnet-5-thinking

Cân bằng

Cân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$2.00/1M
Đầu ra
$10.00/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

claude-opus-4.8

Mạnh nhất

Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó.

Đầu vào
$5.00/1M
Đầu ra
$25.00/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

claude-opus-4.8-thinking

Mạnh nhất

Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$5.00/1M
Đầu ra
$25.00/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

OpenAI

GPT — theo sát hướng dẫn chi tiết

6 model

gpt-5.6-sol

Mạnh nhất

Model họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản.

Đầu vào
$5.63/1M
Đầu ra
$28.13/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

gpt-5.6-sol-thinking

Mạnh nhất

Model họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$5.63/1M
Đầu ra
$28.13/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

gpt-5.6-terra

Cân bằng

Model họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản.

Đầu vào
$2.81/1M
Đầu ra
$14.06/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

gpt-5.6-terra-thinking

Cân bằng

Model họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$2.81/1M
Đầu ra
$14.06/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

gpt-5.6-luna

Tiết kiệm

Model họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản.

Đầu vào
$1.13/1M
Đầu ra
$5.63/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

gpt-5.6-luna-thinking

Tiết kiệm

Model họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$1.13/1M
Đầu ra
$5.63/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

MiniMax

Giá thấp, phù hợp việc thường ngày

4 model

minimax-m2.5

Rất rẻ

Model của MiniMax, giá thấp, phù hợp việc thường ngày không đòi hỏi suy luận phức tạp.

Đầu vào
$0.15/1M
Đầu ra
$0.90/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

minimax-m2.5-thinking

Rất rẻ

Model của MiniMax, giá thấp, phù hợp việc thường ngày không đòi hỏi suy luận phức tạp. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$0.15/1M
Đầu ra
$0.90/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

minimax-m2.1

Rất rẻ

Model của MiniMax, giá thấp, phù hợp việc thường ngày không đòi hỏi suy luận phức tạp.

Đầu vào
$0.30/1M
Đầu ra
$1.20/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

minimax-m2.1-thinking

Rất rẻ

Model của MiniMax, giá thấp, phù hợp việc thường ngày không đòi hỏi suy luận phức tạp. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$0.30/1M
Đầu ra
$1.20/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

Zhipu AI

GLM — cân bằng chi phí và chất lượng

2 model

glm-5

Rất rẻ

Model GLM của Zhipu AI, cân bằng giữa chi phí và chất lượng.

Đầu vào
$0.95/1M
Đầu ra
$2.55/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

glm-5-thinking

Rất rẻ

Model GLM của Zhipu AI, cân bằng giữa chi phí và chất lượng. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$0.95/1M
Đầu ra
$2.55/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

DeepSeek

Mạnh về lập trình và suy luận toán học

2 model

deepseek-3.2

Rất rẻ

Model của DeepSeek, mạnh về lập trình và suy luận toán học với chi phí thấp.

Đầu vào
$0.27/1M
Đầu ra
$0.40/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

deepseek-3.2-thinking

Rất rẻ

Model của DeepSeek, mạnh về lập trình và suy luận toán học với chi phí thấp. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$0.27/1M
Đầu ra
$0.40/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

Alibaba

Qwen — chuyên lập trình, giá thấp nhất

2 model

qwen3-coder-next

Rất rẻ

Model của Alibaba, chuyên về lập trình. Giá rất thấp nên phù hợp việc chạy nhiều lần hoặc xử lý khối lượng lớn.

Đầu vào
$0.11/1M
Đầu ra
$0.80/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ

qwen3-coder-next-thinking

Rất rẻ

Model của Alibaba, chuyên về lập trình. Giá rất thấp nên phù hợp việc chạy nhiều lần hoặc xử lý khối lượng lớn. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.

Đầu vào
$0.11/1M
Đầu ra
$0.80/1M
Đang lỗi 0% giờ qua
60 phút trướcBây giờ