claude-opus-5
Mạnh nhất
Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó.
- Đầu vào
- $5.00/1M
- Đầu ra
- $25.00/1M
Giá dưới đây lấy trực tiếp từ hệ thống tính tiền, không phải bảng viết tay — bạn thấy đúng con số sẽ bị trừ. Dải màu là kết quả gọi thử thật trong một giờ gần nhất.
Cách tính tiền: giá theo một triệu token, không phải mỗi
lần gọi. Token đầu ra đắt hơn đầu vào — công thức hệ thống dùng là
(token vào + token ra × 5) × hệ số model. Bản
-thinking sinh nhiều token đầu ra hơn nên tốn tiền hơn dù
giá mỗi token như nhau.
Claude — mạnh nhất cho việc lập trình phức tạp
claude-opus-5Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó.
claude-opus-5-thinkingMạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
claude-sonnet-5Cân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn.
claude-sonnet-5-thinkingCân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
claude-opus-4.8Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó.
claude-opus-4.8-thinkingMạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
claude-opus-4.7Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó.
claude-opus-4.7-thinkingMạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
claude-opus-4.6Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó.
claude-opus-4.6-thinkingMạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
claude-sonnet-4.6Cân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn.
claude-sonnet-4.6-thinkingCân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
claude-opus-4.5Mạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó.
claude-opus-4.5-thinkingMạnh nhất trong họ Claude, suy luận sâu và theo sát yêu cầu phức tạp. Dùng cho thiết kế hệ thống, tái cấu trúc lớn, gỡ lỗi khó. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
claude-sonnet-4.5Cân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn.
claude-sonnet-4.5-thinkingCân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
claude-sonnet-4Cân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn.
claude-sonnet-4-thinkingCân bằng giữa chất lượng và chi phí. Dùng cho việc lập trình hằng ngày: viết hàm mới, sửa lỗi, đọc hiểu mã có sẵn. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
GPT — theo sát hướng dẫn chi tiết
gpt-5.6-solModel họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản.
gpt-5.6-sol-thinkingModel họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
gpt-5.6-terraModel họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản.
gpt-5.6-terra-thinkingModel họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
gpt-5.6-lunaModel họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản.
gpt-5.6-luna-thinkingModel họ GPT. Mạnh về làm theo hướng dẫn chi tiết và viết văn bản. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
Giá thấp, phù hợp việc thường ngày
minimax-m2.5Model của MiniMax, giá thấp, phù hợp việc thường ngày không đòi hỏi suy luận phức tạp.
minimax-m2.5-thinkingModel của MiniMax, giá thấp, phù hợp việc thường ngày không đòi hỏi suy luận phức tạp. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
minimax-m2.1Model của MiniMax, giá thấp, phù hợp việc thường ngày không đòi hỏi suy luận phức tạp.
minimax-m2.1-thinkingModel của MiniMax, giá thấp, phù hợp việc thường ngày không đòi hỏi suy luận phức tạp. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
GLM — cân bằng chi phí và chất lượng
glm-5Model GLM của Zhipu AI, cân bằng giữa chi phí và chất lượng.
glm-5-thinkingModel GLM của Zhipu AI, cân bằng giữa chi phí và chất lượng. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
Mạnh về lập trình và suy luận toán học
deepseek-3.2Model của DeepSeek, mạnh về lập trình và suy luận toán học với chi phí thấp.
deepseek-3.2-thinkingModel của DeepSeek, mạnh về lập trình và suy luận toán học với chi phí thấp. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.
Qwen — chuyên lập trình, giá thấp nhất
qwen3-coder-nextModel của Alibaba, chuyên về lập trình. Giá rất thấp nên phù hợp việc chạy nhiều lần hoặc xử lý khối lượng lớn.
qwen3-coder-next-thinkingModel của Alibaba, chuyên về lập trình. Giá rất thấp nên phù hợp việc chạy nhiều lần hoặc xử lý khối lượng lớn. Bản -thinking cho model suy nghĩ trước khi trả lời: chất lượng cao hơn nhưng sinh nhiều token đầu ra hơn nên tốn tiền hơn.