So sánh giá GLM-5.3-Flash: OpenRouter, Z.ai và AIHubMix

AIHubMixĐọc 4 phút
So sánh giá GLM-5.3-Flash: OpenRouter, Z.ai và AIHubMix

GLM-5.3-Flash là mô hình đa phương thức gốc của Z.ai tập trung vào hiệu quả. Nó hỗ trợ cửa sổ ngữ cảnh khoảng một triệu token, chấp nhận đầu vào văn bản, hình ảnh và video, và nhắm đến các tác nhân lập trình, lý luận phức tạp và kỹ thuật phần mềm dài hạn. Đối với các khối lượng công việc tiêu thụ một lượng lớn token qua nhiều lần lặp, ngay cả một sự khác biệt nhỏ trong giá truy cập cũng có thể nhanh chóng tích lũy.

Tính đến ngày 1 tháng 9 năm 2026, API chính thức của Z.aiđường dẫn Z.ai trên OpenRouter đều niêm yết GLM-5.3-Flash với giá $0.075 cho mỗi triệu token đầu vào, $0.25 cho mỗi triệu token đầu ra, và $0.015 cho mỗi triệu token đầu vào được lưu trữ. Kế hoạch trả theo mức sử dụng của OpenRouter cũng tính phí 5.5% phí nền tảng. Trong cùng một chương trình khuyến mãi, AIHubMix GLM-5.3-Flash được niêm yết với giá $0.056 cho mỗi triệu token đầu vào, $0.197 cho mỗi triệu token đầu ra, và $0.014 cho mỗi triệu token đầu vào được lưu trữ.

Cả ba tùy chọn đều cung cấp quyền truy cập vào cùng một mô hình, nhưng giá cả, hành vi định tuyến và các tính năng nền tảng không giống nhau.

So sánh giá GLM-5.3-Flash

Tùy chọn truy cập Đầu vào / 1M token Đầu ra / 1M token Đọc bộ nhớ đệm / 1M token Phí nền tảng Giá trước khi giảm giá (đầu vào / đầu ra / bộ nhớ đệm) Định vị
API chính thức của Z.ai $0.075 $0.250 $0.015 Không có $0.150 / $0.500 / $0.030 API chính thức trực tiếp
OpenRouter (nhà cung cấp Z.ai) $0.075 $0.250 $0.015 5.5% $0.150 / $0.500 / $0.030 API thống nhất với định tuyến đa nhà cung cấp
AIHubMix GLM-5.3-Flash $0.056 $0.197 $0.014 Không có $0.113 / $0.394 / $0.028 Giá hiện tại thấp hơn với dự phòng đa nhà cung cấp

Tất cả các giá trên là mức giá hiển thị cho mỗi triệu token, được làm tròn để phù hợp với các trang giá công khai. Các chương trình khuyến mãi có thời hạn 50% trên AIHubMix, OpenRouter và Z.ai đều kết thúc vào ngày 9 tháng 9 năm 2026 lúc 16:00 UTC (ngày 10 tháng 9 lúc 00:00 UTC+8).

Phí nền tảng 5.5% của OpenRouter

Trang giá của OpenRouter liệt kê một phí nền tảng 5.5% cho các tài khoản trả theo mức sử dụng. OpenRouter cũng cho biết rằng họ không tăng giá các nhà cung cấp được hiển thị trong danh mục mô hình của họ. Nói cách khác, $0.075 / $0.25 vẫn là giá niêm yết cho việc suy diễn mô hình, nhưng phí nền tảng vẫn cần được bao gồm trong tổng số tiền phải trả cho các tín dụng.

Nếu phí 5.5% được phân bổ theo tỷ lệ cho việc sử dụng mô hình và tất cả các tín dụng đã mua được sử dụng, chi phí hiệu quả của OpenRouter cho đường dẫn Z.ai khoảng:

  • Đầu vào: $0.0791 cho mỗi triệu token
  • Đầu ra: $0.2638 cho mỗi triệu token
  • Đọc bộ nhớ đệm: $0.0158 cho mỗi triệu token

Ví dụ về chi phí ở các tỷ lệ bộ nhớ đệm khác nhau

Theo tài liệu về bộ nhớ đệm ngữ cảnh của Z.ai, các lời nhắc hệ thống lặp lại, lịch sử cuộc trò chuyện và các ngữ cảnh chia sẻ khác có thể được phát hiện và lưu trữ tự động mà không cần cấu hình thủ công. Các token được phục vụ từ bộ nhớ đệm sẽ được tính phí theo tỷ lệ đọc bộ nhớ đệm thay vì tỷ lệ đầu vào tiêu chuẩn.

Không có một tỷ lệ bộ nhớ đệm nào đại diện cho mọi khối lượng công việc:

  • Một yêu cầu đơn lẻ, hoặc một nhiệm vụ với đầu vào hoàn toàn khác nhau mỗi lần, có thể có tỷ lệ bộ nhớ đệm gần 0%.
  • Các công việc theo lô tái sử dụng một lời nhắc hệ thống cố định có thể đạt được tỷ lệ bộ nhớ đệm cao hơn một cách có ý nghĩa.
  • Các tác nhân lập trình đa lượt thường xuyên mang theo các hướng dẫn hệ thống, ngữ cảnh mã và lịch sử cuộc trò chuyện. Các yêu cầu sau này của họ có thể có tỷ lệ bộ nhớ đệm cao, mặc dù nội dung thay đổi, sự khác biệt về định dạng và thời gian hết hạn bộ nhớ đệm có thể làm giảm nó.

Để tách biệt sự khác biệt về giá, các ví dụ dưới đây giả định một triệu token đầu vào tổng cộng và một triệu token đầu ra, với cùng một tỷ lệ bộ nhớ đệm trên cả hai nền tảng. Tổng của OpenRouter bao gồm phí nền tảng 5.5% của nó.

Tỷ lệ bộ nhớ đệm đầu vào AIHubMix Chi phí mô hình OpenRouter OpenRouter bao gồm phí nền tảng Tiết kiệm của AIHubMix so với tổng OpenRouter
0% (yêu cầu lạnh) $0.253 $0.325 $0.343 26.2%
50% $0.232 $0.295 $0.311 25.5%
80% (ngữ cảnh lặp lại cao) $0.219 $0.277 $0.292 24.9%

Các phép tính là: token đầu vào tiêu chuẩn x tỷ lệ đầu vào + token được lưu trữ x tỷ lệ đọc bộ nhớ đệm + token đầu ra x tỷ lệ đầu ra. Ở tỷ lệ bộ nhớ đệm 80%, ví dụ, một triệu token đầu vào tổng cộng được chia thành 200,000 token đầu vào tiêu chuẩn và 800,000 token đầu vào được lưu trữ.

Các tỷ lệ bộ nhớ đệm cao hơn làm giảm tổng chi phí trên cả hai nền tảng. Bởi vì sự khác biệt giữa các tỷ lệ đọc bộ nhớ đệm của họ nhỏ hơn sự khác biệt giữa các tỷ lệ đầu vào và đầu ra tiêu chuẩn của họ, tiết kiệm tương đối của AIHubMix giảm nhẹ khi tỷ lệ bộ nhớ đệm tăng lên. Trong các ví dụ này, tiết kiệm vẫn khoảng 24.9% đến 26.2%.

Tại sao giá token thấp nhất không phải là yếu tố duy nhất

Chỉ dựa trên tỷ lệ token hiện tại, AIHubMix là tùy chọn truy cập rẻ nhất trong ba tùy chọn. Một quyết định sản xuất vẫn nên xem xét hành vi định tuyến và khả năng của nền tảng.

API chính thức của Z.ai là sự lựa chọn tự nhiên cho các nhóm ưa thích tích hợp trực tiếp với nhà cung cấp và muốn giảm thiểu các lớp trung gian.

OpenRouter cung cấp một API thống nhất và một hệ sinh thái đa nhà cung cấp rộng lớn. Khi các yêu cầu được gán cho Z.ai, tỷ lệ trong danh mục của nó khớp với giá chính thức của Z.ai, nhưng người dùng trả theo mức sử dụng cũng phải trả phí nền tảng 5.5%. Nếu OpenRouter được phép tự động chọn các nhà cung cấp khác, giá mô hình, độ trễ và tỷ lệ đọc bộ nhớ đệm có thể thay đổi theo đường dẫn đã chọn.

AIHubMix hiện tại kết hợp giá đầu vào và đầu ra thấp hơn với việc theo dõi nhà cung cấp và dự phòng khi một nhà cung cấp phía trên gặp sự cố hoặc phản hồi quá chậm. Sự kết hợp đó đặc biệt hữu ích cho các tác nhân lập trình nhạy cảm với chi phí, xử lý theo lô và các khối lượng công việc tiêu tốn nhiều token khác.

Điểm rút ra thực tiễn

Tính đến ngày 1 tháng 9 năm 2026, API chính thức của Z.ai và đường dẫn Z.ai của OpenRouter có cùng tỷ lệ danh mục: $0.075 cho mỗi triệu token đầu vào và $0.25 cho mỗi triệu token đầu ra. OpenRouter trả theo mức sử dụng cũng tính phí nền tảng 5.5%. AIHubMix hiện tại tính phí $0.056 cho mỗi triệu token đầu vào và $0.197 cho mỗi triệu token đầu ra. Trong các kịch bản bộ nhớ đệm đầu vào từ 0% đến 80% ở trên, AIHubMix có chi phí thấp hơn khoảng 24.9% đến 26.2% so với OpenRouter sau khi đã bao gồm phí nền tảng.

Nếu mục tiêu chính là giảm chi phí token GLM-5.3-Flash cho lập trình, đánh giá và quy trình làm việc của tác nhân, AIHubMix GLM-5.3-Flash hiện là tùy chọn có chi phí thấp hơn. OpenRouter vẫn có giá trị khi một điểm cuối đa nhà cung cấp thống nhất và định tuyến linh hoạt quan trọng hơn, trong khi API chính thức của Z.ai là con đường trực tiếp với nhà cung cấp.

Giá cả, chương trình khuyến mãi và sự sẵn có của nhà cung cấp có thể thay đổi. Hãy kiểm tra các trang giá liên kết trước khi cam kết một khối lượng công việc lâu dài.