Trong tháng này, AIHubMix đã thêm khoảng 20 mô hình mới trong các lĩnh vực trò chuyện, mã, video và hình ảnh, và đã triển khai một số khả năng nền tảng. Khóa API hiện tại có thể truy cập nhiều hơn nữa. Dưới đây là những điểm nổi bật.
LLM Router
Đặt tên mô hình thành auto, và cổng sẽ chọn mô hình tốt nhất trong số hàng trăm mô hình trên nền tảng dựa trên yêu cầu của bạn, với các chiến lược ưu tiên chi phí, chất lượng hoặc độ trễ thấp, được tính phí theo mô hình mà nó thực sự truy cập. Không cần so sánh thủ công hay chuyển đổi mô hình, và không cần thay đổi mã khách hàng. Xem LLM Router.
Bất kỳ mô hình nào trên giao thức Responses
Điểm cuối /v1/responses không còn bị giới hạn trong gia đình GPT: nó giờ đây có thể gọi bất kỳ mô hình nào trên nền tảng. Các công cụ được xây dựng trên giao thức Responses (chẳng hạn như Codex CLI) do đó có thể sử dụng GLM, Gemini, DeepSeek, Kimi, Qwen, và nhiều hơn nữa thông qua một danh mục mô hình cục bộ, thay vì bị giới hạn trong các mô hình chính thức của OpenAI. Xem Codex CLI · Mô hình tùy chỉnh.
Mapping mô hình & Dự phòng
Cấu hình ánh xạ bí danh và dự phòng lỗi theo khóa API trong bảng điều khiển: khách hàng của bạn có thể sử dụng bất kỳ tên mô hình nào, mà cổng sẽ viết lại thành mô hình mục tiêu thực tế; nếu mô hình chính gặp sự cố, nó sẽ tự động chuyển sang một mô hình dự phòng, được tính phí theo mô hình cuối cùng phản hồi. Một sự cố nhỏ sẽ không làm gián đoạn lưu lượng sản xuất của bạn, và mã khách hàng vẫn không bị thay đổi. Xem Mapping mô hình & Dự phòng.
AIHubMix CLI
Một tệp nhị phân duy nhất với không có phụ thuộc: không cần Python, Node, hoặc Go. Truy vấn số dư của bạn, quản lý khóa API, và liệt kê các mô hình có sẵn ngay từ terminal, với hỗ trợ hàng đầu cho các kịch bản và tác nhân AI như Claude Code. Xem AIHubMix CLI.
AIHubMix Skill (mở rộng cho các tác nhân lập trình AI)
Một mở rộng cục bộ cho các tác nhân AI hỗ trợ Kỹ năng (Codex, Claude Code, Cursor, Cline, và nhiều hơn nữa). Sử dụng ngôn ngữ tự nhiên để tích hợp AIHubMix, truy vấn các mô hình, chọn theo khả năng, tạo ví dụ, và khắc phục lỗi. Kỹ năng đọc thông tin mô hình, giá cả, và giao thức trực tiếp từ các API chính thức của AIHubMix theo yêu cầu, vì vậy tác nhân không bao giờ phụ thuộc vào danh sách mô hình cũ. Xem Kỹ năng.
Tên miền dự phòng: api.inferera.com
Khi tên miền chính aihubmix.com không thể truy cập hoặc hết thời gian, hãy chỉ định yêu cầu của bạn đến https://api.inferera.com. Các điểm cuối và khả năng là giống nhau: khóa API, mô hình, và nội dung yêu cầu của bạn không thay đổi.
Cũng đã được phát hành
- Đầu vào âm thanh Gemini: điểm cuối tương thích với OpenAI (
/v1/chat/completions) hiện chấp nhậninput_audiovà trả về audio_tokens trong sử dụng. - Nỗ lực lý luận GLM 5.2: kênh Zhipu gốc hỗ trợ
reasoning_effortđể điều chỉnh độ sâu suy nghĩ. - Tích hợp Open Design: AIHubMix hiện là cổng BYOK tích hợp cho Open Design.
- Sửa lỗi plugin OpenClaw: aihubmix-auth đã được sửa và ổn định để sử dụng.
Ổn định & sửa lỗi
- Cải thiện độ chính xác tính phí và độ chính xác đo lường bộ nhớ đệm.
- Sửa lỗi thiếu mô hình trong
/v1/models. - Sửa một số vấn đề trong việc tạo video và kiểm tra kênh.
Mô hình mới trong tháng này (~20)
Trò chuyện / Chung
- claude-fable-5 [Ngừng hoạt động]: Thế hệ mới nhất của Claude, với các rào cản an toàn mạnh mẽ hơn (xem Changelog · Ghi chú Fable 5).
- minimax-m3, qwen3.7-plus, glm-5.2, và Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
Mã
- kimi-k2.7-code và kimi-k2.7-code-highspeed: Dòng mã của Kimi, bao gồm một biến thể tốc độ cao.
- coding-glm-5.2 và miễn phí coding-glm-5.2-free.
Video
- Kling: chuyển văn bản thành video, hình ảnh thành video, tham chiếu đa hình ảnh, và tạo đa phương thức toàn diện.
- happyhorse-1.1: chuyển văn bản thành video (t2v), tham chiếu (r2v), và hình ảnh thành video (i2v).
Hình ảnh
- Baidu musesteamer-air-image cho việc tạo hình ảnh.
Cũng mới
- grok-build-0.1, hy3-preview, và miễn phí step-3.7-flash-free.
Giá cả & thông báo
- step-3.7-flash, giảm 90% (thời gian có hạn): $0.022 / M token đầu vào, $0.132 / M token đầu ra.
- Ngừng hoạt động & tự động định tuyến:
claude-opus-4-20250514vàclaude-sonnet-4-20250514đã bị ngừng hoạt động bởi nhà cung cấp mô hình vào ngày 15 tháng 6; nền tảng tự động định tuyến chúng đến các phiên bản cùng gia đình 4-5.
Câu hỏi thường gặp
Các mô hình nào đã được thêm vào tháng này?
Khoảng 20 mô hình, trải dài từ trò chuyện (claude-fable-5 [Ngừng hoạt động], minimax-m3, qwen3.7-plus, glm-5.2, dòng doubao-seed-2-1), mã (dòng kimi-k2.7-code, coding-glm-5.2), video (Kling, happyhorse-1.1), và hình ảnh (musesteamer-air-image).
Làm thế nào để tôi sử dụng LLM Router?
Đặt tên mô hình trong yêu cầu của bạn thành auto; cổng sẽ chọn mô hình tốt nhất dựa trên yêu cầu của bạn và tính phí theo mô hình mà nó thực sự truy cập, mà không cần thay đổi mã khách hàng. Xem LLM Router.
Điều gì xảy ra nếu tên miền chính không thể truy cập?
Thay thế địa chỉ yêu cầu bằng tên miền dự phòng https://api.inferera.com. Các điểm cuối và khả năng là giống nhau, và không cần thay đổi tham số nào.
Giá trong thời gian có hạn cho step-3.7-flash là gì?
$0.022 / M token đầu vào và $0.132 / M token đầu ra.
Duyệt tất cả các mô hình trên danh mục mô hình, và tìm chi tiết tích hợp trong tài liệu.
Cập nhật: 2026-06-30