Bảng giá model

Bảng giá model API minh bạch theo usage.

Trang này giải thích rõ cách tính chi phí API theo usage thực tế. Bạn có thể xem giá theo từng model, giá bán sau hệ số, quy đổi sang quota và cách tự kiểm tra chi phí của mỗi request.

Tổng model
...
Giá rẻ nhất
...
Ưu tiên
...
Hệ số
...
Đang tải bảng giá...
Model Short ≤300K / 1M tokens Long >300K / 1M tokens Hệ số bán
Input
giá gốc
Output
giá gốc
Cache
giá gốc
Input
giá gốc
Output
giá gốc
Cache
giá gốc
Giá bán

Cách tính chi phí

Gateway tính theo số token thực tế của từng request. Mỗi model có giá riêng cho input, output và cache. Giá trong bảng là giá gốc trên mỗi 1 triệu token; giá bán được nhân với hệ số hiện tại.

normal_input_tokens = input_tokens - cache_read_tokens input_cost = normal_input_tokens / 1,000,000 × input_price cache_cost = cache_read_tokens / 1,000,000 × cache_price output_cost = output_tokens / 1,000,000 × output_price final_usd = (input_cost + cache_cost + output_cost) × sell_multiplier quota_used = final_usd × quota_per_usd

Short: tổng input usage ≤ 300.000 token. Long: tổng input usage > 300.000 token.

Cache token không tính như input thường; cache được áp dụng mức giá riêng thấp hơn nếu model có cấu hình.

Quy đổi tiền và quota

1 USD...
1 quota...
1 token inputTùy model
1 token outputTùy model

Ví dụ token bên trên áp dụng cho model đang tải..., đã bao gồm hệ số bán. Mỗi model có giá khác nhau.

Lưu ý

Gateway tạm giữ quota trước khi gọi API, sau đó quyết toán theo usage thật từ upstream.

Request lỗi sẽ được hoàn quota. Nếu upstream không gửi usage, gateway dùng cơ chế ước tính dự phòng đã cấu hình.