Cơ chế tính chi phí AI
Giúp Admin hiểu rate, token, giây video và cách Budget được giữ rồi quyết toán trong VideoMaker.
OpenAI tính theo token
Token là đơn vị mà model đọc và tạo ra; không đồng nhất tuyệt đối với số từ hay số ký tự.
InputToken
Prompt, chủ đề, hướng dẫn hệ thống và dữ liệu gửi vào OpenAI.
OutputToken
Content plan, kịch bản và prompt cảnh do OpenAI sinh ra.
(InputToken × giá Input) + (OutputToken × giá Output)Mỗi thành phần được chia theo đơn vị rate: Token, 1KTokens hoặc MillionTokens.| Đơn vị rate | Công thức cho một loại token | Ví dụ nếu dùng 10.000 token |
|---|---|---|
| Token | giá × số token | giá × 10.000 |
| 1KTokens | giá × số token / 1.000 | giá × 10 |
| MillionTokens | giá × số token / 1.000.000 | giá × 0,01 |
Server ước tính token trước khi gọi OpenAI như thế nào?
Số cảnh = làm tròn lên(thời lượng video / 15 giây)
Input ước tính = max(2.000; 1.500 + số ký tự chủ đề / 3)
Output ước tính = min(8.000; 2.000 + số cảnh × 300)
Số ước tính chỉ dùng để giữ Budget. Khi OpenAI trả usage, server quyết toán lại bằng số token thực tế và rate snapshot.
Kling tính theo giây video
VideoMaker dùng rate VideoSecond; thời lượng càng dài thì khoản giữ càng lớn.
Số giây provider × đơn giá VideoSecond của đúng modelKling và Fal/Veo dùng 720p + Native Audio. Fal Standard/Fast phải có rate riêng theo endpoint; không dùng chung một đơn giá.Budget đi qua bốn trạng thái
Server luôn kiểm tra và giữ tiền trước outbound call để tránh vượt hạn mức tổ chức hoặc thành viên.
- 1Ước tínhChọn model và rate đang Active.
- 2ReservationGiữ chi phí dự kiến trong Budget.
- 3Provider xử lýOpenAI trả usage; Kling hoàn thành task.
- 4Actual hoặc ReleaseThành công thì quyết toán; lỗi/hủy thì giải phóng khoản giữ.
Request giữ bản chụp rate lúc bắt đầu. Thay giá sau đó không làm đổi chi phí của request cũ.
Budget − Actual − Reserved. Request mới chỉ chạy khi phần còn lại đủ để reserve.
Nếu OpenAI không trả usage hoặc Kling không báo actual cost, hệ thống dùng chi phí đã ước tính.
Minh họa bằng rate đang Active
Khu vực này đọc bảng giá hiện hành, không hard-code giá provider trong tài liệu.
Phạm vi và giới hạn hiện tại
- Mỗi model OpenAI, gồm model Text và GPT-Image-2, cần rate InputToken và OutputToken riêng; không dùng rate của model Text để tính ảnh. VideoMaker chưa tách riêng cached input, tool fee, long-context, regional processing hoặc chương trình giảm giá.
- Kling hiện dùng một VideoSecond rate cho model; bảng giá theo resolution, audio và loại workflow phải được Admin quy đổi đúng với cấu hình thực tế.
- Luôn lấy giá từ hợp đồng hoặc Developer Console của chính tài khoản đang gắn credential. Không sao chép giá từ blog hoặc dịch vụ trung gian.