Skip to content

Quota token & overage

This content is not available in your language yet.

TrolyPage không tính phí AI theo “số câu trả lời”. Mức dùng được đo bằng token — đơn vị text mà LLM xử lý. Mỗi gói có quota token/tháng, khi vượt sẽ chuyển sang overage (trừ ví).

LLM không đếm “số từ” hay “số câu”. Token là đơn vị nhỏ hơn — ~¾ từ tiếng Việt = 1 token (do tiếng Việt nhiều dấu). Có 2 loại:

  • Input token — toàn bộ ngữ cảnh AI nhận: system prompt + knowledge + hội thoại trước + câu hỏi khách.
  • Output token — câu trả lời AI sinh.

Mỗi lần AI trả lời khách = (input + output) token được cộng vào quota.

Loại Ước token Khi nào
Ngắn 500-1.000 Chào, giá 1 sản phẩm, xác nhận
Thường 1.000-2.000 Mô tả sp + tư vấn ngắn
Dài 2.000-4.000 So sánh nhiều sp, tư vấn phức tạp
Có tool 3.000-6.000+ Tạo đơn + QR + ship + research

Chỉ là ước

Thực tế phụ thuộc: model (gpt-5-mini ít hơn gpt-5), độ dài knowledge nạp, số tool gọi, độ dài hội thoại. Con số thật xem ở Billing → Tokens tháng này.

Mỗi gói có max_tokens_per_month — tổng token AI dùng được trong 1 tháng chu kỳ.

Giá và hạn mức hiện hành nằm trong bảng giá. Không quy đổi hạn mức thành số phản hồi cố định. Thanh toán năm vẫn có cửa sổ quota riêng mỗi tháng, neo theo chu kỳ sử dụng.

flowchart LR
    A[Khách nhắn] --> B[Reserve token<br/>~max_tokens agent]
    B --> C{Còn quota?}
    C -- Có --> D[Gọi LLM]
    C -- Hết --> E{Pay-as-you-go<br/>+ ví đủ?}
    E -- Có --> D
    E -- Không --> F[AI nghỉ<br/>không trả lời]
    D --> G[AI trả lời<br/>+ đếm token thật]
    G --> H[Settle: hoàn dư<br/>hoặc cộng thêm]

Trước khi gọi LLM, hệ thống reserve ~max_tokens của Agent (mặc định 2.000 token) khỏi quota. Đây là ước lượng trước, tránh AI chạy xong mới phát hiện hết quota.

Nếu quota còn (hoặc pay-as-you-go OK) → gọi LLM. AI trả lời + dùng tool.

LLM xong → đếm token thật (input + output) → settle:

  • Thực < reserve → hoàn token dư về quota.
  • Thực > reserve → cộng thêm vào quota (có thể đẩy qua overage).

Khi tổng token tháng > max_tokens_per_month:

Điều kiện Xảy ra gì
Bật pay-as-you-go + ví đủ Tiếp tục trả lời → trừ ví 20đ/1.000 token
Tắt pay-as-you-go HOẶC ví = 0 AI nghỉ — khách nhắn không nhận trả lời
Loại Giá
Token 0,02đ/token (20đ / 1.000 token)
Ảnh AI 3.000đ/ảnh
Voice 500đ/giây
Video 2.000đ/giây

Có thể cấu hình max_daily_overage_vnd — khi overage trong ngày đạt giới hạn → AI nghỉ dù ví còn tiền. Tránh “cháy ví” bất ngờ.

Trong Ví tài khoản:

  • Bật “Tự động thanh toán overage” → hết quota vẫn trả lời, trừ ví.
  • Tắt → hết quota là nghỉ, ví không bị đụng.
Tình huống Khuyên
Shop chạy ads, cần AI 24/7 Bật + giữ ví có dư
Shop nhỏ, hết quota OK nghỉ Tắt + nâng gói khi cần
Test gói trial Tắt để tránh phát sinh

Trong Thanh toán (/app/billing) → section “Tổng quan quota”:

  • Tokens tháng này — tổng đã dùng.
  • Input / Output — phân tách (input thường >> output do phải đọc knowledge + history).
  • Progress bar so với max_tokens_per_month.

Hệ thống tự gửi email khi:

  • 80% quota — “Sắp hết quota, xem xét nâng gói.”
  • 95% quota — “Sắp hết, bật pay-as-you-go hoặc nâng gói.”

Bật email alert

Trong Hồ sơ → bật email notification để nhận 2 alert này. Không bật = không biết đến khi AI nghỉ.

Muốn quota kéo dài hơn:

Cách Hiệu quả
Dùng model mini/fast (gpt-5-mini) cho Agent Giảm ~50-70% token
Rút gọn system prompt (bỏ dài dòng) Giảm input token mỗi câu
Knowledge gọn — không dump toàn bộ web Giảm input token khi tra
Đóng hội thoại cũ (khách đi) Tránh AI đọc lại history dài
Tắt tool không cần (vd research_mode) Ít tool call = ít token

Nếu khách báo “nhắn mà không ai trả lời” → check:

  1. Billing → Tokens tháng này có = 100% quota?
  2. Pay-as-you-go bật không? Ví có dư không?
  3. Nếu = 100% + không pay-as-you-go → AI nghỉ.

Fix nhanh: bật pay-as-you-go + nạp ví, HOẶC nâng gói (quota cao hơn ngay).