API chuẩn OpenAI cho các model mở hàng đầu
DeepSeek V4 · Kimi K2 · GLM
Giảm tới 40% so với giá nguồn · VietQR · trả trước
Không cần thẻ tín dụng · tính tiền theo token thật · giữ nguyên SDK OpenAI
curl https://api.clfaigateway.dev/v1/chat/completions \ -H "Authorization: Bearer sk-gw-..." \ -H "Content-Type: application/json" \ -d '{ "model": "kimi-k2.6", "messages": [{"role": "user", "content": "Hello!"}], "stream": true }'Model & giá
Giá USD trên 1 triệu token. ID model nguồn công khai — bạn biết chính xác thứ gì đang chạy.
| Model | Khả năng | Context | Input | Input (cache) | Output |
|---|---|---|---|---|---|
| glm-5.2Giảm 40%@cf/zai-org/glm-5.2 | toolsreasoningjson | 262K | |||
| kimi-k2.7-codeGiảm 40%@cf/moonshotai/kimi-k2.7-code | toolsvisionreasoning | 262K | |||
| kimi-k2.6Giảm 40%@cf/moonshotai/kimi-k2.6 | toolsvisionreasoning | 262K | |||
| glm-4.7-flashGiảm 40%@cf/zai-org/glm-4.7-flash | toolsreasoningfast | 131K | — | ||
| deepseek-v4-flashGiảm 40%@cf/deepseek-ai/deepseek-v4-flash-0731 | toolsreasoningfast | 1M | |||
| deepseek-v4-proGiảm 40%@cf/deepseek-ai/deepseek-v4-pro-0813 | toolsreasoningjson | 1M | |||
| qwen3.8-27bGiảm 40%@cf/qwen/qwen3.8-27b | toolsreasoningvision | 262K |
Trúng cache toàn phần chỉ tính 10% giá thường. Giá tại ngày 2026-08-18 — dashboard luôn hiện giá live.
HTTP/2 200content-type: text/event-streamx-gw-provider: cloudflare-workers-aix-gw-model: kimi-k2.6x-gw-cache: missx-ratelimit-limit: 60Header response từ một request thật, đã lược nội dung.
Bạn biết chính xác mình mua gì
CLF AI Gateway chạy trên Cloudflare Workers AI — và nói thẳng điều đó. ID nguồn của từng model đều công khai, và mỗi response cho bạn biết model nào vừa thực sự chạy.
- ID nguồn công khai: trang model nào cũng hiện định danh @cf/…
- Mỗi response mang header x-gw-provider và x-gw-model
- Số hiệu năng công bố kèm điều kiện đo
- Trạng thái hệ thống công khai — không cần đăng nhập
Chạy được trong ba bước
Tạo tài khoản
Đăng ký là có ngay API key sk-gw-…. Không cần thẻ tín dụng, khoảng 30 giây.
sk-gw-****************Nạp credit
Chuyển khoản VietQR tự xác nhận trong ~15 giây. Thẻ quốc tế cũng dùng được.
topup.confirmed · ~15 sTrỏ SDK về gateway
Đổi base_url, giữ nguyên SDK OpenAI. Có đủ streaming, tools, JSON mode.
base_url = "https://api.clfaigateway.dev/v1"Bạn nhận được gì
Thanh toán kiểu Việt Nam
Nạp bằng VietQR tự xác nhận trong ~15 giây, hoặc thẻ quốc tế qua Dodo Payments.
Câu hỏi thường gặp
Các họ model open-weight hàng đầu: DeepSeek V4 (DeepSeek), Kimi (Moonshot AI), GLM (Z.ai) và Qwen (Alibaba). DeepSeek V4 mang cửa sổ context 1 triệu token, Kimi mạnh về code và agentic tool use, GLM mạnh về reasoning, còn Qwen và Kimi nhận được ảnh đầu vào; cả bảy model đều hỗ trợ tool calls và streaming.
Xem tất cả model →Hoàn toàn được — ID model công khai mà. Gateway thêm vào: thanh toán trả trước bằng USD, nạp VietQR, log chi phí từng request, ưu đãi cache tự động và một endpoint chuẩn OpenAI duy nhất, với overhead đo thật p95 13,6 ms.
Bạn nạp credit trả trước; mỗi request trừ đúng chi phí token theo giá đang bán của model. Hết credit thì request mới bị từ chối ngay với lỗi rõ ràng — không subscription, không hóa đơn bất ngờ.
Tài liệu billing →Token đã sinh ra và gửi tới bạn thì tính. Request lỗi mà chưa sinh ra output nào thì giá đúng bằng $0 — đó là bảo hiểm zero-completion.
Tài liệu billing →Không. Log chỉ có metadata: số token, chi phí, độ trễ, model. Nội dung prompt/response xử lý trong bộ nhớ rồi bỏ — chính sách quyền riêng tư viết đúng như vậy.
Chính sách quyền riêng tư →Mỗi organization có giới hạn request/phút, token/phút và số request song song; response nào cũng báo lại qua header x-ratelimit-*. Cần thêm thì email cho chúng tôi.
Credit đã dùng thì không hoàn. Credit chưa dùng có thể hoàn theo từng trường hợp trong 14 ngày kể từ khi nạp; lỗi tính phí do hệ thống của chúng tôi thì luôn được hoàn đủ.
Điều khoản →Chuyển khoản VietQR tự xác nhận trong khoảng 15 giây, hoặc thẻ quốc tế qua Dodo Payments (Merchant of Record). Credit mua không hết hạn.