Bỏ qua tới nội dung chính
VNSO
Nền tảng lập trìnhMới

AI Inference API

Gọi mô hình AI mã nguồn mở qua API, dữ liệu không rời Việt Nam

Triển khai và gọi các mô hình ngôn ngữ, nhận dạng giọng nói và tạo ảnh mã nguồn mở qua API tương thích OpenAI. Toàn bộ suy luận chạy trên GPU đặt tại Việt Nam nên độ trễ thấp và dữ liệu không gửi ra nước ngoài.

Phù hợp cho

Chatbot chăm sóc khách hàngTóm tắt tài liệu nội bộTìm kiếm ngữ nghĩaChuyển giọng nói thành văn bảnỨng dụng cần dữ liệu ở trong nước

Giá khởi điểm

Miễn phí

mỗi trả theo token

  • Không phí khởi tạo
  • Huỷ bất kỳ lúc nào
  • Hoàn tiền 7 ngày đầu
  • Hỗ trợ tiếng Việt 24/7

Tính năng

Những gì bạn nhận được với AI API

Tương thích OpenAI API

Đổi base URL là chạy, không phải viết lại code tích hợp.

Dữ liệu ở trong nước

Prompt và kết quả không rời khỏi lãnh thổ Việt Nam.

Mô hình tiếng Việt

Có sẵn các mô hình được fine-tune riêng cho tiếng Việt.

Triển khai riêng

Chạy mô hình của bạn trên GPU dành riêng, không chia sẻ với ai.

Trả theo mức dùng

Tính theo token thực tế, không phí tối thiểu.

Độ trễ thấp

Thời gian tới token đầu tiên dưới 300ms cho người dùng trong nước.

Bảng giá

Giá đề xuất theo mô hình

Tính trên mỗi một triệu token. Mô hình chạy trên GPU đặt tại Việt Nam.

Mô hình nhỏ (7–8B) — input4.000đ/1M token
Mô hình nhỏ (7–8B) — output12.000đ/1M token
Mô hình lớn (70B) — input24.000đ/1M token
Mô hình lớn (70B) — output72.000đ/1M token
Nhận dạng giọng nói2.400đ/giờ audio
GPU dành riêng28.080.000đ/A100 40GB/tháng

Bắt đầu với 200.000đ credit miễn phí

Không cần thẻ tín dụng, không phí khởi tạo. Tạo tài khoản, chọn cấu hình và có máy chủ chạy trong chưa đầy một phút.

Đã có hơn 12.000 khách hàng tin dùng · Chuyển dữ liệu sang miễn phí