
Viettel Model as a Service (vMaaS) là dịch vụ cung cấp các mô hình AI dưới dạng API tương thích chuẩn OpenAI, hỗ trợ đa tác vụ xử lý ngôn ngữ (LLM), thị giác máy tính, tạo ảnh và embedding. Vận hành an toàn trên hạ tầng Trung tâm dữ liệu Viettel IDC tại Việt Nam với nền tảng Qualcomm AI Inference Suite tối ưu hiệu năng và chi phí, không cần đầu tư hạ tầng GPU/NPU.
Viettel Model as a Service (vMaaS) là dịch vụ cung cấp các mô hình AI dưới dạng API theo chuẩn tương thích OpenAI. Doanh nghiệp có thể nhanh chóng tích hợp trí tuệ nhân tạo vào ứng dụng, chatbot CSKH, kho tri thức (RAG) hoặc quy trình tự động hóa mà không cần đầu tư máy chủ phần cứng GPU/NPU đắt đỏ hay xây dựng đội ngũ MLOps chuyên biệt.
Hệ thống được vận hành 100% trên hạ tầng Trung tâm Dữ liệu chuẩn quốc tế ANSI/TIA-942 Rated 3 của Viettel IDC tại Việt Nam, ứng dụng nền tảng tăng tốc Qualcomm AI Inference Suite mang lại độ trễ suy luận siêu thấp, thông lượng vượt trội và đáp ứng trọn vẹn chủ quyền an toàn dữ liệu.
Hỗ trợ các mô hình AI hiểu sâu ngữ cảnh tiếng Việt, tối ưu cho tài chính - ngân hàng, bán lẻ và hành chính công.
Chuyển đổi và tích hợp nhanh chóng bằng cách đổi Endpoint & API Key trong OpenAI SDK mà không cần viết lại mã nguồn.
Triển khai 100% tại TTDL Viettel IDC Việt Nam, cam kết dữ liệu doanh nghiệp không bị sử dụng để đào tạo mô hình bên thứ ba.
Đa dạng gói token từ thử nghiệm đến quy mô lớn, chi phí minh bạch, không tốn phí đầu tư hạ tầng phần cứng
Starter Dev
5M Token / tháng
Freelance Dev
10M Token / tháng
SME / Doanh nghiệp
50M Token / tháng
ISV & Agency
100M Token / tháng
Tập đoàn / FinTech / Gov
Không giới hạn (Theo nhu cầu)
Gói thiết kế riêng biệt cho hạ tầng quy mô lớn
Doanh nghiệp lớn/tập đoàn có nhu cầu token lớn, cấu hình riêng hoặc triển khai BYOM (Bring Your Own Model).
Block 1.000.000 token
Gói bổ sung khi khách hàng cần mở rộng dung lượng ngoài giới hạn mức gói chính.
Không phân biệt Input/Output token; Không giới hạn token/phút và API request/phút; Context length tối đa 8K; Max output tối đa 8K; Bảng giá chưa bao gồm thuế VAT.
Cần giải pháp lớn hơn? Chúng tôi hỗ trợ may đo cấu hình riêng biệt với sản lượng hàng tỷ token/tháng, triển khai mô hình riêng (BYOM) hoặc xây dựng cụm Dedicated Endpoint biệt lập với cam kết SLA cao nhất.
* Toàn bộ bảng giá dịch vụ chưa bao gồm thuế VAT (10%). Quý khách có thể mua thêm Add-on Token hoặc nâng cấp gói bất cứ lúc nào.
Hạ tầng tính toán AI hiệu năng cao, chủ quyền dữ liệu 100% nội địa và tương thích hoàn toàn chuẩn OpenAI SDK
Vận hành an toàn tại TTDL tiêu chuẩn quốc tế ANSI/TIA-942 Rated 3 của Viettel IDC tại Hòa Lạc, Hoàng Hoa Thám và Bình Dương.
Trang bị phần cứng gia tốc AI chuyên dụng và Qualcomm AI Inference Suite mang lại thông lượng cao và thời gian phản hồi token đầu tiên < 50ms.
Hệ thống Gateway thông minh tự động phân phối tải giữa các cụm inference, đảm bảo độ sẵn sàng dịch vụ ≥ 99.9% kể cả khi tải đột biến.
from openai import OpenAI
# Khởi tạo client tương thích chuẩn OpenAI với Endpoint Viettel vMaaS
client = OpenAI(
base_url="https://api.vmaas.viettelidc.com.vn/v1",
api_key="vmaas_sec_xxxxxxxxxxxxxxxxxxxx"
)
response = client.chat.completions.create(
model="Qwen/Qwen3-14B",
messages=[
{"role": "system", "content": "Bạn là trợ lý AI chuyên nghiệp của Viettel IDC."},
{"role": "user", "content": "Tư vấn cho tôi giải pháp Cloud Server bảo mật cao."}
],
temperature=0.7,
max_tokens=1024
)
print(response.choices[0].message.content)Hệ thống mô hình SOTA được triển khai sẵn, tối ưu hóa tốc độ phản hồi và độ trễ cực thấp
| Tên Mô Hình | Phân Loại | Độ Dài Ngữ Cảnh | Năng Lực & Ứng Dụng Nổi Bật |
|---|---|---|---|
Qwen/Qwen3-32BPhổ Biến | LLM Reasoning & Agent | 32.768 tokens (32K) | Suy luận logic sâu, phân tích hợp đồng phức tạp, Tool Calling, RAG nâng cao. |
Qwen/Qwen3-14BKhuyên Dùng | LLM Chat & CSKH | 32.768 tokens (32K) | Cân bằng tối ưu giữa hiệu năng và chi phí, lý tưởng cho Chatbot CSKH, tóm tắt. |
Meta-llama/Llama-3.1-8BMeta SOTA | LLM Đa Ngữ Cảnh Dài | 128.000 tokens (128K) | Hỏi đáp tài liệu siêu dài, coding và xử lý văn bản đa ngôn ngữ. |
Aisingapore/Llama-SEA-LION-v3.5-8BSEA Focus | LLM Ngữ Cảnh Tiếng Việt & ĐNÁ | 8.192 tokens (8K) | Tối ưu sâu cho tiếng Việt, văn hóa bản địa, dịch thuật ngữ nghĩa địa phương. |
Qwen/Qwen 2.5-VL-7B-InstructMultimodal | Vision-Language Model (VLM) | 16.384 tokens (16K) | Đọc hiểu hình ảnh, bóc tách biểu đồ, hóa đơn, nhận diện văn bản OCR chữ viết tay. |
BAAI/bge-m3 & bge-reranker-v2-m3RAG Essential | Embedding & Reranker | 8.192 tokens (8K) | Embedding đa ngôn ngữ cho hệ thống tìm kiếm ngữ nghĩa và Enterprise RAG. |
Loại bỏ hoàn toàn gánh nặng đầu tư máy chủ GPU/NPU đắt đỏ và chi phí vận hành đội ngũ MLOps chuyên biệt.
Tích hợp ngay trong 60 giây bằng cách đổi Endpoint & API Key trong OpenAI SDK mà không cần viết lại mã nguồn.
Danh mục mô hình AI được tinh chỉnh sâu sắc cho ngữ cảnh tiếng Việt, hành chính công, bán lẻ và ngân hàng.
Vận hành tại TTDL Viettel IDC Việt Nam, tuân thủ Nghị định 13/2023/NĐ-CP và cam kết không train mô hình bên thứ ba.
Đảm bảo dịch vụ suy luận liên tục với hệ thống cân bằng tải đa cụm và chính sách bồi thường dịch vụ minh bạch.
Đội ngũ kỹ sư giải pháp AI người Việt hỗ trợ trực tiếp 24/7/365, cung cấp hóa đơn tài chính VAT đầy đủ.
Đáp ứng hoàn hảo mọi nhu cầu tích hợp trí tuệ nhân tạo từ môi trường lập trình thử nghiệm đến hệ thống sản xuất cốt lõi của doanh nghiệp.
Tích hợp Qwen3-14B vào website, app di động và Zalo OA, tự động giải đáp 85% thắc mắc thường gặp với tốc độ dưới 1 giây.
Kết hợp BGE-M3 (Vector Embedding) và Qwen3-32B để nhân viên tra cứu chính xác quy trình, hợp đồng kèm trích dẫn nguồn.
Sử dụng Llama-3.1-8B (ngữ cảnh 128K) và Qwen 2.5-VL để tự động bóc tách hóa đơn, hợp đồng kinh tế và rà soát rủi ro pháp lý.
Mô hình AI thực hiện Function Calling tự động hóa quy trình nhập liệu ERP, đối soát công nợ và kích hoạt luồng xử lý tự động.
Giải đáp chi tiết những thắc mắc phổ biến về dịch vụ Viettel Model as a Service (vMaaS)
Liên hệ ngay với đội ngũ chuyên gia của Viettel IDC để được tư vấn thiết kế giải pháp và nhận gói trải nghiệm PoC 50M token miễn phí.
Hướng dẫn tích hợp API, OpenAI SDK và đội ngũ kỹ sư giải pháp AI Viettel IDC luôn sẵn sàng đồng hành cùng bạn 24/7.
Tài liệu tích hợp đầy đủ các Endpoint chuẩn OpenAI, code mẫu Python / NodeJS / cURL và hướng dẫn tối ưu Prompt.
Đội ngũ chuyên gia Viettel IDC sẵn sàng tư vấn tối ưu pipeline, hỗ trợ PoC thử nghiệm và xử lý sự cố kỹ thuật 24/7/365.