Nền tảng AI Riêng tư Nội bộ cho Doanh nghiệp
Trợ lý AI và tri thức nội bộ chạy trên hạ tầng của bạn — dữ liệu không rời tổ chức, hỗ trợ tuân thủ Luật Bảo vệ Dữ liệu Cá nhân có hiệu lực từ 01/01/2026.
Triển khai tại Việt Nam · Singapore · Úc — đội ngũ kỹ sư phần mềm, ERP và DevOps trong nước.
Dữ liệu không rời tổ chức
Mọi truy vấn xử lý 100% trên máy đặt tại văn phòng — không đám mây, không gọi API ngoài.
Namtech cung cấp dịch vụ gì?
Namtech là công ty phần mềm và tư vấn hoạt động tại Việt Nam, Singapore và Úc. Namtech triển khai nền tảng AI riêng tư nội bộ cho doanh nghiệp: một trợ lý AI có khả năng trả lời, soạn thảo và tra cứu trực tiếp trên tài liệu nội bộ thông qua cơ chế truy xuất tăng cường (RAG). Toàn bộ dữ liệu và truy vấn được giữ trong phạm vi tổ chức — chạy 100% trên máy Mac Studio chip M5 đặt ngay tại văn phòng (on-premise), không dùng đám mây — và không gọi tới bất kỳ dịch vụ hay API AI công cộng nào ở nước ngoài. Giải pháp dùng các mô hình mở phát hành năm 2026 — Qwen, Gemma (Apache 2.0) và GLM (MIT) — chạy trên Apple Silicon, tối ưu cho tiếng Việt và tiếng Anh. Điểm khác biệt chính: chủ quyền dữ liệu, hỗ trợ tuân thủ PDPL, chi phí vận hành cố định và phần cứng đặt tại chỗ tiết kiệm điện (theo Apple, Mac Studio M5 Ultra — máy của gói lớn nhất — tiêu thụ tối đa 385W).
Vì sao AI công cộng là rủi ro với dữ liệu doanh nghiệp?
Các công cụ AI phổ biến yêu cầu gửi dữ liệu ra máy chủ đặt ngoài Việt Nam. Với doanh nghiệp xử lý thông tin khách hàng, tài chính, nhân sự hoặc tài liệu mật, điều này tạo ba rủi ro lớn:
Lộ dữ liệu nhạy cảm
Thông tin khách hàng, tài chính, nhân sự và tài liệu mật rời khỏi tầm kiểm soát của doanh nghiệp.
Vi phạm chuyển dữ liệu xuyên biên giới
Khung pháp lý mới siết chặt việc đưa dữ liệu cá nhân ra nước ngoài — rủi ro pháp lý tăng cao.
Chi phí token khó dự đoán
Chi phí theo lượng sử dụng biến động mạnh, khó lập ngân sách và tăng theo quy mô nhân sự.
Bốn lớp của nền tảng AI nội bộ Namtech
Mô hình AI
Mô hình mở phát hành năm 2026, cho phép dùng thương mại — Qwen, Gemma (Apache 2.0) và GLM (MIT) — tối ưu tiếng Việt và tiếng Anh.
Lớp tri thức (RAG)
Trợ lý trả lời bám sát tài liệu, quy trình và dữ liệu thật của doanh nghiệp, có trích dẫn nguồn.
Giao diện & quản trị
Chat web, quản lý người dùng, phân quyền theo phòng ban, nhật ký kiểm toán.
Xử lý 100% nội bộ
Mọi truy vấn chạy trên máy đặt tại văn phòng — không dùng đám mây và không gọi tới bất kỳ API AI bên ngoài nào.
AI nội bộ hỗ trợ tuân thủ PDPL như thế nào?
Luật Bảo vệ Dữ liệu Cá nhân (Luật số 91/2025/QH15) và Nghị định 356/2025/NĐ-CP có hiệu lực từ 01/01/2026, thay thế Nghị định 13/2023/NĐ-CP. Khung pháp lý mới siết chặt yêu cầu về sự đồng ý, kiểm soát chuyển dữ liệu xuyên biên giới và cấm mua bán dữ liệu cá nhân. Vì nền tảng AI riêng tư giữ toàn bộ dữ liệu trong nước hoặc tại chỗ, doanh nghiệp giảm rủi ro liên quan tới việc chuyển dữ liệu ra nước ngoài. Đây là giải pháp kỹ thuật, không thay thế tư vấn pháp lý.
AI nội bộ nằm ở đâu trong Luật Trí tuệ nhân tạo?
Luật Trí tuệ nhân tạo số 134/2025/QH15 có hiệu lực từ 01/3/2026; Nghị định 142/2026/NĐ-CP quy định chi tiết có hiệu lực từ 01/5/2026. Trợ lý tra cứu tài liệu (RAG) chỉ phục vụ quản trị, vận hành nội bộ và không cung cấp trực tiếp ra công chúng thường được xếp rủi ro thấp: không đề xuất vào Danh mục rủi ro cao (Điều 8 khoản 2 điểm c Nghị định 142/2026/NĐ-CP) và không phân loại rủi ro trung bình (Điều 9 khoản 3 Nghị định 142/2026/NĐ-CP), nên không phải thông báo kết quả phân loại cho Bộ Khoa học và Công nghệ như hệ thống rủi ro trung bình, cao (Điều 10 khoản 3 Luật 134/2025/QH15). Hệ thống tương tác trực tiếp với con người vẫn phải cho người dùng nhận biết đang tương tác với AI (Điều 11 khoản 1 Luật 134/2025/QH15). Hệ thống đã vận hành trước 01/3/2026 có 12 tháng, hoặc 18 tháng với lĩnh vực y tế, giáo dục, tài chính, để đáp ứng luật (Điều 35 Luật 134/2025/QH15). Riêng cơ quan nhà nước dùng kết quả AI làm căn cứ trực tiếp để ban hành quyết định hành chính trong các trường hợp tại khoản 7 Điều 20 Nghị định 142/2026/NĐ-CP phải lập Báo cáo đánh giá tác động theo Mẫu AI02 và được người đứng đầu phê duyệt trước khi đưa vào sử dụng; Namtech hỗ trợ đưa việc này vào kế hoạch triển khai ngay từ đầu. Mức rủi ro cuối cùng phụ thuộc cách từng tổ chức sử dụng hệ thống. Đây là giải pháp kỹ thuật, không thay thế tư vấn pháp lý.
Triển khai trên hạ tầng nào?
100% tại chỗ trên Apple Silicon
Toàn bộ nền tảng chạy trên máy Mac Studio chip M5 đặt ngay tại văn phòng — không dùng đám mây, không thuê GPU, không gọi API ngoài. Mỗi gói là một máy để bàn duy nhất, vận hành êm, tiêu thụ điện thấp; dữ liệu không bao giờ rời tổ chức.
385Wtối đa — gói lớn nhất (Mac Studio M5 Ultra, theo Apple)Ba gói theo quy mô
Hệ thống mở rộng theo phần cứng: AI Box (1× Mac Studio M5 Max 64GB) cho nhóm nhỏ, AI Pro (1× Mac Studio M5 Max 128GB) cho nhiều phòng ban, và AI Enterprise (1× Mac Studio M5 Ultra 256GB) chạy mô hình mở lớn nhất cho toàn doanh nghiệp.
AI Box → AI Pro → AI EnterpriseTừ khảo sát đến go-live trong 8–10 tuần
Lộ trình triển khai rõ ràng theo 5 giai đoạn, có tiêu chí nghiệm thu ở mỗi bước. Tổng thời gian điển hình 8–10 tuần, tùy quy mô tài liệu và mức độ tích hợp.
Khảo sát & thiết kế
Thống nhất nhu cầu, kiến trúc và tiêu chí nghiệm thu.
Dựng hạ tầng & triển khai mô hình
Cài đặt nền tảng, mô hình và môi trường vận hành.
Nạp & tinh chỉnh tri thức
Xử lý tài liệu nội bộ, hiệu chỉnh chất lượng câu trả lời.
Tích hợp & kiểm thử
SSO, phân quyền, UAT cùng doanh nghiệp.
Go-live, đào tạo & bàn giao
Vận hành chính thức, đào tạo, bàn giao tài liệu.
Tổng 8–10 tuần
Một đầu mối chịu trách nhiệm xuyên suốt — từ khảo sát, triển khai đến bàn giao và bảo trì.
Chọn mô hình phù hợp với quy mô của bạn
Báo giá chi tiết sau buổi khảo sát miễn phí — không cam kết, không phí ẩn.
AI Box
1× Mac Studio M5 Max 64GB — cho nhóm nhỏ bắt đầu với AI nội bộ.
- Nhóm nhỏ / một phòng ban
- Trả lời nhiều câu hỏi cùng lúc · RAG cơ bản
- 100% tại văn phòng, không API ngoài
Kỹ thuật: Qwen3.6-35B-A3B hoặc Gemma 4 26B-A4B, tìm kiếm tài liệu (RAG), continuous batching
Nhận báo giáAI Pro
1× Mac Studio M5 Max 128GB — cho nhiều phòng ban cần tìm kiếm thông minh hơn và đăng nhập một lần.
- Nhiều phòng ban
- Mô hình nhanh và mô hình suy luận chạy song song · RAG nâng cao
- Đăng nhập một lần (SSO) bằng tài khoản công ty sẵn có
Kỹ thuật: Qwen3.8-27B hoặc Gemma 4 31B, chạy kèm Qwen3.6-35B-A3B, RAG nâng cao, SSO, continuous batching
Nhận báo giáAI Enterprise
1× Mac Studio M5 Ultra 256GB — toàn doanh nghiệp, đủ bộ nhớ chạy mô hình mở lớn nhất của Namtech trên một máy.
- Toàn doanh nghiệp
- Mô hình mạnh nhất · RAG nâng cao + tích hợp ERP/hệ thống lõi
- Dữ liệu 100% tại văn phòng · SSO
Kỹ thuật: Qwen3.5-122B-A10B hoặc GLM-5.3-Flash, chạy kèm bất kỳ mô hình nào của gói nhỏ hơn, bộ nhớ hợp nhất 256GB (bản M5 Ultra 36 CPU/80 GPU sắp có tuỳ chọn 512GB — Apple thông báo ra mắt cuối tháng 10/2026, chưa công bố giá)
Nhận báo giá theo nhu cầuTích hợp ERP & hệ thống nội bộ
Kết nối AI nội bộ với ERP/CRM/kế toán/HRM sẵn có của bạn (ví dụ: Odoo, MISA, SAP… hoặc hệ thống nội bộ riêng). Trợ lý AI tra cứu, tổng hợp và soạn thảo trực tiếp trên dữ liệu nghiệp vụ — vẫn 100% tại chỗ, không đẩy dữ liệu ra ngoài. Báo giá theo phạm vi tích hợp.
Giá phần mềm và phí vận hành chưa gồm VAT; giá máy Mac Studio đã gồm VAT, hàng chính hãng do Công ty Cổ phần Trạm Năng Lượng Số bán và xuất hoá đơn VAT đầy đủ — xem toàn bộ cấu hình Mac Studio; mức cuối cùng chốt sau buổi khảo sát miễn phí theo dung lượng tài liệu, kích thước mô hình và mức tích hợp. Quy mô người dùng phục vụ được xác định bằng buổi chạy thử tải trên chính tài liệu của quý khách — Namtech đo thật trước khi cam kết.
Dùng mô hình AI nào, mỗi mô hình giỏi gì?
Sáu mô hình đầu bảng là mô hình Namtech cài cho các gói; phía dưới là các mô hình mở khác cũng chạy được trên máy của gói. Tất cả có giấy phép cho phép dùng thương mại (Apache 2.0, MIT hoặc OpenMDW) và chạy hoàn toàn trên máy của doanh nghiệp. Namtech chọn mô hình sau buổi khảo sát, theo quy mô đội ngũ và tài liệu.
| Mô hình | Ra mắt | Loại | Dung lượng 4-bit | Gói chạy được | Điểm AA | Điểm tiếng Việt SEA-HELM | Giỏi về |
|---|---|---|---|---|---|---|---|
| Mô hình Namtech cài cho gói | |||||||
| Qwen3.6-35B-A3BQwen (Alibaba) · Apache 2.0 | 04/2026 | MoE · 35B, kích hoạt 3B | 20,4 GB | AI Box, AI Pro | 18,2 | 76,1 | Trả lời nhanh cho nhiều người cùng lúc; mỗi người dùng thêm tốn rất ít bộ nhớ, hợp với đội ngũ đông người. |
| Gemma 4 26B-A4BGoogle · Apache 2.0 | 03/2026 | MoE · 26B, kích hoạt 4B | 15,3 GB | AI Box | 16,7* | 75,3 | Hỏi đáp và soạn thảo hằng ngày nhanh, chiếm ít bộ nhớ. |
| Gemma 4 31BGoogle · Apache 2.0 | 03/2026 | Dense · 31B | 18,4 GB | AI Pro | 14,7 | 77,1 | Viết cẩn thận, nhớ tốt nhất trên tài liệu dài trong họ Gemma 4; điểm tiếng Việt cao nhất trong bảng này. |
| Qwen3.8-27BQwen (Alibaba) · Apache 2.0 | 08/2026 | Dense · 27B | 16,1 GB | AI Pro | 33,7 | chưa công bố | Suy luận và làm theo chỉ dẫn chi tiết; điểm AA cao nhất trong các mô hình của gói AI Pro. |
| Qwen3.5-122B-A10BQwen (Alibaba) · Apache 2.0 | 02/2026 | MoE · 122B, kích hoạt 10B | 69,6 GB | AI Pro, AI Enterprise | 17,7* | 76,4 | Kiến thức rộng hơn cho đội ngũ lớn. Chạy được trên AI Pro hoặc AI Enterprise. |
| GLM-5.3-FlashZ.ai · MIT | 08/2026 | MoE · 320B, kích hoạt 18B | 177,5 GB | AI Enterprise | 41,8 | chưa công bố | Mô hình mạnh nhất của Namtech, điểm AA nhỉnh hơn Gemini 3.8 Flash. Cần gói AI Enterprise: vượt quy ước 75% của Namtech, nhưng đã có bài đo chạy được trên Mac Studio M5 Ultra 256GB (MacStories: đọc 1.217 token/giây, viết 31 token/giây); bản 4-bit nặng 177,5 GB theo qdna.fr. Namtech chạy thử trên máy của khách trước khi chốt. |
| Mô hình mở khác chạy được trên máy của gói | |||||||
| MiMo-V2.6-FlashXiaomi · MIT | 09/2026 | MoE · 309B, kích hoạt 15B | 167,3 GB | AI Enterprise | 37,9 | chưa công bố | Đa phương thức (văn bản, ảnh, video, âm thanh), ngữ cảnh 1 triệu token cho agent chạy dài. Sát trần bộ nhớ của AI Enterprise (còn khoảng 25 GB cho ngữ cảnh). |
| DeepSeek V4 Flash 0731DeepSeek · MIT | 07/2026 | MoE · 284B, kích hoạt 13B | 151,5 GB | AI Enterprise | 34,3 | 72,1 | Lập trình agent và suy luận, cạnh tranh với các mô hình đóng mạnh nhất. Dung lượng đo trên bản 04/2026 cùng kiến trúc. |
| Inkling-SmallThinking Machines Lab · Apache 2.0 | 07/2026 | MoE · 266B, kích hoạt 12B | 153,4 GB | AI Enterprise | 25,7 | 72,5 | Nhận văn bản, ảnh và âm thanh; dùng cho ứng dụng agent, gọi công cụ, trợ lý lập trình. |
| K2-Horizon-MoVA-36B-A4BInstitute of Foundation Models · Apache 2.0 | 09/2026 | MoE · 36B, kích hoạt 4B | 26,4 GB | AI Box trở lên | 25,3 | chưa công bố | Agent và suy luận mạnh chỉ với 4B tham số kích hoạt, ngữ cảnh 512K. Kiến trúc MoVA mới, cần chạy thử trước khi chốt. |
| Hy3Tencent · Apache 2.0 | 07/2026 | MoE · 295B, kích hoạt 21B | 170,3 GB | AI Enterprise | 25,3 | chưa công bố | Lập trình, văn phòng, mô hình tài chính, thiết kế frontend. Sát trần bộ nhớ của AI Enterprise. |
| Ling-3.0-flash-VLinclusionAI · MIT | 09/2026 | MoE · 124B, kích hoạt 5,5B | 78,7 GB | AI Pro trở lên | 24,6 | chưa công bố | Suy luận đa phương thức (ảnh, video) và agent, ngữ cảnh 256K. |
| Qwen3.5-27BQwen (Alibaba) · Apache 2.0 | 02/2026 | Dense · 27B | 16,1 GB | AI Box trở lên | 22,9* | 76,3 | Hiểu cả văn bản lẫn hình ảnh trong một mô hình; suy luận, lập trình, agent. |
| Qwen3.6-27BQwen (Alibaba) · Apache 2.0 | 04/2026 | Dense · 27B | 16,1 GB | AI Box trở lên | 21,4 | 76,1 | Lập trình agent (frontend, cả kho mã), ổn định cho công việc thực tế. |
| Step 3.7 FlashStepFun · Apache 2.0 | 05/2026 | MoE · 198B, kích hoạt 11B | 110,8 GB | AI Enterprise | 19,5* | chưa công bố | Agent tốc độ cao kết hợp thị giác, tìm kiếm và suy luận. |
| Muse Glimmer 30BMeta · Apache 2.0 | 08/2026 | Dense · 30B | 19,4 GB | AI Box trở lên | 17,5 | 73,5 | Agent tự động trên máy cá nhân: suy luận nhiều bước, gọi công cụ, hiểu ảnh. |
| GLM-4.7-FlashZ.ai · MIT | 01/2026 | MoE · 30B, kích hoạt 3B | 16,9 GB | AI Box trở lên | 14,9* | 64,4 | Mô hình 30B triển khai nhẹ, cân bằng hiệu năng và hiệu quả. |
| Granite 4.2 30BIBM · Apache 2.0 | 08/2026 | Dense · 30B | 17,7 GB | AI Box trở lên | 14,8* | chưa công bố | Dành cho doanh nghiệp: có sẵn suy luận, gọi công cụ chính xác, giỏi toán và lập trình. |
| Gemma 4 12BGoogle · Apache 2.0 | 06/2026 | Dense · 12B | 6,7 GB | AI Box trở lên | 14,2* | 69,9 | Đa phương thức gọn (văn bản, ảnh, video, âm thanh), có chế độ suy luận. |
| Command A+Cohere · Apache 2.0 | 05/2026 | MoE · 218B, kích hoạt 25B | 135,1 GB | AI Enterprise | 13,1 | 66,4 | Agent, đa ngôn ngữ và suy luận cho doanh nghiệp, đọc được ảnh. |
| Nemotron 3.5 Lightning 30B-A3BNVIDIA · OpenMDW-1.1 | 08/2026 | MoE · 30B, kích hoạt 3B | 17,8 GB | AI Box trở lên | 12,9 | 61,0 | Dựng agent chuyên biệt hiệu quả, mở cả dữ liệu và công thức huấn luyện. Không hỗ trợ tiếng Việt tốt (tiếng Việt không có trong danh sách ngôn ngữ). |
| Seed-OSS-36B-InstructByteDance Seed · Apache 2.0 | 08/2025 | Dense · 36B | 20,3 GB | AI Box trở lên | 12,1* | chưa công bố | Ngữ cảnh dài, suy luận và agent; tối ưu cho dùng quốc tế. |
| gpt-oss-120bOpenAI · Apache 2.0 | 08/2025 | MoE · 117B, kích hoạt 5,1B | 62,3 GB | AI Pro trở lên | 11,6 | 69,8 | Suy luận và tác vụ agent đa dụng, chỉnh được mức suy nghĩ. |
| Mistral Small 4 (119B-A6B)Mistral AI · Apache 2.0 | 03/2026 | MoE · 119B, kích hoạt 6,5B | 67,8 GB | AI Pro trở lên | 11,3 | 57,2 | Gộp chat, suy luận và lập trình agent trong một mô hình. Điểm tiếng Việt là chế độ không suy luận. |
| Granite 4.2 8BIBM · Apache 2.0 | 08/2026 | Dense · 8B | 5,4 GB | AI Box trở lên | 11,1 | chưa công bố | Bản tầm trung gọn nhẹ, suy luận và gọi công cụ cho doanh nghiệp. |
| gpt-oss-20bOpenAI · Apache 2.0 | 08/2025 | MoE · 21B, kích hoạt 3,6B | 11,2 GB | AI Box trở lên | 9,0 | 63,8 | Bản nhẹ, độ trễ thấp cho chạy cục bộ và tác vụ chuyên biệt. |
| Devstral Small 2 (24B)Mistral AI · Apache 2.0 | 12/2025 | Dense · 24B | 15,1 GB | AI Box trở lên | 7,5 | chưa công bố | Chuyên lập trình agent: khám phá kho mã, sửa nhiều file. |
| Kimi Linear 48B-A3B InstructMoonshot AI · MIT | 10/2025 | MoE · 48B, kích hoạt 3B | 27,6 GB | AI Box trở lên | 7,3* | chưa công bố | Xử lý ngữ cảnh rất dài (tới 1 triệu token) nhanh, ít tốn bộ nhớ cache. |
| Ministral 3 14BMistral AI · Apache 2.0 | 12/2025 | Dense · 14B | 8,4 GB | AI Box trở lên | 6,0 | chưa công bố | Mô hình nhỏ có thị giác cho thiết bị biên, ngang Mistral Small 3.2 24B. |
| Phi-4-reasoning-vision-15BMicrosoft · MIT | 03/2026 | Dense · 15B | 9,1 GB | AI Box trở lên | chưa công bố | chưa công bố | Suy luận trên ảnh, biểu đồ, tài liệu; toán, OCR, thao tác giao diện máy tính. Không hỗ trợ tiếng Việt tốt (huấn luyện chủ yếu bằng tiếng Anh). |
| EuroLLM-22B-InstructUTTER project · Apache 2.0 | 12/2025 | Dense · 22B | 12,7 GB | AI Box trở lên | chưa công bố | chưa công bố | Đa ngôn ngữ châu Âu (24 ngôn ngữ chính thức của EU và một số ngôn ngữ khác). Không hỗ trợ tiếng Việt tốt (tiếng Việt không có trong danh sách ngôn ngữ). |
* = điểm do Artificial Analysis ước tính. Điểm AA: Artificial Analysis Intelligence Index v4.3.2 (tháng 9/2026), lấy cấu hình cao nhất đã công bố của mỗi mô hình, càng cao càng tốt. Điểm tiếng Việt: phần tiếng Việt của bảng xếp hạng SEA-HELM (AI Singapore), cập nhật 18/09/2026; “chưa công bố” nghĩa là mô hình chưa có trên bảng xếp hạng. Dung lượng là file mô hình ở mức 4-bit; mỗi người dùng thêm cần thêm một ít bộ nhớ. Nhóm “Mô hình mở khác chạy được trên máy của gói” gồm các mô hình mở có giấy phép cho phép dùng thương mại (Apache 2.0, MIT, OpenMDW), chạy được trên máy của gói theo quy ước file 4-bit không quá khoảng 75% RAM (AI Box 64 GB → khoảng 48 GB, AI Pro 128 GB → 96 GB, AI Enterprise 256 GB → 192 GB); “trở lên” nghĩa là gói lớn hơn cũng chạy được. Với nhóm này, dung lượng là tổng file trọng số 4-bit trên Hugging Face, chưa gồm bộ nhớ cho ngữ cảnh, và “chưa công bố” ở cột AA nghĩa là mô hình chưa có trên Artificial Analysis. Namtech chạy thử trên máy trước khi chốt mô hình cho khách.
So với AI thương mại trên cloud
Điểm Artificial Analysis Intelligence Index (càng cao càng tốt). Mô hình cloud mạnh nhất vẫn dẫn đầu. Mô hình mạnh nhất của Namtech (GLM-5.3-Flash, gói AI Enterprise) ngang, nhỉnh hơn một chút so với Gemini 3.8 Flash — đổi lại, dữ liệu không rời văn phòng.
- Claude Opus 5.5Anthropic 57,6
- GPT-6 AstraOpenAI 52,7
- Gemini 4 ArgonGoogle 52,6
- GLM-5.3-FlashNamtech · AI Enterprise 41,8
- Gemini 3.8 FlashGoogle 40,9
- GPT-6 LunaOpenAI 38,1
- Qwen3.8-27BNamtech · AI Pro 33,7
- Qwen3.6-35B-A3BNamtech · AI Box 18,2
- Qwen3.5-122B-A10BNamtech · AI Enterprise 17,7*
- Gemma 4 26B-A4BNamtech · AI Box 16,7*
- Gemma 4 31BNamtech · AI Pro 14,7
Nguồn: Artificial Analysis Intelligence Index v4.3.2 (tháng 9/2026), cấu hình cao nhất đã công bố của mỗi mô hình (* = AA ước tính). Mô hình thương mại chạy trên cloud của nhà cung cấp; mô hình của Namtech chạy trên Mac Studio của doanh nghiệp.
AI nội bộ Namtech khác gì ChatGPT, Copilot, Glean?
| Tiêu chí | AI công cộng (ChatGPT, Copilot, Glean) | AI nội bộ Namtech |
|---|---|---|
| Vị trí dữ liệu | Cloud nước ngoài | 100% tại văn phòng (on-premise) |
| Mô hình giá | Theo đầu người, tăng theo nhân sự | Chi phí cố định, dự đoán được |
| Tuân thủ PDPL | Phụ thuộc cấu hình | Thiết kế để giữ dữ liệu trong nước |
| Tùy biến trên dữ liệu nội bộ | Hạn chế | RAG sâu trên tài liệu riêng |
Tham chiếu thị trường (09/2026): Glean không công bố giá; theo tổng hợp benchmark do Workativ (một nhà cung cấp cạnh tranh với Glean) dẫn lại, trung vị khoảng 50 USD/người/tháng, tối thiểu thường 50–100 ghế, còn Vendr ghi hợp đồng thường bắt đầu từ khoảng 100–250 người dùng. Microsoft 365 Copilot Business niêm yết 21 USD/người/tháng (bản Enterprise 30 USD), cộng trên license Microsoft 365.
Thuê SaaS AI theo đầu người tốn bao nhiêu so với AI nội bộ?
Có 3 cách dùng AI: thuê theo ghế (SaaS), tự gọi API trả theo token, hoặc AI nội bộ. Hai cách đầu — chi phí lặp lại mãi và dữ liệu rời khỏi tổ chức. AI nội bộ là đầu tư cố định và giữ 100% dữ liệu tại chỗ. Nhập thông số để xem con số của bạn.
1Cách 1 — Thuê theo ghế (SaaS)
| Giải pháp | Giá/người/tháng | Chi phí/tháng | Chi phí/năm | 3 năm | Dữ liệu |
|---|---|---|---|---|---|
| ChatGPT Business | $ | Rời tổ chức | |||
| Claude Team | $ | Rời tổ chức | |||
| Microsoft 365 Copilot Business | $ | Rời tổ chức | |||
| Gemini (Workspace) | $ | Rời tổ chức | |||
| AI nội bộ Namtech — AI Enterprise | cố định | 100% tại chỗ |
2Cách 2 — Tự gọi API (trả theo token)
| Mô hình API | Giá ($/1M in · out) | Chi phí/tháng | Chi phí/năm | Dữ liệu |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 · $10 | Rời tổ chức | ||
| OpenAI gpt-6-sol | $2 · $10 | Rời tổ chức | ||
| Gemini 3.1 Pro | $2 · $12 | Rời tổ chức |
API linh hoạt và có thể rẻ ở mức dùng thấp, nhưng chi phí tăng theo lượng token và dữ liệu vẫn được gửi tới máy chủ của nhà cung cấp — doanh nghiệp không giữ được toàn quyền kiểm soát.
Chỉ để ước tính; Namtech đo trên máy thật trước khi cam kết cấu hình.
Giá thuê ghế (niêm yết công khai, cập nhật 09/2026, chỉnh được; mặc định lấy giá trả năm): ChatGPT Business $20 (trả tháng $25), Claude Team $20 (trả tháng $25), Microsoft 365 Copilot Business $21 (giá niêm yết, chưa gồm license Microsoft 365 nền; bản Enterprise vẫn $30), Gemini đã gộp vào gói Google Workspace (Business Standard $14/người/tháng) nên mặc định $0. Giá API token (mỗi 1 triệu token input · output): Claude Sonnet 5 $2·$10, OpenAI gpt-6-sol $2·$10, Gemini 3.1 Pro $2·$12 (prompt tới 200k token). Chi phí Namtech tự chọn gói theo số người — AI Box (≤15), AI Pro (16–40), AI Enterprise (>40); đây chỉ là ngưỡng giả định để ước tính, không phải số người dùng đã đo tải — gồm phần mềm + phần cứng một lần (máy Mac Studio M5 Max 64GB / Mac Studio M5 Max 128GB / Mac Studio M5 Ultra 256GB, doanh nghiệp sở hữu) + bảo trì hàng tháng; phần mềm và phí bảo trì chưa gồm VAT, giá máy đã gồm VAT. Đây là ước tính tham khảo, không thay thế báo giá chính thức.
AI nội bộ ứng dụng vào ngành nào?
Mỗi ngành có một bài toán tri thức nội bộ riêng. Dưới đây là các ví dụ tiêu biểu — toàn bộ dữ liệu xử lý trong phạm vi tổ chức, không gửi ra ngoài.

Tài chính – Ngân hàng
Tra cứu quy định, hợp đồng và hồ sơ khách hàng nội bộ tức thì — không gửi dữ liệu ra ngoài.

Y tế
Tổng hợp phác đồ, quy trình và tài liệu chuyên môn cho nhân viên y tế — bệnh án giữ trong hệ thống nội bộ.

Sản xuất
Hỏi-đáp trên quy trình vận hành (SOP), tài liệu kỹ thuật và hướng dẫn bảo trì ngay tại nhà máy.

Pháp lý
Soạn thảo và rà soát hợp đồng, tra cứu án lệ và văn bản nội bộ — tài liệu mật không rời tổ chức.

Bán lẻ & TMĐT
Trợ lý nội bộ cho nhân viên tra cứu thông tin sản phẩm, chính sách và đơn hàng từ dữ liệu của doanh nghiệp.

Khu vực công
Tra cứu văn bản, quy định và quy trình thủ tục nội bộ — dữ liệu giữ tại chỗ, đáp ứng yêu cầu chủ quyền dữ liệu.
Ảnh minh hoạ: Pexels. Mỗi ngành có bài toán tri thức riêng — danh sách chỉ là ví dụ tiêu biểu.
AI nội bộ giải quyết vấn đề thực tế ra sao?
Các kịch bản minh hoạ điển hình theo ngành — số liệu thực tế và logo khách hàng sẽ được bổ sung khi có sự đồng ý.
Tra cứu hồ sơ tín dụng không để lộ dữ liệu khách hàng
Vấn đề: Đội thẩm định muốn dùng AI tóm tắt hồ sơ, nhưng gửi dữ liệu tài chính cá nhân ra AI công cộng nước ngoài là rủi ro pháp lý và lộ thông tin.
Giải pháp: Trợ lý AI + RAG của Namtech chạy on-prem, đọc trực tiếp hồ sơ nội bộ và trả lời có trích dẫn nguồn — không có lệnh gọi ra ngoài.
Hỏi-đáp phác đồ & bệnh án mà không gửi dữ liệu bệnh nhân ra ngoài
Vấn đề: Nhân viên y tế cần tra cứu nhanh phác đồ và hồ sơ bệnh án, nhưng dữ liệu sức khỏe là dữ liệu nhạy cảm — không được phép đưa lên AI công cộng.
Giải pháp: Nền tảng AI riêng tư đặt tại cơ sở, phân quyền theo phòng ban, có nhật ký kiểm toán đầy đủ.
Trợ lý tra cứu quy trình & SOP cho nhà máy
Vấn đề: Tài liệu kỹ thuật, SOP và bí quyết vận hành là tài sản trí tuệ cốt lõi — đưa lên dịch vụ AI bên ngoài đồng nghĩa rủi ro rò rỉ bí mật công nghệ.
Giải pháp: Appliance AI đặt tại nhà máy (theo Apple, Mac Studio M5 Ultra — máy của gói lớn nhất — tiêu thụ tối đa 385W), RAG trên toàn bộ kho tài liệu kỹ thuật, chi phí vận hành cố định hàng tháng.
Các thuật ngữ AI nội bộ, giải thích ngắn gọn
Những khái niệm thường gặp khi triển khai nền tảng AI riêng tư cho doanh nghiệp — mỗi mục trả lời trực tiếp “là gì”.
Nền tảng AI riêng tư (Private AI)
Nền tảng AI riêng tư là hệ thống AI chạy hoàn toàn trên hạ tầng do doanh nghiệp kiểm soát, nơi dữ liệu và truy vấn không rời khỏi tổ chức. Khác với AI công cộng, nó không gửi dữ liệu tới máy chủ nước ngoài, giúp giữ chủ quyền thông tin và hỗ trợ tuân thủ PDPL.
On-premise (tại chỗ)
On-premise (tại chỗ) nghĩa là phần mềm và dữ liệu được cài đặt, vận hành ngay trên máy chủ đặt tại văn phòng của doanh nghiệp, thay vì trên cloud của bên thứ ba. Với AI nội bộ, mô hình chạy trực tiếp trên phần cứng tại chỗ nên không cần gọi API bên ngoài.
RAG (Truy xuất tăng cường)
RAG (Retrieval-Augmented Generation) là kỹ thuật cho mô hình AI tìm và đọc tài liệu nội bộ liên quan trước khi sinh câu trả lời. Nhờ đó, trợ lý trả lời bám sát dữ liệu riêng của doanh nghiệp và có thể trích dẫn nguồn thay vì “bịa”.
LLM (Mô hình ngôn ngữ lớn)
LLM (Large Language Model — mô hình ngôn ngữ lớn) là mô hình AI được huấn luyện trên khối lượng văn bản lớn để hiểu và sinh ngôn ngữ tự nhiên. Đây là “bộ não” trả lời, tóm tắt và soạn thảo trong nền tảng AI nội bộ; Namtech dùng các LLM mã nguồn mở chạy tại chỗ.
MoE (Mixture of Experts)
MoE (Mixture of Experts) là kiến trúc mô hình chia thành nhiều “chuyên gia” con, mỗi truy vấn chỉ kích hoạt một phần nhỏ trong số đó. Cách này cho chất lượng cao mà tốn ít tài nguyên tính toán hơn, phù hợp để chạy AI nội bộ trên phần cứng đặt tại chỗ.
PDPL (Luật Bảo vệ Dữ liệu Cá nhân)
PDPL là Luật Bảo vệ Dữ liệu Cá nhân của Việt Nam (Luật số 91/2025/QH15), có hiệu lực từ 01/01/2026. Luật siết chặt việc chuyển dữ liệu cá nhân ra nước ngoài và cấm mua bán dữ liệu cá nhân; giữ dữ liệu tại chỗ giúp doanh nghiệp giảm rủi ro tuân thủ.
SSO (Đăng nhập một lần)
SSO (Single Sign-On — đăng nhập một lần) cho phép người dùng đăng nhập một lần để truy cập nhiều ứng dụng bằng cùng một tài khoản. Nền tảng AI nội bộ có thể tích hợp SSO sẵn có của doanh nghiệp, giúp quản lý phân quyền tập trung và an toàn hơn.
Chủ quyền dữ liệu (Data sovereignty)
Chủ quyền dữ liệu (data sovereignty) là nguyên tắc dữ liệu chịu sự kiểm soát và pháp luật của quốc gia/tổ chức nơi nó được lưu trữ. Khi AI chạy tại chỗ ở Việt Nam, doanh nghiệp giữ toàn quyền với dữ liệu của mình và tuân theo quy định trong nước.
- AI chạy 100% tại chỗ trên máy Mac Studio (Apple Silicon) — dữ liệu không rời doanh nghiệp, không gọi API bên ngoài.
- Hỗ trợ tuân thủ PDPL (hiệu lực 01/01/2026) nhờ giữ dữ liệu trong nước và đảm bảo chủ quyền dữ liệu.
- Mô hình mở cho phép dùng thương mại — Qwen, Gemma (Apache 2.0) và GLM (MIT) — chạy trên Apple Silicon, dữ liệu không rời văn phòng.
- Sở hữu phần cứng, xuất VAT đầy đủ, bảo hành 60 ngày cho cài đặt và tinh chỉnh (máy bảo hành chính hãng Apple 12 tháng) và bảo trì tối thiểu 12 tháng.
- Mở rộng linh hoạt từ AI Box lên AI Pro rồi AI Enterprise theo nhu cầu, tích hợp SSO và API tương thích OpenAI.
Những điều doanh nghiệp thường hỏi
Nền tảng AI riêng tư là hệ thống AI chạy 100% trên hạ tầng do doanh nghiệp kiểm soát — đặt ngay tại văn phòng (on-premise) — nơi dữ liệu và truy vấn không được gửi tới dịch vụ AI công cộng ở nước ngoài. Namtech triển khai nền tảng này kèm trợ lý hỏi-đáp trên tài liệu nội bộ (RAG).
Có. PDPL (Luật số 91/2025/QH15) có hiệu lực từ 01/01/2026, siết chặt việc chuyển dữ liệu xuyên biên giới và cấm mua bán dữ liệu cá nhân. Vì AI nội bộ giữ dữ liệu trong nước/tại chỗ, doanh nghiệp giảm rủi ro vi phạm. Đây là giải pháp kỹ thuật, không thay thế tư vấn pháp lý.
Hệ thống chạy trên máy Apple Mac Studio chip M5 đặt ngay tại văn phòng, theo ba gói: AI Box (Mac Studio M5 Max 64GB), AI Pro (Mac Studio M5 Max 128GB) và AI Enterprise (Mac Studio M5 Ultra 256GB); bản M5 Ultra 36 CPU/80 GPU sắp có tuỳ chọn 512GB — Apple thông báo ra mắt cuối tháng 10/2026, chưa công bố giá. Mỗi gói là một máy để bàn duy nhất, chạy êm; theo Apple, Mac Studio M5 Ultra — máy của gói lớn nhất — tiêu thụ tối đa 385W. Không dùng đám mây, không gọi API ngoài.
Nhiều nhân viên có thể dùng chung một máy, vì tại mỗi thời điểm thường chỉ vài người đang đặt câu hỏi. Phần mềm phục vụ gom nhiều câu hỏi để xử lý cùng lúc (continuous batching) thay vì trả lời lần lượt từng câu. Trong thử nghiệm đã công bố trên Mac Studio M5 Max 128GB, mô hình Qwen3.6-35B-A3B (bản 8-bit) trả lời 8 câu hỏi cùng lúc với tổng tốc độ khoảng 238 token (mẩu chữ) mỗi giây. Namtech không đưa con số người dùng cố định cho từng gói; cấu hình phù hợp được xác định bằng buổi chạy thử tải trên chính tài liệu của quý khách.
ChatGPT và Copilot gửi dữ liệu lên cloud nước ngoài và tính phí theo đầu người. AI nội bộ của Namtech giữ dữ liệu tại chỗ, chi phí vận hành cố định, và trả lời bám sát tài liệu riêng của doanh nghiệp qua RAG.
Các mô hình thương mại mạnh nhất trên cloud vẫn đạt điểm cao hơn. Trên Artificial Analysis Intelligence Index, Claude Opus 5.5 đạt 57,6 và GPT-6 Astra đạt 52,7. Mô hình mạnh nhất của Namtech là GLM-5.3-Flash trên gói AI Enterprise, đạt 41,8 — nhỉnh hơn Gemini 3.8 Flash (40,9). Đổi lại, dữ liệu của doanh nghiệp không rời văn phòng.
Không. Dữ liệu chỉ được truy xuất trong phạm vi phân quyền của doanh nghiệp và không dùng để huấn luyện lại các mô hình công cộng.
Có. Nền tảng dùng mô hình tối ưu cho tiếng Việt và hỗ trợ song ngữ Việt — Anh.
Thông thường 8–10 tuần, gồm năm giai đoạn: khảo sát & thiết kế, dựng hạ tầng & mô hình, nạp & tinh chỉnh tri thức, tích hợp & kiểm thử, go-live & đào tạo.
Chi phí phụ thuộc số người dùng, dung lượng tài liệu, kích thước mô hình và mức tích hợp. Namtech báo giá chính xác sau một buổi khảo sát miễn phí.
Namtech bảo hành 60 ngày cho phần dịch vụ cài đặt và tinh chỉnh; riêng máy Mac được bảo hành chính hãng Apple 12 tháng tại trung tâm bảo hành uỷ quyền của Apple. Sau 60 ngày bảo hành dịch vụ, hệ thống được hỗ trợ qua gói bảo trì hàng tháng với cam kết tối thiểu 12 tháng. Gói bảo trì bao gồm theo dõi vận hành, cập nhật và hỗ trợ kỹ thuật để nền tảng AI nội bộ luôn hoạt động ổn định.
Có. Máy là hàng chính hãng do Công ty Cổ phần Trạm Năng Lượng Số bán và xuất hoá đơn VAT đầy đủ, nên doanh nghiệp sở hữu hoàn toàn thiết bị. Vì máy đặt tại chỗ và do doanh nghiệp sở hữu, dữ liệu cùng mô hình AI luôn nằm trong tầm kiểm soát của tổ chức.
Nền tảng mở rộng theo cấp: nâng từ AI Box lên AI Pro, rồi lên AI Enterprise khi số người dùng và khối lượng tài liệu tăng, hoặc khi cần mô hình mạnh hơn. Nhờ đó doanh nghiệp đầu tư theo nhu cầu thực tế và mở rộng năng lực xử lý mà không phải làm lại từ đầu.
Có. Nền tảng hỗ trợ đăng nhập một lần (SSO) để dùng chung tài khoản với hệ thống hiện có, và cung cấp API tương thích chuẩn OpenAI nên dễ kết nối với các ứng dụng và quy trình sẵn có của doanh nghiệp.
Vì hệ thống chạy tại chỗ, Namtech thiết kế phương án vận hành và sao lưu dữ liệu để khôi phục sau sự cố mất điện hay hỏng phần cứng. Mức độ dự phòng (sao lưu, thiết bị thay thế) được thống nhất theo nhu cầu từng doanh nghiệp; chúng tôi không cam kết một con số SLA cố định nếu chưa khảo sát thực tế.
Nền tảng dùng ba họ mô hình mở phát hành năm 2026: Qwen (Alibaba) và Gemma (Google) theo giấy phép Apache 2.0, GLM (Z.ai) theo giấy phép MIT — đều cho phép sử dụng thương mại. Với mỗi dự án, Namtech xác nhận giấy phép của đúng phiên bản mô hình được triển khai. Vì mô hình chạy tại chỗ và giấy phép rõ ràng, doanh nghiệp tránh được rủi ro phụ thuộc nhà cung cấp và ràng buộc pháp lý không minh bạch.
Vì sao làm việc với Namtech là quyết định an toàn?
Minh bạch từ buổi khảo sát đầu tiên đến vận hành dài hạn — không khoá nhà cung cấp, không phí ẩn.
Khảo sát miễn phí, không cam kết
Bắt đầu bằng một buổi khảo sát ngắn không tính phí. Bạn nhận được phạm vi và báo giá rõ ràng trước khi quyết định bất cứ điều gì.
Phần cứng chính hãng, hoá đơn VAT đầy đủ
Thiết bị mua chính hãng, do Công ty Cổ phần Trạm Năng Lượng Số xuất hoá đơn VAT đầy đủ cho doanh nghiệp — minh bạch nguồn gốc và chứng từ kế toán.
Bảo hành dịch vụ 60 ngày + bảo trì hàng tháng
Bảo hành 60 ngày sau go-live cho phần cài đặt và tinh chỉnh, máy Mac bảo hành chính hãng Apple 12 tháng, cùng gói bảo trì hàng tháng — hệ thống được theo dõi, cập nhật và hỗ trợ liên tục.
Dữ liệu không rời tổ chức
Toàn bộ dữ liệu và truy vấn xử lý 100% tại chỗ — không gửi tới dịch vụ AI công cộng nước ngoài.
Mô hình mở, giấy phép rõ ràng — không khoá nhà cung cấp
Nền tảng dùng mô hình mở Qwen, Gemma (Apache 2.0) và GLM (MIT). Bạn không bị khoá vào một nhà cung cấp độc quyền.
Thanh toán theo cột mốc rõ ràng (50/30/20)
Thanh toán chia theo cột mốc 50 / 30 / 20 gắn với kết quả bàn giao — bạn chỉ trả khi từng giai đoạn được nghiệm thu.
Bắt đầu với một buổi khảo sát miễn phí
Để xác định gói phù hợp và phạm vi chi tiết, Namtech đề xuất một buổi khảo sát ngắn không tính phí.