Mac Studio M5 là máy chạy AI local: mô hình ngôn ngữ (LLM) chạy thẳng trên máy đặt tại văn phòng quý vị — hồ sơ, hợp đồng, dữ liệu khách hàng không gửi ra bất kỳ dịch vụ nào bên ngoài. Bộ nhớ hợp nhất tới 256GB cho phép nạp những mô hình mà card đồ hoạ rời thông thường không chứa nổi, trong khi máy chỉ to bằng hộp giấy và tiêu thụ tối đa 480W.
Giá Mac Studio M5 Max từ 84.000.000₫, M5 Ultra từ 192.000.000₫. Mỗi thẻ ghi sẵn cỡ mô hình AI chạy được, lọc theo chip, RAM hoặc cỡ mô hình cần chạy.
M5 MaxChạy được mô hình tới ~43B tham số (ước lượng, 4-bit)
M5 MaxChạy được mô hình tới ~57B tham số (ước lượng, 4-bit)
M5 MaxChạy được mô hình tới ~76B tham số (ước lượng, 4-bit)
M5 MaxChạy được mô hình tới ~153B tham số (ước lượng, 4-bit)
M5 UltraChạy được mô hình tới ~115B tham số (ước lượng, 4-bit)
M5 UltraChạy được mô hình tới ~307B tham số (ước lượng, 4-bit)
M5 UltraChạy được mô hình tới ~115B tham số (ước lượng, 4-bit)
M5 UltraChạy được mô hình tới ~307B tham số (ước lượng, 4-bit)
Giá đã bao gồm VAT. Nâng SSD tính thêm — chọn trong trang chi tiết từng máy. Thông số tham chiếu apple.com/vn, cập nhật ngày 24/09/2026.
| Cấu hình | CPU / GPU | Bộ nhớ | Băng thông | Mô hình tối đa | Giá |
|---|---|---|---|---|---|
| M5 Max 18/32 · 36GB | 18 / 32 lõi | 36GB | 460GB/s | ~43B | 84.000.000₫ |
| M5 Max 18/40 · 48GB | 18 / 40 lõi | 48GB | 614GB/s | ~57B | 103.800.000₫ |
| M5 Max 18/40 · 64GB | 18 / 40 lõi | 64GB | 614GB/s | ~76B | 117.000.000₫ |
| M5 Max 18/40 · 128GB | 18 / 40 lõi | 128GB | 614GB/s | ~153B | 169.800.000₫ |
| M5 Ultra 30/64 · 96GB | 30 / 64 lõi | 96GB | 1.2TB/s | ~115B | 192.000.000₫ |
| M5 Ultra 30/64 · 256GB | 30 / 64 lõi | 256GB | 1.2TB/s | ~307B | 324.000.000₫ |
| M5 Ultra 36/80 · 96GB | 36 / 80 lõi | 96GB | 1.2TB/s | ~115B | 234.900.000₫ |
| M5 Ultra 36/80 · 256GB | 36 / 80 lõi | 256GB | 1.2TB/s | ~307B | 366.900.000₫ |
Băng thông bộ nhớ quyết định tốc độ máy sinh chữ. Số lõi GPU quyết định tốc độ đọc xong câu hỏi dài trước khi bắt đầu trả lời.
Cần bao nhiêu RAM để chạy LLM local phụ thuộc cỡ mô hình: từ ~43B tham số ở bản 36GB tới ~307B ở bản 256GB. Với mô hình ngôn ngữ, thứ quyết định "chạy nổi hay không" là dung lượng bộ nhớ, còn thứ quyết định "nhanh hay chậm" là băng thông bộ nhớ. Bảng dưới quy đổi từ dung lượng máy sang cỡ mô hình chạy được.
| Bộ nhớ máy | Phần dùng cho mô hình | Cỡ mô hình tối đa (4-bit) | Phù hợp với |
|---|---|---|---|
| 36GB | ~27GB | ~43B | Trợ lý hỏi đáp tài liệu nội bộ, tóm tắt, soạn thảo cho nhóm nhỏ |
| 48GB | ~36GB | ~57B | Như trên, thêm dư địa cho ngữ cảnh dài và nhiều người hỏi cùng lúc |
| 64GB | ~48GB | ~76B | Mô hình cỡ trung, chạy song song vài tác vụ |
| 96GB | ~72GB | ~115B | Mô hình lớn, xử lý hồ sơ dài, phục vụ nhiều người truy vấn |
| 128GB | ~96GB | ~153B | Mô hình lớn ở mức nén nhẹ hơn, chất lượng trả lời cao hơn |
| 256GB | ~192GB | ~307B | Mô hình rất lớn, hoặc chạy nhiều mô hình cùng lúc trên một máy |
Đây là ước lượng để tư vấn chọn máy, không phải số đo thực nghiệm. Cách tính: mô hình nén 4-bit tốn khoảng 0,5 byte cho mỗi tham số; macOS cho phần đồ hoạ mượn khoảng 75% bộ nhớ; chừa thêm 20% cho ngữ cảnh hội thoại. Số thực tế thay đổi theo mô hình, độ dài ngữ cảnh và số người dùng đồng thời — Namtech đo giúp trên máy thật trước khi quý vị chốt cấu hình.
Chọn M5 Max khi mô hình cần chạy dưới khoảng 153B tham số và nhóm người dùng vừa phải. Chọn M5 Ultra khi cần mô hình lớn hơn, ngữ cảnh dài hơn hoặc nhiều người truy vấn cùng lúc — Ultra có băng thông bộ nhớ và số lõi GPU khoảng gấp đôi.
| M5 Max | M5 Ultra | |
|---|---|---|
| CPU / GPU | 18 / 32/40 lõi | 30/36 / 64/80 lõi |
| Neural Engine | 16 lõi | 32 lõi |
| Bộ nhớ hợp nhất | 36–128GB | 96–256GB |
| Băng thông bộ nhớ | 460GB/s/614GB/s | 1.2TB/s |
| Mô hình tối đa (ước lượng, 4-bit) | ~153B | ~307B |
| Giá tại Namtech (gồm VAT) | 84.000.000₫ – 169.800.000₫ | 192.000.000₫ – 366.900.000₫ |
Băng thông quyết định tốc độ sinh chữ; số lõi GPU quyết định tốc độ đọc xong câu hỏi dài. Chip, RAM và băng thông tham chiếu apple.com/vn ngày 24/09/2026.
Không có máy nào tốt nhất cho mọi bài toán. Điểm khác biệt chính là bộ nhớ chứa được mô hình trong một máy, chỗ đặt máy và hệ sinh thái phần mềm. Bảng dưới so sánh định tính, không phải số đo tốc độ.
| Lựa chọn | Bộ nhớ cho mô hình | Điểm mạnh | Cần cân nhắc |
|---|---|---|---|
| Mac Studio M5 Max / M5 Ultra | Bộ nhớ hợp nhất 36–256GB | Nạp mô hình tới ~307B trong một máy; tối đa 480W; đặt trên bàn làm việc | Đọc ngữ cảnh rất dài chậm hơn hệ card đồ hoạ chuyên dụng |
| PC card rời RTX 5090 | 32GB bộ nhớ đồ hoạ mỗi card (NVIDIA) | Hợp mô hình vừa trong 32GB; nhiều công cụ AI viết cho NVIDIA trước | Mô hình lớn hơn phải ghép nhiều card, tốn điện và tản nhiệt hơn |
| NVIDIA DGX Spark | 128GB bộ nhớ hợp nhất (NVIDIA) | Máy để bàn nhỏ gọn, chạy hệ sinh thái phần mềm NVIDIA | Mức bộ nhớ thấp hơn tuỳ chọn 256GB của Mac Studio M5 Ultra |
| Máy chủ AI nhiều GPU | Tuỳ số card lắp | Mạnh nhất khi nhiều người hỏi cùng lúc với ngữ cảnh rất dài | Cần phòng máy, tủ rack, làm mát riêng; chi phí đầu tư và điện năng cao |
Số bộ nhớ RTX 5090 và DGX Spark lấy từ trang sản phẩm chính thức của NVIDIA, tra ngày 24/09/2026.
Mac Studio mạnh ở khâu sinh chữ nhờ băng thông bộ nhớ lớn, nhưng khâu đọc-hiểu một lượng văn bản rất dài (ví dụ nạp cả tập hồ sơ vào mỗi câu hỏi) thì các hệ card đồ hoạ chuyên dụng vẫn nhanh hơn. Nếu bài toán của quý vị thiên về nhiều người hỏi cùng lúc với ngữ cảnh rất dài, hãy nói với chúng tôi để đo trước khi mua.
Quý vị mới thử nghiệm AI local, chạy mô hình nhỏ, chỉ một vài người dùng, hoặc chủ yếu tóm tắt và soạn thảo văn bản ngắn.
Cần mô hình lớn, ngữ cảnh dài, nhiều người hỏi cùng lúc, hoặc chạy nhiều mô hình trên một máy. Mac Studio có mức bộ nhớ 36–256GB.
Cấu hình Mac mini rẻ nhất là Mac mini M6 12CPU 12GPU 16GB 256GB, giá 30.000.000₫, chạy mô hình tới ~19B; Mac mini có mức bộ nhớ 16–64GB.
Chúng tôi tư vấn thẳng: nếu Mac mini đã đủ cho bài toán của quý vị, Namtech sẽ nói trước khi quý vị chi tiền cho Mac Studio.
AI on-premise nghĩa là mô hình chạy trên máy đặt tại công ty. Câu hỏi, tài liệu và câu trả lời đều nằm trong mạng nội bộ — nền tảng cho chatbot nội bộ, trợ lý hỏi đáp trên kho tài liệu, tóm tắt hồ sơ và soạn thảo.
CPU và GPU dùng chung một khối bộ nhớ. Không phải chia nhỏ mô hình rồi ghép nhiều card đồ hoạ, không mất công đồng bộ giữa các card.
Cao 9,5 cm, nặng 2,7–3,6 kg, chạy êm. Không cần phòng máy, không cần tủ rack, không cần hệ thống làm mát riêng.
Tối đa 480W cho cả máy. Một hệ nhiều card đồ hoạ cùng tầm bộ nhớ thường ăn gấp nhiều lần, kéo theo chi phí điện và tản nhiệt.
Mô hình chạy cục bộ, không gọi dịch vụ bên ngoài. Phù hợp hồ sơ nhân sự, hợp đồng, dữ liệu khách hàng và tài liệu nội bộ.
Namtech bán máy chính hãng, xuất hoá đơn VAT và nhận cài đặt, tinh chỉnh phần mềm chạy mô hình (MLX, Ollama hoặc LM Studio) theo nhu cầu (báo giá riêng).
| Cổng kết nối | 4× Thunderbolt 5 (USB-C, tới 120Gb/s, DisplayPort 2.1) · 2× USB-A (tới 5Gb/s) · 1× HDMI 2.1 · 1× Ethernet 10Gb (Nbase-T, RJ-45) · Jack tai nghe 3,5 mm · Mặt trước: khe thẻ SDXC (UHS-II) + 2× USB-C 10Gb/s (M5 Max) hoặc 2× Thunderbolt 5 (M5 Ultra) · Wi-Fi 7 (802.11be), Bluetooth 6, Thread — chip Apple N1 |
|---|---|
| Hỗ trợ màn hình | M5 Max: tối đa 5 màn hình ngoài · M5 Ultra: tối đa 8 màn hình ngoài (6K@60Hz) |
| Kích thước | Cao 9,5 cm · Rộng 19,7 cm · Sâu 19,7 cm |
| Khối lượng | 2,7 kg (M5 Max) · 3,6 kg (M5 Ultra) |
| Nguồn điện | 100–240V, công suất liên tục tối đa 480W · nhiệt độ hoạt động 10–35°C |
| Trong hộp | Mac Studio và dây nguồn. Màn hình, bàn phím, chuột bán riêng. |
Nguồn thông số: trang kỹ thuật chính thức của Apple, tham chiếu ngày 24/09/2026.
Yếu tố số một là dung lượng bộ nhớ đủ chứa mô hình, sau đó mới tới băng thông bộ nhớ. Quy tắc nhanh: mô hình nén 4-bit tốn khoảng 0,5GB cho mỗi tỷ tham số, cộng thêm phần cho ngữ cảnh hội thoại. Mac Studio rẻ nhất trên trang (36GB, 84.000.000₫) chạy được mô hình tới khoảng 43B tham số; bản 256GB chạy tới khoảng 307B.
Tuỳ cỡ mô hình: 36GB chạy tới ~43B, 64GB tới ~76B, 96GB tới ~115B, 128GB tới ~153B và 256GB tới ~307B tham số (ước lượng ở mức nén 4-bit). Cách tính: macOS cho phần đồ hoạ dùng khoảng 75% bộ nhớ, chừa 20% cho ngữ cảnh, mỗi tham số tốn khoảng 0,5 byte.
Có, từ bản 64GB trở lên. Cấu hình rẻ nhất chạy được mô hình 70B là Mac Studio M5 Max 18CPU 40GPU 64GB 512GB, giá 117.000.000₫ đã gồm VAT, chứa được mô hình tới khoảng 76B ở mức nén 4-bit. Muốn chạy 70B ở mức nén nhẹ hơn cho chất lượng trả lời cao hơn, hoặc phục vụ nhiều người cùng lúc, nên chọn 128GB trở lên.
Tuỳ phiên bản DeepSeek quý vị định chạy. Các bản rút gọn cỡ vài chục tỷ tham số chạy được từ bản 36GB (~43B). Bản đầy đủ của DeepSeek lớn hơn nhiều so với mức ~307B mà máy 256GB chứa được ở 4-bit, nên cần nén mạnh hơn hoặc ghép nhiều máy. Hãy gửi tên mô hình cụ thể, Namtech quy đổi ra cấu hình phù hợp.
Tại Namtech, Mac Studio M5 Max có giá từ 84.000.000₫ đến 169.800.000₫, M5 Ultra từ 192.000.000₫ đến 366.900.000₫ ở ổ lưu trữ mặc định. Giá đã gồm VAT, có hoá đơn, kèm tư vấn chọn cấu hình theo mô hình AI cần chạy. Nâng SSD tính thêm, chọn trong trang chi tiết từng máy.
M5 Ultra gấp khoảng đôi M5 Max ở những chỗ quan trọng cho AI: băng thông bộ nhớ 1.2TB/s so với 460GB/s/614GB/s, GPU 64/80 lõi so với 32/40 lõi, Neural Engine 32 lõi so với 16 lõi. M5 Max có bộ nhớ 36–128GB (mô hình tới ~153B); M5 Ultra có 96–256GB (tới ~307B).
Bản 96GB chạy mô hình tới khoảng 115B tham số, bản 256GB tới khoảng 307B (ước lượng, nén 4-bit). Bản 96GB hợp với mô hình lớn cho nhiều người truy vấn; bản 256GB hợp với mô hình rất lớn hoặc chạy nhiều mô hình cùng lúc. Giá bản 96GB: 192.000.000₫ – 234.900.000₫; bản 256GB: 324.000.000₫ – 366.900.000₫, đã gồm VAT.
Tuỳ cỡ mô hình. Theo NVIDIA, RTX 5090 có 32GB bộ nhớ đồ hoạ, nên mô hình lớn hơn mức đó phải ghép nhiều card hoặc chạy chậm đi. Mac Studio dùng bộ nhớ hợp nhất tới 256GB, nạp mô hình tới ~307B trong một máy, tiêu thụ tối đa 480W. Ngược lại, với mô hình vừa trong 32GB và công cụ viết riêng cho NVIDIA, PC RTX 5090 là lựa chọn đáng cân nhắc.
Cả hai đều là máy để bàn dùng bộ nhớ hợp nhất. Theo NVIDIA, DGX Spark có 128GB bộ nhớ hợp nhất; Mac Studio M5 Ultra có tuỳ chọn 256GB, chứa được mô hình lớn hơn trong một máy. DGX Spark có lợi thế chạy hệ sinh thái phần mềm của NVIDIA. Mac Studio dùng macOS, đặt gọn ở văn phòng và dùng được như một máy tính làm việc bình thường.
Được, với mô hình nhỏ, thử nghiệm hoặc một vài người dùng. Khi cần mô hình lớn, ngữ cảnh dài hoặc nhiều người hỏi cùng lúc thì nên lên Mac Studio, vì Mac Studio có mức bộ nhớ từ 36GB tới 256GB. Namtech tư vấn thẳng: nếu Mac mini đã đủ cho bài toán của quý vị, chúng tôi sẽ nói.
AI on-premise là mô hình AI chạy trên máy đặt tại công ty, không gửi câu hỏi hay tài liệu lên dịch vụ bên ngoài. AI cloud thì ngược lại: dữ liệu đi qua máy chủ của nhà cung cấp và thường tính phí theo lượt dùng. On-premise hợp với hồ sơ nhân sự, hợp đồng, dữ liệu khách hàng; đổi lại, doanh nghiệp đầu tư máy một lần và tự quản lý.
Có. Mac Studio chạy được trợ lý hỏi đáp trên kho tài liệu nội bộ cho nhân viên trong mạng công ty, dữ liệu không ra ngoài. Máy là máy nguyên bản Apple; Namtech nhận cài đặt và tinh chỉnh phần mềm chạy mô hình (MLX, Ollama hoặc LM Studio) theo nhu cầu, báo giá riêng theo khối lượng công việc.
Về kỹ thuật là có: nhiều máy nối với nhau qua Thunderbolt 5 để chia một mô hình lớn. Tuy nhiên cách này phức tạp hơn khi vận hành. Với phần lớn doanh nghiệp, chọn một máy đủ bộ nhớ ngay từ đầu vẫn đơn giản hơn. Nếu bài toán thật sự cần cụm máy, Namtech tư vấn theo trường hợp cụ thể.
Không. Bộ nhớ của Mac Studio gắn liền trong chip, phải chọn đúng mức ngay khi đặt máy. Vì vậy nên tính kỹ cỡ mô hình định chạy trước khi chốt cấu hình.
Có. Giá niêm yết trên trang đã bao gồm VAT và Namtech xuất hoá đơn đầy đủ cho doanh nghiệp. Cấu hình nâng RAM hoặc SSD là hàng đặt riêng; mốc giao báo cụ thể khi nhận yêu cầu.
Cho chúng tôi biết quý vị định dùng AI vào việc gì và bao nhiêu người dùng — Namtech đề xuất cấu hình vừa đủ, không bán dư.