Giới thiệu series
Bạn có Mac M-chip nhưng vẫn đang trả tiền cho ChatGPT hay Anthropic mỗi tháng?
Series này sẽ dạy bạn chạy AI hoàn toàn local trên máy của bạn: không internet, không API key, không phí hàng tháng, và dữ liệu không rời khỏi máy.
Apple Silicon là một trong những nền tảng inference local tốt nhất hiện nay nhờ Unified Memory Architecture. Một chiếc MacBook với 16GB hoặc 32GB RAM có thể chạy rất nhiều model 7B đến 30B mượt hơn mức nhiều người nghĩ.
Bạn sẽ học được gì?
- Cài đặt và vận hành Ollama để chạy LLM local
- Tích hợp MLX của Apple để tăng tốc inference
- Gọi model từ Python, JavaScript, hay bất kỳ ngôn ngữ nào qua REST API
- Xây chatbot, vision app, embedding pipeline chạy local
- Tối ưu memory, concurrency và custom AI assistant
Prerequisites
- Mac với chip Apple Silicon (M1 trở lên)
- RAM 16GB trở lên, khuyến nghị 32GB nếu chạy model lớn
- macOS Ventura 13.3+ hoặc mới hơn
- Biết Terminal cơ bản
- Python cơ bản để theo các bài thực hành
Tại sao nên học series này?
Trong 2026, khả năng chạy AI locally là kỹ năng rất thực dụng cho developer:
- Privacy: code, data và chat không rời khỏi máy
- Cost: gần như $0 thay vì thuê API hàng tháng
- Speed: latency local thường thấp hơn cloud cho các tác vụ lặp lại
- Offline: vẫn làm việc được khi không có mạng
- Customization: dễ tạo workflow riêng, modelfile riêng, stack riêng
