Chuẩn bị Ubuntu cho AI self-host: user, SSH, storage và swap

Một máy Ubuntu sạch giúp AI self-host dễ bảo trì hơn một máy đã tích tụ nhiều dịch vụ. Mục tiêu của bước chuẩn bị không phải chạy ngay model, mà tạo nền tảng có user riêng, SSH có kiểm soát, storage rõ ràng và cơ chế xử lý khi RAM thiếu.

NHT
· 4 phút đọc
Minh họa kỹ thuật cho Chuẩn bị Ubuntu cho AI self-host: user, SSH, storage và swap.

Một máy Ubuntu sạch giúp AI self-host dễ bảo trì hơn một máy đã tích tụ nhiều dịch vụ. Mục tiêu của bước chuẩn bị không phải chạy ngay model, mà tạo nền tảng có user riêng, SSH có kiểm soát, storage rõ ràng và cơ chế xử lý khi RAM thiếu.

Tóm tắt nhanh

Nếu bạn đang tìm cách Ubuntu AI self-host, điểm mấu chốt là chuẩn hóa nền tảng trước khi cài Docker và runtime AI. Hãy coi đây là một bài toán vận hành có điều kiện, không phải một lệnh thần kỳ. Khi có thay đổi phần cứng, model, dữ liệu hoặc số người dùng, bạn cần đo lại các giả định quan trọng.

Cách tiếp cận thực tế

Trong môi trường self-host, một lỗi thường nằm ở ranh giới giữa nhiều lớp. Vì vậy, hãy xác định input, trạng thái mong đợi và bằng chứng quan sát được trước khi sửa. Các bước dưới đây ưu tiên thay đổi nhỏ, có thể kiểm tra và có đường quay lại.

  1. Tạo user vận hành không dùng root cho công việc thường ngày.
  2. Thiết lập SSH key, tắt đăng nhập password nếu chính sách và quy trình khôi phục cho phép.
  3. Tách volume dữ liệu khỏi hệ điều hành để backup và thay máy thuận tiện.
  4. Theo dõi swap: swap là lưới an toàn, không phải cách biến máy thiếu RAM thành máy đủ RAM.
  5. Cập nhật hệ thống có kế hoạch, đọc changelog và giữ một cửa sổ rollback.

Ví dụ kiểm tra

Các lệnh dưới đây là khung kiểm tra, không phải cấu hình áp dụng nguyên xi cho mọi máy. Thay placeholder bằng giá trị đã được kiểm tra; không đưa credential thật vào shell history hoặc bài viết.

sudo adduser aiops
sudo usermod -aG sudo aiops
free -h
swapon --show
df -h

Sau khi chạy, lưu timestamp, model/version, thông số tài nguyên và kết quả. Việc ghi chép này giúp phân biệt lỗi tái hiện được với hiện tượng nhất thời và tạo dữ liệu cho lần rollback sau.

Lỗi thường gặp và cách xử lý

  • Tắt SSH password trước khi kiểm thử key ở một phiên thứ hai.: dừng thay đổi lan rộng, thu log liên quan, kiểm tra quyền và tài nguyên, sau đó thử lại với phạm vi nhỏ hơn.
  • Đặt swap trên ổ đĩa gần đầy.: dừng thay đổi lan rộng, thu log liên quan, kiểm tra quyền và tài nguyên, sau đó thử lại với phạm vi nhỏ hơn.
  • Cho container quyền root hoặc mount toàn bộ filesystem mà không có lý do.: dừng thay đổi lan rộng, thu log liên quan, kiểm tra quyền và tài nguyên, sau đó thử lại với phạm vi nhỏ hơn.
Một hệ thống AI self-host tốt không phải là hệ thống không bao giờ lỗi; đó là hệ thống cho phép phát hiện, giới hạn ảnh hưởng và phục hồi có kiểm soát.

Góc nhìn SEO/AEO và vận hành

Với chủ đề Ubuntu AI self-host, câu trả lời tốt cần nêu rõ điều kiện áp dụng và cách xác minh. Đừng chỉ đưa một lệnh hoặc một con số benchmark. Hãy công bố môi trường, phiên bản, giới hạn và cách người đọc có thể tự kiểm tra trên máy của họ.

Checklist trước khi đưa vào dùng thật

  • Có ít nhất hai phiên SSH được kiểm thử.
  • Đã ghi lại mount point và quyền thư mục dữ liệu.
  • Đã cập nhật package nhưng chưa xóa kernel cũ khi chưa có phương án boot.
  • Đã đặt firewall theo đúng các cổng cần dùng.

Câu hỏi thường gặp

Có cần chạy Ollama bằng root không?

Không nên; service nên chạy với user và quyền tối thiểu phù hợp.

Swap bao nhiêu là đúng?

Không có một con số cho mọi máy; hãy căn theo RAM, workload và mục tiêu tránh OOM.

Có nên mở SSH ra Internet?

Nếu bắt buộc, dùng key, firewall, giới hạn nguồn truy cập và giám sát log.

Tài liệu tham khảo chính thống

Các liên kết dưới đây là điểm bắt đầu để đối chiếu phiên bản, tham số và giới hạn trước khi áp dụng vào môi trường thật.

  1. Ollama Quickstart
  2. Docker Engine on Ubuntu

Kết luận

Chuẩn bị Ubuntu cho AI self-host: user, SSH, storage và swap nên được triển khai như một bước trong chuỗi, không phải một cấu hình độc lập. Hãy lưu lại kết quả kiểm tra, pin những phiên bản quan trọng và chỉ mở rộng khi đã có giới hạn tài nguyên cùng phương án khôi phục. Ở tập tiếp theo, serial sẽ tiếp tục từ nền tảng này để đi sâu hơn vào vận hành AI self-host.