Back to articles
Technology Insight

Hướng Dẫn Tự Dựng Máy Chủ AI Search Engine Cá Nhân Bằng Perplexica Và SearXNG Trên VPS RAM 2GB

June 1, 2026

Giới thiệu về xu hướng AI Search Engine tự doanh

Trong kỷ nguyên số hiện nay, các công cụ tìm kiếm tích hợp trí tuệ nhân tạo (AI Search Engine) như Perplexity AI đã thay đổi hoàn toàn cách chúng ta khai thác thông tin trên Internet. Thay vì trả về hàng triệu liên kết rời rạc, AI sẽ tổng hợp thông tin, trích dẫn nguồn cụ thể và đưa ra câu trả lời trực tiếp. Tuy nhiên, việc phụ thuộc vào các dịch vụ thương mại luôn đi kèm rủi ro về quyền riêng tư dữ liệu cá nhân, giới hạn lượt truy vấn và chi phí bản quyền tăng dần.

Để giải quyết bài toán này, giải pháp tối ưu nhất cho các kỹ sư công nghệ và doanh nghiệp nhỏ là tự vận hành một hệ thống AI Search Engine riêng biệt. Bài viết này sẽ hướng dẫn chi tiết cách triển khai hệ thống tìm kiếm AI mạnh mẽ sử dụng Perplexica làm giao diện điều phối và SearXNG làm lõi thu thập dữ liệu, tất cả được tối ưu hóa hoàn hảo để hoạt động mượt mà trên một cấu hình máy chủ ảo (VPS) phổ thông chỉ với RAM 2GB.

---

Tại sao chọn bộ đôi Perplexica và SearXNG?

Sự kết hợp giữa Perplexica và SearXNG mang đến một kiến trúc tìm kiếm thế hệ mới nhờ tận dụng tối đa sức mạnh của cả hai nền tảng mã nguồn mở:

  • SearXNG (Metasearch Engine): Đóng vai trò làm cổng trung gian, thu thập kết quả tìm kiếm từ hơn 70 dịch vụ phổ biến (Google, Bing, DuckDuckGo) mà không lưu lại bất kỳ dữ liệu định danh hay cookie nào của người dùng.
  • Perplexica (AI Orchestrator): Hoạt động như một lớp xử lý ngôn ngữ tự nhiên lấy cảm hứng từ Perplexity AI. Nó tiếp nhận kết quả thô từ SearXNG, trích xuất văn bản cốt lõi, tiến hành kỹ thuật nhúng từ (embeddings) và gửi dữ liệu đã tinh lọc đến các mô hình ngôn ngữ lớn (LLM) để tổng hợp câu trả lời kèm trích dẫn chuẩn xác.
Mẹo tối ưu: Điểm mấu chốt để chạy hệ thống này trên cấu hình VPS RAM 2GB khiêm tốn là chúng ta sẽ sử dụng các API LLM bên ngoài (như Groq, OpenAI, OpenRouter hoặc Gemini) để xử lý phần suy luận (inference), thay vì chạy mô hình cục bộ qua Ollama vô cùng tốn tài nguyên.
---

Chuẩn bị hạ tầng hệ thống

Để đảm bảo quá trình cài đặt diễn ra thông suốt, bạn cần chuẩn bị các thành phần cơ bản sau đây:

  1. Một VPS Linux: Hệ điều hành khuyến nghị là Ubuntu 22.04 LTS hoặc Ubuntu 24.04 LTS với cấu hình tối thiểu 1 vCPU và 2GB RAM.
  2. Một tên miền (Domain Name): Đã được cấu hình bản ghi DNS (bản ghi A) trỏ về địa chỉ IP công cộng của VPS (ví dụ: search.domain.com).
  3. API Key từ nhà cung cấp LLM: Khuyên dùng Groq API (với tốc độ phản hồi cực nhanh và có gói miễn phí) hoặc OpenRouter để có thể tiếp cận các mô hình giá rẻ nhưng chất lượng cao như Llama 3 hay Qwen 2.5.
---

Quy trình triển khai chi tiết qua 4 bước

Bước 1: Cài đặt Docker và Docker Compose

Đầu tiên, hãy truy cập vào VPS thông qua giao thức SSH với quyền root hoặc sudoer để cập nhật hệ thống và cài đặt Docker:

sudo apt update && sudo apt upgrade -y
sudo apt install -y curl git nginx python3-certbot-nginx

Cài đặt môi trường Docker Engine chính thức:

curl -fsSL [https://get.docker.com](https://get.docker.com) -o get-docker.sh
sudo sh get-docker.sh

Bước 2: Cấu hình và triển khai SearXNG độc lập

Chúng ta sẽ tạo một thư mục làm việc riêng cho hệ thống search để dễ dàng quản lý các tệp cấu hình cấu trúc Docker Compose:

mkdir -p /opt/ai-search/searxng
cd /opt/ai-search

Khởi tạo tệp cấu hình quan trọng cho SearXNG nhằm đảm bảo dữ liệu trả về định dạng JSON phù hợp với giao thức kết nối của Perplexica. Tạo tệp searxng/settings.yml với nội dung sau:

use_default_settings: true
search:
  formats:
    - html
    - json
server:
  secret_key: "super_secret_key_change_me"
engines:
  - name: google
    engine: google
    shortcut: go
    timeout: 3.0

Bước 3: Thiết lập Docker Compose kết nối Perplexica

Tại thư mục /opt/ai-search, tạo tệp quản lý container docker-compose.yml:

version: '3.8'

services:
  searxng:
    image: searxng/searxng:latest
    container_name: perplexica-searxng
    volumes:
      - ./searxng:/etc/searxng
    networks:
      - ai-network
    restart: unless-stopped

  perplexica:
    image: itzcrazykns1337/perplexica:slim-latest
    container_name: perplexica-core
    ports:
      - "127.0.0.1:3000:3000"
    environment:
      - SEARXNG_API_URL=http://searxng:8080
    volumes:
      - perplexica-data:/home/vane/data
    networks:
      - ai-network
    depends_on:
      - searxng
    restart: unless-stopped

networks:
  ai-network:
    driver: bridge

volumes:
  perplexica-data:

Khởi động hệ sinh thái bằng lệnh:

docker compose up -d

Bước 4: Cấu hình Nginx Reverse Proxy và kích hoạt SSL

Perplexica sử dụng công nghệ kết nối thời gian thực WebSockets để truyền tải kết quả dạng chuỗi (streaming text). Do đó, cấu hình Nginx cần đảm bảo các tiêu đề (headers) nâng cấp kết nối được thiết lập chính xác. Tạo cấu hình tại /etc/nginx/sites-available/perplexica:

server {
    listen 80;
    server_name search.yourdomain.com;

    location / {
        proxy_pass [http://127.0.0.1:3000](http://127.0.0.1:3000);
        proxy_http_version 1.1;
        proxy_set_header Upgrade $$http_upgrade;
        proxy_set_header Connection "upgrade";
        proxy_set_header Host $$host;
        proxy_set_header X-Real-IP $$remote_addr;
        proxy_set_header X-Forwarded-For $$proxy_add_x_forwarded_for;
    }
}

Kích hoạt cấu hình và xin cấp chứng chỉ bảo mật mã hóa SSL Let's Encrypt tự động:

sudo ln -s /etc/nginx/sites-available/perplexica /etc/nginx/sites-enabled/
sudo nginx -t
sudo systemctl restart nginx
sudo certbot --nginx -d search.yourdomain.com
---

Cấu hình giao diện và kết nối mô hình ngôn ngữ lớn (LLM)

Sau khi thiết lập thành công cấu trúc hạ tầng mạng, hãy truy cập đường dẫn tên miền của bạn qua trình duyệt. Hệ thống sẽ hiển thị giao diện cấu hình ban đầu trực quan của Perplexica. Tại đây, bạn tiến hành thiết lập kết nối AI:

  1. Chọn nhà cung cấp (Provider): Chọn Groq hoặc OpenRouter để tối ưu hóa tài nguyên RAM mang lại tốc độ xử lý tức thì.
  2. Điền API Key: Nhập khóa bảo mật tương ứng từ bảng điều khiển nhà cung cấp của bạn.
  3. Lựa chọn mô hình nền tảng (Chat Model): Các dòng mô hình như llama3-70b-8192 hoặc mixtral-8x7b-32768 được khuyến khích vì chúng có khả năng hiểu ngữ cảnh tìm kiếm rất tốt và giữ chi phí vận hành ở mức gần như bằng 0.
---

Kinh nghiệm tối ưu hiệu năng trên VPS RAM 2GB

Khi chạy các dịch vụ container trên môi trường tài nguyên hạn chế, việc kiểm soát và tinh chỉnh cấu hình định kỳ là vô cùng quan trọng giúp hệ thống hoạt động bền bỉ, không rơi vào tình trạng quá tải (Out of Memory):

  • Kích hoạt Swap không gian nhớ đệm: Luôn tạo thêm từ 2GB đến 4GB không gian Swap trên ổ đĩa SSD của VPS để làm bộ đệm giải cứu hệ thống khi có lưu lượng truy cập đột biến.
  • Tối ưu hóa số lượng Engine trong SearXNG: Trong tệp settings.yml, hãy tắt bớt các công cụ tìm kiếm không thực sự cần thiết, chỉ giữ lại Google và Bing để giảm thiểu độ trễ phản hồi (latency) và tiết kiệm băng thông mạng của VPS.
  • Giới hạn tài nguyên Docker Container: Bạn hoàn toàn có thể bổ sung các tham số giới hạn trần dung lượng bộ nhớ (ví dụ: mem_limit: 512m) trực tiếp trong tệp Docker Compose đối với vùng chứa của SearXNG để ngăn hiện tượng rò rỉ bộ nhớ.
---

Lời kết và định hướng phát triển

Chỉ với một chiếc VPS 2GB RAM chi phí thấp, bạn đã hoàn toàn làm chủ một hệ thống AI Search Engine mang tính bảo mật cao, tốc độ phản hồi ấn tượng không thua kém các công cụ trả phí thương mại. Mô hình tự doanh này không chỉ giúp bảo vệ tuyệt đối dữ liệu hành vi tìm kiếm hàng ngày của bạn mà còn là nền tảng vững chắc để mở rộng, tích hợp sâu vào các quy trình tự động hóa tác vụ tự động (Automated Agents) hoặc hệ thống quản trị tri thức nội bộ của doanh nghiệp trong tương lai.

Hướng Dẫn Tự Dựng Máy Chủ AI Search Engine Cá Nhân Bằng Perplexica Và SearXNG Trên VPS RAM 2GB | DPTCloud