Chuyển đến nội dung chính
Giảm 50% tất cả các gói, có thời hạn. Khởi điểm từ $2.48/mo
Ollama

Ollama

Ollama chạy các LLM ngay trên VPS của bạn. Kéo và phục vụ Llama 3, Mistral, Phi, Gemma và Qwen chỉ với một lệnh. AI tự lưu trữ, không cần khóa API, tương thích với các client OpenAI. Cách đơn giản nhất để chạy inference riêng tư, đang được hơn 200.000 lập trình viên sử dụng.

Tổng quan

175k

Sao GitHub

29

Lượt xem trang

324

Cài đặt đang hoạt động

Giấy phép MIT Phiên bản Latest OS Ubuntu Server 24.04 LTS Min RAM 8 GB IP IPV4,IPV6

Cài đặt đang hoạt động là dữ liệu mẫu (xem trước); số liệu thực sẽ được kết nối trước khi ra mắt.

Các Thành Phần Đã Cài Đặt

  1. Ollama → một framework nhẹ, có thể mở rộng để chạy các LLM cục bộ.
  2. Open WebUI → giao diện web để tương tác với Ollama.

Thư mục cài đặt

Tệp Docker Compose cho Open WebUI nằm tại:

/root/open-webui/docker-compose.yml

Thư mục làm việc cho dịch vụ systemd: /root/open-webui

Thông tin truy cập

Giao diện Web:

  • Open WebUI: http://<server-ip>:8080
  • UI có thể mất vài phút để khởi động.
  • Truy cập sớm để hoàn tất thiết lập ban đầu và tạo một người dùng quản trị.

Ollama API:

  • Base URL: http://127.0.0.1:11434
  • Có thể truy cập cục bộ bên trong máy chủ.

Cách dùng Ollama

Chạy các lệnh này trực tiếp trong terminal:

# Pull a model
ollama pull <model_name>

# Run a model
ollama run <model_name>

Ví dụ:

ollama pull llama3.1
ollama run llama3.1

Quản lý dịch vụ

# Open WebUI
systemctl status open-webui
systemctl restart open-webui

# Ollama
systemctl status ollama
systemctl restart ollama

Thêm về Khoa học Dữ liệu

Ứng dụng liên quan.

Triển khai Ollama ngay. Từ $2.48/tháng.