Zum Hauptinhalt springen
50 % Rabatt alle Pläne, begrenzte Zeit. Ab $2.48/mo
Ollama

Ollama

Ollama führt LLMs lokal auf deinem VPS aus. Llama 3, Mistral, Phi, Gemma und Qwen mit einem Befehl laden und bereitstellen. Self-hosted AI ohne API-Key, REST API-kompatibel mit OpenAI-Clients. Der direkteste Weg zu privater Inferenz – genutzt von über 200.000 Entwicklern.

Auf einen Blick

175k

GitHub-Sterne

31

Seitenaufrufe

Lizenz MIT Version Latest OS Ubuntu Server 24.04 LTS Min RAM 8 GB IP IPV4,IPV6

Installierte Komponenten

  1. Ollama → ein leichtgewichtiges, erweiterbares Framework zum lokalen Ausführen von LLMs.
  2. Open WebUI → Weboberfläche für die Interaktion mit Ollama.

Installationsverzeichnis

Die Docker-Compose-Datei für Open WebUI befindet sich unter:

/root/open-webui/docker-compose.yml

Arbeitsverzeichnis für den systemd-Dienst: /root/open-webui

Zugriffsinformationen

Weboberfläche:

  • Open WebUI: http://<server-ip>:8080
  • Es kann einige Minuten dauern, bis die UI startet.
  • Greifen Sie frühzeitig zu, um die Ersteinrichtung abzuschließen und einen Admin-Benutzer zu erstellen.

Ollama API:

  • Base URL: http://127.0.0.1:11434
  • Lokal innerhalb des Servers erreichbar.

Ollama-Nutzung

Führen Sie diese Befehle direkt im Terminal aus:

# Pull a model
ollama pull <model_name>

# Run a model
ollama run <model_name>

Beispiel:

ollama pull llama3.1
ollama run llama3.1

Service-Management

# Open WebUI
systemctl status open-webui
systemctl restart open-webui

# Ollama
systemctl status ollama
systemctl restart ollama

Mehr aus dem Bereich Data Science

Verwandte Apps.

Ollama jetzt deployen. Ab 2,48 $/Monat.