Enable llama.cpp builds, release management and reference model auto-fit
This commit is contained in:
+5
-3
@@ -2,7 +2,9 @@
|
||||
|
||||
Eigenständige Installation ohne WireGuard-Modul und ohne Änderungen am bestehenden
|
||||
Athena-Router. Der Installer installiert den aktuellen Deck-Anwendungsstand;
|
||||
Modellkatalog, Downloads und llama.cpp-Builds bleiben weiterhin GUI-Vorschau.
|
||||
Modellkatalog, Downloads und llama.cpp-Buildverwaltung sind aktiv. Das Docker-Image
|
||||
enthält das CUDA-Build-Toolkit; der Debian-Host wird nicht verändert. Zielprodukt
|
||||
bleibt ein nativer systemd-Dienst. Modellstarts sind noch nicht angebunden.
|
||||
|
||||
## Voraussetzungen
|
||||
|
||||
@@ -21,7 +23,7 @@ auf einem bereits genutzten Server. Offizielle Anleitung:
|
||||
|
||||
Optional für GPU-Messwerte: vorhandener NVIDIA-Treiber und vorhandenes NVIDIA
|
||||
Container Toolkit. `--gpu-telemetry` bindet ausschließlich Treiber-Capability
|
||||
`utility` ein; es installiert keinen Treiber und startet kein Modell. Ohne diese
|
||||
`compute,utility` für Telemetrie und Fit-Prüfung ein; es installiert keinen Treiber und startet kein Modell. Ohne diese
|
||||
Option bleiben GPU-Werte in der Server-GUI ausdrücklich nicht verfügbar.
|
||||
|
||||
## Installation
|
||||
@@ -158,7 +160,7 @@ sudo ./install.sh --status --directory /opt/athena-deck-test
|
||||
|
||||
Die Webanwendung läuft als UID/GID 65534, mit schreibgeschütztem Root-Dateisystem,
|
||||
allen Linux-Capabilities entzogen, ohne Docker-Socket, ohne privilegierten Modus
|
||||
und ohne Host-Netzwerk. Ressourcenlimit: eine CPU, 512 MiB RAM, 128 Prozesse.
|
||||
und ohne Host-Netzwerk. Ressourcenlimit: zwei CPUs, 8 GiB RAM, 128 Prozesse.
|
||||
GPU-Zugriff ist standardmäßig aus. Nur `state/` und ein temporäres tmpfs sind für
|
||||
die Anwendung beschreibbar. Docker erstellt seine normalen Regeln für den neuen
|
||||
Container; vorhandene Gateways und ihre Konfiguration werden nicht bearbeitet.
|
||||
|
||||
Reference in New Issue
Block a user