Enable llama.cpp builds, release management and reference model auto-fit

This commit is contained in:
Mikei386
2026-09-28 16:45:24 +02:00
parent 5fb732469a
commit ba524b0a70
13 changed files with 411 additions and 20 deletions
+5 -3
View File
@@ -2,7 +2,9 @@
Eigenständige Installation ohne WireGuard-Modul und ohne Änderungen am bestehenden
Athena-Router. Der Installer installiert den aktuellen Deck-Anwendungsstand;
Modellkatalog, Downloads und llama.cpp-Builds bleiben weiterhin GUI-Vorschau.
Modellkatalog, Downloads und llama.cpp-Buildverwaltung sind aktiv. Das Docker-Image
enthält das CUDA-Build-Toolkit; der Debian-Host wird nicht verändert. Zielprodukt
bleibt ein nativer systemd-Dienst. Modellstarts sind noch nicht angebunden.
## Voraussetzungen
@@ -21,7 +23,7 @@ auf einem bereits genutzten Server. Offizielle Anleitung:
Optional für GPU-Messwerte: vorhandener NVIDIA-Treiber und vorhandenes NVIDIA
Container Toolkit. `--gpu-telemetry` bindet ausschließlich Treiber-Capability
`utility` ein; es installiert keinen Treiber und startet kein Modell. Ohne diese
`compute,utility` für Telemetrie und Fit-Prüfung ein; es installiert keinen Treiber und startet kein Modell. Ohne diese
Option bleiben GPU-Werte in der Server-GUI ausdrücklich nicht verfügbar.
## Installation
@@ -158,7 +160,7 @@ sudo ./install.sh --status --directory /opt/athena-deck-test
Die Webanwendung läuft als UID/GID 65534, mit schreibgeschütztem Root-Dateisystem,
allen Linux-Capabilities entzogen, ohne Docker-Socket, ohne privilegierten Modus
und ohne Host-Netzwerk. Ressourcenlimit: eine CPU, 512 MiB RAM, 128 Prozesse.
und ohne Host-Netzwerk. Ressourcenlimit: zwei CPUs, 8 GiB RAM, 128 Prozesse.
GPU-Zugriff ist standardmäßig aus. Nur `state/` und ein temporäres tmpfs sind für
die Anwendung beschreibbar. Docker erstellt seine normalen Regeln für den neuen
Container; vorhandene Gateways und ihre Konfiguration werden nicht bearbeitet.