Add Qwen GSQ-RCO Beta 1 profile
This commit is contained in:
@@ -2,20 +2,22 @@
|
||||
"""AI Profile Router – OpenAI-kompatibler Proxy vor llama.cpp.
|
||||
|
||||
Leitet OpenAI-kompatible Requests transparent an den lokalen llama.cpp-Server
|
||||
weiter (Streaming, Tool Calls, JSON) und schaltet zwischen fünf festen
|
||||
weiter (Streaming, Tool Calls, JSON) und schaltet zwischen sechs festen
|
||||
Profilen um:
|
||||
|
||||
Profil Kontext
|
||||
------ --------
|
||||
fast 76800
|
||||
medium 160000
|
||||
beta1 192000
|
||||
large 192000
|
||||
ultra 262144
|
||||
uncensored 80000
|
||||
|
||||
Virtuelle Modelle: qwen-fast, qwen-medium, qwen-large, qwen-ultra,
|
||||
qwen-uncensored
|
||||
Kommandos: POST /fast, /medium, /large, /ultra, /uncensored
|
||||
Virtuelle Modelle: qwen-fast, qwen-medium, qwen-beta-1, qwen-large,
|
||||
qwen-ultra, qwen-uncensored
|
||||
Kommandos: POST /fast, /medium, /beta1, /large, /ultra,
|
||||
/uncensored
|
||||
GET /status (Zustand)
|
||||
|
||||
Bildgenerierung und Editing (FLUX.2-klein-4B):
|
||||
@@ -207,7 +209,10 @@ PROFILES = {name: definition["context"]
|
||||
for name, definition in PROFILE_REGISTRY.items()}
|
||||
EXPECTED_MODELS = {name: definition.get("model_alias")
|
||||
for name, definition in PROFILE_REGISTRY.items()}
|
||||
VIRTUAL_MODELS = {f"qwen-{name}": name for name in PROFILES}
|
||||
VIRTUAL_MODELS = {
|
||||
(EXPECTED_MODELS.get(name) or f"qwen-{name}"): name
|
||||
for name in PROFILES
|
||||
}
|
||||
|
||||
log = logging.getLogger("ai-profile-router")
|
||||
AUTH: AuthPolicy | None = None
|
||||
@@ -1524,11 +1529,11 @@ class Handler(BaseHTTPRequestHandler):
|
||||
self._images_list()
|
||||
elif path.startswith("/images/") and self.command == "GET":
|
||||
self._image_serve(path[len("/images/"):])
|
||||
elif (path in ("/fast", "/medium", "/large", "/ultra", "/uncensored")
|
||||
elif (path.removeprefix("/") in PROFILES
|
||||
and (self.command == "POST"
|
||||
or (self.command == "GET" and ALLOW_LEGACY_GET_SWITCH))):
|
||||
self._switch(path[1:])
|
||||
elif (path in ("/fast", "/medium", "/large", "/ultra", "/uncensored")
|
||||
elif (path.removeprefix("/") in PROFILES
|
||||
and self.command == "GET"):
|
||||
self._send_error(405, "Profilwechsel erfordert POST",
|
||||
"invalid_request_error", "method_not_allowed")
|
||||
@@ -1673,7 +1678,7 @@ class Handler(BaseHTTPRequestHandler):
|
||||
def _models_payload() -> dict:
|
||||
models = [
|
||||
{
|
||||
"id": f"qwen-{name}",
|
||||
"id": EXPECTED_MODELS.get(name) or f"qwen-{name}",
|
||||
"object": "model",
|
||||
"created": 0,
|
||||
"owned_by": "ai-profile-router",
|
||||
|
||||
@@ -8,6 +8,10 @@
|
||||
"context": 160000,
|
||||
"model_alias": "qwen-medium"
|
||||
},
|
||||
"beta1": {
|
||||
"context": 192000,
|
||||
"model_alias": "qwen-beta-1"
|
||||
},
|
||||
"large": {
|
||||
"context": 192000,
|
||||
"model_alias": "qwen-large"
|
||||
|
||||
Reference in New Issue
Block a user