Add LM Backend selector (PT vs VLLM) to reduce VRAM usage

PT backend uses ~1.6 GB VRAM vs ~9.2 GB for VLLM, making it accessible
on lower-end GPUs. Adds dropdown in Advanced Settings defaulting to PT.
This commit is contained in:
fspecii
2026-02-05 22:30:23 +02:00
parent 823fbe0cd3
commit d05c665f4d
6 changed files with 37 additions and 2 deletions
+3
View File
@@ -90,6 +90,7 @@ interface GenerateBody {
lmTopK?: number;
lmTopP?: number;
lmNegativePrompt?: string;
lmBackend?: 'pt' | 'vllm';
// Expert Parameters
referenceAudioUrl?: string;
@@ -189,6 +190,7 @@ router.post('/', authMiddleware, async (req: AuthenticatedRequest, res: Response
lmTopK,
lmTopP,
lmNegativePrompt,
lmBackend,
referenceAudioUrl,
sourceAudioUrl,
audioCodes,
@@ -252,6 +254,7 @@ router.post('/', authMiddleware, async (req: AuthenticatedRequest, res: Response
lmTopK,
lmTopP,
lmNegativePrompt,
lmBackend,
referenceAudioUrl,
sourceAudioUrl,
audioCodes,