Versão: 1.3.1
Audiência: Administradores de TI, DevOps
- CPU x64, 8 GB RAM (16 GB+ recomendado)
- NVIDIA GPU 6 GB+ VRAM para inferência
- 50 GB+ disco (app + modelos)
- Windows 10 20H1+ ou Windows 11
- Driver NVIDIA com CUDA 12.8+
- Não copies
bin\Releaseframework-dependent por cima de Program Files (parte o hostfxr). Só publish self-contained. - Porta TCP 14563 livre
- Administrador local para instalação
- Visual C++ Redistributable 2022 x64 (embutido no Setup)
- .NET runtime embutido (self-contained)
- PyTorch CUDA 12.8 no venv (download ~2–3 GB durante Install.ps1)
- ExLlamaV3
.pyd+ deps + Python/VC (embutidos no Setup)
| Pacote | Arquivo | Notas |
|---|---|---|
| Recomendado | ExLlamaSharp-Setup-win-x64.exe |
App + ExLlamaV3 .pyd + deps + Python/VC; PyTorch descarrega na instalação |
| Slim | Build-Installer.ps1 -SkipBundleWheels |
Só a app; GPU fica para depois |
Modos de host (%ProgramData%\ExLlamaSharp\host-mode.json):
- desktop (default): serviço Manual; Tray + tarefa de logon
ExLlamaSharpTrayLogonsobem o Server na sessão do utilizador (GPU). - headless: serviço Delayed Auto com conta GPU (não LocalSystem). Tray só observa.
Após install: packaging\Verify-Install.ps1. Provas de resiliência: packaging\Prove-Resilience.ps1. Redeploy local (nunca copies bin FDD): packaging\Redeploy-Local.ps1.
Authenticode: se EXLLAMASHARP_SIGN_PFX + signtool existirem, Build-Installer.ps1 assina Server/Tray/Setup. Sem PFX o Setup fica por assinar (SmartScreen).
Build:
powershell -ExecutionPolicy Bypass -File packaging\Build-Installer.ps1
# slim: -SkipBundleWheels- Extrair o ZIP
- Executar
Install.ps1ouInstall.batcomo Admin - Aguardar PyTorch
- Abrir http://localhost:14563
# No host (Admin)
powershell -NoProfile -ExecutionPolicy Bypass -File Install.ps1 -Unattended
# Remoto (exemplo)
$servers = @("GPU-01", "GPU-02")
$zip = "\\fileserver\Software\ExLlamaSharp\ExLlamaSharp-Setup-win-x64.zip"
foreach ($s in $servers) {
Copy-Item $zip "\\$s\C$\Temp\exls.zip" -Force
Invoke-Command -ComputerName $s -ScriptBlock {
Expand-Archive C:\Temp\exls.zip C:\Temp\ExLlamaSharpSetup -Force
Set-Location C:\Temp\ExLlamaSharpSetup
powershell -NoProfile -ExecutionPolicy Bypass -File .\Install.ps1 -Unattended
}
}Install.ps1 -SkipPyTorch
Install.ps1 -InstallDir "D:\Apps\ExLlamaSharp"
Install.ps1 -Unattended
Install.ps1 -HostMode headless -ServiceAccount ".\gpuuser" -ServicePasswordFile C:\Temp\svc.pwd| Item | Local |
|---|---|
| App | C:\Program Files\ExLlamaSharp\ |
| venv / PyTorch (novo) | %ProgramData%\ExLlamaSharp\venv\ |
| venv legado | C:\Program Files\ExLlamaSharp\venv\ (reusado, não migrado) |
| Dados / modelos / logs | %ProgramData%\ExLlamaSharp\ |
| Serviço | Desktop: Manual/parado. Headless: Delayed Auto + conta GPU |
| UI | http://localhost:14563 |
Get-Service ExLlamaSharp
Invoke-WebRequest http://localhost:14563/health& "C:\Program Files\ExLlamaSharp\Setup-Exl3Python.bat"# No pacote ou em Program Files\ExLlamaSharp\scripts
.\Uninstall.bat
# ou
powershell -File Uninstall.ps1 -RemoveData # também apaga %ProgramData%| Sintoma | Ação |
|---|---|
| Porta 14563 em uso | Parar serviço / processo antigo; Cleanup-BrokenInstall.ps1 |
| PyTorch falhou | Setup-Exl3Python.bat |
| exllamav3 Python não compila (VS 2025) | Ver vs2025-cuda-issue.md — backend nativo OK |
| Serviço não sobe | Logs em %ProgramData%\ExLlamaSharp\logs\ |
Mais: INSTALL.md · packaging/README.md