Supervision Technique & Inférence
Espace AdministrateurMétriques d'exécution matérielle du VPS OVH, latences d'inférence et consommation de tokens.
Nœud d'Inférence IA (OVH VPS-1)
En ligneSupabase : 0 logs réelsOVHcloud France (VPS-1, Gravelines) • Modèle : Qwen2.5-1.5B-Instruct (Quantification Q4_K_M)
Données réelles VPS & Supabase
IPv4 : 162.19.74.3
Vitesse de calcul
0tokens / sec
Calculé en temps réel depuis tokens_used et latency_ms
Latence moyenne
0ms / inférence
Temps cumulé : 0s
Tokens traités
0tokens cumulés
In: 0 • Out: 0
File de traitement
0email en attente
Synchronisation En continu
Charge Processeur (2 vCores)
Allocation exclusive pour l'exécution du Small Language Model et Nginx.
Mémoire Vive (RAM)
Empreinte modèle Qwen Q4_K_M : ~1,4 Go. Marge de sécurité de 2,6 Go pour le système.
Fichier Swap NVMe (2 Go)
Swappiness configurée à 10 (sysctl.conf).