← Blog
July 31, 2025

Les RTX 5090 sont désormais disponibles sur Hivenet Compute

Une nouvelle étape pour les GPU sur Compute

En juillet 2025, Hivenet a ajouté des RTX 5090 de NVIDIA à Compute. Cette page conserve l'annonce de ce lancement et renvoie vers le benchmark corrigé ainsi que vers les informations d'accès actuelles.

Pourquoi la RTX 5090 a rejoint l'offre

Lors du lancement de Hivenet avec des RTX 4090, ces cartes offraient aux équipes une solution grand public pour l'inférence et d'autres charges compatibles avec leur mémoire et leurs fonctions. L'arrivée de la RTX 5090 a ajouté 32 Go de mémoire GDDR7 et une génération de GPU plus récente. Le premier lot comprenait également de la capacité dans la région UAE-2.

Il s'agit du contexte historique du lancement. Les régions, les presets, la capacité et les tarifs peuvent changer. La disponibilité actuelle doit donc être vérifiée dans la console Compute.

Résultats du benchmark

Le benchmark de lancement comparait une RTX 4090, une RTX 5090 et une A100 80 Go avec Llama 3.1 8B Instruct en BF16. Dans le test enregistré :

  • À 1 requête/s, la RTX 5090 a enregistré un TTFT moyen de 45,41 ms et une latence moyenne de bout en bout de 6 058,57 ms. L'A100 a enregistré respectivement 296,44 ms et 7 080,9 ms.
  • À forte charge, la RTX 5090 a enregistré 3 802,09 jetons en sortie par seconde, contre 3 748,16 pour l'A100, soit un écart d'environ 1,4 % lors de cette exécution.
  • La RTX 4090 a enregistré 737,65 jetons en sortie par seconde dans le même tableau à forte charge.

Aucun test avec deux RTX 5090 n'a été enregistré. L'ancien chiffre de 7 604 jetons/s provenait d'une extrapolation linéaire et n'est pas présenté comme un résultat mesuré. L'ancienne infographie du lancement a également été retirée : elle montrait un autre test de parallélisme tensoriel et de pipeline, sans protocole suffisant pour le rapprocher du PDF cité.

Consultez le protocole complet, les résultats et les limites du benchmark RTX 4090, RTX 5090 et A100 avant d'appliquer ces chiffres à une autre charge de travail.

Protocole de test

  • Modèle : meta-llama/Meta-Llama-3.1-8B-Instruct
  • Précision : BF16
  • Jeu de données : ShareGPT
  • Contexte et sortie : contexte de 8 192 jetons et sortie de 512 jetons
  • Moteur : vLLM 0.8.3 benchmark_serving.py
  • Scénarios : 1 requête/s avec 100 requêtes de test ; 1 100 requêtes/s avec 1 500 requêtes de test
  • Régions de lancement indiquées dans l'article : France et UAE-2

Le dossier historique n'indique pas le format exact de l'A100, le processeur hôte et la mémoire système, les versions du pilote NVIDIA et de CUDA, la commande et les options complètes, la date du test, le nombre d'exécutions, la variance ni le comportement en cas d'erreur. La méthodologie actuelle des benchmarks Hivenet présente les règles utilisées pour les tests plus récents.

Ce que cela signifie pour votre charge de travail

Ce benchmark permet une conclusion limitée : pour ce protocole Llama 3.1 8B en BF16, la RTX 5090 a enregistré un TTFT nettement inférieur à celui de l'A100 et un débit proche à forte charge. Il ne démontre pas un avantage universel en matière de performances, d'efficacité énergétique, de coût ou de passage à plusieurs GPU.

La RTX 4090 a depuis été retirée de l'offre Hivenet disponible au lancement. Pour connaître les tarifs et la disponibilité actuels de la RTX 5090, consultez la page Tarifs de Hivenet, puis vérifiez le preset actif dans la console Compute.

Lancer une RTX 5090 aujourd'hui

Le guide de démarrage Compute présente la création du compte, l'ajout de crédits, la création d'une instance, le choix de la région et du GPU, la connectivité et l'arrêt des ressources. Utilisez ce guide plutôt que les anciennes étapes ou captures d'écran de cette page.

Capture historique de la console Compute en juillet 2025

Pour connaître le prix actif et les configurations disponibles au lancement, consultez la page actuelle des tarifs Compute et la console.

Your next workload belongs on Hivenet.

Pick one AI, compute, or storage workload and see the difference for yourself. Spin it up in minutes, or let our team map your fastest path to production.

Shader gradient background