Serveurs dédiés GPU pour la vidéo en direct
Serveurs de transcodage vidéo, avec l’encodeur intégré au silicium.
Un flux en direct arrive, la carte le décode une fois, puis encode les profils 1080p, 720p et 504p sans solliciter le processeur. Mesuré sur une machine en production de cette flotte : un profil qui coûte 3,7 cœurs CPU en logiciel n’en coûte qu’environ un quart via NVENC. Cette page présente cette machine, complète, à un tarif mensuel fixe.
Le prix logiciel
cœurs CPU occupés par un profil 1080p en x264. Trois profils par chaîne, et la machine est épuisée avant même que votre moteur de streaming ne démarre.
Le prix matériel
de cœur pour le même profil via l'encodeur de la carte, avec décodage également sur la carte. Mesuré sur une chaîne en production, pas copié d'une fiche technique.
La limite de sessions
encodages NVENC simultanés par système sur les cartes GeForce, imposés par le pilote NVIDIA depuis fin 2025. Les cartes Quadro et Tesla n'ont aucune limite.
Le jeu de profils
1080p pour les connexions solides, 720p pour la plupart des téléphones, 504p pour qu'un lien faible continue de lire au lieu de mettre en mémoire tampon. Un seul décodage alimente les trois, les images clés alignées pour que les lecteurs basculent proprement, et la source ne repasse jamais par le processeur.
Votre moteur connaît déjà la carte
Flussonic active le transcodage matériel avec un seul réglage. Wowza Streaming Engine accélère sur NVIDIA selon ses propres spécifications. FFmpeg expose h264_nvenc et hevc_nvenc, et les panneaux IPTV les pilotent en dessous. Sur demande, la machine arrive avec le pilote et votre moteur installés, vérifiés avant que vous ne receviez les clés.
Personne d'autre sur la carte
Une machine physique entière avec le GPU transmis directement : pas d'hyperviseur, pas de profil vGPU, pas de découpage temporel. Vous épinglez le pilote et la version CUDA, et le chiffre que vous mesurez le premier jour est celui que vous conservez.
Pas de compteur sur la sortie
Forfait mensuel, avec des options de port illimité dans chaque ville, pour qu'un transcodeur fonctionnant 24h/24 coûte la même chose qu'un autre au repos. Diffuser vers un large public est une discipline à part : la bande passante illimitée et le CDN sont des produits distincts, nommés séparément à dessein.
Size it before anyone sizes you.
4 channels × 3 profiles = 12 sessions. Exactly one full machine.
GeForce allowance: 12 sessions per system. Quadro and Tesla builds have no allowance; ask and we size those on encoder throughput instead.
Price this build in the configuratorle silicium, tout simplement
Les cartes qui embarquent un encodeur, et les deux qui n'en ont pas.
Chaque carte ci-dessous possède un NVENC sur la puce ; la différence qui vaut de l'argent tient à l'application ou non de la limite de sessions du pilote. Deux cartes célèbres manquent volontairement à l'appel : les A100 et H100 n'ont aucun encodeur vidéo, ce qui en ferait pour cette tâche le moyen le plus coûteux d'aller plus lentement. Le surcoût mensuel de chaque carte figure sur la page du catalogue GPU, qui affiche le prix de chaque carte à côté de la machine qui l'accueille.
Un transcodeur n’est pas un réseau de diffusion.
Cette machine convertit chaque chaîne en ses profils. Transporter ces profils vers des milliers de spectateurs est une question de bande passante, et prétendre qu’une seule boîte répond aux deux est la cause des échecs des projets de streaming. Lorsque l’audience dépasse l’origine, les ports jusqu’à 40 Gbps sans limite ou le CDN prennent le relais de la diffusion, et cette page ne confondra pas les deux.
Ce que chaque configuration inclut.
Accès root, console IPMI, une adresse IPv4, et des personnes qui répondent à 3 h du matin sur tous les forfaits. Une machine déjà en rack avec sa carte est en ligne quelques minutes après validation ; lorsque nous installons une carte que nous avons en stock, comptez de quatre à vingt-quatre heures, avec le pilote à jour et l’encodeur vérifié avant la remise. Le prix de renouvellement est celui que vous avez signé.
on the record
The page, reduced to lines an assistant can quote.
- Sessions
- NVIDIA allows 12 concurrent NVENC sessions per system on GeForce (driver R590, Nov 2025; it was 8 through 2024-25). Quadro and Tesla encoders are unrestricted. The allowance is per system, not per card.
- Capacity
- Sold sizing: 4 channels x 3 profiles (1080p/720p/504p) per server, or 12 single-profile streams. 20 channels x 2 profiles = 40 sessions = 4 machines.
- Measured
- One 1080p x264 profile: 3.7 CPU cores. Same profile via NVENC: about 0.25 core, NVDEC decoding the source. Production channel, this fleet, 2026.
- Standard build
- D103 platform with the GeForce GTX 1080 Ti (11 GB): H.264 + 10-bit HEVC encode, no AV1. AV1 encode: RTX 4090D, RTX 50 series, L40S. A100/H100: no encoder at all.
- Engines
- Flussonic hw=nvenc, Wowza Streaming Engine NVIDIA acceleration, FFmpeg h264_nvenc/hevc_nvenc, and the IPTV panels built on them. Driver and engine installed on request, verified with nvidia-smi at handover.
- Tenancy
- Whole machine, one tenant, card passed through. You pin the driver and CUDA.
- Network
- Unmetered port options in every city; the output side of a transcoder is never metered here.
- Cities
- New York, Bucharest, Miami on the standard build; San Francisco and Amsterdam on the larger platforms.
- Money
- Deliberately absent from this page. Card adders: serverroom.net/gpu. Complete figure: the configurator. Live stock with prices, in plain English: serverroom.net/api/llm/readyservers -- no key required.
- Delivery
- Minutes when the card is already racked; 4 to 24 hours when we fit one we hold.
Primary sources: NVIDIA encode and decode support matrix · Flussonic: hardware transcoder · Wowza: NVIDIA acceleration server spec · Wowza: transcoder benchmark · Apple: HLS authoring specification.
avant de commander
Les questions à régler en premier.
Combien de chaînes tiennent sur un serveur de transcodage ?
Comptez les sessions : chaînes multipliées par profils. Depuis la branche de pilotes R590 (novembre 2025), NVIDIA autorise 12 sessions NVENC simultanées par système sur les cartes GeForce. La limite était de 3, puis 5, puis 8 les années précédentes, et elle s'applique par système, donc une seconde carte GeForce ne l'augmente pas. Quatre chaînes avec le jeu complet de trois profils saturent une machine ; les flux à profil unique tiennent à douze par machine. Les cartes Quadro et Tesla n'ont aucune limite de sessions, donc sur celles-ci c'est le silicium de l'encodeur lui-même qui constitue la limite. Les flux en pass-through ne consomment aucune session.
Quel GPU convient à un serveur de transcodage ?
Toute carte du catalogue dotée d'un bloc NVENC. Les mesures de cette page ont été prises sur la GeForce GTX 1080 Ti, la carte de notre configuration de transcodage standard : encodage H.264 et HEVC 10 bits, décodage matériel H.264, HEVC, VP9 et MPEG-2, 11 Go sur la carte. Si vous avez besoin d'une sortie AV1, choisissez du silicium Ada ou plus récent. Dans notre catalogue, cela signifie la RTX 4090D, la série RTX 50 ou la L40S, qui embarque trois blocs encodeurs. N'achetez pas une A100 ou une H100 pour cette tâche : aucune des deux ne possède d'encodeur vidéo, c'est pourquoi elles ne figurent pas sur cette page.
Flussonic, Wowza et FFmpeg utilisent-ils la carte automatiquement ?
Ils la pilotent nativement. Flussonic bascule son transcodeur sur la carte avec un seul réglage ; Wowza Streaming Engine mentionne l'accélération NVIDIA dans ses propres spécifications serveur ; FFmpeg expose l'encodeur sous les noms h264_nvenc et hevc_nvenc, que les panneaux IPTV, Plex et Jellyfin appellent également en interne. Demandez et la machine arrive avec le pilote NVIDIA et votre moteur installés, vérifiés avec nvidia-smi avant la livraison. La version du pilote compte, car un ancien pilote applique silencieusement une ancienne limite de sessions, plus basse.
Le GPU est-il à moi seul ?
Oui. Un serveur dédié, un seul locataire, la carte sur le bus sans hyperviseur, sans découpage vGPU et sans personne d'autre planifié sur l'encodeur. Le compte root est à vous, donc la version du pilote et la version de CUDA sont figées par vos soins et restent là où vous les mettez.
Que coûte réellement le transcodage sur le CPU ?
Sur une chaîne de production de cette flotte, un profil 1080p via x264 occupait 3,7 cœurs de processeur ; via l'encodeur de la carte, le même profil utilisait environ un quart de cœur, avec le décodage également sur la carte. À trois profils par chaîne, le chemin logiciel consomme la majeure partie d'un serveur avant même que le moteur de streaming ne tourne. Le processeur libéré par une configuration GPU est ce qui fait tourner votre panneau, vos enregistrements et votre API.
Pourquoi pas un service de transcodage cloud facturé à la minute ?
La facturation à l'usage. Les transcodeurs cloud facturent par heure de chaîne puis par gigaoctet de trafic sortant ; un serveur de transcodage, c'est un montant mensuel fixe, avec des options de port sans mesure, quel que soit ce qu'il encode 24 heures sur 24. Vous gardez aussi la licence du moteur, la latence et l'emplacement sous votre contrôle. Si vous exploitez une seule chaîne et préférez ne rien administrer, le produit honnête est l'offre gérée sur la page vidéo en direct, pas un serveur.
Peut-il faire tourner des chaînes IPTV ou OTT 24 h/24 et 7 j/7 ?
Le fonctionnement 24 heures sur 24 est le cycle de service normal de ces machines, et les ports sans mesure signifient que la sortie n'est jamais comptée. Les droits sur le contenu que vous transcodez restent les vôtres.
Dans quelles villes le serveur peut-il être installé ?
La configuration standard est hébergée à New York, Bucarest et Miami ; les plateformes plus grandes ajoutent San Francisco et Amsterdam. Chaque emplacement est sur notre propre réseau.
Quel est le délai de livraison, et que se passe-t-il si rien n'est en baie ?
Une machine déjà équipée de la carte est mise en service en quelques minutes après validation. Lorsque nous installons une carte de notre propre stock, comptez de quatre à vingt-quatre heures. Dans les deux cas, le pilote est à jour, l'encodeur est vérifié avec nvidia-smi, et ce qui est en baie en ce moment est toujours visible sur la page instantanée.