GUIDE 02 / DÉPLOIEMENT DE FLOTTE
Déployer sur toute une flotte
D'une cohorte pilote à des milliers d'appareils : la référence d'abord, des vagues observables ensuite, des points d'arrêt entre elles et un responsable nommé pour le retour en arrière.
La règle qui garde les sites en vieNe flashez jamais un site entier d'un seul coup. Chaque vague doit être réversible et observée avant que la suivante ne commence.
Étape 01 · Référence
- Consignez ce que vous avezExportez le hashrate actuel, la consommation, les plages de température et les taux d'erreur par worker. C'est ce à quoi vous comparerez : sans cela, tout chiffre ultérieur n'est qu'une opinion
- Fixez les limites du siteTempérature ambiante, marge des disjoncteurs, plafond du générateur si vous en avez un. Ce sont elles qui décident du profil que vous avez le droit d'utiliser
- Nommez le responsable du retour en arrièreUne seule personne, nommément, qui peut décider d'arrêter et de revenir en arrière sans réunion
Étape 02 · Cohorte pilote
- Choisissez 1-5 appareilsMême modèle, même carte, même type d'emplacement en rack que le gros de la flotte
- Installez via le toolkitBalayage de groupe, sélection de la cohorte, installation du firmware, confirmation
- Laissez tourner 24-48 heures sans y toucherPlus longtemps si la température ambiante varie fortement entre le jour et la nuit
- Comparez à la référenceHashrate accepté, J/TH, dispersion des températures de puces, shares rejetées, taux des ventilateurs. Si l'un de ces indicateurs part du mauvais côté, c'est un arrêt
Étape 03 · Vagues observables
- Vague un : 10-20 % de la flotteUniquement ce qui a survécu au pilote, mêmes réglages, même fichier
- Tenez le point d'arrêtObservez une journée entière. L'agrégat de la flotte et le worker le plus faible doivent tous deux rester dans la plage que vous avez acceptée
- Élargissez la vagueDoublez-la tant que les chiffres tiennent. Arrêtez et revenez en arrière dès qu'ils ne tiennent plus
- Gardez une seule couche de pilotageSupervision centrale, un point de décision par vague, un responsable. Pas un tableur par équipe
Conditions d'arrêt : écrivez-les avant la première vague
- Température de puce au-dessus de la plage fixée pour le site
- Shares rejetées qui montent au-dessus de la référence
- Tout appareil qui exige une intervention manuelle pour revenir
- Toute vague que vous ne pouvez pas annuler en une seule équipe