JOURNAL DE BORD — HEXAOS

Les avancées, les choix et les preuves.

Suivez la construction d'HexaOS, découvrez les décisions d'architecture et retrouvez les nouvelles de la communauté sans exposer les données sensibles du projet.

PUBLICATION ÉDITORIALE

Projet · IA locale · HPC · Sécurité · Écosystème

HPC & Cluster

Maintenance et non-régression — Comprendre le rôle — Grafana et dashboards versionnés

Grafana et dashboards versionnés : lier chaque panneau à une métrique existante et à une question opérationnelle, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Limites et prochaine validation — Collecte Prometheus et santé des cibles

Collecte Prometheus et santé des cibles : distinguer un exporter installé d’une cible réellement collectée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Méthode de vérification — Collecte Prometheus et santé des cibles

Collecte Prometheus et santé des cibles : distinguer un exporter installé d’une cible réellement collectée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Point d’avancement contrôlé — Collecte Prometheus et santé des cibles

Collecte Prometheus et santé des cibles : distinguer un exporter installé d’une cible réellement collectée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Choix d’architecture — Collecte Prometheus et santé des cibles

Collecte Prometheus et santé des cibles : distinguer un exporter installé d’une cible réellement collectée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Comprendre le rôle — Collecte Prometheus et santé des cibles

Collecte Prometheus et santé des cibles : distinguer un exporter installé d’une cible réellement collectée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Limites et prochaine validation — Qualification physique multinœud

Qualification physique multinœud : réserver le verdict cluster à une topologie matérielle réellement exercée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Méthode de vérification — Qualification physique multinœud

Qualification physique multinœud : réserver le verdict cluster à une topologie matérielle réellement exercée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Point d’avancement contrôlé — Qualification physique multinœud

Qualification physique multinœud : réserver le verdict cluster à une topologie matérielle réellement exercée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Choix d’architecture — Qualification physique multinœud

Qualification physique multinœud : réserver le verdict cluster à une topologie matérielle réellement exercée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Comprendre le rôle — Qualification physique multinœud

Qualification physique multinœud : réserver le verdict cluster à une topologie matérielle réellement exercée, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Limites et prochaine validation — MPI, modules et conteneurs Apptainer

MPI, modules et conteneurs Apptainer : exécuter une charge scientifique avec environnement reproductible, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Méthode de vérification — MPI, modules et conteneurs Apptainer

MPI, modules et conteneurs Apptainer : exécuter une charge scientifique avec environnement reproductible, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Point d’avancement contrôlé — MPI, modules et conteneurs Apptainer

MPI, modules et conteneurs Apptainer : exécuter une charge scientifique avec environnement reproductible, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Choix d’architecture — MPI, modules et conteneurs Apptainer

MPI, modules et conteneurs Apptainer : exécuter une charge scientifique avec environnement reproductible, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Comprendre le rôle — MPI, modules et conteneurs Apptainer

MPI, modules et conteneurs Apptainer : exécuter une charge scientifique avec environnement reproductible, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Limites et prochaine validation — Munge et cohérence temporelle

Munge et cohérence temporelle : authentifier les messages entre machines d’un même domaine, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Méthode de vérification — Munge et cohérence temporelle

Munge et cohérence temporelle : authentifier les messages entre machines d’un même domaine, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Point d’avancement contrôlé — Munge et cohérence temporelle

Munge et cohérence temporelle : authentifier les messages entre machines d’un même domaine, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Choix d’architecture — Munge et cohérence temporelle

Munge et cohérence temporelle : authentifier les messages entre machines d’un même domaine, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Comprendre le rôle — Munge et cohérence temporelle

Munge et cohérence temporelle : authentifier les messages entre machines d’un même domaine, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Limites et prochaine validation — Jobs, allocations et cgroup v2

Jobs, allocations et cgroup v2 : contrôler que les ressources promises sont réellement isolées, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Méthode de vérification — Jobs, allocations et cgroup v2

Jobs, allocations et cgroup v2 : contrôler que les ressources promises sont réellement isolées, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire
HPC & Cluster

Maintenance et non-régression — Point d’avancement contrôlé — Jobs, allocations et cgroup v2

Jobs, allocations et cgroup v2 : contrôler que les ressources promises sont réellement isolées, avec un verdict limité à HexaOS 3.0.0-rc1 et au snapshot RC23. Ce dossier R2 vise à définir les contrôles à rejouer après une modification de source, de configuration ou d’artefact.

Lire