Skip to content

System Architecture

Resource allocation on Galvani is managed using Slurm. Global storage is provided by a Lustre file system ($HOME and $WORK). Inter-node communication is provided by an Ethernet network. Galvani also has Ceph archival storage available for users using the S3 protocol. The cluster is housed in 16 air-cooled racks.

Login Nodes

Hostname CPU RAM Root disk
galvani-login.mlcloud.uni-tuebingen.de Intel(R) Xeon(R) Gold 6226R CPU @ 2.90GHz ×2 (32 cores / 64 threads) 1.5Ti 894G
galvani-login2.mlcloud.uni-tuebingen.de Intel(R) Xeon(R) Gold 6226R CPU @ 2.90GHz ×2 (32 cores / 64 threads) 1.5Ti 350G

CPU Compute Nodes

Nodes CPU layout RAM
galvani-cn001, galvani-cn002 2 sockets, 32 cores (32 threads) 1.09 TiB

RAM type: DDR4 @ 2933 MT/s.

GPU Compute Nodes

Compute nodes grouped by GPU model and hardware profile (live cluster state):

GPU model GPUs/node Nodes CPU layout RAM/node Node list
a100 9 11 2 sockets, 128 cores (256 threads) 1.80 TiB galvani-cn227, galvani-cn228, galvani-cn229, galvani-cn230, galvani-cn231, galvani-cn232, galvani-cn233, galvani-cn234, galvani-cn235, galvani-cn238, galvani-cn239
a100 8 22 2 sockets, 32 cores (64 threads) 927 GB galvani-cn201, galvani-cn202, galvani-cn203, galvani-cn204, galvani-cn205, galvani-cn206, galvani-cn207, galvani-cn208, galvani-cn209, galvani-cn210, galvani-cn211, galvani-cn212, galvani-cn213, galvani-cn214, galvani-cn218, galvani-cn219, galvani-cn220, galvani-cn221, galvani-cn222, galvani-cn223, galvani-cn225, galvani-cn226
a100 3 2 2 sockets, 32 cores (64 threads) 463 GB galvani-cn240, galvani-cn241
rtx2080ti 8 13 2 sockets, 36 cores (72 threads) 346 GB galvani-cn102, galvani-cn103, galvani-cn109, galvani-cn111, galvani-cn112, galvani-cn114, galvani-cn115, galvani-cn116, galvani-cn117, galvani-cn121, galvani-cn122, galvani-cn123, galvani-cn132
v100 8 1 2 sockets, 32 cores (64 threads) 283 GB galvani-cn053
v100 8 1 2 sockets, 32 cores (64 threads) 424 GB galvani-cn059
v100 4 2 2 sockets, 32 cores (64 threads) 283 GB galvani-cn057, galvani-cn060

Per-node hardware reference

Per-card and per-node specs that do not change with cluster state. Full per-card spec sheets: RTX 2080 Ti, V100, A100.

Feature RTX 2080 Ti nodes A100 nodes (8-GPU) A100 nodes (9-GPU, fat)
CPU model 2× Intel Xeon Gold 6240 (18 cores, 2.6 GHz) 2× AMD EPYC 7302 (16 cores, 3.0 GHz) 2× AMD EPYC 7742 (64 cores, 2.25 GHz)
Accelerator connect PCIe PCIe PCIe
GPU memory / card 11 GB GDDR6 (352-bit bus) 40 GB HBM2 40 GB HBM2
Host RAM type DDR4 @ 3200 MT/s DDR4 @ 3200 MT/s DDR4 @ 3200 MT/s
CUDA cores / card 4 352 6 912 (FP32) / 3 456 (FP64) 6 912 (FP32) / 3 456 (FP64)
NVIDIA Tensor Cores / card 544 432 432
Local storage / node 1.92 TB 3.84 TB 30.72 TB
Theoretical peak FP32 8× 14.2 = 113.6 TFLOPS 8× 19.5 = 156 TFLOPS 9× 19.5 = 175.5 TFLOPS
Theoretical peak FP64 negligible (1/32 FP32 rate) 8× 9.7 = 77.6 TFLOPS 9× 9.7 = 87.3 TFLOPS

Partitions

Partition Nodes GPUs (total) Default time Max time Max nodes/job
2080-galvani 12 96× rtx2080ti 18:00:00 3-00:00:00 2
2080-preemptable-galvani 13 104× rtx2080ti 18:00:00 3-00:00:00 2
a100-fat-galvani 8 72× a100 18:00:00 3-00:00:00 2
a100-galvani 26 201× a100 18:00:00 3-00:00:00 32
a100-preemptable-galvani 27 209× a100 18:00:00 3-00:00:00 2
cpu-galvani 2 18:00:00 30-00:00:00 2
v100-galvani 4 24× v100 18:00:00 3-00:00:00 1

Network

The Galvani Cluster uses an Ethernet fat-tree non-blocking topology. Most compute nodes have a 40Gb/s HCA. Storage is connected using 100Gb/s HCAs.


Last update: July 17, 2026
Created: June 21, 2024