Help is available by moving the cursor above any
symbol or by checking MAQAO website.
| Metric | r0 | r1 | r2 | r3 | r4 | r5 | |
|---|---|---|---|---|---|---|---|
| Total Time (s) | 88.12 | 55.00 | 52.03 | 46.69 | 46.58 | 46.58 | |
| Part of Application Profiled (%) | 100 | 100 | 100 | 100 | 100 | 100 | |
| Max (Thread Active Time) (s) | 87.91 | 54.82 | 51.84 | 46.45 | 46.40 | 46.42 | |
| Average Active Time (s) | 87.91 | 54.82 | 51.84 | 46.45 | 46.40 | 46.42 | |
| Activity Ratio (%) | 99.8 | 99.7 | 99.6 | 99.5 | 99.6 | 99.6 | |
| Average number of active threads | 0.998 | 0.997 | 0.996 | 0.995 | 0.996 | 0.996 | |
| Affinity Stability (%) | 100.0 | 100.0 | 100.0 | 99.9 | 100.0 | 100.0 | |
| Time in analyzed loops (%) | 28.7 | 39.0 | 50.6 | 63.5 | 63.4 | 62.6 | |
| Time in analyzed innermost loops (%) | 8.22 | 23.9 | 1.20 | 1.16 | 1.28 | 1.11 | |
| Time in user code (%) | 55.0 | 49.6 | 50.6 | 63.5 | 63.4 | 62.6 | |
| Compilation Options Score (%) | 66.7 | 100 | 100 | 100 | 100 | 100 | |
| Array Access Efficiency (%) | 84.9 | 78.2 | 50.1 | 50.0 | 50.0 | 50.0 | |
| Potential Speedups | |||||||
| Perfect Flow Complexity | 1.00 | 1.24 | 1.00 | 1.00 | 1.00 | 1.00 | |
| Perfect OpenMP/MPI/Pthread/TBB | 1.00 | 1.00 | 1.00 | 1.00 | 1.00 | 1.00 | |
| Perfect OpenMP/MPI/Pthread/TBB + Perfect Load Distribution | 1.00 | 1.00 | 1.00 | 1.00 | 1.00 | 1.00 | |
| No Scalar Integer | Potential Speedup | 1.10 | 1.15 | 1.21 | 1.25 | 1.25 | 1.25 |
| Nb Loops to get 80% | 2 | 2 | 2 | 2 | 2 | 2 | |
| FP Vectorised | Potential Speedup | 1.13 | 1.23 | 1.31 | 1.42 | 1.42 | 1.41 |
| Nb Loops to get 80% | 2 | 2 | 2 | 2 | 2 | 2 | |
| Fully Vectorised | Potential Speedup | 1.35 | 1.49 | 1.75 | 2.17 | 2.17 | 2.14 |
| Nb Loops to get 80% | 3 | 2 | 3 | 3 | 3 | 3 | |
| Only FP Arithmetic | Potential Speedup | 1.17 | 1.26 | 1.44 | 1.54 | 1.54 | 1.53 |
| Nb Loops to get 80% | 3 | 2 | 2 | 2 | 2 | 2 | |
| Source Object | Issue |
|---|---|
| ▼xy_model | |
| ▼lattice.cpp | |
| ○ | -O2, -O3 or -Ofast is missing. |
| ▼simulation.cpp | |
| ○ | -O2, -O3 or -Ofast is missing. |
| ▼mpi_utils.cpp | |
| ○ | -O2, -O3 or -Ofast is missing. |
| ▼random.h | |
| ○ | -O2, -O3 or -Ofast is missing. |
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
| r0 | r1 | r2 | r3 | r4 | r5 | |
|---|---|---|---|---|---|---|
| Experiment Name | ||||||
| Application | ./xy_model | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Timestamp | 2026-09-29 17:01:29 | 2026-09-29 16:46:46 | 2026-09-29 17:52:57 | 2026-09-29 17:47:11 | 2026-09-29 17:32:18 | 2026-09-29 17:14:01 |
| Experiment Type | MPI; | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Machine | kairoscomp35 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Architecture | x86_64 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Micro Architecture | GRANITE_RAPIDS | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Model Name | Intel(R) Xeon(R) 6952P | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Cache Size | 491520 KB | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of Cores | 96 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Maximal Frequency | 2.10 GHz | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| OS Version | Linux 5.14.0-570.129.1.el9_6.x86_64 #1 SMP PREEMPT_DYNAMIC Wed Jul 15 21:37:25 EDT 2026 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Architecture used during static analysis | x86_64 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Micro Architecture used during static analysis | GRANITE_RAPIDS | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Compilation Options | xy_model: --driver-mode=g++ --intel -std=c++20 -Wall -Wextra -O1 -march=native -funroll-loops -fno-omit-frame-pointer -g -I include -c simulation.cpp -o simulation.o -I /softs/x86/openmpi/openmpi-5.0.8/intel/include -fveclib=SVML | xy_model: --driver-mode=g++ --intel -std=c++20 -Wall -Wextra -O2 -march=native -funroll-loops -fno-omit-frame-pointer -g -I include -c simulation.cpp -o simulation.o -I /softs/x86/openmpi/openmpi-5.0.8/intel/include -fveclib=SVML | xy_model: --driver-mode=g++ --intel -std=c++20 -Wall -Wextra -O3 -march=native -fno-omit-frame-pointer -g -I include -c simulation.cpp -o simulation.o -I /softs/x86/openmpi/openmpi-5.0.8/intel/include -fveclib=SVML | xy_model: --driver-mode=g++ --intel -std=c++20 -Wall -Wextra -O3 -ffast-math -march=native -fno-omit-frame-pointer -g -I include -c simulation.cpp -o simulation.o -I /softs/x86/openmpi/openmpi-5.0.8/intel/include -fveclib=SVML | same as r3 | xy_model: --driver-mode=g++ --intel -std=c++20 -Wall -Wextra -O3 -ffast-math -march=native -funroll-loops -fno-omit-frame-pointer -g -I include -c simulation.cpp -o simulation.o -I /softs/x86/openmpi/openmpi-5.0.8/intel/include -fveclib=SVML |
| Number of processes observed | 1 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of threads observed | 1 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Frequency Driver | acpi-cpufreq | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Frequency Governor | performance | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Huge Pages | always | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Hyperthreading | off | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of sockets | 2 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of cores per socket | 96 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| MAQAO version | 2026.1.0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| MAQAO build | fff18a0ba5aa3507aa4143632fe45bb453698cc2::20260928-175656 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Comments | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |