Help is available by moving the cursor above any
symbol or by checking MAQAO website.
| Metric | r0 | r1 | r2 | r3 | r4 | r5 | r6 | r7 | |
|---|---|---|---|---|---|---|---|---|---|
| Total Time (s) | 480.16 | 252.72 | 142.39 | 92.30 | 71.76 | 62.88 | 63.53 | 56.14 | |
| Max (Thread Active Time) (s) | 474.02 | 247.44 | 133.97 | 77.25 | 58.40 | 50.36 | 50.26 | 45.14 | |
| Average Active Time (s) | 457.87 | 231.54 | 121.89 | 70.81 | 52.54 | 44.27 | 43.07 | 38.26 | |
| Activity Ratio (%) | 95.4 | 91.7 | 85.7 | 76.9 | 73.5 | 70.7 | 68.1 | 68.5 | |
| Average number of active threads | 7.629 | 14.659 | 27.392 | 49.098 | 70.287 | 90.114 | 108.476 | 130.855 | |
| Affinity Stability (%) | 99.6 | 99.3 | 98.3 | 97.1 | 96.0 | 95.5 | 95.5 | 94.9 | |
| GFLOPS | 15.360 | 29.437 | 54.395 | 94.364 | 124.822 | 144.748 | 145.038 | 161.487 | |
| Time in analyzed loops (%) | 98.4 | 98.2 | 97.0 | 95.6 | 94.4 | 93.0 | 92.9 | 92.3 | |
| Time in analyzed innermost loops (%) | 6.75 | 7.07 | 8.85 | 19.4 | 23.7 | 28.1 | 30.9 | 33.4 | |
| Time in user code (%) | 98.4 | 98.2 | 97.0 | 95.6 | 94.4 | 93.0 | 92.9 | 92.3 | |
| Compilation Options Score (%) | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | |
| Array Access Efficiency (%) | 84.5 | 84.6 | 85.4 | 86.7 | 86.9 | 87.0 | 87.1 | 87.1 | |
| Potential Speedups | |||||||||
| Perfect Flow Complexity | 1.00 | 1.00 | 1.00 | 1.00 | 1.00 | 1.00 | 1.00 | 1.00 | |
| Perfect OpenMP/MPI/Pthread/TBB | 1.00 | 1.01 | 1.01 | 1.02 | 1.03 | 1.04 | 1.02 | 1.05 | |
| Perfect OpenMP/MPI/Pthread/TBB + Perfect Load Distribution | 1.04 | 1.08 | 1.12 | 1.12 | 1.16 | 1.20 | 1.23 | 1.25 | |
| Scalability - Gap | 1.00 | 1.05 | 1.19 | 1.54 | 1.79 | 2.10 | 2.65 | 2.81 | |
| No Scalar Integer | Potential Speedup | 1.25 | 1.25 | 1.24 | 1.20 | 1.18 | 1.16 | 1.15 | 1.15 |
| Nb Loops to get 80% | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 | |
| FP Vectorised | Potential Speedup | 2.01 | 2.00 | 1.93 | 1.72 | 1.64 | 1.57 | 1.53 | 1.49 |
| Nb Loops to get 80% | 1 | 1 | 1 | 1 | 1 | 1 | 1 | 1 | |
| Fully Vectorised | Potential Speedup | 3.63 | 3.59 | 3.34 | 2.69 | 2.45 | 2.25 | 2.17 | 2.08 |
| Nb Loops to get 80% | 1 | 1 | 1 | 1 | 1 | 2 | 2 | 2 | |
| Only FP Arithmetic | Potential Speedup | 5.14 | 5.07 | 4.69 | 3.86 | 3.53 | 3.22 | 3.12 | 2.99 |
| Nb Loops to get 80% | 1 | 1 | 1 | 2 | 2 | 3 | 3 | 3 | |
| Source Object | Issue |
|---|---|
| ▼exec | |
| ▼Collapse.hpp | |
| ○ |
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
| r0 | r1 | r2 | r3 | r4 | r5 | r6 | r7 | |
|---|---|---|---|---|---|---|---|---|
| Application | /beegfs/hackathon/users/eoseret/qaas_runs_test/179-069-7963/intel/Kripke/run/binaries/gcc_1/exec | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Timestamp | 2026-09-29 22:02:02 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Experiment Type | MPI; OpenMP; | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Machine | gpu04sas.benchmarkcenter.megware.com | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Architecture | x86_64 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Micro Architecture | ZEN_V4 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Model Name | AMD EPYC 9654 96-Core Processor | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Cache Size | 1024 KB | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of Cores | 96 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Maximal Frequency | 3.71 GHz | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| OS Version | Linux 5.14.0-687.29.1.el9_8.x86_64 #1 SMP PREEMPT_DYNAMIC Thu Jul 23 16:18:48 EDT 2026 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Architecture used during static analysis | x86_64 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Micro Architecture used during static analysis | ZEN_V4 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Compilation Options | exec: GNU C++17 11.5.0 20240719 (Red Hat 11.5.0-14) -march=znver4 -g -O3 -O3 -O3 -std=c++17 -funroll-loops -ffast-math -fno-omit-frame-pointer -fcf-protection=none -fPIC -fopenmp | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of processes observed | 1 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of threads observed | 8 | 16 | 32 | 64 | 96 | 128 | 160 | 192 |
| Frequency Driver | acpi-cpufreq | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Frequency Governor | performance | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Huge Pages | always | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Hyperthreading | on | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of sockets | 2 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of cores per socket | 96 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| MAQAO version | 2026.1.0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| MAQAO build | 6d1be1d51c1e63266254997eb301734a7264775d::20260810-150026 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Comments | OV scalability run using gcc_1 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |