options

picongpu - 2023-12-07 16:26:57 - MAQAO 2.18.0

Help is available by moving the cursor above any symbol or by checking MAQAO website.

Global Metrics

Total Time (s)471.68
Profiled Time (s)467.94
Time in analyzed loops (%)5.99
Time in analyzed innermost loops (%)4.85
Time in user code (%)75.4
Compilation Options Score (%)100
Array Access Efficiency (%)58.1
Potential Speedups
Perfect Flow Complexity1.02
Perfect OpenMP + MPI + Pthread1.10
Perfect OpenMP + MPI + Pthread + Perfect Load Distribution1.33
No Scalar IntegerPotential Speedup1.01
Nb Loops to get 80%8
FP VectorisedPotential Speedup1.01
Nb Loops to get 80%3
Fully VectorisedPotential Speedup1.06
Nb Loops to get 80%22
FP Arithmetic OnlyPotential Speedup1.03
Nb Loops to get 80%19
OpenMP perfectly balancedPotential Speedup1.17
Nb Loops to get 80%2

CQA Potential Speedups Summary

Loop Based Profile⏎

Innermost Loop Based Profile⏎

Application Categorization⏎

Compilation Options⏎

Source ObjectIssue
▼picongpu–
○Particles.kernel
○FieldJ.kernel
○invoke.h
○TaskKernelCpuOmp2Blocks.hpp

Loop Path Count Profile⏎

Cumulated Speedup If No Scalar Integer⏎

Cumulated Speedup If FP Vectorized⏎

Cumulated Speedup If Fully Vectorized⏎

Cumulated Speedup If FP Arithmetic Only⏎

Cumulated Speedup If OpenMP perfetecly balanced⏎

Experiment Summary

Experiment Name
Application./bin/picongpu
Timestamp2023-12-07 16:26:57 Universal Timestamp1701962817
Number of processes observed1 Number of threads observed52
Experiment TypeOpenMP;
Machineskylake
Model NameIntel(R) Xeon(R) Platinum 8170 CPU @ 2.10GHz
Architecturex86_64 Micro ArchitectureSKYLAKE
Cache Size36608 KB Number of Cores26
OS VersionLinux 6.5.7-arch1-1 #1 SMP PREEMPT_DYNAMIC Tue, 10 Oct 2023 21:10:21 +0000
Architecture used during static analysisx86_64 Micro Architecture used during static analysisSKYLAKE
Frequency Driverintel_cpufreq Frequency Governorperformance
Huge Pagesalways Hyperthreadingoff
Number of sockets2 Number of cores per socket26
Compilation Optionspicongpu: clang based Intel(R) oneAPI DPC++/C++ Compiler 2023.0.0 (2023.0.0.20221201) --driver-mode=g++ --intel -I /home/eoseret/apps/buildPIC/khi_test_omp2b_icpx/include -I /home/eoseret/apps/picongpu/include/picongpu/.. -I /home/eoseret/apps/picongpu/thirdParty/cupla/include -I /home/eoseret/apps/picongpu/include/pmacc/.. -D ALPAKA_ACC_CPU_B_OMP2_T_SEQ_ENABLED -D ALPAKA_BLOCK_SHARED_DYN_MEMBER_ALLOC_KIB=47 -D ALPAKA_DEBUG=0 -D ALPAKA_OFFLOAD_MAX_BLOCK_SIZE= -D BOOST_ATOMIC_DYN_LINK -D BOOST_ATOMIC_NO_LIB -D BOOST_NO_AUTO_PTR -D BOOST_PROGRAM_OPTIONS_DYN_LINK -D BOOST_PROGRAM_OPTIONS_NO_LIB -D CMAKE_BUILD_TYPE=Release -D CMAKE_CXX_COMPILER_ID=IntelLLVM -D CMAKE_CXX_COMPILER_VERSION=2023.0.0 -D CMAKE_SYSTEM=Linux-6.5.7-arch1-1 -D CMAKE_SYSTEM_PROCESSOR=x86_64 -D CMAKE_VERSION=3.27.7 -D CUPLA_STREAM_ASYNC_ENABLED=0 -D PIC_VERBOSE_LVL=1 -D PMACC_VERBOSE_LVL=0 -isystem /opt/intel/oneapi/mpi/2021.8.0/include -isystem /home/eoseret/apps/picongpu/thirdParty/cupla/alpaka/include -g -fno-omit-frame-pointer -x Host -fiopenmp -O3 -D NDEBUG -std=c++17 -fiopenmp -MD -MT CMakeFiles/picongpu.dir/main.cpp.o -MF CMakeFiles/picongpu.dir/main.cpp.o.d -o CMakeFiles/picongpu.dir/main.cpp.o -c /home/eoseret/apps/picongpu/include/picongpu/main.cpp -fveclib=SVML -fheinous-gnu-extensions
Comments

Configuration Summary

Dataset
Run Command<executable> -d 1 1 1 -g 128 128 32 --periodic 1 1 1 -s 1500 --fields_energy.period 20
Number Processes1
Number Nodes1
FilterNot Used
Profile StartNot Used
Maximal Path Number4
×