@@ -326,18 +326,16 @@ namespace cms {
326326 template <typename T, typename T_Acc>
327327 class elements_with_stride {
328328 public:
329-
330329 ALPAKA_FN_ACC elements_with_stride (const T_Acc& acc,
331330 T extent,
332331 Idx elementIdxShift = 0 ,
333332 const unsigned int dimIndex = 0 ) {
334-
335333 const Idx threadIdxLocal (alpaka::getIdx<alpaka::Block, alpaka::Threads>(acc)[dimIndex]);
336334 const Idx blockIdxInGrid (alpaka::getIdx<alpaka::Grid, alpaka::Blocks>(acc)[dimIndex]);
337335
338336 const Idx blockDimension (alpaka::getWorkDiv<alpaka::Block, alpaka::Elems>(acc)[dimIndex]);
339337 const Idx gridDimension (alpaka::getWorkDiv<alpaka::Grid, alpaka::Blocks>(acc)[dimIndex]);
340-
338+
341339 thread_ = blockDimension * blockIdxInGrid + threadIdxLocal;
342340 thread_ = thread_ + elementIdxShift; // Add the shift
343341 stride_ = gridDimension * blockDimension;
@@ -347,9 +345,8 @@ namespace cms {
347345 }
348346
349347 ALPAKA_FN_ACC elements_with_stride (const T_Acc& acc) {
350-
351348 const Idx gridDimension (alpaka::getWorkDiv<alpaka::Grid, alpaka::Elems>(acc)[0 ]);
352- elements_with_stride (acc, gridDimension);
349+ elements_with_stride (acc, gridDimension);
353350 }
354351
355352 class iterator {
@@ -359,15 +356,14 @@ namespace cms {
359356 ALPAKA_FN_ACC constexpr T operator *() const { return index_; }
360357
361358 ALPAKA_FN_ACC constexpr iterator& operator ++() {
362-
363359#ifdef ALPAKA_ACC_GPU_CUDA_ENABLED
364360 // increment the index
365361 index_ += stride_;
366362 if (index_ < extent_)
367363 return *this ;
368364
369- #else // CPU Backend
370- // Iterate over all the elements for one thread
365+ #else // CPU Backend \
366+ // Iterate over all the elements for one thread
371367 index_ += 1 ;
372368 if (index_ < old_index_ + blockDim && index_ < extent_) {
373369 return *this ;
@@ -392,12 +388,7 @@ namespace cms {
392388
393389 private:
394390 ALPAKA_FN_ACC constexpr iterator (T thread, T stride, T extent, T blockDim)
395- : thread_{thread},
396- stride_{stride},
397- extent_{extent},
398- index_{thread_},
399- old_index_{index_},
400- blockDim{blockDim} {}
391+ : thread_{thread}, stride_{stride}, extent_{extent}, index_{thread_}, old_index_{index_}, blockDim{blockDim} {}
401392
402393 ALPAKA_FN_ACC constexpr iterator (T thread, T stride, T extent, T index, T blockDim)
403394 : thread_{thread}, stride_{stride}, extent_{extent}, index_{index}, old_index_{index_}, blockDim{blockDim} {}
@@ -429,7 +420,6 @@ namespace cms {
429420 class elements_with_stride_1d {
430421 public:
431422 ALPAKA_FN_ACC elements_with_stride_1d (const T_Acc& acc) {
432-
433423 const Vec3 threadIdxLocal (alpaka::getIdx<alpaka::Block, alpaka::Threads>(acc));
434424 const Vec3 blockIdxInGrid (alpaka::getIdx<alpaka::Grid, alpaka::Blocks>(acc));
435425
@@ -469,7 +459,6 @@ namespace cms {
469459 ALPAKA_FN_ACC Vec3 operator *() const { return index_; }
470460
471461 ALPAKA_FN_ACC constexpr iterator& operator ++() {
472-
473462#ifdef ALPAKA_ACC_GPU_CUDA_ENABLED
474463 // increment the first coordinate
475464 index_[0u ] += stride_[0u ];
@@ -514,12 +503,7 @@ namespace cms {
514503
515504 private:
516505 ALPAKA_FN_ACC iterator (Vec3 thread, Vec3 stride, Vec3 extent, Vec3 blockDim)
517- : thread_{thread},
518- stride_{stride},
519- extent_{extent},
520- index_{thread_},
521- old_index_{index_},
522- blockDim{blockDim} {}
506+ : thread_{thread}, stride_{stride}, extent_{extent}, index_{thread_}, old_index_{index_}, blockDim{blockDim} {}
523507
524508 ALPAKA_FN_ACC iterator (Vec3 thread, Vec3 stride, Vec3 extent, Vec3 index, Vec3 blockDim)
525509 : thread_{thread}, stride_{stride}, extent_{extent}, index_{index}, old_index_{index_}, blockDim{blockDim} {}
@@ -551,7 +535,6 @@ namespace cms {
551535 class elements_with_stride_2d {
552536 public:
553537 ALPAKA_FN_ACC elements_with_stride_2d (const T_Acc& acc) {
554-
555538 const Vec3 threadIdxLocal (alpaka::getIdx<alpaka::Block, alpaka::Threads>(acc));
556539 const Vec3 blockIdxInGrid (alpaka::getIdx<alpaka::Grid, alpaka::Blocks>(acc));
557540
@@ -591,7 +574,6 @@ namespace cms {
591574 ALPAKA_FN_ACC Vec3 operator *() const { return index_; }
592575
593576 ALPAKA_FN_ACC constexpr iterator& operator ++() {
594-
595577#ifdef ALPAKA_ACC_GPU_CUDA_ENABLED
596578 // increment the first coordinate
597579 index_[0u ] += stride_[0u ];
@@ -645,12 +627,7 @@ namespace cms {
645627
646628 private:
647629 ALPAKA_FN_ACC iterator (Vec3 thread, Vec3 stride, Vec3 extent, Vec3 blockDim)
648- : thread_{thread},
649- stride_{stride},
650- extent_{extent},
651- index_{thread_},
652- old_index_{index_},
653- blockDim{blockDim} {}
630+ : thread_{thread}, stride_{stride}, extent_{extent}, index_{thread_}, old_index_{index_}, blockDim{blockDim} {}
654631
655632 ALPAKA_FN_ACC iterator (Vec3 thread, Vec3 stride, Vec3 extent, Vec3 index, Vec3 blockDim)
656633 : thread_{thread}, stride_{stride}, extent_{extent}, index_{index}, old_index_{index_}, blockDim{blockDim} {}
@@ -682,7 +659,6 @@ namespace cms {
682659 class elements_with_stride_3d {
683660 public:
684661 ALPAKA_FN_ACC elements_with_stride_3d (const T_Acc& acc) {
685-
686662 const Vec3 threadIdxLocal (alpaka::getIdx<alpaka::Block, alpaka::Threads>(acc));
687663 const Vec3 blockIdxInGrid (alpaka::getIdx<alpaka::Grid, alpaka::Blocks>(acc));
688664
@@ -692,7 +668,8 @@ namespace cms {
692668 thread_ = {blockDimension[0u ] * blockIdxInGrid[0u ] + threadIdxLocal[0u ],
693669 blockDimension[1u ] * blockIdxInGrid[1u ] + threadIdxLocal[1u ],
694670 blockDimension[2u ] * blockIdxInGrid[2u ] + threadIdxLocal[2u ]};
695- stride_ = {blockDimension[0u ] * gridDimension[0u ], blockDimension[1u ] * gridDimension[1u ],
671+ stride_ = {blockDimension[0u ] * gridDimension[0u ],
672+ blockDimension[1u ] * gridDimension[1u ],
696673 blockDimension[2u ] * gridDimension[2u ]};
697674 extent_ = stride_;
698675
@@ -711,7 +688,8 @@ namespace cms {
711688 blockDimension[1u ] * blockIdxInGrid[1u ] + threadIdxLocal[1u ],
712689 blockDimension[2u ] * blockIdxInGrid[2u ] + threadIdxLocal[2u ]};
713690 thread_ = thread_ + elementIdxShift;
714- stride_ = {blockDimension[0u ] * gridDimension[0u ], blockDimension[1u ] * gridDimension[1u ],
691+ stride_ = {blockDimension[0u ] * gridDimension[0u ],
692+ blockDimension[1u ] * gridDimension[1u ],
715693 blockDimension[2u ] * gridDimension[2u ]};
716694
717695 blockDim = blockDimension;
@@ -724,7 +702,6 @@ namespace cms {
724702 ALPAKA_FN_ACC Vec3 operator *() const { return index_; }
725703
726704 ALPAKA_FN_ACC constexpr iterator& operator ++() {
727-
728705#ifdef ALPAKA_ACC_GPU_CUDA_ENABLED
729706 // increment the first coordinate
730707 index_[0u ] += stride_[0u ];
@@ -785,12 +762,7 @@ namespace cms {
785762
786763 private:
787764 ALPAKA_FN_ACC iterator (Vec3 thread, Vec3 stride, Vec3 extent, Vec3 blockDim)
788- : thread_{thread},
789- stride_{stride},
790- extent_{extent},
791- index_{thread_},
792- old_index_{index_},
793- blockDim{blockDim} {}
765+ : thread_{thread}, stride_{stride}, extent_{extent}, index_{thread_}, old_index_{index_}, blockDim{blockDim} {}
794766
795767 ALPAKA_FN_ACC iterator (Vec3 thread, Vec3 stride, Vec3 extent, Vec3 index, Vec3 blockDim)
796768 : thread_{thread}, stride_{stride}, extent_{extent}, index_{index}, old_index_{index_}, blockDim{blockDim} {}
0 commit comments