-
Notifications
You must be signed in to change notification settings - Fork 4
Expand file tree
/
Copy pathParallelVectorOps.hh
More file actions
86 lines (74 loc) · 3.68 KB
/
Copy pathParallelVectorOps.hh
File metadata and controls
86 lines (74 loc) · 3.68 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
////////////////////////////////////////////////////////////////////////////////
// ParallelVectorOps.hh
////////////////////////////////////////////////////////////////////////////////
/*! @file
// Parallel versions of basic vector operations.
*/
// Author: Julian Panetta (jpanetta), julian.panetta@gmail.com
// Created: 03/07/2022 17:23:39
////////////////////////////////////////////////////////////////////////////////
#ifndef PARALLELVECTOROPS_HH
#define PARALLELVECTOROPS_HH
#include <Eigen/Dense>
#include <MeshFEM/Parallelism.hh>
#include <tbb/parallel_reduce.h>
#include "VoxelFEMBenchmark.hh"
extern "C" {
int ddot_(const int *N,
const double *DX,
const int *INCX,
const double *DY,
const int *INCY);
}
template<class Derived>
void setZeroParallel(const Eigen::MatrixBase<Derived> &result, size_t rows, size_t cols) {
Eigen::MatrixBase<Derived> &out = const_cast<Eigen::MatrixBase<Derived> &>(result);
out.derived().resize(rows, cols);
tbb::parallel_for(tbb::blocked_range<size_t>(0, rows),
[&out](const tbb::blocked_range<size_t> &r) {
out.middleRows(r.begin(), r.size()).setZero();
});
}
template<class Derived>
void copyParallel(const Eigen::MatrixBase<Derived> &in, const Eigen::MatrixBase<Derived> &result) {
FINE_BENCHMARK_SCOPED_TIMER_SECTION timer("copyParallel");
Eigen::MatrixBase<Derived> &out = const_cast<Eigen::MatrixBase<Derived> &>(result);
out.derived().resize(in.rows(), in.cols());
tbb::parallel_for(tbb::blocked_range<size_t>(0, in.rows()),
[&out, &in](const tbb::blocked_range<size_t> &r) {
out.middleRows(r.begin(), r.size()) = in.middleRows(r.begin(), r.size());
});
}
template<class Derived>
typename Derived::Scalar squaredNormParallel(const Eigen::MatrixBase<Derived> &v) {
using Scalar = typename Derived::Scalar;
// int N = v.size();
// int INC = 1;
// return ddot_(&N, (double *) v.derived().data(), &INC, (double *) v.derived().data(), &INC);
return tbb::parallel_reduce(tbb::blocked_range<size_t>(0, v.rows()),
Scalar(0.0),
[&](const tbb::blocked_range<size_t> &r, double total) {
return total += v.middleRows(r.begin(), r.size()).squaredNorm();
}, std::plus<Scalar>());
}
template<class Derived>
typename Derived::Scalar dotProductParallel(const Eigen::MatrixBase<Derived> &a, const Eigen::MatrixBase<Derived> &b) {
if ((a.rows() != b.rows()) || (a.cols() != b.cols())) throw std::runtime_error("Size mismatch in dotProductParallel");
using Scalar = typename Derived::Scalar;
return tbb::parallel_reduce(tbb::blocked_range<size_t>(0, a.rows()),
Scalar(0.0),
[&](const tbb::blocked_range<size_t> &r, double total) {
return total += a.middleRows(r.begin(), r.size()).cwiseProduct(b.middleRows(r.begin(), r.size())).sum();
}, std::plus<Scalar>());
}
// x = a * x + y (similar to BLAS' daxpy)
template<class Derived>
void scaleAndAddInPlace(typename Derived::Scalar a, Eigen::MatrixBase<Derived> &x, const Eigen::MatrixBase<Derived> &y) {
if (y.rows() != x.rows()) throw std::runtime_error("Row size mismatch");
if (y.cols() != x.cols()) throw std::runtime_error("Col size mismatch");
tbb::parallel_for(tbb::blocked_range<size_t>(0, x.rows()),
[a, &y, &x](const tbb::blocked_range<size_t> &r) {
x.middleRows(r.begin(), r.size()) = a * x.middleRows(r.begin(), r.size()) + y.middleRows(r.begin(), r.size());
});
}
#endif /* end of include guard: PARALLELVECTOROPS_HH */