Packages
evision
1.0.0-rc.0
1.0.1-rc.0
1.0.0
1.0.0-rc.0
0.2.17
0.2.17-rc2
0.2.17-rc1
0.2.16
0.2.16-pre.2
0.2.16-pre
0.2.15
0.2.14
0.2.13
0.2.12
0.2.11
0.2.9
0.2.8
0.2.7
0.2.6
0.2.5
0.2.4
0.2.3
0.2.2
0.2.2-rc2
0.2.1
0.2.0
0.1.39
0.1.38
0.1.37
0.1.36
0.1.35
0.1.34
0.1.33
0.1.32
retired
0.1.31
0.1.30
0.1.29
0.1.28
0.1.27
0.1.26
0.1.26-rc3
0.1.26-rc2
0.1.26-rc1
0.1.26-rc0
0.1.25
0.1.24
0.1.23
0.1.22
0.1.21
0.1.20
0.1.19
0.1.18
0.1.17
0.1.16
0.1.15
0.1.14
0.1.13
0.1.12
0.1.11
0.1.10
0.1.9
0.1.8
0.1.7
OpenCV-Erlang/Elixir binding.
Current section
Files
Jump to
Current section
Files
c_src/modules/evision_backend/take.h
#ifndef EVISION_BACKEND_TAKE_H
#define EVISION_BACKEND_TAKE_H
#include <atomic>
#include <cstring>
#include <erl_nif.h>
#include "../../ArgInfo.hpp"
#include "../evision_mat_utils.hpp"
#include "parallel.h"
// Gather along one axis (Nx.take). Type-agnostic byte copy:
// out[o, i, inner-block] = src[o, indices[i], inner-block], where o in [0,outer),
// i in [0,num_idx). indices are int64; bounds are checked to match Nx.
// @evision c: mat_take, evision_cv_mat_take, 1
// @evision nif: def mat_take(_opts \\ []), do: :erlang.nif_error(:undefined)
static ERL_NIF_TERM evision_cv_mat_take(ErlNifEnv *env, int argc, const ERL_NIF_TERM argv[]) {
using namespace cv;
using namespace evision::nif;
std::map<std::string, ERL_NIF_TERM> erl_terms;
int nif_opts_index = 0;
evision::nif::parse_arg(env, nif_opts_index, argv, erl_terms);
{
Mat src, indices;
int outer = 0, axis_dim = 0, inner = 0;
if (evision_to_safe(env, evision_get_kw(env, erl_terms, "src"), src, ArgInfo("src", ArgInfo::INPUT_ONLY)) &&
evision_to_safe(env, evision_get_kw(env, erl_terms, "indices"), indices, ArgInfo("indices", ArgInfo::INPUT_ONLY)) &&
evision_to_safe(env, evision_get_kw(env, erl_terms, "outer"), outer, ArgInfo("outer", 0)) &&
evision_to_safe(env, evision_get_kw(env, erl_terms, "axis_dim"), axis_dim, ArgInfo("axis_dim", 0)) &&
evision_to_safe(env, evision_get_kw(env, erl_terms, "inner"), inner, ArgInfo("inner", 0))) {
Mat src_c = src.isContinuous() ? src : src.clone();
Mat idx_c = indices.isContinuous() ? indices : indices.clone();
const uchar *sp = src_c.data;
const int64_t *ip = (const int64_t *)idx_c.data;
int64_t num_idx = (int64_t)idx_c.total();
size_t inner_bytes = (size_t)inner * src_c.elemSize();
Mat dst(1, (int)((int64_t)outer * num_idx * inner), src.type());
uchar *dp = dst.data;
int64_t copies = (int64_t)outer * num_idx;
int64_t work = copies * (inner > 0 ? inner : 1);
// take is a scattered gather of `inner`-sized blocks; threading random
// reads only pays off once the blocks (or their count) are large, so it
// takes a higher bar than the contiguous elementwise kernels.
if (!evision_should_parallelize(copies, work, EVISION_PARALLEL_NESTED_MIN_WORK)) {
for (int64_t o = 0; o < outer; o++) {
for (int64_t i = 0; i < num_idx; i++) {
int64_t idx = ip[i];
if (idx < 0 || idx >= axis_dim)
return evision::nif::error(env, "take: index out of bounds");
std::memcpy(dp + (size_t)(o * num_idx + i) * inner_bytes,
sp + (size_t)(o * axis_dim + idx) * inner_bytes,
inner_bytes);
}
}
return evision_from(env, dst);
}
std::atomic<bool> bad_index(false);
evision_parallel_for(num_idx, num_idx, EVISION_PARALLEL_SIMPLE_MIN_WORK, [&](int64_t begin, int64_t end) {
for (int64_t i = begin; i < end; i++) {
int64_t idx = ip[i];
if (idx < 0 || idx >= axis_dim)
bad_index.store(true, std::memory_order_relaxed);
}
});
if (bad_index.load(std::memory_order_relaxed))
return evision::nif::error(env, "take: index out of bounds");
evision_parallel_for(copies, work, EVISION_PARALLEL_SIMPLE_MIN_WORK, [&](int64_t begin, int64_t end) {
for (int64_t p = begin; p < end; p++) {
int64_t o = p / num_idx;
int64_t i = p - o * num_idx;
int64_t idx = ip[i];
std::memcpy(dp + (size_t)p * inner_bytes,
sp + (size_t)(o * axis_dim + idx) * inner_bytes,
inner_bytes);
}
});
return evision_from(env, dst);
}
}
return enif_make_badarg(env);
}
#endif // EVISION_BACKEND_TAKE_H