mirror of
https://github.com/opencv/opencv.git
synced 2026-07-21 19:33:03 +04:00
Compare commits
3 Commits
2b6ea5f344
...
0e09f1a238
| Author | SHA1 | Date | |
|---|---|---|---|
| 0e09f1a238 | |||
| ba53d1d6b7 | |||
| 1f36f15a49 |
@@ -99,9 +99,18 @@ int fast_atan_64(const double* y, const double* x, double* dst, size_t n, bool a
|
|||||||
/* ############ split ############ */
|
/* ############ split ############ */
|
||||||
|
|
||||||
int split8u(const uchar* src, uchar** dst, int len, int cn);
|
int split8u(const uchar* src, uchar** dst, int len, int cn);
|
||||||
|
int split16u(const ushort* src, ushort** dst, int len, int cn);
|
||||||
|
int split32s(const int* src, int** dst, int len, int cn);
|
||||||
|
int split64s(const int64* src, int64** dst, int len, int cn);
|
||||||
|
|
||||||
#undef cv_hal_split8u
|
#undef cv_hal_split8u
|
||||||
#define cv_hal_split8u cv::rvv_hal::core::split8u
|
#define cv_hal_split8u cv::rvv_hal::core::split8u
|
||||||
|
#undef cv_hal_split16u
|
||||||
|
#define cv_hal_split16u cv::rvv_hal::core::split16u
|
||||||
|
#undef cv_hal_split32s
|
||||||
|
#define cv_hal_split32s cv::rvv_hal::core::split32s
|
||||||
|
#undef cv_hal_split64s
|
||||||
|
#define cv_hal_split64s cv::rvv_hal::core::split64s
|
||||||
|
|
||||||
/* ############ sqrt ############ */
|
/* ############ sqrt ############ */
|
||||||
|
|
||||||
|
|||||||
@@ -30,8 +30,27 @@ static int copyToMasked_e##X##c1(const uchar *src_data, size_t src_step, const u
|
|||||||
return CV_HAL_ERROR_OK; \
|
return CV_HAL_ERROR_OK; \
|
||||||
}
|
}
|
||||||
|
|
||||||
CV_HAL_RVV_COPY_MASK_eXc1(8, 8)
|
#define CV_HAL_RVV_COPY_MASK_MERGE_eXc1(X, data_lmul, mask_lmul) \
|
||||||
CV_HAL_RVV_COPY_MASK_eXc1(16, 4)
|
static int copyToMasked_e##X##c1(const uchar *src_data, size_t src_step, const uchar *mask_data, size_t mask_step, \
|
||||||
|
uchar *dst_data, size_t dst_step, int width, int height) { \
|
||||||
|
for (; height--; mask_data += mask_step, src_data += src_step, dst_data += dst_step) { \
|
||||||
|
const uint##X##_t *src = (const uint##X##_t*)src_data; \
|
||||||
|
uint##X##_t *dst = (uint##X##_t*)dst_data; \
|
||||||
|
int vl; \
|
||||||
|
for (int i = 0; i < width; i += vl) { \
|
||||||
|
vl = __riscv_vsetvl_e##X##m##data_lmul(width - i); \
|
||||||
|
auto m = __riscv_vmsne(__riscv_vle8_v_u8m##mask_lmul(mask_data + i, vl), 0, vl); \
|
||||||
|
auto src_v = __riscv_vle##X##_v_u##X##m##data_lmul(src + i, vl); \
|
||||||
|
auto dst_v = __riscv_vle##X##_v_u##X##m##data_lmul(dst + i, vl); \
|
||||||
|
__riscv_vse##X##_v_u##X##m##data_lmul(dst + i, __riscv_vmerge(dst_v, src_v, m, vl), vl); \
|
||||||
|
} \
|
||||||
|
} \
|
||||||
|
return CV_HAL_ERROR_OK; \
|
||||||
|
}
|
||||||
|
|
||||||
|
CV_HAL_RVV_COPY_MASK_MERGE_eXc1(8, 8, 8)
|
||||||
|
CV_HAL_RVV_COPY_MASK_MERGE_eXc1(16, 8, 4)
|
||||||
|
|
||||||
CV_HAL_RVV_COPY_MASK_eXc1(32, 2)
|
CV_HAL_RVV_COPY_MASK_eXc1(32, 2)
|
||||||
CV_HAL_RVV_COPY_MASK_eXc1(64, 1)
|
CV_HAL_RVV_COPY_MASK_eXc1(64, 1)
|
||||||
|
|
||||||
|
|||||||
@@ -8,84 +8,92 @@ namespace cv { namespace rvv_hal { namespace core {
|
|||||||
|
|
||||||
#if CV_HAL_RVV_1P0_ENABLED
|
#if CV_HAL_RVV_1P0_ENABLED
|
||||||
|
|
||||||
int split8u(const uchar* src, uchar** dst, int len, int cn)
|
#define OPENCV_HAL_IMPL_RVV_SPLIT(func, T, vtype, suffix, width) \
|
||||||
{
|
int func(const T* src, T** dst, int len, int cn) \
|
||||||
int vl = 0;
|
{ \
|
||||||
if (cn == 1)
|
int vl = 0; \
|
||||||
{
|
if (cn == 1) \
|
||||||
uchar* dst0 = dst[0];
|
{ \
|
||||||
for (int i = 0; i < len; i += vl)
|
T* dst0 = dst[0]; \
|
||||||
{
|
for (int i = 0; i < len; i += vl) \
|
||||||
vl = __riscv_vsetvl_e8m8(len - i);
|
{ \
|
||||||
__riscv_vse8_v_u8m8(dst0 + i, __riscv_vle8_v_u8m8(src + i, vl), vl);
|
vl = __riscv_vsetvl_e##width##m8(len - i); \
|
||||||
}
|
__riscv_vse##width##_v_##suffix##m8(dst0 + i, __riscv_vle##width##_v_##suffix##m8(src + i, vl), vl); \
|
||||||
}
|
} \
|
||||||
else if (cn == 2)
|
} \
|
||||||
{
|
else if (cn == 2) \
|
||||||
uchar *dst0 = dst[0], *dst1 = dst[1];
|
{ \
|
||||||
for (int i = 0; i < len; i += vl)
|
T *dst0 = dst[0], *dst1 = dst[1]; \
|
||||||
{
|
for (int i = 0; i < len; i += vl) \
|
||||||
vl = __riscv_vsetvl_e8m4(len - i);
|
{ \
|
||||||
vuint8m4x2_t seg = __riscv_vlseg2e8_v_u8m4x2(src + i * cn, vl);
|
vl = __riscv_vsetvl_e##width##m4(len - i); \
|
||||||
__riscv_vse8_v_u8m4(dst0 + i, __riscv_vget_v_u8m4x2_u8m4(seg, 0), vl);
|
v##vtype##m4x2_t seg = __riscv_vlseg2e##width##_v_##suffix##m4x2(src + i * cn, vl); \
|
||||||
__riscv_vse8_v_u8m4(dst1 + i, __riscv_vget_v_u8m4x2_u8m4(seg, 1), vl);
|
__riscv_vse##width##_v_##suffix##m4(dst0 + i, __riscv_vget_v_##suffix##m4x2_##suffix##m4(seg, 0), vl); \
|
||||||
}
|
__riscv_vse##width##_v_##suffix##m4(dst1 + i, __riscv_vget_v_##suffix##m4x2_##suffix##m4(seg, 1), vl); \
|
||||||
}
|
} \
|
||||||
else if (cn == 3)
|
} \
|
||||||
{
|
else if (cn == 3) \
|
||||||
uchar *dst0 = dst[0], *dst1 = dst[1], *dst2 = dst[2];
|
{ \
|
||||||
for (int i = 0; i < len; i += vl)
|
T *dst0 = dst[0], *dst1 = dst[1], *dst2 = dst[2]; \
|
||||||
{
|
for (int i = 0; i < len; i += vl) \
|
||||||
vl = __riscv_vsetvl_e8m2(len - i);
|
{ \
|
||||||
vuint8m2x3_t seg = __riscv_vlseg3e8_v_u8m2x3(src + i * cn, vl);
|
vl = __riscv_vsetvl_e##width##m2(len - i); \
|
||||||
__riscv_vse8_v_u8m2(dst0 + i, __riscv_vget_v_u8m2x3_u8m2(seg, 0), vl);
|
v##vtype##m2x3_t seg = __riscv_vlseg3e##width##_v_##suffix##m2x3(src + i * cn, vl); \
|
||||||
__riscv_vse8_v_u8m2(dst1 + i, __riscv_vget_v_u8m2x3_u8m2(seg, 1), vl);
|
__riscv_vse##width##_v_##suffix##m2(dst0 + i, __riscv_vget_v_##suffix##m2x3_##suffix##m2(seg, 0), vl); \
|
||||||
__riscv_vse8_v_u8m2(dst2 + i, __riscv_vget_v_u8m2x3_u8m2(seg, 2), vl);
|
__riscv_vse##width##_v_##suffix##m2(dst1 + i, __riscv_vget_v_##suffix##m2x3_##suffix##m2(seg, 1), vl); \
|
||||||
}
|
__riscv_vse##width##_v_##suffix##m2(dst2 + i, __riscv_vget_v_##suffix##m2x3_##suffix##m2(seg, 2), vl); \
|
||||||
}
|
} \
|
||||||
else if (cn == 4)
|
} \
|
||||||
{
|
else if (cn == 4) \
|
||||||
uchar *dst0 = dst[0], *dst1 = dst[1], *dst2 = dst[2], *dst3 = dst[3];
|
{ \
|
||||||
for (int i = 0; i < len; i += vl)
|
T *dst0 = dst[0], *dst1 = dst[1], *dst2 = dst[2], *dst3 = dst[3]; \
|
||||||
{
|
for (int i = 0; i < len; i += vl) \
|
||||||
vl = __riscv_vsetvl_e8m2(len - i);
|
{ \
|
||||||
vuint8m2x4_t seg = __riscv_vlseg4e8_v_u8m2x4(src + i * cn, vl);
|
vl = __riscv_vsetvl_e##width##m2(len - i); \
|
||||||
__riscv_vse8_v_u8m2(dst0 + i, __riscv_vget_v_u8m2x4_u8m2(seg, 0), vl);
|
v##vtype##m2x4_t seg = __riscv_vlseg4e##width##_v_##suffix##m2x4(src + i * cn, vl); \
|
||||||
__riscv_vse8_v_u8m2(dst1 + i, __riscv_vget_v_u8m2x4_u8m2(seg, 1), vl);
|
__riscv_vse##width##_v_##suffix##m2(dst0 + i, __riscv_vget_v_##suffix##m2x4_##suffix##m2(seg, 0), vl); \
|
||||||
__riscv_vse8_v_u8m2(dst2 + i, __riscv_vget_v_u8m2x4_u8m2(seg, 2), vl);
|
__riscv_vse##width##_v_##suffix##m2(dst1 + i, __riscv_vget_v_##suffix##m2x4_##suffix##m2(seg, 1), vl); \
|
||||||
__riscv_vse8_v_u8m2(dst3 + i, __riscv_vget_v_u8m2x4_u8m2(seg, 3), vl);
|
__riscv_vse##width##_v_##suffix##m2(dst2 + i, __riscv_vget_v_##suffix##m2x4_##suffix##m2(seg, 2), vl); \
|
||||||
}
|
__riscv_vse##width##_v_##suffix##m2(dst3 + i, __riscv_vget_v_##suffix##m2x4_##suffix##m2(seg, 3), vl); \
|
||||||
}
|
} \
|
||||||
else
|
} \
|
||||||
{
|
else \
|
||||||
int k = 0;
|
{ \
|
||||||
for (; k <= cn - 4; k += 4)
|
int k = 0; \
|
||||||
{
|
for (; k <= cn - 4; k += 4) \
|
||||||
uchar *dst0 = dst[k], *dst1 = dst[k + 1], *dst2 = dst[k + 2], *dst3 = dst[k + 3];
|
{ \
|
||||||
for (int i = 0; i < len; i += vl)
|
T *dst0 = dst[k], *dst1 = dst[k + 1], *dst2 = dst[k + 2], *dst3 = dst[k + 3]; \
|
||||||
{
|
for (int i = 0; i < len; i += vl) \
|
||||||
vl = __riscv_vsetvl_e8m2(len - i);
|
{ \
|
||||||
vuint8m2x4_t seg = __riscv_vlsseg4e8_v_u8m2x4(src + k + i * cn, cn, vl);
|
vl = __riscv_vsetvl_e##width##m2(len - i); \
|
||||||
__riscv_vse8_v_u8m2(dst0 + i, __riscv_vget_v_u8m2x4_u8m2(seg, 0), vl);
|
v##vtype##m2x4_t seg = __riscv_vlsseg4e##width##_v_##suffix##m2x4(src + k + i * cn, cn * sizeof(T), vl); \
|
||||||
__riscv_vse8_v_u8m2(dst1 + i, __riscv_vget_v_u8m2x4_u8m2(seg, 1), vl);
|
__riscv_vse##width##_v_##suffix##m2(dst0 + i, __riscv_vget_v_##suffix##m2x4_##suffix##m2(seg, 0), vl); \
|
||||||
__riscv_vse8_v_u8m2(dst2 + i, __riscv_vget_v_u8m2x4_u8m2(seg, 2), vl);
|
__riscv_vse##width##_v_##suffix##m2(dst1 + i, __riscv_vget_v_##suffix##m2x4_##suffix##m2(seg, 1), vl); \
|
||||||
__riscv_vse8_v_u8m2(dst3 + i, __riscv_vget_v_u8m2x4_u8m2(seg, 3), vl);
|
__riscv_vse##width##_v_##suffix##m2(dst2 + i, __riscv_vget_v_##suffix##m2x4_##suffix##m2(seg, 2), vl); \
|
||||||
}
|
__riscv_vse##width##_v_##suffix##m2(dst3 + i, __riscv_vget_v_##suffix##m2x4_##suffix##m2(seg, 3), vl); \
|
||||||
}
|
} \
|
||||||
for (; k < cn; ++k)
|
} \
|
||||||
{
|
for (; k < cn; ++k) \
|
||||||
uchar* dstK = dst[k];
|
{ \
|
||||||
for (int i = 0; i < len; i += vl)
|
T* dstK = dst[k]; \
|
||||||
{
|
for (int i = 0; i < len; i += vl) \
|
||||||
vl = __riscv_vsetvl_e8m2(len - i);
|
{ \
|
||||||
vuint8m2_t seg = __riscv_vlse8_v_u8m2(src + k + i * cn, cn, vl);
|
vl = __riscv_vsetvl_e##width##m2(len - i); \
|
||||||
__riscv_vse8_v_u8m2(dstK + i, seg, vl);
|
v##vtype##m2_t seg = __riscv_vlse##width##_v_##suffix##m2(src + k + i * cn, cn * sizeof(T), vl); \
|
||||||
}
|
__riscv_vse##width##_v_##suffix##m2(dstK + i, seg, vl); \
|
||||||
}
|
} \
|
||||||
}
|
} \
|
||||||
return CV_HAL_ERROR_OK;
|
} \
|
||||||
|
return CV_HAL_ERROR_OK; \
|
||||||
}
|
}
|
||||||
|
|
||||||
|
OPENCV_HAL_IMPL_RVV_SPLIT(split8u, uchar, uint8, u8, 8)
|
||||||
|
OPENCV_HAL_IMPL_RVV_SPLIT(split16u, ushort, uint16, u16, 16)
|
||||||
|
OPENCV_HAL_IMPL_RVV_SPLIT(split32s, int, int32, i32, 32)
|
||||||
|
OPENCV_HAL_IMPL_RVV_SPLIT(split64s, int64, int64, i64, 64)
|
||||||
|
|
||||||
|
#undef OPENCV_HAL_IMPL_RVV_SPLIT
|
||||||
|
|
||||||
#endif // CV_HAL_RVV_1P0_ENABLED
|
#endif // CV_HAL_RVV_1P0_ENABLED
|
||||||
|
|
||||||
}}} // cv::rvv_hal::core
|
}}} // cv::rvv_hal::core
|
||||||
|
|||||||
Reference in New Issue
Block a user