Function arm_depthwise_conv_f16¶
Defined in File arm_nnfunctions_flt.h
Function Documentation¶
-
arm_cmsis_nn_status arm_depthwise_conv_f16(const cmsis_nn_context *ctx, const cmsis_nn_dw_conv_params_f16 *dw_conv_params, const cmsis_nn_dims *input_dims, const float16_t *input, const cmsis_nn_dims *filter_dims, const float16_t *kernel, const cmsis_nn_dims *bias_dims, const float16_t *bias, const cmsis_nn_dims *output_dims, float16_t *output, arm_nn_tensor_layout layout)¶
Depthwise convolution, dispatch by layout.
Note
When
ctx->bufis used for internal kernel repacking, it must be aligned to the element type stored in scratch: at least 4-byte aligned for float32_t and at least 2-byte aligned for float16_t.- Parameters:
ctx – [inout] Function context that may hold a temporary scratch buffer.
dw_conv_params – [in] Depthwise convolution parameters (stride, padding, dilation, channel multiplier and activation clamp).
input_dims – [in] Input tensor dimensions. Format depends on
layout.input – [in] Pointer to the input tensor data.
filter_dims – [in] Filter tensor dimensions. Format depends on
layout.kernel – [in] Pointer to the filter tensor data.
bias_dims – [in] Bias tensor dimensions. Format: [C_OUT].
bias – [in] Optional bias tensor data.
output_dims – [in] Output tensor dimensions. Format depends on
layout.output – [out] Pointer to the output tensor data.
layout – [in] Tensor layout selector. Current float APIs require
ARM_NN_LAYOUT_NHWC.
- Returns:
ARM_CMSIS_NN_SUCCESSon success orARM_CMSIS_NN_ARG_ERRORon invalid arguments.