Function arm_depthwise_conv_f16

Function Documentation

arm_cmsis_nn_status arm_depthwise_conv_f16(const cmsis_nn_context *ctx, const cmsis_nn_dw_conv_params_f16 *dw_conv_params, const cmsis_nn_dims *input_dims, const float16_t *input, const cmsis_nn_dims *filter_dims, const float16_t *kernel, const cmsis_nn_dims *bias_dims, const float16_t *bias, const cmsis_nn_dims *output_dims, float16_t *output, arm_nn_tensor_layout layout)

Depthwise convolution, dispatch by layout.

Note

When ctx->buf is used for internal kernel repacking, it must be aligned to the element type stored in scratch: at least 4-byte aligned for float32_t and at least 2-byte aligned for float16_t.

Parameters:
  • ctx[inout] Function context that may hold a temporary scratch buffer.

  • dw_conv_params[in] Depthwise convolution parameters (stride, padding, dilation, channel multiplier and activation clamp).

  • input_dims[in] Input tensor dimensions. Format depends on layout.

  • input[in] Pointer to the input tensor data.

  • filter_dims[in] Filter tensor dimensions. Format depends on layout.

  • kernel[in] Pointer to the filter tensor data.

  • bias_dims[in] Bias tensor dimensions. Format: [C_OUT].

  • bias[in] Optional bias tensor data.

  • output_dims[in] Output tensor dimensions. Format depends on layout.

  • output[out] Pointer to the output tensor data.

  • layout[in] Tensor layout selector. Current float APIs require ARM_NN_LAYOUT_NHWC.

Returns:

ARM_CMSIS_NN_SUCCESS on success or ARM_CMSIS_NN_ARG_ERROR on invalid arguments.