CMSIS-NN  
CMSIS NN Software Library
 
Loading...
Searching...
No Matches
arm_nnfunctions_flt.h File Reference

Functions

arm_cmsis_nn_status arm_depthwise_nhwc_conv_f32 (const cmsis_nn_context *ctx, const cmsis_nn_dw_conv_params_f32 *dw_conv_params, const cmsis_nn_dims *input_dims, const float32_t *input, const cmsis_nn_dims *filter_dims, const float32_t *kernel, const cmsis_nn_dims *bias_dims, const float32_t *bias, const cmsis_nn_dims *output_dims, float32_t *output)
 Depthwise convolution, NHWC layout.
 
arm_cmsis_nn_status arm_depthwise_conv_f32 (const cmsis_nn_context *ctx, const cmsis_nn_dw_conv_params_f32 *dw_conv_params, const cmsis_nn_dims *input_dims, const float32_t *input, const cmsis_nn_dims *filter_dims, const float32_t *kernel, const cmsis_nn_dims *bias_dims, const float32_t *bias, const cmsis_nn_dims *output_dims, float32_t *output, arm_nn_tensor_layout layout)
 Depthwise convolution, dispatch by layout.
 
arm_cmsis_nn_status arm_depthwise_conv_wrapper_f32 (const cmsis_nn_context *ctx, const cmsis_nn_dw_conv_params_f32 *dw_conv_params, const cmsis_nn_dims *input_dims, const float32_t *input, const cmsis_nn_dims *filter_dims, const float32_t *kernel, const cmsis_nn_dims *bias_dims, const float32_t *bias, const cmsis_nn_dims *output_dims, float32_t *output)
 Depthwise convolution wrapper using the CMSIS-NN baseline path.
 
int32_t arm_depthwise_conv_f32_get_buffer_size (const cmsis_nn_dw_conv_params_f32 *dw_conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the temporary buffer size required by depthwise convolution.
 
int32_t arm_depthwise_conv_wrapper_f32_get_buffer_size (const cmsis_nn_dw_conv_params_f32 *dw_conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims)
 Get the buffer size required by the depthwise convolution wrapper.
 
arm_cmsis_nn_status arm_convolve_nhwc_f32 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data)
 Convolution, NHWC layout.
 
arm_cmsis_nn_status arm_convolve_f32 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data, arm_nn_tensor_layout layout)
 Convolution, dispatch by layout.
 
arm_cmsis_nn_status arm_convolve_wrapper_f32 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data)
 Convolution wrapper using the CMSIS-NN baseline path.
 
arm_cmsis_nn_status arm_convolve_1x1_nhwc_f32 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data)
 1x1 convolution, NHWC layout.
 
arm_cmsis_nn_status arm_convolve_1x1_f32 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data, arm_nn_tensor_layout layout)
 1x1 convolution, dispatch by layout.
 
arm_cmsis_nn_status arm_convolve_1_x_n_nhwc_f32 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data)
 1xN convolution, NHWC layout.
 
arm_cmsis_nn_status arm_convolve_1_x_n_f32 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data, arm_nn_tensor_layout layout)
 1xN convolution, dispatch by layout.
 
int32_t arm_convolve_f32_get_buffer_size (const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the temporary buffer size required by convolution.
 
int32_t arm_convolve_wrapper_f32_get_buffer_size (const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims)
 Get the buffer size required by the convolution wrapper.
 
int32_t arm_convolve_1x1_f32_get_buffer_size (const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the buffer size required by 1x1 convolution.
 
int32_t arm_convolve_1_x_n_f32_get_buffer_size (const cmsis_nn_conv_params_f32 *conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the buffer size required by 1xN convolution.
 
arm_cmsis_nn_status arm_max_pool_f32 (const cmsis_nn_context *ctx, const cmsis_nn_pool_params_f32 *pool_params, const cmsis_nn_dims *input_dims, const float32_t *src, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, float32_t *dst)
 Max pooling.
 
arm_cmsis_nn_status arm_avg_pool_f32 (const cmsis_nn_context *ctx, const cmsis_nn_pool_params_f32 *pool_params, const cmsis_nn_dims *input_dims, const float32_t *src, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, float32_t *dst)
 Average pooling.
 
arm_cmsis_nn_status arm_nn_activation_f32 (const float32_t *input, float32_t *output, int32_t size, arm_nn_activation_type_flt type, float32_t act_param)
 Elementwise activation.
 
arm_cmsis_nn_status arm_elementwise_add_f32 (const float32_t *input_1_vect, const float32_t *input_2_vect, float32_t *output, float32_t out_activation_min, float32_t out_activation_max, int32_t block_size)
 Elementwise add with optional output clamp.
 
arm_cmsis_nn_status arm_elementwise_mul_f32 (const float32_t *input_1_vect, const float32_t *input_2_vect, float32_t *output, float32_t out_activation_min, float32_t out_activation_max, int32_t block_size)
 Elementwise multiply with optional output clamp.
 
arm_cmsis_nn_status arm_minimum_f32 (const cmsis_nn_context *ctx, const float32_t *input_1_data, const cmsis_nn_dims *input_1_dims, const float32_t *input_2_data, const cmsis_nn_dims *input_2_dims, float32_t *output_data, const cmsis_nn_dims *output_dims)
 Elementwise minimum.
 
arm_cmsis_nn_status arm_maximum_f32 (const cmsis_nn_context *ctx, const float32_t *input_1_data, const cmsis_nn_dims *input_1_dims, const float32_t *input_2_data, const cmsis_nn_dims *input_2_dims, float32_t *output_data, const cmsis_nn_dims *output_dims)
 Elementwise maximum.
 
arm_cmsis_nn_status arm_fully_connected_nhwc_f32 (const cmsis_nn_context *ctx, const cmsis_nn_fc_params_f32 *fc_params, const cmsis_nn_dims *input_dims, const float32_t *input, const cmsis_nn_dims *filter_dims, const float32_t *kernel, const cmsis_nn_dims *bias_dims, const float32_t *bias, const cmsis_nn_dims *output_dims, float32_t *output)
 Fully connected layer, NHWC layout.
 
arm_cmsis_nn_status arm_fully_connected_f32 (const cmsis_nn_context *ctx, const cmsis_nn_fc_params_f32 *fc_params, const cmsis_nn_dims *input_dims, const float32_t *input, const cmsis_nn_dims *filter_dims, const float32_t *kernel, const cmsis_nn_dims *bias_dims, const float32_t *bias, const cmsis_nn_dims *output_dims, float32_t *output, arm_nn_tensor_layout layout)
 Fully connected layer, dispatch by layout.
 
int32_t arm_fully_connected_f32_get_buffer_size (const cmsis_nn_fc_params_f32 *fc_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the temporary buffer size required by the fully connected layer.
 
arm_cmsis_nn_status arm_transpose_f32 (const cmsis_nn_context *ctx, const cmsis_nn_transpose_params_f32 *params, const cmsis_nn_dims *input_dims, const float32_t *input, const cmsis_nn_dims *output_dims, float32_t *output)
 Transpose a floating-point tensor.
 
void arm_concatenation_f32_x (const float32_t *input, int32_t input_x, int32_t input_y, int32_t input_z, int32_t input_w, float32_t *output, int32_t output_x, uint32_t offset_x)
 Concatenate tensors along the X axis.
 
void arm_concatenation_f32_y (const float32_t *input, int32_t input_x, int32_t input_y, int32_t input_z, int32_t input_w, float32_t *output, int32_t output_y, uint32_t offset_y)
 Concatenate tensors along the Y axis.
 
void arm_concatenation_f32_z (const float32_t *input, int32_t input_x, int32_t input_y, int32_t input_z, int32_t input_w, float32_t *output, int32_t output_z, uint32_t offset_z)
 Concatenate tensors along the Z axis.
 
void arm_concatenation_f32_w (const float32_t *input, int32_t input_x, int32_t input_y, int32_t input_z, int32_t input_w, float32_t *output, uint32_t offset_w)
 Concatenate tensors along the W axis.
 
arm_cmsis_nn_status arm_pad_f32 (const float32_t *input, float32_t *output, float32_t pad_value, const cmsis_nn_dims *input_size, const cmsis_nn_dims *pre_pad, const cmsis_nn_dims *post_pad)
 Pad a tensor with a constant value.
 
arm_cmsis_nn_status arm_batch_norm_f32 (const float32_t *input, float32_t *output, const float32_t *scale, const float32_t *bias, const cmsis_nn_dims *input_dims, arm_nn_tensor_layout layout)
 Apply batch normalization.
 
void arm_reshape_f32 (const float32_t *input, float32_t *output, uint32_t total_size)
 Reshape by copying data without changing element order.
 
arm_cmsis_nn_status arm_batch_matmul_f32 (const cmsis_nn_context *ctx, const cmsis_nn_bmm_params_f32 *bmm_params, const cmsis_nn_dims *input_lhs_dims, const float32_t *input_lhs, const cmsis_nn_dims *input_rhs_dims, const float32_t *input_rhs, const cmsis_nn_dims *output_dims, float32_t *output)
 Batched matrix multiplication.
 
int32_t arm_batch_matmul_f32_get_buffer_size (const cmsis_nn_bmm_params_f32 *bmm_params, const cmsis_nn_dims *input_lhs_dims, const cmsis_nn_dims *input_rhs_dims, const cmsis_nn_dims *output_dims)
 Get the temporary buffer size required by batched matrix multiplication.
 
arm_cmsis_nn_status arm_transpose_conv_wrapper_f32 (const cmsis_nn_context *ctx, const cmsis_nn_context *output_ctx, const cmsis_nn_transpose_conv_params_f32 *transpose_conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data, arm_nn_tensor_layout layout)
 Transpose convolution wrapper using the CMSIS-NN baseline path.
 
arm_cmsis_nn_status arm_transpose_conv_nhwc_f32 (const cmsis_nn_context *ctx, const cmsis_nn_context *output_ctx, const cmsis_nn_transpose_conv_params_f32 *transpose_conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data)
 Transpose convolution, NHWC layout.
 
arm_cmsis_nn_status arm_transpose_conv_f32 (const cmsis_nn_context *ctx, const cmsis_nn_context *output_ctx, const cmsis_nn_transpose_conv_params_f32 *transpose_conv_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *filter_dims, const float32_t *filter_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data, arm_nn_tensor_layout layout)
 Transpose convolution, dispatch by layout.
 
int32_t arm_transpose_conv_f32_get_buffer_size (const cmsis_nn_transpose_conv_params_f32 *transpose_conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *out_dims)
 Get the temporary buffer size required by transpose convolution.
 
int32_t arm_transpose_conv_f32_get_reverse_conv_buffer_size (const cmsis_nn_transpose_conv_params_f32 *transpose_conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims)
 Get the reverse-convolution workspace size used by transpose convolution helpers.
 
arm_cmsis_nn_status arm_svdf_f32 (const cmsis_nn_context *ctx, const cmsis_nn_context *input_ctx, const cmsis_nn_context *output_ctx, const cmsis_nn_svdf_params_f32 *svdf_params, const cmsis_nn_dims *input_dims, const float32_t *input_data, const cmsis_nn_dims *state_dims, float32_t *state_data, const cmsis_nn_dims *weights_feature_dims, const float32_t *weights_feature_data, const cmsis_nn_dims *weights_time_dims, const float32_t *weights_time_data, const cmsis_nn_dims *bias_dims, const float32_t *bias_data, const cmsis_nn_dims *output_dims, float32_t *output_data)
 Stateful singular value decomposition filter.
 
arm_cmsis_nn_status arm_lstm_unidirectional_f32 (const float32_t *input, float32_t *output, const cmsis_nn_lstm_params_f32 *params, cmsis_nn_lstm_context_f32 *buffers)
 Unidirectional LSTM inference.
 
arm_cmsis_nn_status arm_softmax_f32 (const float32_t *input, int32_t num_rows, int32_t row_size, float32_t *output)
 Softmax using the float-native API signature.
 
arm_cmsis_nn_status arm_depthwise_nhwc_conv_f16 (const cmsis_nn_context *ctx, const cmsis_nn_dw_conv_params_f16 *dw_conv_params, const cmsis_nn_dims *input_dims, const float16_t *input, const cmsis_nn_dims *filter_dims, const float16_t *kernel, const cmsis_nn_dims *bias_dims, const float16_t *bias, const cmsis_nn_dims *output_dims, float16_t *output)
 Depthwise convolution, NHWC layout.
 
arm_cmsis_nn_status arm_depthwise_conv_f16 (const cmsis_nn_context *ctx, const cmsis_nn_dw_conv_params_f16 *dw_conv_params, const cmsis_nn_dims *input_dims, const float16_t *input, const cmsis_nn_dims *filter_dims, const float16_t *kernel, const cmsis_nn_dims *bias_dims, const float16_t *bias, const cmsis_nn_dims *output_dims, float16_t *output, arm_nn_tensor_layout layout)
 Depthwise convolution, dispatch by layout.
 
arm_cmsis_nn_status arm_depthwise_conv_wrapper_f16 (const cmsis_nn_context *ctx, const cmsis_nn_dw_conv_params_f16 *dw_conv_params, const cmsis_nn_dims *input_dims, const float16_t *input, const cmsis_nn_dims *filter_dims, const float16_t *kernel, const cmsis_nn_dims *bias_dims, const float16_t *bias, const cmsis_nn_dims *output_dims, float16_t *output)
 Depthwise convolution wrapper using the CMSIS-NN baseline path.
 
int32_t arm_depthwise_conv_f16_get_buffer_size (const cmsis_nn_dw_conv_params_f16 *dw_conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the temporary buffer size required by depthwise convolution.
 
int32_t arm_depthwise_conv_wrapper_f16_get_buffer_size (const cmsis_nn_dw_conv_params_f16 *dw_conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims)
 Get the buffer size required by the depthwise convolution wrapper.
 
arm_cmsis_nn_status arm_convolve_nhwc_f16 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data)
 Convolution, NHWC layout.
 
arm_cmsis_nn_status arm_convolve_f16 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data, arm_nn_tensor_layout layout)
 Convolution, dispatch by layout.
 
arm_cmsis_nn_status arm_convolve_wrapper_f16 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data)
 Convolution wrapper using the CMSIS-NN baseline path.
 
arm_cmsis_nn_status arm_convolve_1x1_nhwc_f16 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data)
 1x1 convolution, NHWC layout.
 
arm_cmsis_nn_status arm_convolve_1x1_f16 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data, arm_nn_tensor_layout layout)
 1x1 convolution, dispatch by layout.
 
arm_cmsis_nn_status arm_convolve_1_x_n_nhwc_f16 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data)
 1xN convolution, NHWC layout.
 
arm_cmsis_nn_status arm_convolve_1_x_n_f16 (const cmsis_nn_context *ctx, const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data, arm_nn_tensor_layout layout)
 1xN convolution, dispatch by layout.
 
int32_t arm_convolve_f16_get_buffer_size (const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the temporary buffer size required by convolution.
 
int32_t arm_convolve_wrapper_f16_get_buffer_size (const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims)
 Get the buffer size required by the convolution wrapper.
 
int32_t arm_convolve_1x1_f16_get_buffer_size (const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the buffer size required by 1x1 convolution.
 
int32_t arm_convolve_1_x_n_f16_get_buffer_size (const cmsis_nn_conv_params_f16 *conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the buffer size required by 1xN convolution.
 
arm_cmsis_nn_status arm_max_pool_f16 (const cmsis_nn_context *ctx, const cmsis_nn_pool_params_f16 *pool_params, const cmsis_nn_dims *input_dims, const float16_t *src, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, float16_t *dst)
 Max pooling.
 
arm_cmsis_nn_status arm_avg_pool_f16 (const cmsis_nn_context *ctx, const cmsis_nn_pool_params_f16 *pool_params, const cmsis_nn_dims *input_dims, const float16_t *src, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, float16_t *dst)
 Average pooling.
 
arm_cmsis_nn_status arm_nn_activation_f16 (const float16_t *input, float16_t *output, int32_t size, arm_nn_activation_type_flt type, float16_t act_param)
 Elementwise activation.
 
arm_cmsis_nn_status arm_elementwise_add_f16 (const float16_t *input_1_vect, const float16_t *input_2_vect, float16_t *output, float16_t out_activation_min, float16_t out_activation_max, int32_t block_size)
 Elementwise add with optional output clamp.
 
arm_cmsis_nn_status arm_elementwise_mul_f16 (const float16_t *input_1_vect, const float16_t *input_2_vect, float16_t *output, float16_t out_activation_min, float16_t out_activation_max, int32_t block_size)
 Elementwise multiply with optional output clamp.
 
arm_cmsis_nn_status arm_minimum_f16 (const cmsis_nn_context *ctx, const float16_t *input_1_data, const cmsis_nn_dims *input_1_dims, const float16_t *input_2_data, const cmsis_nn_dims *input_2_dims, float16_t *output_data, const cmsis_nn_dims *output_dims)
 Elementwise minimum.
 
arm_cmsis_nn_status arm_maximum_f16 (const cmsis_nn_context *ctx, const float16_t *input_1_data, const cmsis_nn_dims *input_1_dims, const float16_t *input_2_data, const cmsis_nn_dims *input_2_dims, float16_t *output_data, const cmsis_nn_dims *output_dims)
 Elementwise maximum.
 
arm_cmsis_nn_status arm_fully_connected_nhwc_f16 (const cmsis_nn_context *ctx, const cmsis_nn_fc_params_f16 *fc_params, const cmsis_nn_dims *input_dims, const float16_t *input, const cmsis_nn_dims *filter_dims, const float16_t *kernel, const cmsis_nn_dims *bias_dims, const float16_t *bias, const cmsis_nn_dims *output_dims, float16_t *output)
 Fully connected layer, NHWC layout.
 
arm_cmsis_nn_status arm_fully_connected_f16 (const cmsis_nn_context *ctx, const cmsis_nn_fc_params_f16 *fc_params, const cmsis_nn_dims *input_dims, const float16_t *input, const cmsis_nn_dims *filter_dims, const float16_t *kernel, const cmsis_nn_dims *bias_dims, const float16_t *bias, const cmsis_nn_dims *output_dims, float16_t *output, arm_nn_tensor_layout layout)
 Fully connected layer, dispatch by layout.
 
int32_t arm_fully_connected_f16_get_buffer_size (const cmsis_nn_fc_params_f16 *fc_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *output_dims, arm_nn_tensor_layout layout)
 Get the temporary buffer size required by the fully connected layer.
 
arm_cmsis_nn_status arm_transpose_f16 (const cmsis_nn_context *ctx, const cmsis_nn_transpose_params_f16 *params, const cmsis_nn_dims *input_dims, const float16_t *input, const cmsis_nn_dims *output_dims, float16_t *output)
 Transpose a floating-point tensor.
 
void arm_concatenation_f16_x (const float16_t *input, int32_t input_x, int32_t input_y, int32_t input_z, int32_t input_w, float16_t *output, int32_t output_x, uint32_t offset_x)
 arm concatenation f16 x
 
void arm_concatenation_f16_y (const float16_t *input, int32_t input_x, int32_t input_y, int32_t input_z, int32_t input_w, float16_t *output, int32_t output_y, uint32_t offset_y)
 arm concatenation f16 y
 
void arm_concatenation_f16_z (const float16_t *input, int32_t input_x, int32_t input_y, int32_t input_z, int32_t input_w, float16_t *output, int32_t output_z, uint32_t offset_z)
 arm concatenation f16 z
 
void arm_concatenation_f16_w (const float16_t *input, int32_t input_x, int32_t input_y, int32_t input_z, int32_t input_w, float16_t *output, uint32_t offset_w)
 arm concatenation f16 w
 
arm_cmsis_nn_status arm_pad_f16 (const float16_t *input, float16_t *output, float16_t pad_value, const cmsis_nn_dims *input_size, const cmsis_nn_dims *pre_pad, const cmsis_nn_dims *post_pad)
 Pad a tensor with a constant value.
 
arm_cmsis_nn_status arm_batch_norm_f16 (const float16_t *input, float16_t *output, const float16_t *scale, const float16_t *bias, const cmsis_nn_dims *input_dims, arm_nn_tensor_layout layout)
 Apply batch normalization.
 
void arm_reshape_f16 (const float16_t *input, float16_t *output, uint32_t total_size)
 Reshape by copying data without changing element order.
 
arm_cmsis_nn_status arm_batch_matmul_f16 (const cmsis_nn_context *ctx, const cmsis_nn_bmm_params_f16 *bmm_params, const cmsis_nn_dims *input_lhs_dims, const float16_t *input_lhs, const cmsis_nn_dims *input_rhs_dims, const float16_t *input_rhs, const cmsis_nn_dims *output_dims, float16_t *output)
 Batched matrix multiplication.
 
int32_t arm_batch_matmul_f16_get_buffer_size (const cmsis_nn_bmm_params_f16 *bmm_params, const cmsis_nn_dims *input_lhs_dims, const cmsis_nn_dims *input_rhs_dims, const cmsis_nn_dims *output_dims)
 Get the temporary buffer size required by batched matrix multiplication.
 
arm_cmsis_nn_status arm_transpose_conv_wrapper_f16 (const cmsis_nn_context *ctx, const cmsis_nn_context *output_ctx, const cmsis_nn_transpose_conv_params_f16 *transpose_conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data, arm_nn_tensor_layout layout)
 Transpose convolution wrapper using the CMSIS-NN baseline path.
 
arm_cmsis_nn_status arm_transpose_conv_nhwc_f16 (const cmsis_nn_context *ctx, const cmsis_nn_context *output_ctx, const cmsis_nn_transpose_conv_params_f16 *transpose_conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data)
 Transpose convolution, NHWC layout.
 
arm_cmsis_nn_status arm_transpose_conv_f16 (const cmsis_nn_context *ctx, const cmsis_nn_context *output_ctx, const cmsis_nn_transpose_conv_params_f16 *transpose_conv_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *filter_dims, const float16_t *filter_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data, arm_nn_tensor_layout layout)
 Transpose convolution, dispatch by layout.
 
int32_t arm_transpose_conv_f16_get_buffer_size (const cmsis_nn_transpose_conv_params_f16 *transpose_conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims, const cmsis_nn_dims *out_dims)
 Get the temporary buffer size required by transpose convolution.
 
int32_t arm_transpose_conv_f16_get_reverse_conv_buffer_size (const cmsis_nn_transpose_conv_params_f16 *transpose_conv_params, const cmsis_nn_dims *input_dims, const cmsis_nn_dims *filter_dims)
 Get the reverse-convolution workspace size used by transpose convolution helpers.
 
arm_cmsis_nn_status arm_svdf_f16 (const cmsis_nn_context *ctx, const cmsis_nn_context *input_ctx, const cmsis_nn_context *output_ctx, const cmsis_nn_svdf_params_f16 *svdf_params, const cmsis_nn_dims *input_dims, const float16_t *input_data, const cmsis_nn_dims *state_dims, float16_t *state_data, const cmsis_nn_dims *weights_feature_dims, const float16_t *weights_feature_data, const cmsis_nn_dims *weights_time_dims, const float16_t *weights_time_data, const cmsis_nn_dims *bias_dims, const float16_t *bias_data, const cmsis_nn_dims *output_dims, float16_t *output_data)
 Stateful singular value decomposition filter.
 
arm_cmsis_nn_status arm_lstm_unidirectional_f16 (const float16_t *input, float16_t *output, const cmsis_nn_lstm_params_f16 *params, cmsis_nn_lstm_context_f16 *buffers)
 Unidirectional LSTM inference.
 
arm_cmsis_nn_status arm_softmax_f16 (const float16_t *input, int32_t num_rows, int32_t row_size, float16_t *output)
 Softmax using the float-native API signature.