跳到主要内容

aclblasS8gemm

aclblasHgemm

函数功能

执行矩阵-矩阵的乘法,C = αAB + βC,输入数据和输出数据的数据类型为**aclFloat16**,异步接口:

函数原型

aclError aclblasHgemm(****aclTransType transA,

aclTransType transB,

aclTransType transC,

int m,

int n,

int k,

const aclFloat16 *alpha,

const aclFloat16 *matrixA,

int lda,

const aclFloat16 *matrixB,

int ldb,

const aclFloat16 *beta,

aclFloat16 *matrixC,

int ldc,

aclComputeType type,

aclrtStream stream)

参数说明

参数名输入/输出说明
transA输入A矩阵是否转置的标记。
transB输入B矩阵是否转置的标记。
transC输入C矩阵的标记,当前仅支持ACL_TRANS_N。
m输入矩阵A的行数与矩阵C的行数。
n输入矩阵B的列数与矩阵C的列数。
k输入矩阵A的列数与矩阵B的行数。
alpha输入用于执行乘操作的标量α的指针。
matrixA输入矩阵A的指针。
lda输入A矩阵的主维,此时选择转置,按行优先,则lda为A的列数。预留参数,当前只能设置为-1。
matrixB输入矩阵B的指针。
ldb输入B矩阵的主维,此时选择转置,按行优先,则ldb为B的列数。预留参数,当前只能设置为-1。
beta输入用于执行乘操作的标量β的指针。
matrixC输入&输出矩阵C的指针。
ldc输入C矩阵的主维,预留参数,当前只能设置为-1。
type输入计算精度,默认高精度。
stream输入执行算子所在的Stream。

返回值说明

返回0表示成功,返回其它值表示失败。

参考资源

接口调用流程,参见单算子调用流程

父主题: CBLAS接口

aclblasCreateHandleForHgemm

函数功能

创建矩阵-矩阵乘的handle,输入数据和输出数据的数据类型为**aclFloat16**,同步接口。

创建handle成功后,需调用aclopExecWithHandle接口执行算子。

函数原型

aclError aclblasCreateHandleForHgemm(****aclTransType transA,

aclTransType transB,

aclTransType transC,

int m,

int n,

int k,

aclComputeType type,

aclopHandle **handle)

参数说明

参数名输入/输出说明
transA输入A矩阵是否转置的标记。
transB输入B矩阵是否转置的标记。
transC输入C矩阵的标记,当前仅支持ACL_TRANS_N。
m输入矩阵A的行数与矩阵C的行数。
n输入矩阵B的列数与矩阵C的列数。
k输入矩阵A的列数与矩阵B的行数。
type输入计算精度,默认高精度。
handle输出“算子执行handle的指针”的指针。

返回值说明

返回0表示成功,返回其它值表示失败。

父主题: CBLAS接口

aclblasS8gemm

函数功能

执行矩阵-矩阵的乘法,C = αAB + βC,输入数据的数据类型为int8_t,输出数据的数据类型为int32_t,异步接口:

函数原型

aclError aclblasS8gemm(****aclTransType transA,

aclTransType transB,

aclTransType transC,

int m,

int n,

int k,

const int32_t *alpha,

const int8_t *matrixA,

int lda,

const int8_t *matrixB,

int ldb,

const int32_t *beta,

int32_t *matrixC,

int ldc,

aclComputeType type,

aclrtStream stream)

参数说明

参数名输入/输出说明
transA输入A矩阵是否转置的标记。
transB输入B矩阵是否转置的标记。
transC输入C矩阵的标记,当前仅支持ACL_TRANS_N。
m输入矩阵A的行数与矩阵C的行数。
n输入矩阵B的列数与矩阵C的列数。
k输入矩阵A的列数与矩阵B的行数。
alpha输入用于执行乘操作的标量α的指针。
matrixA输入矩阵A的指针。
lda输入A矩阵的主维,此时选择转置,按行优先,则lda为A的列数。预留参数,当前只能设置为-1。
matrixB输入矩阵B的指针。
ldb输入B矩阵的主维,此时选择转置,按行优先,则ldb为B的列数。预留参数,当前只能设置为-1。
beta输入用于执行乘操作的标量β的指针。
matrixC输入&输出矩阵C的指针。
ldc输入C矩阵的主维,预留参数,当前只能设置为-1。
type输入计算精度,默认高精度。
stream输入执行算子所在的Stream。

返回值说明

返回0表示成功,返回其它值表示失败。

参考资源

接口调用流程,参见单算子调用流程

父主题: CBLAS接口

aclblasCreateHandleForS8gemm

函数功能

创建矩阵-矩阵乘的handle,输入数据的数据类型为int8_t,输出数据的数据类型为int32_t,同步接口。

创建handle成功后,需调用aclopExecWithHandle接口执行算子。

函数原型

aclError aclblasCreateHandleForS8gemm(****aclTransType transA,

aclTransType transB,

aclTransType transC,

int m,

int n,

int k,

aclComputeType type,

aclopHandle **handle)

参数说明

参数名输入/输出说明
transA输入A矩阵是否转置的标记。
transB输入B矩阵是否转置的标记。
transC输入C矩阵的标记,当前仅支持ACL_TRANS_N。
m输入矩阵A的行数与矩阵C的行数。
n输入矩阵B的列数与矩阵C的列数。
k输入矩阵A的列数与矩阵B的行数。
type输入计算精度,默认高精度。
handle输出“算子执行handle的指针”的指针。

返回值说明

返回0表示成功,返回其它值表示失败。

父主题: CBLAS接口

aclopCast

函数功能

转换输入数据的数据类型,异步接口。

函数原型

aclError aclopCast(const aclTensorDesc *srcDesc,

const aclDataBuffer *srcBuffer,

const aclTensorDesc *dstDesc,

aclDataBuffer *dstBuffer,

uint8_t truncate,

aclrtStream stream)

参数说明

参数名输入/输出说明
srcDesc输入输入tensor描述的指针。
srcBuffer输入输入tensor的指针。
dstDesc输入输出tensor描述的指针。
dstBuffer输出输出tensor的指针。
truncate输入预留。
stream输入执行算子所在的Stream。

返回值说明

返回0表示成功,返回其它值表示失败。

父主题: CBLAS接口

aclopCreateHandleForCast

函数功能

创建数据类型转换的handle,同步接口。

创建handle成功后,需调用aclopExecWithHandle接口执行算子。

函数原型

aclError aclopCreateHandleForCast(****aclTensorDesc *srcDesc,

aclTensorDesc *dstDesc,

uint8_t truncate,

aclopHandle **handle)

参数说明

参数名输入/输出说明
srcDesc输入输入tensor描述的指针。
dstDesc输入输出tensor描述的指针。
truncate输入预留。
handle输出“算子执行handle的指针”的指针。

返回值说明

返回0表示成功,返回其它值表示失败。

父主题: CBLAS接口

在线提单