ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

CANN/GE ACL矩阵向量乘法API

CANN/GE ACL矩阵向量乘法API aclblasGemvEx【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge产品支持情况Ascend 950PR/Ascend 950DT不支持Atlas A3 训练系列产品/Atlas A3 推理系列产品支持Atlas A2 训练系列产品/Atlas A2 推理系列产品支持Atlas 200I/500 A2 推理产品支持Atlas 推理系列产品支持Atlas 训练系列产品支持IPV350不支持功能说明执行矩阵-向量的乘法y αAx βy输入数据、输出数据的数据类型通过入参设置。异步接口。A、x、y的数据类型仅支持以下组合 α和β的数据类型与y一致。A的数据类型x的数据类型y的数据类型aclFloat16aclFloat16aclFloat16aclFloat16aclFloat16float(float32)int8_tint8_tfloat(float32)int8_tint8_tint32_t函数原型aclError aclblasGemvEx(aclTransType transA, int m, int n, const void *alpha, const void *a, int lda, aclDataType dataTypeA, const void *x, int incx, aclDataType dataTypeX, const void *beta, void *y, int incy, aclDataType dataTypeY, aclComputeType type, aclrtStream stream)参数说明参数名输入/输出说明transA输入A矩阵是否转置的标记。类型定义请参见aclTransType。m输入矩阵A的行数存储矩阵乘数据时行优先。n输入矩阵A的列数。alpha输入用于执行乘操作的标量α的指针。a输入矩阵A的指针。lda输入A矩阵的主维此时选择转置按行优先则lda为A的列数。预留参数当前只能设置为-1。dataTypeA输入矩阵A的数据类型。类型定义请参见aclDataType。x输入向量x的指针。incx输入x连续元素之间的步长。预留参数当前只能设置为-1。dataTypeX输入向量x的数据类型。类型定义请参见aclDataType。beta输入用于执行乘操作的标量β的指针。y输入输出向量y的指针。incy输入y连续元素之间的步长。预留参数当前只能设置为-1。dataTypeY输入向量y的数据类型。类型定义请参见aclDataType。type输入计算精度默认高精度。类型定义请参见aclComputeType。stream输入执行算子所在的Stream。类型定义请参见aclrtStream。返回值说明返回0表示成功返回其他值表示失败请参见aclError。【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表