CANN/ops-cv 边界框编码算子 BoundingBoxEncode【免费下载链接】ops-cv本项目是CANN提供的图像处理、目标检测相关的算子库实现网络在NPU上加速计算。项目地址: https://gitcode.com/cann/ops-cv产品支持情况产品是否支持Ascend 950PR/Ascend 950DT√Atlas A3 训练系列产品/Atlas A3 推理系列产品√Atlas A2 训练系列产品/Atlas A2 推理系列产品√Atlas 200I/500 A2 推理产品×Atlas 推理系列产品×Atlas 训练系列产品×功能说明算子功能计算锚框anchor box与真实边界框ground truth box之间的编码偏移量生成目标检测回归目标。计算公式先将输入坐标 $(x_1, y_1, x_2, y_2)$ 转换为中心点宽高格式$$ cx (x_1 x_2) / 2, \quad cy (y_1 y_2) / 2, \quad w x_2 - x_1 1, \quad h y_2 - y_1 1 $$再计算编码偏移量$$ dx \frac{g_{cx} - p_{cx}}{p_w}, \quad dy \frac{g_{cy} - p_{cy}}{p_h}, \quad dw \ln\left(\frac{g_w}{p_w}\right), \quad dh \ln\left(\frac{g_h}{p_h}\right) $$最后做均值标准化$$ \delta_i \frac{raw_i - means_i}{stds_i}, \quad i \in {0,1,2,3} $$其中$p$为anchor_box对应值$g$为ground_truth_box对应值。参数说明参数名输入/输出/属性描述数据类型数据格式anchor_box输入锚框坐标张量坐标格式为(x1, y1, x2, y2)。数据类型需与ground_truth_box一致。FLOAT16、FLOATNDground_truth_box输入真实边界框坐标张量坐标格式为(x1, y1, x2, y2)。数据类型和shape需与anchor_box一致。FLOAT16、FLOATNDmeans属性编码均值偏移量长度为4。默认值为[0.0, 0.0, 0.0, 0.0]。ListFloat-stds属性编码标准差缩放量长度为4各元素不可为0。默认值为[1.0, 1.0, 1.0, 1.0]。ListFloat-delats输出编码偏移量输出张量。数据类型与anchor_box一致shape与anchor_box相同。FLOAT16、FLOATND约束说明anchor_box和ground_truth_box的数据类型必须相同支持float16和float32。anchor_box和ground_truth_box的shape必须完全一致均为(N, 4)。means和stds的长度必须为4stds各元素不可为0。坐标格式为标准(x1, y1, x2, y2)格式即左上角和右下角坐标。公式中宽高计算包含1偏移w x2 - x1 1, h y2 - y1 1保证宽高至少为1防止除零。支持空TensorN0时返回空输出。调用说明调用方式样例代码说明图模式test_geir_bounding_box_encode通过算子IR构图方式调用BoundingBoxEncode算子。【免费下载链接】ops-cv本项目是CANN提供的图像处理、目标检测相关的算子库实现网络在NPU上加速计算。项目地址: https://gitcode.com/cann/ops-cv创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

最新新闻

基于Stigmergy的团队LLM wiki协作机制与FastAPI工程实践

基于Stigmergy的团队LLM wiki协作机制与FastAPI工程实践

Stigmergy 听起来像一个冷门词,但它可能是团队协作型 LLM wiki 最值得借鉴的设计原则。Andrej Karpathy 带动的 “LLM wiki” 讨论,通常指向一种个人化知识管理范式:一个人借助大语言模型持续提问、修订、链接页面,把零散笔记变成…

2026/8/28 8:09:48
Think Broad, Act Narrow: CWE Identification with Multi-Agent Large Language Models

Think Broad, Act Narrow: CWE Identification with Multi-Agent Large Language Models

一、文章主要内容和创新点 1. 主要内容 本文针对现有大型语言模型(LLMs)在漏洞检测中存在的局限性,提出了一种基于多智能体LLM的CWE(常见弱点枚举)识别方法。 现有技术的核心问题包括:(1)LLMs难以通过一次性预测完成漏洞检测所需的深度分析;(2)多聚焦于函数级分析…

2026/8/28 8:09:48
实时辩论AI裁判:从WebSocket到大模型结构化裁决的工程实践

实时辩论AI裁判:从WebSocket到大模型结构化裁决的工程实践

如果两个人吵架,谁都觉得自己有理。这种事放到线下,可以找人评理、发动群众投票,或者干脆不欢而散。但放到线上,有人把它做成了一款即时对战游戏:两个玩家实时辩论一个话题,最后由大模型当裁判,…

2026/8/28 8:09:48
WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Fram...

WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Fram...

文章主要内容总结 研究背景:大型语言模型(LLMs)在数学问题解决上表现出色,但受限于高质量、多样化训练数据的获取。现有方法通过重述或难度递进扩充数据集,却忽视了LLMs的特定缺陷,导致生成的问题多为模型已能解决的,提升有限。 核心方法:提出WarriorMath框架,整合缺陷…

2026/8/28 8:09:48
青岛活动策划公司靠谱吗

青岛活动策划公司靠谱吗

1. 活动策划公司到底在解决什么问题青岛一家地产公司的市场经理老张,去年自己张罗了一场300人的项目发布会。结果场地音响和LED屏是两家供应商,现场调试时互相推诿,活动延迟了40分钟。会后他算了笔账,自己对接了7个不同团队&#…

2026/8/28 8:09:48
从国赛实战看华为云CodeArts如何重塑智能车开发流程

从国赛实战看华为云CodeArts如何重塑智能车开发流程

1. 从“即兴创作”到“工业级流水线”:我的国赛初体验与认知重塑 去年,我第一次带队参加了全国大学生智能汽车竞赛(简称“国赛”)。在很多人眼里,国赛是技术高手云集的殿堂,是代码与硬件的终极对决。但当我…

2026/8/28 8:04:47