GE数据流TimeBatch功能 # dataflow.TimeBatch【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge产品支持情况Atlas A3 训练系列产品/Atlas A3 推理系列产品支持Atlas A2 推理系列产品/Atlas A2 训练系列产品支持函数功能TimeBatch功能是基于UDF为前提的。正常模型每次处理一个数据当需要一次处理一批数据时就需要将这批数据组成一个batch。最基本的batch方式是将这批N个数据直接拼接然后shape前加N而某些场景需要将某段或者某几段时间数据组成一个batch并且按特定的维度拼接则可以通过使用TimeBatch功能来组batch。在ASR(Automatic Speech Recognition)自动语音识别场景下存在按定长时间段组batch或按时间分段时间不连续组整批batch两种诉求可以通过TimeBatch实现。函数原型TimeBatch(time_window0, batch_dim0, drop_remainderFalse)参数说明参数名称数据类型取值说明time_windowint64_t整型(单位ms)当值0时表示按该时间窗来组batch当值为-1时表示按时间分段来组batch其它值报错。batch_dimint64_t只有设置了time_window时该参数才生效。取值范围[-1,shape维度]。- 默认为-1表示数据输出shape会在第0维添加一个batch维。- shape维度batch_dim0时表示按某个维度组batch。- batch_dimshape维度或者-1时报错。drop_remainderBool只有设置了time_window时该参数才生效。仅在time_window0时生效选择不足time_window时是否丢弃默认false不丢弃。true则丢弃。举例如下假如time_window5ms输入数据时长为3ms则- drop_remainder不配置或者配置为false时不丢弃输入数据。- drop_remainder配置为true时如果输入数据未携带EOS或者SEG会一直等待不丢弃数据。如果输入数据只携带了SEG则丢弃数据。如果输入数据携带了EOS标记则丢弃输入数据只传递EOS标记。- 如果输入数据未携带EOS或者SEG会一直等待不丢弃数据。- 如果输入数据只携带了SEG则丢弃数据。- 如果输入数据携带了EOS标记则丢弃输入数据只传递EOS标记。返回值正常场景下返回None。返回“TypeError”表示参数类型不正确。调用示例import dataflow as df # 按需设置time_batch中的各个属性值 time_batch df.TimeBatch() time_batch.time_window 5 time_batch.batch_dim 0 # 通过FlowNode的map_input接口使用 df.FlowNode(...).map_input(..., [time_batch])约束说明当前Batch特性无法做负荷分担因此如果使用2P环境需要在ge初始化时添加{ge.exec.logicalDeviceClusterDeployMode, SINGLE}, {ge.exec.logicalDeviceId, [0:0]}。其中logicalDeviceId可以是[0:0]也可以是[0:1]。logicalDeviceId解释如下。logical_device_cluster_deploy_mode为SINGLE时用于指定模型部署在某个指定的设备上。配置格式[node_id:device_id]node_id昇腾AI处理器逻辑ID从0开始表示资源配置文件中第几个设备。device_id昇腾AI处理器物理ID。【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

最新新闻

x64dbg脚本编程:自动化逆向工程与调试分析实战指南

x64dbg脚本编程:自动化逆向工程与调试分析实战指南

在逆向工程和软件分析领域,调试器是安全研究员和逆向工程师不可或缺的“手术刀”。面对复杂的二进制程序,手动跟踪每一条指令、每一个寄存器值,不仅效率低下,而且极易出错。你是否曾因反复执行相同的调试步骤而感到疲惫&#xff1…

2026/9/1 17:27:15
MLX Control Center v0.4 实战:macOS 上搭建苹果芯片本地模型推理与监控工作流

MLX Control Center v0.4 实战:macOS 上搭建苹果芯片本地模型推理与监控工作流

最近在 Apple Silicon 的 Mac 上做本地模型实验时,我发现 MLX 生态里一个很实用的配套工具 MLX Control Center 已经迭代到了 v0.4。对于经常在终端里跑 MLX 脚本、又要反复确认资源占用和任务状态的同学来说,这种“GUI 总控台”确实能省掉不少来回敲命令…

2026/9/1 17:27:15
Claude Code自动在Git提交中追加Session URL?一文读懂原因与关闭方法

Claude Code自动在Git提交中追加Session URL?一文读懂原因与关闭方法

最近不少用 Claude Code 做开发的团队碰到一个奇怪现象:git log里突然多了一行Claude Session URL: https://claude.ai/session/xxxx,PR 描述底部也被自动追加了同一条链接。有人在群里问:这是中病毒了,还是哪个插件在“夹带私货”…

2026/9/1 17:27:15
SharpDevelop 2.2 安装与配置:轻量级开源C# IDE实战指南

SharpDevelop 2.2 安装与配置:轻量级开源C# IDE实战指南

简介:SharpDevelop 2.2.1.0.2429 是一款开源免费的 C# 集成开发环境,适合初学者搭建 .NET 编程学习环境,也适合开发者作为轻量级 IDE 使用。安装包内共 2 个文件:主安装程序为 exe 格式,约 4.11MB,包含完整…

2026/9/1 17:27:15
kkce.com:为什么网站测速要分离首屏与全量加载?-快快测

kkce.com:为什么网站测速要分离首屏与全量加载?-快快测

把 网站测速​ 收敛成“总加载 2.8s 达标”,是单点总时长视角的典型降维;在 Core Web Vitals 与关键渲染路径(CRP)里,用户感知的是“首屏可见内容什么时候出来”,而不是“页面上第 47 张懒加载图什么时候下…

2026/9/1 17:27:15
同一份对话历史 加载项发起的对话进入桌面历史

同一份对话历史 加载项发起的对话进入桌面历史

chayuan-wps 加载项发起的对话同步到 察元AI智能体 的对话历史。这一篇讲。 共享的意义 员工早上在 察元AI智能体 跟 AI 聊了 大客户拜访策略。 下午在 WPS 写访客报告。chayuan-wps 加载项侧栏。 理论上这是 同一个工作。聊天历史应该统一。 不分桌面 / WPS。 实现链路 链路。…

2026/9/1 17:22:15