LG AI芯片转单三星,嵌入式开发者如何应对NPU与SoC变化 一家电视与家电巨头把AI芯片代工订单从台积电切换到三星这条新闻在消费电子圈很容易被读成一句普通的供应链消息。但如果把视角切到做嵌入式AI和智能家居的开发者身上它背后牵出的问题要具体得多AI家电芯片到底是一颗什么样的芯片为什么它非要找代工厂换一家代工对底层BSP、NPU工具链、模型部署和产品送测这些环节会带来哪些连锁变化先把判断放在前面LG选择三星代工短期看是产能与成本的账长期看是终端厂商在AI芯片供应链上从“单点依赖”走向“双供应商备份”。对开发者来说这意味着接下来你会面对更多不同代工厂出身、不同NPU指令集、不同工具链的AI SoC。过去只认某一家芯片原厂的日子会结束适配与验证能力会变得更重要。这篇文章不打算做新闻复述而是从三个层面展开第一AI家电芯片的技术构成和它为什么离不开代工第二LG把订单从台积电换到三星对芯片设计、流片验证和量产会产生哪些真实变化第三站在嵌入式AI开发者的角度如何应对SoC启动、NPU工具链、模型部署、芯片测试这些环节中的实际问题。最后会给出一个最小可行的端侧AI实践以及一套面向多供应商芯片的工程建议。1. 这篇文章真正要解决的三个问题这则新闻看起来是“公司A找公司B代工”对普通开发者来说最直接的反应可能是“跟我有什么关系”。但如果你的工作涉及AI家电、智能家居或端侧AI应用开发关系非常直接因为芯片加工方式的变化会通过产品形态传导到你的代码、编译参数、驱动接口和测试流程上。第一个问题是选型问题。以前推一款智能家电方案基本上是某颗固定SoC或者MCU换供应商往往意味着从原理图到驱动全部重来。现在头部家电厂商开始主动管理芯片供应链同一个产品可能同时评估多家代工厂、多个芯片原厂方案。开发者要接受一个现实上游会越来越多地把“同一功能在不同芯片上跑”而不是“永远只维护一款芯片”。第二个问题是适配问题。AI芯片要真正落地不是芯片本身做出来就行还必须有一整套软件开发链条Boot ROM引导、Linux内核适配、NPU驱动、模型转换工具、推理运行时、OTA升级。换代工厂不等于换外壳它会影响晶圆制程、IP组合、寄存器布局以及芯片原厂SDK的底层实现。这些变化最终都会出现在开发者的编译日志和调试串口里。第三个问题也是更实际的问题终端厂商和越来越多模组公司都在把AI能力往设备端下沉。设备端芯片越来越像一台“边缘AI服务器”需要同时处理语音、视觉、传感和控制。如果你不理解SoC启动、NPU算子支持和模型量化之间的关系会在产品从送样到量产的过程中持续踩坑。这篇文章正好把这些问题串起来。它不是某一颗芯片的手册而是一张从供应链到开发板的“问题地图”帮你判断下一代AI家电平台选型时该看哪些指标该在什么阶段验证什么。2. AI家电芯片为什么是一类特殊芯片2.1 从云端AI到端侧AI家电为什么要装NPU过去很多智能家电的“智能”只是把摄像头或麦克风数据传到云端由云端AI大模型处理再把结果返回。这种方法部署简单但有几个根深蒂固的问题网络一抖语音助手就变笨视频流一直上传隐私压力很大每次交互往返几百毫秒控制空调、门锁这类实时设备体验不好云端推理按次计费长期运营成本居高不下。端侧AI家电芯片解决的就是这个问题。芯片内部集成CPU、NPU神经网络处理单元、DSP、ISP、音视频编解码和各类外设接口音频唤醒、人脸识别、宠物识别、跌倒检测、食材识别这些任务直接在本地完成。以一台智能冰箱为例摄像头识别冰箱里的食材NPU完成图像分类CPU根据分类结果管理食材库存和保鲜策略。即使断网也能继续工作。2.2 AI家电芯片的技术组成AI家电芯片不是一颗简单的MCU而是一颗面向特定场景的SoC关键模块包括CPU负责运行应用程序、操作系统和业务逻辑常见的是Cortex-A系列或多核RISC-V。NPU做卷积、矩阵乘、激活函数等AI算子是芯片算力的主要来源。ISP处理摄像头输入自动曝光、白平衡、降噪直接影响图像识别准确率。DSP处理音频信号负责语音唤醒、回声消除和麦克风阵列。视频编解码单元用于视频监控、门锁可视对讲、电视画质处理。安全单元负责密钥存储、安全启动和固件防篡改。这类芯片目前的演进趋势是往“大模型端侧化”走。比如语音助手从单纯的命令词识别转向自然语言理解图像识别从分类模型升级到目标检测和语义分割模型甚至跑轻量化大模型。这要求NPU不仅支持常见CNN算子还要支持Transformer结构中的Attention、LayerNorm等算子。“AI大模型”“AI Agent”并不是只在云端未来家电端也会出现承担部分Agent功能的芯片。2.3 一颗芯片为什么要做出来这么复杂因为家电产品不是开发板。它需要低成本、低功耗、高可靠性还要在每年数百万台的出货量下保证一致性。CPU可以买ARM IPGPU/NPU可以买加速器IP但把这些东西集成在一起完成前后端设计、验证、流片、封装测试再写出稳定BSP是一个系统工程。这也是为什么终端厂商通常不会自己建晶圆厂而是找台积电、三星这类代工厂合作。芯片设计公司负责架构和代码代工厂负责把设计变成物理芯片。你手上那颗能跑TensorFlow的AI模组背后其实是一条包含数百道工序的制造链条。3. 代工模式与LG换供应商的技术逻辑3.1 IDM、Fabless与Foundry是什么在聊LG和三星之前先理清半导体行业的三种模式IDM集设计、制造、封测于一体比如三星电子自己设计芯片也自己生产Intel过去也长期如此。Fabless无晶圆厂只做芯片设计和销售不建晶圆厂典型代表是苹果、高通、联发科、海思。Foundry代工厂只负责制造不设计终端芯片典型代表是台积电、三星代工、中芯国际。LG电子作为终端品牌具备电视SoC和家电控制芯片的自主设计能力但它不是大规模IDM也不会为所有家电芯片自建先进制程产线。所以它设计完一颗AI家电芯片后必须把版图交给代工伙伴生产。“LG委托三星代工”这个动作本质上是用三星的晶圆厂资源换掉原先在台积电的产能。对LG来说无论最终订单比例如何都增加了供应链的灵活度这是更稳妥的判断。3.2 台积电和三星代工的差异点这里先明确代工厂与代工厂之间的差异不只是“谁工艺更先进”还涉及IP生态、设计规则、PDK工艺设计套件、标准单元库和流片服务。维度台积电代工三星代工工艺选择成熟制程和先进制程覆盖全面在先进制程和特殊工艺上有布局IP/生态生态最完整第三方IP多近年生态快速增长但部分IP仍需定制产能策略长期稳定客户多代工与自有产品部门并存产能分配有博弈开发支持供应商成熟设计服务多对特定客户可能给出更灵活的商务条件从产业逻辑看LG选择三星除了降低对单一供应商依赖还有一个容易被忽略的协同点三星在屏幕、存储、传感器和生产自动化上同样有布局LG和三星虽然在消费市场是竞争对手但在供应链层面可以形成更紧密的配合。芯片的迭代、测试和定制开发离代工厂近一点沟通成本会更低。这是一种典型的“竞合”关系。3.3 换代工厂对芯片本身意味着什么从芯片设计流程来看一家企业决定切换代工厂会牵扯到很多环节数字前后端设计要按新的PDK重做时序收敛标准单元库要更换SRAM、模拟IP、GPIO等IP要重新评估芯片测试向量要调整封装和可靠性验证也要重新走一遍。即使逻辑功能不变一颗芯片在物理层面已经发生了改变。对于家电AI芯片来说这种改变最终会体现在寄存器地址、时钟频率、中断号、电源域和启动方式上。你在开发板上看到的现象可能就是同样的启动流程在某芯片上能从SD卡启动在另一个芯片上却只能从eMMC启动同样的摄像头型号在某个平台上驱动可用在另一个平台上却需要改上电时序。这些不是玄学而是代工切换和IP变化带来的连锁反应。既然提到SoC启动下一节就直接进入这个环节这也是很多从MCU转做AI芯片的开发者最不熟悉的部分。4. 从SoC启动到量产AI芯片开发链条上的关键环节4.1 一颗AI SoC的启动流程家电AI芯片通常跑嵌入式Linux它的启动流程可以简单拆成下面几个阶段Boot ROM芯片内部固化的第一段代码负责从外部存储读取引导程序一般无法修改。BL1/BL2或预引导加载完成DDR初始化、时钟配置、安全启动校验然后加载下一级引导。ATFArm Trusted Firmware或类似安全固件建立可信执行环境处理安全启动链。U-Boot初始化外设、加载设备树和内核镜像。Linux内核启动驱动、挂载文件系统最终运行用户态AI推理程序。在开发板阶段最常见的调试方式就是连接串口和JTAG/SWD调试器。如果你的芯片进入不了内核第一件事永远是看串口打印停在哪个阶段。停留位置不同排查方向完全不同。4.2 回片后Bring-Up的常见操作芯片回片之后硬件工程师和嵌入式工程师要一起做Bring-Up也就是让这颗裸芯片从“能上电”走到“能跑代码”。比较常见的做法是先按住芯片复位键在调试软件里点连接连接成功后松开复位键然后再擦除或下载固件。这个操作的本质是让调试器在芯片刚上电、CPU还没跑乱的时候介入保证调试器能拿到CPU控制权。如果你遇到过“连不上SWD”“下载器报错”之类的问题很可能就是复位时序没有配合好。# 示意GDB 远程调试时先连上再触发复位 # 具体端口和命令以调试器厂商工具为准 target remote :3333 monitor reset halt load u-boot.elf resume这一步看起来简单但在AI芯片上尤其重要因为NPU和多媒体子系统经常会抢占总线或进入异常状态。连不上调试器时可以先用示波器确认复位引脚和电源时序再检查调试器速率是否过高最后再把复位保持时间拉长一些。4.3 从启动到量产需要做哪些测试一颗AI家电芯片能不能量产不只是启动一次就够。还要做芯片测试包括晶圆测试和成品测试确保每颗芯片的频率、功耗、IO都符合规格。压力测试长时间跑NPU负载和多媒体负载观察温度、电流和性能是否漂移。老化测试模拟多年使用环境验证可靠性。安全测试检查安全启动、密钥保护和加密通信。这些工作大多数看起来是硬件工程师的事但软件工程师也要参与。因为测试过程中需要大量的驱动和脚本支持而且量产之后出现功能异常第一步要看的就是芯片日志和内核日志。一个良好设计的日志系统能节省大量问题定位时间。5. 端侧AI开发者的最小实践从模型到NPU推理前面的内容偏供应链和芯片架构接下来进入真正能动手的部分。假设你现在要在一颗AI家电芯片上实现一个“食材识别”功能但手头还没有最终模组你可以先用通用开发板或电脑跑通模型转换和ONNX推理流程之后再替换成目标NPU runtime。这里用到的是完全公开的工具链不绑定某一家芯片原厂。5.1 第一步把PyTorch模型导出成ONNX在训练阶段模型通常用PyTorch保存为.pt但NPU工具链一般不能直接吃PyTorch格式需要先导出成ONNX。以下是一个最小导出脚本。# 文件路径export_onnx.py import torch import torch.onnx # 假设已经有了一个训练好的分类模型这里是示意加载方式 model torch.load(food_classifier.pt, map_locationcpu) model.eval() dummy_input torch.randn(1, 3, 224, 224) torch.onnx.export( model, dummy_input, food.onnx, input_names[input], output_names[output], opset_version11, dynamic_axes{input: {0: batch}, output: {0: batch}}, ) print(ONNX model exported at food.onnx)这里需要解释几个关键点。opset_version11是一个兼容性选择太高版本可能在部分NPU工具链上不被支持太低又可能缺少新算子dynamic_axes允许batch维可变但如果你确定推理时batch永远是1也可以去掉这个参数。导出之后建议先用onnxruntime检查一遍ONNX模型是否能正常运行排除算子兼容问题。5.2 第二步用ONNX Runtime在开发板上验证很多NPU工具链都提供了“PC模拟器”和“板端runtime”。在没有NPU环境时先用CPU执行ONNX模型可以验证预处理和后处理逻辑是否完整。下面是一个简单的推理脚本。# 文件路径infer_onnx.py import cv2 import numpy as np import onnxruntime as ort # 读取一张本地图片模拟摄像头输入 image cv2.imread(apple.jpg) image cv2.cvtColor(image, cv2.COLOR_BGR2RGB) image cv2.resize(image, (224, 224)).astype(np.float32) / 255.0 # 按模型的预处理要求调整通道顺序 image np.transpose(image, (2, 0, 1)) input_tensor np.expand_dims(image, axis0) # 创建 ONNX Runtime 会话 sess ort.InferenceSession( food.onnx, providers[CPUExecutionProvider], ) outputs sess.run(None, {input: input_tensor}) pred np.argmax(outputs[0], axis1)[0] print(predicted class id:, pred)在这个阶段运行结果不依赖任何NPU硬件核心目的是验证模型图结构和数据流。如果输出结果和PyTorch不一致优先检查预处理归一化、通道顺序和resize插值方式。到了这一步你已经完成了端侧AI应用开发里最不依赖硬件的一部分。5.3 第三步接入NPU设备树当产品真正选用某颗SoC后NPU和摄像头通常需要在内核设备树里配置。下面是一个示意片段实际地址和中断号必须以芯片原厂手册为准。// 文件路径arch/arm64/boot/dts/board/ai-home.dts / { npu: npu12300000 { compatible vendor,ai-npu; reg 0x0 0x12300000 0x0 0x100000; interrupts 0 42 4; clocks cru NPU_CLK; power-domains power NPU_PD; status okay; }; camera0: camera34500000 { compatible vendor,camera-sensor; reg 0x0 0x34500000 0x0 0x1000; reset-gpios gpio3 10 GPIO_ACTIVE_LOW; pinctrl-names default; pinctrl-0 camera0_pins; status okay; }; };设备树是Linux内核和硬件之间的一座桥。摄像头挂在哪条I2C总线、GPIO编号是多少、NPU的时钟和电源域怎么接都要在上面体现。如果设备树里的寄存器地址写错驱动能加载但访问会出错严重时会导致整个内核崩溃。所以拿到新平台的第一个任务通常是对照原理图和原厂Linux内核把设备树里的节点逐一核对清楚。5.4 第四步在目标NPU上编译和运行ONNX模型不能在NPU上直接运行需要经过原厂工具链转换成NPU专属指令集模型文件。不同厂家的转换命令差异很大但逻辑都是类似的三步导入模型、配置量化参数、生成可执行模型。# 示意命令不同NPU工具链的命令不同请以芯片原厂工具链为准 npu_convert --framework onnx \ --model food.onnx \ --output food.npu \ --quantization asymmetric \ --calibration_data calibration/ \ --target_platform ai_home_npu_v1转换完之后在你的C/C程序里调用NPU runtime加载模型。大多数厂商SDK提供的操作方式类似// 示意NPU推理伪代码实际API以原厂SDK为准 #include npu_runtime.h npu_context ctx; npu_model model; npu_init(ctx); npu_load_model(ctx, food.npu, model); npu_input input {0}; npu_output output {0}; prepare_input(input, camera_frame); // 把摄像头帧转成模型输入 npu_run(model, input, output); printf(class %d, confidence %.3f\n, output.top_class, output.top_score); npu_release_model(model); npu_deinit(ctx);这里最重要的是理解“模型转换不是透明过程”。ONNX里的算子数量、算子类型、张量排布都会影响转换成功率。更常见的情况是一个模型在PyTorch里跑得很好转成ONNX也没问题但进入NPU工具链时报“Unsupported Op”。这种问题通常只能通过改写模型算子、拆分子图或升级工具链解决。6. 运行结果与效果验证模型部署不是烧进去就结束还要在真实环境和模拟条件下验证效果。这里列出典型的运行命令和判断标准。# 板端运行ONNX/Runtime推理程序 ./infer_onnx --model food.onnx --image test.jpg # 预期输出示例 [INFO] model loaded: food.onnx [INFO] inference time: 45.6 ms on CPU predicted class id: 3, confidence: 0.92如果是NPU环境重点看三个指标推理时延、吞吐量和端到端精度。对于家电场景语音唤醒要求时延一般在几十毫秒级别图像识别可以放宽到几百毫秒但连续识别时不能有明显的卡顿。精度指标则要与云端模型做对比不能只看准确率掉没掉还要看误报率有没有升高。# 查看NPU利用率、温度和频率 cat /sys/class/devfreq/*/cur_freq cat /sys/class/thermal/thermal_zone*/temp # 查看内核日志中与NPU、摄像头相关的错误 dmesg | grep -E npu|camera|iommu|error如果运行失败第一步看的是日志不是改代码。很多NPU错误会通过内核日志丢弃或打印在stderr里比如“Allocate memory failed”“IOMMU fault”等。先用这些信息确认问题是驱动层、运行时层还是数据层再决定排查方向。7. 常见问题与排查思路结合前面提到的SoC启动、NPU工具链和代工切换相关风险整理一张排查表。问题现象可能原因排查方式解决方案开发板上电后串口无输出电源时序、Boot引脚、串口速率不对检查电源、Boot引脚电平、串口连接调整启动拨码确认串口工具速率与芯片一致卡在U-Boot阶段DDR初始化失败或配置文件错误查看U-Boot日志定位DDR初始化位置核对内存型号/容量重编U-Boot的DDR参数NPU模型转换报Unsupported Op模型含工具链不支持的算子打印转换日志查看算子映射表改写算子、拆分子图或升级NPU工具链板端推理时延比预期高很多NPU频率未拉满或数据拷贝瓶颈检查devfreq调频策略分析输入数据拷贝路径开启DVFS使用零拷贝API识别精度低于云端模型量化损失或预处理不一致对比量化前后输出分布检查预处理代码增加校准数据集改用混合精度量化设备树配置后驱动加载失败地址冲突、GPIO复用错误查看内核打印和设备树解析日志对照原理图修正节点检查pinctrl配置代工批次芯片功能不稳定芯片筛选或可靠性测试覆盖不足做温度循环、高低温测试、长时间压力测试联系芯片原厂联合分析调整测试向量摄像头画面异常或无法出图上电时序、复位引脚、驱动不匹配用示波器量复位和MCLK时序查看sensor驱动日志调整GPIO延时按sensor手册修改初始化序列这张表解决的是“现象 - 原因”的定位思路。实际项目里很多问题是交叉出现的比如NPU时延高可能是设备树里没有配置热管理策略导致的降频也可能是因为DMA buffer没有复用。建议每次只改一个变量记录日志再继续下一轮测试。8. 最佳实践与工程建议8.1 供应链层面的建议如果你所在的公司现在开始评估AI家电芯片我建议不要等到产品定稿才找芯片供应商。至少提前两个季度锁定候选方案同时送样验证两块不同来源的模组分别跑相同的功能和压力测试。多供应商策略不是把成本最低的方案选出来而是要对“第二家方案”的真实成熟度做到心中有数。很多团队只验证了主方案备胎方案一旦启用发现BSP还缺模块这是最糟糕的情况。对终端厂商来说“摆脱对台积电依赖”并不是完全不用某一家代工厂而是引入冗余。真正的

相关新闻

最新新闻

CS2 Demo智能录制与事件切片:伪实战验证自动化素材生产链路

CS2 Demo智能录制与事件切片:伪实战验证自动化素材生产链路

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/2 13:58:35
Blender制作3D国漫表情包:从建模、形态键到透明动图输出

Blender制作3D国漫表情包:从建模、形态键到透明动图输出

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/2 13:58:35
用pyecharts+Flask实现个人信息可视化大屏:完整方案与踩坑实录

用pyecharts+Flask实现个人信息可视化大屏:完整方案与踩坑实录

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/2 13:58:35
12类垃圾分类图像数据集实战:从数据预处理到模型调优全流程解析

12类垃圾分类图像数据集实战:从数据预处理到模型调优全流程解析

简介:这是一份专为计算机视觉初学者与垃圾分类算法开发者设计的图像分类数据集,聚焦生活场景下的12类常见垃圾细粒度识别任务,可直接用于PyTorch ImageFolder加载、YOLOv5分类训练或模型微调等实践。资源共2000个文件,含1998张JPG…

2026/9/2 13:58:35
开源机器人避坑指南:从选购到调试的完整验证流程

开源机器人避坑指南:从选购到调试的完整验证流程

开源机器人听起来很香:整机图和演示视频里小车圆滚滚、配色亮眼,电机参数、底盘图纸、控制源码全部开放,价格看起来也比同规格商业机器人低一截。尤其是接触过 ROS / ROS 2、刷过机器人博主视频之后,很多人会忍不住想下单。但真拿…

2026/9/2 13:58:35
降AI率教程:护理学硕士论文AIGC超标4.8元知网维普达标完整操作指南

降AI率教程:护理学硕士论文AIGC超标4.8元知网维普达标完整操作指南

降AI率教程:护理学硕士论文AIGC超标4.8元知网维普达标完整操作指南 同学问过好几次护理学硕士论文降AI率降AI率怎么操作,干脆写篇教程。嘎嘎降AI(www.aigcleaner.com),4.8元,降AI率达标率99.26%&#xff0…

2026/9/2 13:53:35