联想发布可本地运行大模型的 AI 终端,Windows 加入 Agent 主机竞争! 1. 联想发布 AI 终端Yoga Pro 9n 成焦点AI PC 概念提出两年后联想在柏林 IFA 2026 期间的 Lenovo Innovation World 2026 上发布一系列 AI 终端包括手表、手机、平板、笔记本电脑、显示器等。其中联想联合英伟达推出的 Lenovo Yoga Pro 9n国内型号YOGA Pro 15 Spark最为重要它是一台可本地运行千亿参数大模型的量产 Windows 笔记本重 1.65 千克最薄 16.7 毫米最高配备 128GB 统一内存。按照英伟达对 RTX Spark 的规格说明该配置可在本地运行 1200 亿参数、最高支持 100 万 token 上下文的大语言模型。2. AI PC 发展现状与挑战以往的 AI PC 要么是像 DGX Spark 和 Mac Studio 等专业主机要么是 Mac Mini。一台合格的 AI PC要么在硬件上堆料有大内存和顶级显卡并保持尺寸与散热要么在软件上能无痛安装 OpenClaw 并支持各种 AI Agent 的使用。然而当 AI PC 走过概念走红、参数比拼阶段用户开始追问其价值。目前应付实时翻译、会议降噪等功能级任务算力或许足够但完整的大模型推理和稍复杂的 AI 工作流仍需云端处理本地大模型多在演示台上。3. Yoga Pro 9n 的技术亮点联想 Yoga Pro 9n 选择深度接入英伟达的端侧 AI 架构体系搭载 NVIDIA RTX Spark 超级芯片通过 NVLink - C2C 互联将 20 核 NVIDIA Grace CPU 与 6144 个 CUDA 核心的 Blackwell RTX GPU 合为一体提供 1 PFLOPSFP4 精度的 AI 性能使 Windows 笔记本有了成为 Agent 主机的潜力。4. 统一内存AI PC 新趋势传统 PC 中CPU 内存与 GPU 显存相互独立显存容量决定能运行的模型大小。消费级产品显存通常较小大模型装不下。而英伟达 RTX Spark 的统一内存架构让 CPU、GPU 共享最高 128GB 物理内存池千亿参数级大模型可在笔记本上本地运行英伟达给出的参考值是 1200 亿参数、100 万 token 上下文的大语言模型。开发者可沿用 CUDA 技术栈数据留本地平台还能协调多个 AI 智能体完成复杂创作任务。此外联想 X Power 散热架构把 80W TDP 压进最薄 16.7 毫米机身配 15.3 英寸 2.5K 165Hz PureSight Pro OLED 屏Yoga 家族基于 RTX 平台获得进阶游戏能力可完成开发 AI 应用、剪高分辨率视频、渲染 3D 场景等任务。同平台的 Lenovo Yoga 9n 2 - in - 1 则将算力装进 360 度翻转创作本最高 64GB 统一内存支持「屏幕 触控板」双表面手写。5. 其他厂商的统一内存布局联想并非唯一押注统一内存的玩家。苹果更新的 Mac mini 和 Mac Studio 提升了本地 AI 计算性能上限。Mac mini 提供 M6 和 M5 Pro 两种芯片统一内存最高 64GB支持通过 Thunderbolt 组成集群Mac Studio 提供 M5 Max 与 M5 UltraM5 Ultra 版本最高支持 512GB 统一内存、每秒 1.2TB 带宽能承载数百亿乃至数千亿参数模型。今年 6 月 WWDC26 上苹果演示 4 台 Mac Studio 通过 Thunderbolt 5 互联用 LM Studio 基于 MLX Distributed 跑起万亿参数规模的开放权重模型 Kimi K2.64 机集群推理性能最高达单机 3 倍。苹果 128GB 统一内存的 MacBook ProM5 Max可在本地运行 120B 参数的开源模型 gpt - oss - 120b实测最高约 79 token/s但需 4 - bit 量化且长上下文会挤占内存。6. 端侧 AI 竞争焦点转变对比两家 PC 更新方向端侧 AI 的瓶颈从单纯算力转到「模型装不装得下、数据搬不搬得动」的比拼。苹果用统一内存加 Thunderbolt 集群覆盖笔记本到桌面联想和英伟达则将同样能力带入 Windows CUDA 生态用 FP4 精度和统一内存将本地上下文上限推高到 100 万 token。7. Windows 争夺 Agent 主机在这场竞争中Windows 入场。过去能稳定承载本地大模型、长上下文和多智能体工作流的设备讨论多集中在 Mac 和 Linux 操作系统。Mac 靠统一内存和 MLX 使 Mac mini 畅销Linux 是英伟达、工作站和开发者工具链的大本营。而 Windows 虽为最广泛的个人电脑平台却很少被视为本地大模型和 Agent 的主场。现在联想将 RTX Spark 能力装进量产笔记本并带入商用场景Windows 有了承载千亿参数模型和本地 Agent 的现实基础。对于围绕 CUDA 开发 AI 应用的人来说RTX Spark 背后有 CUDA 的开发工具、软件库和开发者群体Windows 在争夺个人 Agent 主机时多了软件吸引力。8. 联想产品为 AI Agent 服务联想将算力和内存提升后目标是服务 AI Agent。当 AI 成为能自主规划、持续工作的协作者时对设备要求改变任务需长时间运行上下文要长期留存数据和权限留本地。联想商用新品 ThinkCentre X Ultra国内型号ThinkCentre X Tiny针对此需求1.6 升机身塞进 AMD 锐龙 AI Max PRO 495 系列处理器和最高 128GB 统一内存。与 DGX Spark 仅支持 Linux 系统不同该超算盒子提供面向 Windows 和 Linux 的预配置 AI 工具与工作流。其扩展方式为最多四台设备集群互联成统一计算平台可运行更大模型、更长上下文和多智能体工作流部门可按需叠加设备。9. 联想其他产品盘点除上述产品外联想此次阵容丰富包括两款概念机Project Aeroblade 用固态主动散热取代风扇在小机身实现无风扇全性能Project Swan 将卷轴屏引入商用本。平板有 Lenovo Yoga Tab Plus Gen 2 / Yoga Tab Gen 2国内型号拯救者 Y900 13 / Y900 11主打笔优先交互Lenovo Smart Canvas Concept 演示创作跨设备接力。主流与家用产品有与潘通合作的七色 IdeaPad Vibe 系列和无中置主机设计的 IdeaCentre AIO i 一体机。商用产品有 ThinkBook 14 Gen 9、ThinkBook 14x Gen 2、ThinkCentre M75 系列及四款 ThinkVision 显示器其中 P34WD - 4v 是全球首款获微软认证的雷电 VoIP 显示器。摩托罗拉产品有首款内置 Motorola Qira 的智能手表 moto watch ultra、搭载高像素主摄的 edge 70 plus 和镶水晶的 razr 特别版。个人 AI 方面Lenovo Motorola Qira 支持门槛降至 16GB 内存 PC随 Android 17 覆盖更多手机平板借 Workato 打通邮件与日历国内天禧个人智能体升级到 4.3支持全双工自然语音对话。10. AI PC 竞争新衡量标准过去两年Windows 和 Mac 走出不同 AI PC 路线。Windows 早将 AI 融入操作系统但本地运行大模型和搭建 AI 工作流方面 Mac 更受开发者青睐。搭载 RTX Spark 的联想笔记本出现后两条路线开始汇合Windows PC 拥有百 GB 级统一内存、千亿参数模型和 CUDA本地 AI 可成为电脑长期工作负载。这会促使模型厂商为端侧做蒸馏和量化开发者基于 CUDA 或 MLX 生态做本地优先应用有望绕开隐私、延迟和订阅成本问题。联想降低 Qira 支持门槛未来手机、平板、手表或有机会运行本地大模型。下一场 AI PC 竞争的衡量标准变为一台电脑的 AI 程度不仅看功能还看有多少原本需云端处理的工作可在本地完成。过去 Mac 和 Linux 占优势现在 Windows 设备带着统一内存、CUDA 和千亿模型能力加入竞争未来无论 Windows 还是 macOS用户都可能拥有真正属于自己的 Agent 主机。那么这场竞争谁能笑到最后呢

相关新闻

最新新闻

手撕单周期MIPS CPU:从Verilog到FPGA的硬核实践

手撕单周期MIPS CPU:从Verilog到FPGA的硬核实践

简介:本资源是一份面向计算机体系结构初学者与数字电路课程学习者的实践型教学材料,聚焦MIPS指令集架构下的32位单周期CPU设计与Verilog实现,帮助读者深入理解取指、译码、执行、访存、写回等核心硬件流程。资源共123个文件,包含1…

2026/9/8 20:45:45
Claude Code插件怎么选?2026年9款实战验证的高效工具清单

Claude Code插件怎么选?2026年9款实战验证的高效工具清单

我试过把市面上排得上号的Claude Code插件全装一遍的滋味。那段时间我的终端窗口像过年一样热闹,二十多个插件同时加载,看起来很有排面,实际上每次敲完命令都要等半天,有时候几个插件还在后台抢同一份上下文,把本来准确…

2026/9/8 20:45:45
ARM开源ML-KWS-for-MCU:在MCU上实现高效语音唤醒的完整工程解析

ARM开源ML-KWS-for-MCU:在MCU上实现高效语音唤醒的完整工程解析

如果有人问你,在Cortex-M这种主频普遍在200MHz以内、RAM以几十到几百KB计的MCU上,能不能跑一套实时语音唤醒?早几年我会摇头,觉得这个需求至少也得是Cortex-A或DSP的活儿。但自从花了几个晚上把ARM开源的 ML-KWS-for-MCU 源码从头…

2026/9/8 20:45:45
反向传播怎么算:手推一个 2-3-1 前馈网络,完整走完梯度计算与踩坑排查

反向传播怎么算:手推一个 2-3-1 前馈网络,完整走完梯度计算与踩坑排查

反向传播怎么算:手推一个 2-3-1 前馈网络,完整走完梯度计算与踩坑排查 【免费下载链接】nndl 邱锡鹏《神经网络与深度学习》第二版与通识版:电子书、章节目录、学习资源与勘误。 项目地址: https://gitcode.com/GitHub_Trending/nn/nndl …

2026/9/8 20:45:45
LightGBM实战:Learning to Rank排序学习全流程解析

LightGBM实战:Learning to Rank排序学习全流程解析

简介:这是一份利用LightGBM实现Learning to Rank排序学习的完整项目实践,面向推荐系统、搜索引擎等场景的数据科学开发者与算法学习者,尤其适合对排序学习、搜索排序或推荐召回排序有需求的初中级工程师。项目内容覆盖数据预处理、模型训练、…

2026/9/8 20:45:45
GPT Image 2与AI编程工具本地化:架构治理与踩坑实录

GPT Image 2与AI编程工具本地化:架构治理与踩坑实录

这周的 GitHub 趋势榜,我翻了三遍才敢细看:awesome-gpt-image-2这种资源合集直接登顶,Archify这种主打“架构治理”的也进了视野,而热词区更热闹——满屏都是unable to locate the codex cli binary、Claude Code 怎么装、模型名不…

2026/9/8 20:40:44