Grok 4.5 今日登场,Agent 这一周连发三件大事:一份技术向速记 周四下午随手记一笔。这周 Agent 圈动静不小今天7/9最炸的是 Grok 4.5 正式发布往前数还有阿里把三条 Agent 产品线并成一条、国内两大平台的智能体功能宣布退场。下面按发生了什么 技术上意味着什么的节奏捋一遍顺手记几个值得抄的代码范式。一、Grok 4.5第一个为编程 Agent联合训练的模型今天 SpaceXAI 正式放出 Grok 4.5。几个技术点值得细看定位首个专门面向编程和智能体任务训练的模型由 SpaceXAI 与 Cursor 联合训练完成效率单个任务 Token 消耗约为同级领先模型的一半输出速度 80 TPS单次任务步骤数少一半成本输入 $2 / 百万 Token输出 $6 / 百万 Token不到同类可比模型的一半底座基于约 1.5 万亿参数的 V9 基础模型马斯克称其为Opus 级。对 Agent 工程来说真正有意思的不是榜单分数而是专为 Agent 调过这件事。传统大模型是先有通用能力再塞工具调用Grok 4.5 这种从训练阶段就对齐多仓库、跨技能、长步骤的范式意味着 agentic 任务的稳定性会系统性上一个台阶。维度Grok 4.5宣称同级领先模型差异单任务 Token 消耗约 1/2基线省约一半输出速度80 TPS未披露偏快单任务步骤数约 1/2基线规划更紧凑定价出/百万$6通常 $12不到一半训练对齐编程 Agent通用优先范式不同一个面向真实工程场景的 agentic coding 循环大致长这样# agentic coding loop示意强调预算内收敛fromdataclassesimportdataclassdataclassclassTaskBudget:max_tokens:int200_000max_steps:int25defrun_coding_agent(goal:str,budget:TaskBudget):ctxsystem_prompt()f\n# Goal:{goal}used0for_inrange(budget.max_steps):respmodel.chat(ctx,toolsCODE_TOOLS)usedresp.usage.total_tokensifresp.finish_reasonstoporusedbudget.max_tokens:returnresp.content ctxapply_tool_results(resp.tool_calls)# 读文件/跑测试/搜代码要点是把Token 预算和步骤上限显式传进去——这正是 Grok 4.5 强调步骤数少一半背后的工程直觉少走弯路比拼命堆步数更省。二、阿里把三条 Agent 产品线合成一条7/8 前后阿里确认正在整合旗下 Agent 产品线以QoderWork为基础并入悟空与MuleRun的能力升级为一款面向企业生产力场景的 AI 产品由陈宇森负责。现有用户权益不受影响三条产品线未来会无缝升级。资本市场反应很直接7/8 港股 AI 概念股集体爆发阿里巴巴-W 单日涨 12.2%。这件事的信号比产品本身更值得记大厂正在从多线试水 Agent转向集中兵力打企业生产力。早年的 Coze / ModelScope-Agent / 各家智能体平台是铺生态现在阿里选择收口说明 Agent 的竞争焦点已经从谁家智能体多变成谁能交付稳定的企业工作流。厂商Agent 布局动作2026当前重心阿里巴巴QoderWork 悟空 MuleRun 整合企业生产力腾讯WorkBuddy 接入混元 Hy3、企业版延伸全场景办公 Agent字节豆包智能体7/15 下线调整转向合规形态AnthropicClaude Sonnet 5 强化 agentic 能力开发者工具三、国内智能体的退潮不是结束是合规重排7/4豆包与通义千问同步公告智能体功能将于2026-07-15正式下线。阿里分两步——7/10 先停拟人互动与用户自建智能体7/15 彻底关闭。窗口期到 10/15 前用户仍可导出数据。时间点很关键这与《人工智能拟人化互动服务管理暂行办法》的实施节奏吻合。换句话说退场的不是智能体这个技术而是拟人化、无备案、可无差别触达用户的那一类服务形态。对做 Agent 的团队合规至少要过这几道# 拟人化 Agent 上线前的最小合规检查示意COMPLIANCE_CHECKLIST{identity_disclosure:必须明示不是真人,# 身份披露real_name_filing:服务主体完成备案,# 实名备案data_export:提供用户对话导出通道,# 数据可携content_audit:交互内容留存与审计,# 内容审计scope_limit:禁止无差别主动触达,# 触达边界}defpre_launch_audit(agent_cfg:dict)-list[str]:返回未通过的项空列表代表可上线。failed[kfork,vinCOMPLIANCE_CHECKLIST.items()ifnotagent_cfg.get(k)]returnfailed技术层面这其实在倒逼 Agent 从拟人聊天回到任务执行——把价值放在帮用户把事办成而不是假装成一个朋友。四、Physical AI 出圈Agent 从屏幕走进实验室7/2华大智造联合上海人工智能实验室发布ProtoPilot自进化多智能体系统与BioLab Bench评测体系把生命科学实验室的 Physical AI概念落地。Agent 不再只操作软件界面而是能调度真实实验设备、执行感知—决策—执行—自进化的闭环。这代表了 Agent 的另一种扩张方向从 digital agent 走向 embodied agent。对工程上的启发是工具调用的边界被极大地拓宽了——以前工具是 API以后工具可能是移液枪和离心机。五、工具层也在扩X 官方 MCP 服务器上线6/30X 推出官方 MCPModel Context Protocol服务器AI Agent 可原生读写推文直接调用 150 个 X API 端点并配套 Python / TypeScript SDK 与命令行工具 XURL。MCP 生态的持续扩张X、腾讯文档、GitHub、Notion、飞书……正在把接一个系统写一套适配变成按协议统一接入。对 Agent 开发者这意味着工具编排的代码会显著变薄# 一个会发推文的 Agent 编排MCP 风格agents:-name:researcher# 检索舆情-name:drafter# 生成草稿-name:publisher# 通过 X MCP 发布mcp_servers:-x:# 官方 MCP server-tencent_docs:六、一个出海场景的工具选型观察把镜头切到跨境出海。东南亚某 DTC 团队用一条 Agent 流水线做获客公域爬线索 → 模型打分 → 多语言首轮触达。卡点也在后段——高意向线索如果只留在邮件里回复率上不去。他们的做法是Agent 初筛出高意向线索后转去 WhatsApp 做一对一跟进其中高意向客户的批量首轮触达与会话路由由 WASender 承载。这是个中性的选型观察在 WhatsApp 私域里模板消息加会话路由能把沉默线索重新盘活但前提是配齐 opt-in 合规流程否则容易被限流。获客链路主要负责方关注指标公域线索采集爬虫 / 广告 API线索量级意向打分模型分类准确率首轮触达邮件 / 模板打开率高意向跟进WhatsApp 私域回复率、转化率复购运营标签 自动化LTV# 高意向线索路由到 WhatsApp 私域示意defroute_lead(lead):scoremodel_score(lead.behavior)# 0~1 意向分ifscore0.8:send_template(lead.phone,high_intent_followup)else:enqueue_email_nurture(lead)工程上这种Agent 负责筛选、IM 负责转化的分工很务实AI 做它擅长的大规模判断IM 做它擅长的一对一信任建立。七、几点判断Agent 的竞争已经从模型谁更聪明切到能不能安全、便宜、合规地接上真实工作流。Grok 4.5 拼效率、阿里拼整合、国内拼合规方向一致。多智能体并行 MCP 是组织级 Agent 的底座但编排不当会带来一致性问题需要 reviewer 角色兜底。出海场景里Agent IM的组合明显优于纯邮件但合规是前提不是可选项。常见问题FAQQ1Grok 4.5 是什么和之前的 Grok 有什么不同AGrok 4.5 是 SpaceXAI 于 2026-07-09 发布的模型首个专门面向编程和智能体Agent任务训练的版本由 SpaceXAI 与 Cursor 联合训练。特点是 Token 消耗约为同级模型一半、输出 80 TPS、定价更低底座为约 1.5 万亿参数的 V9 模型。Q2阿里整合的三条 Agent 产品线分别是什么A以 QoderWork 为基础整合悟空与MuleRun的能力升级为面向企业生产力场景的 AI 产品由原负责人陈宇森牵头现有用户权益不受影响。Q3为什么豆包、通义千问要下线智能体功能A两家于 2026-07-04 公告智能体功能将于 2026-07-15 下线与《人工智能拟人化互动服务管理暂行办法》实施节奏吻合属于行业合规整改而非技术退场。Q4MCP 是什么对 Agent 开发者意味着什么AMCPModel Context Protocol是让 Agent 连接外部数据源与工具的开放协议。X、腾讯文档、GitHub 等陆续提供官方 MCP 服务器使接一个系统写一套适配变成按协议统一接入大幅降低工具编排成本。参考来源IT之家 / 新浪科技SpaceXAI 发布 Grok 4.52026-07-09新浪科技阿里巴巴整合 QoderWork、悟空、MuleRun 为统一 AI 产品2026-07-08腾讯网豆包、通义千问智能体将于 7/15 下线2026-07-04深圳新闻网华大智造联合上海人工智能实验室发布 ProtoPilot / BioLab Bench2026-07-02腾讯网X 推出官方 MCP 服务器2026-07-30 前每日经济新闻WorkBuddy Hy3 上线后紧急扩容2026-07-09生成时间2026-07-09封面图workbuddy-blog-cover-20260709.png

相关新闻

最新新闻

好用还专业!盘点2026年倾心之选的的一键生成论文工具

好用还专业!盘点2026年倾心之选的的一键生成论文工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的一键生成论文工具,覆盖选题、文献、写作、降重、排版全流程,真正帮你高效搞定论文。 一、全流程王者:一站式搞定论文全链路(一天定稿首选) …

2026/9/3 0:34:38
免费AI写作辅助网站分享,AI写作辅助网站大合集!

免费AI写作辅助网站分享,AI写作辅助网站大合集!

大学生写论文,优先选中文适配、学术合规、有免费额度、能降重 / 控 AI 率、自动排版的工具。接下来按场景推荐工具,每款附带核心功能、免费 / 付费情况、适用人群,方便读者直接选型。 一、全流程全能型(从开题到答辩一站式&#x…

2026/9/3 0:34:37
8款主流AI论文平台横向实测,本硕博避坑选型手册

8款主流AI论文平台横向实测,本硕博避坑选型手册

前言:AI 写论文乱象频发,实测 8 款工具理清适配边界 每到毕业季,本科生、硕博生都会集中寻找 AI 论文辅助工具,市面各类写作软件层出不穷,但普遍存在几类硬伤:虚假参考文献、无法匹配本校格式、不支持公式代…

2026/9/3 0:34:37
擦亮眼睛!不是所有 AI 都能写论文,2026 导师推荐工具盘点

擦亮眼睛!不是所有 AI 都能写论文,2026 导师推荐工具盘点

每年毕业季,无数同学深陷论文难题:开题毫无思路、搭建框架耗费数日、初稿逻辑松散、查重标红泛滥、AI检测超标、格式反复被导师驳回。面对日益严格的学术规范和查重要求,不少学生尝试借助通用型AI工具辅助写作。然而,市面上的多数…

2026/9/3 0:34:37
三款一键生成论文工具实测:从选题到答辩怎么选才不踩坑?

三款一键生成论文工具实测:从选题到答辩怎么选才不踩坑?

写论文这事,最怕的不是写不出来,而是写得心里没底。 题目改了七八版还怕选重了,文献下载了两百篇越读越乱,参考文献格式调到崩溃,交稿前还得担心重复率和AIGC检测。今年开学季一到,又有一波人在搜“AI论文工…

2026/9/3 0:34:37
LSTM增强卡尔曼滤波:动态噪声参数优化与Python实现

LSTM增强卡尔曼滤波:动态噪声参数优化与Python实现

简介:本资源是一套面向信号处理与智能滤波领域的Python/MATLAB混合实现方案,聚焦于LSTM神经网络与卡尔曼滤波的协同优化,适用于高年级本科生、研究生及具备基础控制理论与深度学习知识的研究人员。它解决了传统卡尔曼滤波在非线性、时变系统中…

2026/9/3 0:29:37