Kimi K3重磅发布!2.8万亿参数,碾压开源阵营? K3本身的硬参数先对齐月之暗面2026年7月17日凌晨发布Kimi K32.8万亿总参数基于KDAKimi Delta Attention混合线性注意力与AttnRes构建原生视觉理解、100万token上下文896个MoE专家激活16个整体扩展效率较K2提升约2.5倍。官方明确整体表现仍落后于Claude Fable 5与GPT-5.6 Sol但在开源阵营与多数代码/前端评测中居前完整权重2026年7月27日前发布。API定价国内开放平台缓存命中输入2元/百万tok、未命中20元、输出100元/百万tokK3默认reasoning_effortmax兼容OpenAI SDK。现在Kimi不止一个聊天框。kimi.com、Kimi App、Kimi Work、Kimi Code、API都能调用K3但能触达的资料、适合的任务、需要承担的权限风险完全不同。网页Agent第一次用K3从这里开始kimi.com和App里的Agent入口不需要装客户端、不碰本地文件。给它链接明确指令它调搜索、抓取、Python、记忆等工具5—20分钟出事实表/大纲/单页HTML。建议第一轮只做事实整理不直接写正文请根据提供的官方链接整理事实表只使用这些链接不自行补充未确认来源。事实表包含日期、主体、动作、关键数据、原始链接、可信度。冲突项进待核验不替我猜结论。本轮只交付事实表和文章大纲。验收三件事——实际访问了哪些URL、数字能否回溯原页、冲突是否标记。资料量大时拆成事实→判断→成稿三轮避免128K工作上下文被正文挤爆。K3原生支持图片、PDF/Word/Excel等多模态输入处理长文档和办公任务是它被设计出来的主场景之一。Kimi Work本地文件授权要从最小开始Work是桌面端Agent3.1.0可读授权目录、跑Python/Shell、通过WebBridge用本机浏览器登录态操作网页支持定时任务。能力涨了权限半径也涨了。第一次使用不要直接把整个工作目录交给它新建一个test/文件夹只放几份不敏感PDF明确限制“只读取授权目录不要移动/改名/删除/覆盖原文件提取公司名/报告期/关键数字每条标注文件名和页码存local-facts.md”抽三条回原文件核对文件名页码数字WebBridge虽在本机跑但页面文本会进上下文——客户名单、财务表、内部系统仍按敏感数据对待发帖、下单、付款、删文件做到确认页最后一下人点。Kimi Code先只读诊断再谈改代码终端kimi启动/login后/model切K3Moderato档可用Allegretto解锁1M上下文。K3在Kimi Code里模型ID就是k3支持low/high/max三档思考强度。别开头就让它与改写业务代码第一步下只读检查指令分析目录结构、受影响模块、风险点、验证方式不修改任何文件人确认方案后再让其修改、跑测试构建、列改动文件与残留风险验收不看生成行数看四项测试/构建是否真跑过、关键交互是否可用、数据能否回原始输入、有无顺手改无关文件。高权限跳过确认模式新手别开。K3具备长周期编码能力——极少人工监督下可持续完成长时间工程任务、理解大型代码库、协调终端工具但这是工程边界不是放手让它改的代名词。API接系统才碰先跑通再谈生产前面三个入口够用就别先写代码。API层要自己管密钥走环境变量别硬编码、超时、重试、限流、日志、费用。最小Python示例fromopenaiimportOpenAIimportos clientOpenAI(api_keyos.environ[MOONSHOT_API_KEY],base_urlhttps://api.moonshot.cn/v1)rclient.chat.completions.create(modelkimi-k3,messages[{role:user,content:用一句话介绍Kimi K3}])print(r.choices[0].message.content)能回不代表能上生产——K3默认max思考、输出100元/百万tok是真实账单长程Agent循环里成本会快速累积。接业务前按官方定价重算一轮别把发布当日报价当合同。四个入口怎么选搜网页、写报告、做单页 →网页Agent看来源可追溯性读本地PDF、整理目录、定时汇总 →Kimi Work看授权目录与敏感隔离读代码库、改功能、跑测试 →Kimi Code看改动范围与审批接自有产品、自动化 →API看密钥、成本、重试、上下文顺序建议网页Agent验证任务 → 稳定流程再迁Work/Code/API。别因入口更专业就默认更适合你。任务说明书与验收闭环Agent能调工具后一句帮我做一下不够用。落得下来的任务写清六段目标 / 背景 / 输入含冲突优先级/ 过程含何时暂停询问/ 交付格式位置/ 验收必过测试、必引来源、禁出现错误。收尾五项检查事实回源、数据完整、文件可编辑留存、代码构建真过、删/付/发/发消息留人工确认。AI能把任务启动起来不稀奇能按模板收尾、可检查可回滚才算进工作流。假如你从2026年开始学大模型按这个步骤走准能稳步进阶。接下来告诉你一条最快的邪修路线3个月即可成为模型大师薪资直接起飞。阶段1:大模型基础阶段2:RAG应用开发工程阶段3:大模型Agent应用架构阶段4:大模型微调与私有化部署配套文档资源全套AI 大模型 学习资料朋友们如果需要可以微信扫描下方二维码免费领取【保证100%免费】配套文档资源全套AI 大模型 学习资料朋友们如果需要可以微信扫描下方二维码免费领取【保证100%免费】

相关新闻

最新新闻

在 Java 中,NIO中Channel(通道)和传统 IO 的 Stream(流)有什么区别?以及NIO和Netty的区别?

在 Java 中,NIO中Channel(通道)和传统 IO 的 Stream(流)有什么区别?以及NIO和Netty的区别?

传统 IO 的 Stream 和 NIO 的 Channel 的区别① 单向 vs 双向 (Directionality)Stream(流)是单向的:如果你想读文件,必须创建 FileInputStream。如果你想写文件,必须创建 FileOutputStream。水流只能朝一个方向流动。C…

2026/7/23 19:45:36
计算机毕业设计之基于c#的第三方仓库管理系统

计算机毕业设计之基于c#的第三方仓库管理系统

随着网络科学技术不断的发展和普及化,用户在寻找适合自己的信息管理系统时面临着越来越大的挑战。因此,本文介绍了一套第三方仓库管理系统,在技术实现方面,本系统采用Net、HTML、CSS、JS以及SQL Server数据库编程,使用…

2026/7/23 19:45:36
使用vLLM高效部署Gemma-4-31B-it大模型

使用vLLM高效部署Gemma-4-31B-it大模型

1. 项目概述Gemma-4-31B-it作为Google最新开源的大语言模型,在开源社区引起了广泛关注。这个31B参数规模的模型在多项基准测试中表现优异,但真正要发挥其威力,需要解决从模型部署到应用接入的全链路问题。本文将详细记录我如何通过vLLM高效部…

2026/7/23 19:45:36
DecoTV:构建个性化跨平台影视聚合站的完整指南

DecoTV:构建个性化跨平台影视聚合站的完整指南

DecoTV:构建个性化跨平台影视聚合站的完整指南 【免费下载链接】DecoTV 基于最新版LunaTV二次开发的一个开箱即用的、跨平台的影视聚合播放站。【原KatelyaTV】 项目地址: https://gitcode.com/gh_mirrors/de/DecoTV 在数字娱乐需求日益增长的今天&#xff0…

2026/7/23 19:45:36
树莓派OpenWrt软路由实战:用Cloudflare API实现动态DNS+15年免费SSL证书

树莓派OpenWrt软路由实战:用Cloudflare API实现动态DNS+15年免费SSL证书

树莓派OpenWrt软路由实战:用Cloudflare API实现动态DNS+15年免费SSL证书 在智能家居和自建服务日益普及的今天,越来越多的技术爱好者选择用树莓派搭建OpenWrt软路由来实现更灵活的网络控制。但动态公网IP管理和长期稳定的SSL证书始终是两大痛点。本文将带你用Cloudflare API…

2026/7/23 19:45:36
软路由小白必看:OpenWRT旁路由在ESXi下的完整配置流程(含固件转换技巧)

软路由小白必看:OpenWRT旁路由在ESXi下的完整配置流程(含固件转换技巧)

软路由入门指南:ESXi虚拟机中部署OpenWRT旁路由的完整实践 对于刚接触软路由的新手来说,将OpenWRT配置为旁路由可能是最安全稳妥的入门方案。不同于直接替代主路由的高风险操作,旁路由模式允许你在保留原有网络结构的同时,逐步探索OpenWRT的强大功能。本文将手把手带你完成…

2026/7/23 19:40:36

月新闻