目录
Kimi 写完之后,是不是这样?
读长资料、改代码,Kimi 一口气就做完了。可是在那之后,发生的是这些。
长资料的要点出来了,会上定下的事却埋在另一份笔记里。
修改已经提交。评审请求和给客户的通知,还没有人写。
负责人和期限都是口头定的。最后去确认的,总是自己。
读和写,Kimi 一口气就完成。工作能不能推进,取决于写完之后。
其实,你想要的是这样:Kimi 写完之后
同一场会议,同一个 Kimi。你希望写完的那一刻,就已经是这样。
阅读和代码照旧用 Kimi。已定的修改、负责人和期限,已经排好了。
评审请求和给客户的进度同步,已经用你的口吻准备好。
等回复、等评审的工作,SIMY 会在下次会议前先提醒你。
“要不要本周发布”。回到你这里的,只有这一个问题。
这些会从你把会议和聊天接入 SIMY 后的下一场会议开始发生。Kimi 照旧做它擅长的事。
Kimi 的回答,停在这里
Kimi 擅长的是“读、写被要求的东西”。再往后,没有人接手。
- 提问你来要求
- 长文阅读整份资料
- 代码、草稿Kimi Code 也行
- 负责人与期限
- 评审请求
- 进度同步
- 下次之前的确认
※ 流程仅为示意
不管是 Kimi 聊天、API 还是 Kimi Code,都停在同一个地方。回答可以要多少次都行。但每次“开口要”的是你,去查有没有做完的也是你。
SIMY 接上后半程。Kimi 照旧,写完之后交给它
原本空着的 4 格,由 SIMY 填上。回到你手上的,只有判断那一格。
- 提问
- 长文阅读
- 代码、草稿
- 负责人与期限从会议中拾取
- 评审请求批准后发布
- 进度同步在 Gmail 存为草稿
- 判断只回来一个问题
※ 流程仅为示意
- 从会议和聊天中接活
- 按你的做法
- 只把判断交给你
SIMY 会自己从会议记录和聊天里找出“之后的工作”。它从对话中学习你反复使用的步骤和确认事项,按同样的做法推进,并把完成情况列在 My Actions 中。
- 注册 SIMY,连接 ChatGPT(Codex)SIMY 的云端执行使用你的 ChatGPT 账户。Codex 的用量在你的 ChatGPT 方案范围内。
- 安装 SIMY 桌面应用可以让电脑上的 Claude Code 担任 SIMY 的执行者。SIMY 会从 Claude Code 和 Codex 的对话中,把你反复做的工作整理成“来自 SIMY 的提议”。对话正文不保存到服务器。 点此下载
- 接入会议记录在集成页面连接 Plaud、Notion 等。用 Kimi 整理的要点,贴到会议或聊天里,SIMY 也会拾取。
※ SIMY 画面示意
SIMY 与 Kimi 的关系:目前 SIMY 不接入 Kimi。SIMY 本身通过你的 ChatGPT(Codex)账户和电脑上的 Claude Code 运行。阅读、草稿、代码照旧交给擅长这些的 Kimi,把结果带进会议或聊天,之后的事由 SIMY 推进。
用一场会议对比:Kimi 的梳理,与 SIMY 完成的下一步
这是用 Kimi 梳理一场 45 分钟、围绕支付页面改版的设计评审的示例。左边是 Kimi,右边是 SIMY。
- 结论
- 把银行卡输入框换成新的支付 SDK。旧页面并存 1 个月。
- 影响范围
- 下单确认 API、收据邮件、后台退款处理,共 3 处。
- 未决事项
- 本周末发布,还是下周例会后发布。
- 待办
- 申请测试环境的密钥,通知客户切换日期。
替换 SDK:张伟,10/6。确认退款处理:李娜,10/7。申请测试密钥:基础设施组,10/3。
“这是替换支付 SDK 的 PR,请重点看对退款处理的影响。”批准后发到聊天群。
切换日期的候选,以及旧页面保留 1 个月,用你一贯的行文方式写好,存入 Gmail 草稿。
本周末发布,还是推到下周。只有需要判断的地方,才会回到你手上。
Kimi 负责读和写,SIMY 负责推进。发不发布,依然由你决定。
按行业:Kimi 的用法,与 SIMY 的产出
用 Kimi 读完、写完之后,SIMY 会准备什么。个人也好,团队也好,套路都一样。
开发团队 Kimi:Kimi Code、代码生成
- 设计评审会议→已定修改项与负责人清单
- 写完代码之后→评审请求文案
- 每周结束时→进度与待判断事项汇总
调研 Kimi:阅读长资料
- 研读报告→会上采用的要点与负责人
- 调研结果汇报会→追加调研的请求文案与期限
- 截止之前→等待回复事项的提醒
咨询与策划 Kimi:提案书初稿
- 与客户开会→待办清单、感谢邮件草稿
- 内部策划会议→采用的方案、负责人与截止日期
- 提案前一天→待确认清单和一个待判断的问题
管理层会议与 1on1 Kimi:资料摘要、要点梳理
- 管理层会议→决定事项与负责人清单、同步给相关人员
- 1on1→不用问“那件事怎么样了”,进度和待判断事项已备好
- 每周结束时→汇总多场会议的周报
上手:Kimi 照旧,3 个步骤
- Kimi 照常使用阅读、草稿、代码。Kimi 聊天、API、Kimi Code 都可以。
- 注册 SIMY,连接 ChatGPT,安装 simy云端执行使用你的 ChatGPT(Codex)。连接方法见上文。在用 Claude Code 的人,也装上 SIMY 桌面应用。 点此下载
- 开完一场会议负责人与期限、请求文案、分享草稿会送到你面前。决定,然后发送。仅此而已。
注册流程:选择方案 → 邮箱验证 → 银行卡付款(没有免费方案)。查看价格/电脑端应用见下载页面。
Kimi 的用法不变。SIMY 不是 Kimi 的替代品,而是另一套负责写完之后工作的机制。
Kimi 是什么、Kimi K3 是什么:用法、API、Kimi Code、数据处理(供想深入了解的人)
以下内容,在你想确认 Kimi 本身的情况时再展开。模型名称和规格为 2026 年 10 月的信息。
Kimi 是什么:出自哪个国家(月之暗面)中国北京的月之暗面(Moonshot AI)开发的 AI
Kimi 的开发方
Kimi 是中国北京的 AI 公司月之暗面(Moonshot AI)开发的聊天 AI 和大语言模型(LLM)系列。面向中国的 Kimi 由北京的法人运营,面向海外的 API(Kimi Open Platform)由新加坡法人 MOONSHOT AI PTE. LTD. 提供。
三种用法
- Kimi 聊天:在 kimi.com 和手机应用里对话使用。可以免费开始,也有付费会员方案。
- API:通过 Kimi Open Platform 接入自家系统或开发工具。按用量付费。
- 开放权重:把 Hugging Face 上公开的模型权重放在自家服务器上运行。有许可证条件。
Kimi 的特点
特点是能一次处理很长的上下文,并且编程工具齐全。最新的 Kimi K3 支持 100 万 token 上下文,除了文字还能输入图像和视频。在终端中运行的 Kimi Code CLI 也已公开。
搜索“Kimi”时,也会出现 F1 车手安德烈亚·基米·安东内利等同名话题。本页讲的是月之暗面的 Kimi。
Kimi 聊天怎么用:网页与应用可免费开始。成为会员后用量额度增加
- 打开 kimi.com。浏览器即可使用。也有手机应用。
- 登录。创建账户后,对话历史会保留下来。
- 开始对话。可以用中文提问。附上 PDF 或图片,让它“把要点做成表格”“解释一下这张图”。
- 一次交给它多份长资料。一次读入多个文件,进行对比或总结,是 Kimi 的拿手好戏。
付费会员方案
Kimi 的付费会员采用积分制,官方帮助中介绍了按月计费的 4 档方案(截至 2026 年 10 月)。每档方案都能使用 Kimi K3,并附带 Kimi Code 的用量额度。价格的显示因地区和币种而异,请在官方会员方案页面确认。
工作中使用的诀窍
- 先写想问的,再让它读:像“只把这份合同里的解约条件和违约金摘出来”这样先说明目的,即使资料很长,回答也不容易跑偏。
- 追问出处:摘要里的数字和条件,先问一句“写在第几页的哪里?”确认后再用。
- 每个项目分开对话:可以避免回答被之前的资料带偏。
把这样得到的要点变成“谁、在什么时候之前、做什么”并持续跟进,是 Kimi 之外的工作。如果这部分每次都是你自己在做,请看看 SIMY 的连接方法。
Kimi 能做什么:工作中的用途长资料、多个文件、代码。从擅长的场景开始试
- 阅读长资料:把合同、需求文档、调研报告等长资料一次读完,摘出条件和要点。
- 对比多份资料:交给它好几份报价单或提案书,把差异整理成表。
- 理解图像和视频:给它看界面截图、图表或短视频,让它说明内容。
- 编程:在 Kimi Code 或编辑器中,把读代码、改代码、补测试交给它。
- 草稿:写报告、邮件、会议笔记的初稿。
试用的顺序
一开始,选一份手头的长资料,请它“列出这份资料里必须做决定的 3 件事”,就容易体会 Kimi 擅长的场景。熟悉之后,再扩展到多份资料的对比和代码工作。
无论哪种用途,Kimi 给出的都只到“回答”或“草稿”为止。据此在会上定下的负责人、期限和对相关人员的通知,由 SIMY 从会议和聊天中拾取并推进。
Kimi K3 是什么:与 K2 的区别和主要模型2026 年 10 月。名称和代际变化频繁
Kimi K3 是 2026 年 7 月发布的 Kimi 最新一代模型(截至 2026 年 10 月)。总参数 2.8 万亿,每次处理只用其中的 1,040 亿,属于 MoE 架构(在擅长领域不同的小模型之间切换使用的结构)。支持 100 万 token(token 是大致对应字数的单位)上下文,以及文本、图像、视频输入。
表格可以横向滚动 →
| 模型 | 定位 | 许可证 |
|---|---|---|
| Kimi K3 | 最新主力。长上下文,图像和视频输入,智能体式的工作 | Kimi K3 License(专有) |
| kimi-k2.7-code | 专注编程的 K2 系列模型。API 单价比 K3 低(每百万 token 输入 0.95 美元、输出 4.00 美元,不含税) | 通过 API 提供 |
| Kimi K2.6 及更早 | 上一代。至今仍通过 API 和开放权重被使用 | Modified MIT |
用 K3 还是 K2
- K3:想让它读长资料、同时处理图像和视频、承担复杂工作时。
- K2 系列:想低成本大量生成代码时。K2.6 及更早的公开模型,许可证条件也比 K3 宽松。
怎么记名字:Kimi 的模型名每几个月就变一次。按“最新主力(K3)”“面向编程、便宜(k2.7-code)”的定位记住就够了。
Kimi Code CLI:在终端中运行的编程智能体开源(MIT)。也能用会员方案的额度
Kimi Code CLI 是月之暗面以 MIT 许可证开源的编程智能体。它在终端中运行,能读代码、改代码、执行命令。支持 MCP(与外部工具和数据连接的通用机制),也能通过 ACP(从编辑器调用智能体的机制)在 Zed、JetBrains 等编辑器中使用。之前 Python 版的 kimi-cli 已归档,由它取代。
- 安装:除了官方安装脚本,也能用 npm 安装。步骤见 GitHub 页面。
- 登录:启动后执行
/login,选择 Kimi Code 账户或 Kimi Open Platform 的 API Key。会员可以使用方案内的额度。 - 适合谁:想用 Kimi 的模型,尝试与 Claude Code、Codex 相同用法的开发者。
上手流程
- 在要工作的文件夹里启动 Kimi Code。首次启动时选择登录方式。
- 用中文说出你想做的事。像“说明一下这个仓库的结构”“修好失败的测试”这样,从目的出发提要求。
- 确认后再接受修改。改写文件、执行命令,都要看过内容再允许。
用 Kimi Code 写完代码之后,评审会议上定下的修改和分工,由 SIMY 从会议中拾取并列成清单。
Kimi 的 API:兼容 Anthropic,也能从 Claude Code 调用兼容 OpenAI 和 Anthropic。价格按每百万 token 的美元计
- 入口:在 Kimi Open Platform(platform.kimi.ai)创建 API Key。提供方是新加坡的法人。
- 兼容性:有兼容 OpenAI 和兼容 Anthropic 的端点。可以替换 OpenAI 的 SDK,或以 Anthropic 格式通信的工具的接入地址来使用。
- 从 Claude Code 使用:把 Claude Code 的接入地址(
ANTHROPIC_BASE_URL)和 API Key 换成 Kimi 的,就能在 Claude Code 界面里调用 Kimi 的模型。官方文档中有步骤说明。 - 价格:截至 2026 年 10 月,Kimi K3 每百万 token 输入 3.00 美元、输出 15.00 美元(不含税)。复用相同前缀的缓存,读取只需 0.30 美元,写入按保留时长另行计费。最新单价请在官方价格页面确认。
开始使用 API 的步骤
- 创建 Kimi Open Platform 账户。在控制台设置充值和付款方式。
- 创建 API Key。把 Key 放进环境变量,不要直接写在代码或共享文档里。
- 修改常用工具的接入地址。选择 OpenAI 格式或 Anthropic 格式,替换 URL 和模型名称。
- 先小规模试用,观察用量。长上下文会消耗大量 token。先确认每天的用量,再扩大到正式规模。
与 SIMY 的关系:目前 SIMY 不接入 Kimi 的 API Key。SIMY 的云端执行使用你的 ChatGPT(Codex)账户。
开放权重与许可证:K3 附带条件不要笼统地称为“开源”
Kimi K3 的模型权重已在 Hugging Face 公开,但许可证是专有的“Kimi K3 License”。可以使用、修改和再分发,但附有与业务规模相关的条件。
- 提供模型服务的业务:把 K3 作为服务提供、且最近 12 个月收入超过 2,000 万美元时,需要与月之暗面另签商业合同。
- 大型产品:月活用户超过 1 亿或月收入超过 2,000 万美元的产品,需要在界面上标示“Kimi K3”。
- K2.6 及更早:采用 Modified MIT 许可证,条件比 K3 宽松。
对多数公司来说,在内部使用的范围内,这些条件不太会构成大的限制。但如果要集成到产品中,请确认许可证原文。
Kimi 能在本地运行吗:Ollama 上是 cloud 标签“能在 Ollama 上用”不等于“在自己电脑上运行”
Ollama 官方模型库里的 kimi-k3、kimi-k2.7-code、kimi-k2.6,截至 2026 年 10 月都是“cloud”标签。这表示它们运行在 Ollama 的云端,模型并不是在你自己的电脑上运行。输入会发送到 Ollama 的服务器。
- 在自家服务器上运行:可以用 vLLM 或 SGLang 运行公开的权重。K3 是 2.8 万亿参数的大规模结构,面向以多块高性能 GPU 为前提的服务器。
- 想在个人电脑上运行:Kimi 的最新模型并不现实。如果要找能在本地运行的中国模型,Qwen 的中小规模模型等是可选项。
如果目的是“不让数据外流”,带 cloud 标签的模型并不符合。请在自家服务器上运行权重,或选择能在本地运行的规模的模型。
在公司使用时的判断:数据存储位置与训练入口不同,数据的去向也不同
表格可以横向滚动 →
| 用法 | 运营、提供方 | 数据存储位置 | 是否用于训练 |
|---|---|---|---|
| Kimi 聊天(官方帮助的中文说明) | 北京的法人 | 中国境内的服务器 | 可能匿名化后用于训练。向客服申请可停止(5 至 7 个工作日) |
| API(Kimi Open Platform) | MOONSHOT AI PTE. LTD.(新加坡) | 新加坡的服务器 | 有将输入用于“模型优化”的表述。具体处理请看原文 |
| 自行部署开放权重 | 自家公司 | 只在自家服务器内 | 不外流 |
- 先确认公司规定:有些公司的生成式 AI 使用规定,限定了可用的服务和可以输入的信息。
- 从不同地区使用聊天时:适用的条款和存储位置,请在登录后的界面和帮助中确认。上表是对官方说明的直接概括。
- 原则上不输入机密:无论哪个聊天 AI,输入客户信息或未公开数字之前都要三思。
- 也要看合作方的要求:有些合作方会在合同中对数据存储所在国家设定条件。
数据处理依据 2026 年 10 月 1 日时Kimi 数据使用说明和 Kimi Open Platform 隐私政策的内容。SIMY 的数据处理方式公开在安全和隐私政策中。
Kimi 的语言能力:能用到什么程度可以用中文提要求,但官方未写明支持语言
Kimi 聊天可以用中文、英文等语言对话并得到回答。不过截至 2026 年 10 月,K3 的模型卡没有写明支持的语言。各语言的质量并没有官方保证,请用实际业务中的文档试用确认。
- 容易试的:总结中文资料,把英文资料整理成中文,用中文询问代码的含义。
- 需要留意:专有名词、行业术语、法规和商业惯例的描述,请核实后再使用。
想小规模试用,可以拿一份自己以前写的报告,请它做摘要并润色措辞。原文你很熟悉,更容易判断质量好坏。
可以这样分工:用 Kimi 读英文长资料,会上定下的负责人、期限和对内分享文案交给 SIMY。
与 ChatGPT、Claude 及其他中国 LLM 的区别不分好坏,擅长的地方不同
表格可以横向滚动 →
| 对比项 | Kimi | Qwen | MiniMax | DeepSeek | SIMY |
|---|---|---|---|---|---|
| 开发方 | 月之暗面(北京) | 阿里巴巴集团(杭州) | MiniMax(上海) | 深度求索 DeepSeek(杭州) | AwakApp Inc. |
| 擅长 | 长上下文、编程 | 多语言、本地部署 | 便宜的 API、视频和语音 | 推理与便宜的 API | 推进回答之后的工作 |
| 自家编程 CLI | Kimi Code | Qwen Code | MiniMax Code | 无 | 可让电脑上的 Claude Code 担任执行者 |
| 起点 | 你来要求 | 你来要求 | 你来要求 | 你来要求 | SIMY 从会议和聊天中拾取 |
怎么选
分工:给出回答和草稿的,可以是包括 Kimi 在内的任何 AI。之后的负责人、期限、请求、分享,如果每次都要你自己跟进,就是 SIMY 出场的时候。各家的区别整理在中国 LLM 对比中,字节跳动的模型见豆包指南。
常见问题
Kimi 是什么?
Kimi 是中国月之暗面(Moonshot AI)开发的聊天 AI 和大语言模型(LLM)系列。有三种用法:kimi.com 和应用里的聊天、API,以及公开的模型权重。
Kimi 是哪个国家的 AI?
中国的 AI。由北京的月之暗面(Moonshot AI)开发,面向中国的 Kimi 由北京的法人运营,面向海外的 API 由新加坡法人 MOONSHOT AI PTE. LTD. 提供。
Kimi K3 是什么?
Kimi K3 是月之暗面在 2026 年 7 月发布的最新一代模型(截至 2026 年 10 月)。支持 100 万 token 上下文,除文本外还能输入图像和视频,权重以专有的 Kimi K3 License 公开。
Kimi K3 和 Kimi K2 有什么区别?
K3 是支持长上下文和图像、视频输入的最新主力模型,以专有的 Kimi K3 License 公开。K2 系列是上一代,面向编程的 k2.7-code 的 API 单价比 K3 低。
Kimi 可以免费使用吗?
kimi.com 和应用里的聊天可以免费开始使用。有增加用量额度的付费会员方案,API 按用量计费。
Kimi Code 是什么?
月之暗面以 MIT 许可证开源、在终端中运行的编程智能体。用 Kimi Code 账户或 API Key 登录使用,也可以使用会员方案的用量额度。
能在 Claude Code 中使用 Kimi 的模型吗?
可以。Kimi 的 API 提供兼容 Anthropic 的端点,官方说明了替换 Claude Code 接入地址和 API Key 的步骤。
Kimi 能在本地(自己的电脑)运行吗?
在个人电脑上运行最新的 Kimi K3 并不现实。Ollama 官方模型库中的 Kimi 带 cloud 标签,运行在 Ollama 的云端。若要自行部署,需要在高性能 GPU 服务器上运行公开的权重。
输入 Kimi 的内容保存在哪里?
官方说明称,Kimi 聊天(中文帮助)的数据保存在中国境内的服务器,面向海外的 API 保存在新加坡的服务器。处理机密信息时,请确认公司规定和各项政策的原文。
Kimi 支持哪些语言?
可以用中文、英文等语言提问并获得回答。不过官方模型卡没有写明支持的语言,请先用实际业务文档确认质量再使用。
SIMY 用 Kimi 运行吗?
不是。目前 SIMY 不接入 Kimi,而是通过你的 ChatGPT(Codex)账户和电脑上的 Claude Code 运行。用 Kimi 整理的要点和写的代码,可以直接带进会议和聊天里。
Kimi 写完之后的工作,每次都要去拜托 SIMY 吗?
不用。SIMY 会自己从会议记录和聊天中找出已定事项、负责人和截止日期。它从对话中学习你的做法,只把需要判断的事交回给你。
参考资料
Kimi 的模型、计费方式、许可证和数据处理,依据以下官方信息确认(确认日期:2026 年 10 月 1 日)。模型名称和规格变化频繁,最新信息请以各官方页面为准。