1. SIMY
  2. 指南
  3. Qwen 使用指南

写给 Qwen(通义千问)用户的使用指南

别让 Qwen 的回答 停在 聊天框里。

翻译、摘要、代码,Qwen 都能又快又便宜地给出来。可“谁、在什么时候之前、做什么”,还留在你手里。接下来的部分,交给 SIMY 推进。

  • Qwen 照旧做它擅长的事
  • SIMY 从会议和聊天中接活
  • 用你的 ChatGPT(Codex)账户运行

※ 画面仅为示意

目录
  1. 回答之后,是不是这样?
  2. 其实,你想要的是这样
  3. Qwen 停在这里
  4. SIMY 接上后半程
  5. 用一场会议对比
  6. 按行业:Qwen 的用法与 SIMY 的产出
  7. 上手:3 个步骤
  8. Qwen 是什么、用法、API、安全性
  9. 常见问题
  10. 参考资料
01 / AFTER THE ANSWER

Qwen 给出回答之后,是不是这样?

翻译、摘要、草稿,Qwen 一瞬间就给出来了。可是在那之后,发生的是这些。

翻译完的第二天 该谁回复来着

英文会议记录译好了,待办和期限却埋在译文里,回复一拖再拖。

批量写草稿的那周 最后用了哪版?

用 API 生成了一大堆方案,定下来的事却散落在聊天和文件里。

本地部署的那个月 只有自己变快

用 Ollama 跑 Qwen,手头快了。会上定下的请求,还停在自己的笔记里。

给出回答,Qwen 一瞬间就完成。工作能不能推进,取决于回答之后。

02 / WHAT YOU REALLY WANTED

其实,你想要的是这样:Qwen 回答之后

同一场会议,同一个 Qwen。你希望回答出来的那一刻,就已经是这样。

会议一结束 负责人和期限已列好

翻译和摘要照旧用 Qwen。已定事项、负责人和期限,已经排好了。

截止之前 卡住的事先送到

等回复、快到期的工作,SIMY 会在下次会议前先提醒你。

不管用哪个 AI 结论集中在一处

采用的结论和下一步行动,跨模型、跨聊天,都留在一个地方。

回到你手上的 只有判断

“这次调价要不要接受”。回到你这里的,只有这一个问题。

这些会从你把会议和聊天接入 SIMY 后的下一场会议开始发生。Qwen 照旧做它擅长的事。

03 / WHERE QWEN STOPS

Qwen 的回答,停在这里

Qwen 擅长的是“回答被要求的事”。再往后,没有人接手。

※ 流程仅为示意

不管是 Qwen Chat、API 还是本地部署,都停在同一个地方。回答可以要多少次都行。但每次“开口要”的是你,去查有没有做完的也是你。

04 / CONNECT

SIMY 接上后半程。Qwen 照旧,回答之后交给它

原本空着的 4 格,由 SIMY 填上。回到你手上的,只有判断那一格。

※ 流程仅为示意

  • 从会议和聊天中接活
  • 按你的做法
  • 只把判断交给你

SIMY 会自己从会议记录和聊天里找出“之后的工作”。它从对话中学习你反复使用的步骤和确认事项,按同样的做法推进,并把完成情况列在 My Actions 中。

  1. 注册 SIMY,连接 ChatGPT(Codex)SIMY 的云端执行使用你的 ChatGPT 账户。Codex 的用量在你的 ChatGPT 方案范围内。
  2. 安装 SIMY 桌面应用可以让电脑上的 Claude Code 担任 SIMY 的执行者。SIMY 会从 Claude Code 和 Codex 的对话中,把你反复做的工作整理成“来自 SIMY 的提议”。对话正文不保存到服务器。 点此下载
  3. 接入会议记录在集成页面连接 Plaud 或 Notion。会议记录就是 SIMY 拾取工作的起点。

※ SIMY 画面示意

SIMY 与 Qwen 的关系:目前 SIMY 不接入 Qwen。SIMY 本身通过你的 ChatGPT(Codex)账户,以及经由 SIMY 桌面应用驱动电脑上的 Claude Code 运行。翻译、草稿、代码照旧交给 Qwen,会议上定下的事情的后续安排由 SIMY 负责。

05 / SAMPLE

用一场会议对比:Qwen 的翻译摘要,与 SIMY 完成的下一步

这是用部署在内部服务器上的 Qwen,翻译和总结与海外供应商一小时例会的示例。单价这类机密信息,不放进外部聊天服务,而在封闭环境中处理。左边是 Qwen,右边是 SIMY。

Qwen 的翻译与摘要(示例,内部服务器)英文 → 中文
概要
对方提出,从 11 月出货起把零部件采购单价上调 4%。
交期
第 2 批货因港口拥堵,预计延迟 1 周。
对方的请求
10 月 10 日前答复调价,并确认新的包装规格。
我方待办
重新安排质检团队的检验日程。
负责人与期限清单完成

答复调价:你,10/10。确认包装规格:采购,10/7。重排检验日程:质检,10/8。

回复邮件草稿Autorun

感谢对方告知调价,说明会在 10 月 10 日前答复,并请对方发来包装规格资料,用你一贯的行文方式写好,存入 Gmail 草稿。译成英文,也交给内部的 Qwen。

内部分享文案下一步

“第 2 批货将延迟 1 周,请重新安排检验日程。”批准后发布到聊天群。

你的判断轮到你

接受 4% 的调价,还是去谈判。只有需要判断的地方,才会回到你手上。

Qwen 负责翻译,SIMY 负责推进。谈判本身,依然是你大显身手的地方。

06 / BY INDUSTRY

按行业:Qwen 的用法,与 SIMY 的产出

用 Qwen 得到回答之后,SIMY 会准备什么。个人也好,团队也好,套路都一样。

外贸与采购 Qwen:外语会议的翻译与摘要

  • 与供应商的例会→负责人与期限清单、回复草稿
  • 价格或交期变更→内部分享文案、一个待判断的问题
  • 答复期限之前→等待回复事项的提醒

开发团队 Qwen:Qwen Code、本地 LLM

  • 设计评审会议→已定修改项与负责人清单
  • 写完代码之后→用电脑上的 Claude Code 做下一步
  • 每周结束时→进度与待判断事项汇总

市场与内容 Qwen:用 API 批量写草稿

  • 策划会议→采用的方案、负责人与截止日期
  • 草稿评审→汇总修改点的请求文案
  • 发布之前→待确认清单和一个待判断的问题

管理层会议与 1on1 Qwen:资料摘要、要点梳理

  • 管理层会议→决定事项与负责人清单、同步给相关人员
  • 1on1→不用问“那件事怎么样了”,进度和待判断事项已备好
  • 每周结束时→汇总多场会议的周报
07 / START

上手:Qwen 照旧,3 个步骤

  1. Qwen 照常使用翻译、摘要、草稿、代码。Qwen Chat、API、本地部署都可以。
  2. 注册 SIMY,连接 ChatGPT云端执行使用你的 ChatGPT(Codex)账户。如果你在用 Claude Code,也装上 SIMY 桌面应用。连接方法见上文。
  3. 开完一场会议负责人与期限、回复草稿、分享文案会送到你面前。决定,然后发送。仅此而已。

注册流程:选择方案 → 邮箱验证 → 银行卡付款(没有免费方案)。价格见价格页面,电脑端应用见下载页面。

Qwen 的用法不变。SIMY 不是 Qwen 的替代品,而是另一套负责回答之后工作的机制。

08 / REFERENCE

Qwen 是什么:用法、模型、API、本地部署、安全性(供想深入了解的人)

以下内容,在你想确认 Qwen 本身的情况时再展开。模型名称和规格为 2026 年 10 月的信息。

Qwen 是什么:名称与出自哪里通义千问。中国阿里巴巴集团开发

Qwen 的名称

Qwen 是“通义千问(Tongyi Qianwen)”的简称和英文名。它既是聊天 AI 的名字,也指能处理文本、图像、语音、代码等的整个大语言模型(LLM)系列。

出自哪个国家

Qwen 是中国的 AI,由阿里巴巴集团的 Qwen 团队开发。国际版 Qwen Chat(chat.qwen.ai)由新加坡法人 Alibaba Cloud (Singapore) 提供,隐私政策说明输入内容在新加坡处理。API 通过阿里云的 Model Studio 提供,可以从包括东京在内的多个地域中选择。

三种用法

  • Qwen Chat:在浏览器或手机应用里免费对话使用。适合个人查资料和翻译。
  • API:通过阿里云的 Model Studio 接入自家系统或工具。按用量付费。
  • 开放权重:把 Hugging Face 或 ModelScope 上公开的模型(权重文件)放在自己的电脑或服务器上运行。数据不出本地。

Qwen 能做什么

  • 对话:回答问题、撰写文章、翻译、摘要。还有联网搜索和 Deep Research。
  • 图像与视频:理解图像和视频,生成与编辑图像。
  • 语音:有语音合成和实时翻译模型。
  • 代码:面向编程的模型,以及在终端中运行的 Qwen Code。

许多中小规模模型以开放权重发布,可以在自己的电脑或服务器上运行,这是它与 ChatGPT、Claude 的一大区别。

Qwen Chat 怎么用:网页与手机应用免费。登录后直接对话
  1. 打开 chat.qwen.ai。浏览器即可使用。手机上有 iOS 和 Android 的“Qwen”应用。
  2. 登录。创建账户并登录。
  3. 选择模型。在界面的模型选择处切换。拿不准就用默认的。
  4. 开始对话。可以用中文提问。附上文件或图片,让它“总结一下”“做成表格”。
  5. 切换功能。可以选择联网搜索、Deep Research、图像生成、Web Dev(网页原型)等。

Qwen Chat 可以免费使用。截至 2026 年 10 月,我们没有找到类似 ChatGPT Plus 的 Qwen Chat 个人付费方案。

工作中使用的诀窍

  • 先说明角色和输出形式:像“作为给客户的回复,语气正式,分 3 段”这样,一开始就写清楚写给谁、写什么,返工会少很多。
  • 翻译要对照原文核实:金额、日期、型号、人名,不要只看译文,请与原文对照。
  • 长资料用文件传:比起粘贴,附上 PDF 或文档文件,表格和标题结构更不容易乱。
  • 分开对话:每个项目开一个新对话,可以避免回答被之前的话题带偏。

把这样得到的回答变成“谁、在什么时候之前、做什么”并持续跟进,是 Qwen Chat 之外的工作。如果这部分每次都是你自己在做,请看看 SIMY 的连接方法。

主要模型:Qwen3.8、Qwen3.5、TTS、Image Edit2026 年 10 月。名称和代际变化频繁

表格可以横向滚动 →

模型定位可用渠道
Qwen3.8-Max3.8 代的旗舰。100 万 token 长上下文,支持图像和视频输入,思考模式API
Qwen3.8-27B处理文本、图像、视频的中型模型。Apache 2.0开放权重(本地)
Qwen3.8-2.4T-A95B3.8 代最大规模的开放权重版本。专有许可证开放权重(面向大型服务器)
Qwen3.8-Flash、Omni重视速度和成本的 Flash,也能处理语音和视频的 Omni,以及实时翻译API
Qwen3.5、Qwen3上一代。面向本地的小模型多,至今仍被广泛使用开放权重、API
Qwen-VL读取图像和文档的视觉语言模型开放权重、API
Qwen3-Coder专注于代码生成与修改。与 Qwen Code 搭配使用开放权重、API
Qwen3-TTS把文字转成自然语音的语音合成API 等
Qwen-Image、Image Edit图像生成,以及用文字指令编辑图像Qwen Chat、开放权重、API

下一代:阿里巴巴在 2026 年 9 月 22 日的云栖大会(Apsara Conference)上宣布 Qwen 4 正在训练中(发布日期未公布)。模型名称变得很快,按“旗舰”“中型、适合本地”“重视速度”这样的定位记住就够了。

Qwen Image Edit 怎么用

在 Qwen Chat 中附上图片,用文字下指令,比如“把背景换成白色”“把招牌上的文字改成中文”。开放权重版常被集成到 ComfyUI 等图像生成工具中使用。

Qwen 的 API 与价格:Alibaba Cloud Model Studio兼容 OpenAI。价格随模型和地域而变
  • 入口:在阿里云的 Model Studio(DashScope)创建 API Key。API 兼容 OpenAI,只需替换现有工具的接入地址即可使用。
  • 地域:以 Qwen3.8-Max 为例,可以从北京、新加坡、法兰克福、弗吉尼亚、东京、香港中选择。可选地域因模型而异,数据在哪里处理就由这里决定。
  • 价格:按输入和输出的 token 数计费。截至 2026 年 10 月,官方显示 qwen3.8-max 每百万 token 输入 1.65 美元、输出 4.951 美元(东京等地域;新加坡为 2.00 美元、6.00 美元)。模型、思考模式和缓存也会影响单价,最新金额请在官方价格页面确认(税费处理也请在同一页面确认)。
  • Coding Plan:可在 Claude Code、Qwen Code 等编程工具中以固定月费使用 Qwen 等模型的方案。截至 2026 年 10 月只有 Pro(每月 50 美元),并设有每 5 小时、每周、每月的请求上限。详情请看官方说明。

开始使用 API 的步骤

  1. 创建阿里云账户。打开 Model Studio 控制台,选择要使用的地域。
  2. 创建 API Key。把 Key 放进环境变量,不要直接写在代码或共享文档里。
  3. 指向兼容 OpenAI 的端点。如果用的是 OpenAI 的 SDK 或现有工具,只需替换接入 URL 和模型名称即可调用。
  4. 先小规模试用,观察用量。思考模式和长上下文会消耗大量 token。先在控制台确认每天的用量,再扩大到正式规模。

与 SIMY 的关系:目前不能把 Qwen 的 API Key 接入 SIMY。SIMY 的云端执行使用你的 ChatGPT(Codex)账户。

在本地运行 Qwen:Ollama、LM Studio数据不出本地。许可证因模型而异
  • Ollama:安装后在终端输入 ollama run qwen3.8,即可运行 27B 模型(下载约 18GB,可输入文本和图像)。大致需要一台内存比较充裕的电脑。
  • LM Studio:可以在界面上搜索并下载模型。适合不习惯命令行的人。
  • 其他:llama.cpp、Jan、vLLM、SGLang 等。用 vLLM 或 SGLang 可以搭建面向内部的兼容 OpenAI 的服务器(能以与 OpenAI 相同的方式调用的 API)。

许可证的区别

不能笼统地说“Qwen 是开源的”。Qwen3.8-27B 等中小规模模型多采用 Apache 2.0,商用也比较方便。最大规模的 Qwen3.8-2.4T-A95B 采用专有许可证,Max 等仅限 API 的模型则没有公开权重。

适合本地部署的工作

不想让数据外流的内部文档摘要、离线作业、每天大量运行的固定格式草稿,都是本地部署的强项。另一方面,小模型不如大模型聪明,把它当作“打底稿”而不是出终稿的角色,落差会小一些。先定下一个用途再试,更容易判断多大的模型就够用。

所需内存、量化方式的选择、模型大小的参考,整理在在本地运行 Qwen 的方法中。

Qwen Code:在终端中运行的编程智能体开源。也能接入 Qwen 以外的模型

Qwen Code 是 Qwen 团队以开源(Apache 2.0)形式发布的编程智能体。它在终端中运行,能读代码、改代码、执行命令。

  • 安装:Node.js 22 以上,执行 npm i -g @qwen-code/qwen-code@latest。Mac 也可以用 Homebrew 安装。
  • 可接入的模型:除了 Qwen,还有 OpenAI、Anthropic、Gemini 的各家 API,以及用 Ollama 或 vLLM 运行的本地模型。
  • 适合谁:想用 Qwen 模型或自建服务器,尝试与 Claude Code、Codex 相同用法的开发者。

上手流程

  1. 在要工作的文件夹里启动 qwen。首次启动时选择要用的模型和认证方式。
  2. 用中文说出你想做的事。像“说明一下这个文件夹的结构”“找出测试失败的原因”这样,从目的出发提要求。
  3. 确认后再接受修改。改写文件、执行命令,都要看过内容再允许。一开始从小修改试起更放心。

用 Qwen Code 写完代码之后,评审会议上定下的修改和分工,由 SIMY 从会议中拾取并列成清单。

Qwen 的多语言能力:能用到什么程度翻译、摘要、草稿都能用中文提要求

Qwen3 发布时宣称支持 119 种语言和方言(3.8 代的模型卡未写明语言数量)。中文和英文是它的强项,第三方评测也报告其在同等规模模型中具有较高的日语能力。

  • 擅长:中文、英文、日文等语言之间的翻译,长资料摘要,邮件和报告草稿,表格整理。
  • 需要留意:专有名词、行业术语、法规和商业惯例的描述,请核实后再使用。
  • 小模型的情况:在本地运行的小模型,处理长篇外语文本时措辞可能不够自然。重要的文字用大模型定稿更放心。

与海外客户或供应商打交道时,可以这样分工:用 Qwen 翻译和总结会议,已定事项的负责人、期限和回复草稿交给 SIMY。上面的一场会议的对比就是例子。

数据处理与安全性:Qwen Chat、API、本地的区别用法不同,数据的去向也不同

表格可以横向滚动 →

用法数据处理地点是否用于训练适合的用途
Qwen Chat(网页、应用)说明在新加坡处理可能匿名化后用于改进。说明通过邮件申请可停止个人查资料,公开信息的翻译和摘要
API(Model Studio)签约时选择的地域(可选东京等)遵循云服务的合同条款接入业务系统,大批量处理
本地部署只在自己的电脑或服务器内不外流机密文档,离线作业
  • 先确认公司规定:有些公司的生成式 AI 使用规定,限定了可用的服务和可以输入的信息。
  • 原则上不输入机密:无论哪个聊天 AI,输入客户信息或未公开数字之前都要三思。
  • 回答要核实:翻译中的数字、专有名词、法规和规格描述,请与原文对照后再使用。

Qwen Chat 的数据处理,依据 2026 年 10 月 1 日时Qwen 隐私政策的内容。SIMY 的数据处理方式公开在安全和隐私政策中。

与 ChatGPT、Claude、DeepSeek 的区别不分好坏,擅长的地方不同

表格可以横向滚动 →

对比项QwenChatGPTClaudeDeepSeekSIMY
开发方阿里巴巴集团(中国)OpenAI(美国)Anthropic(美国)深度求索 DeepSeek(中国)AwakApp Inc.
擅长多语言、便宜的 API、本地部署用途广泛,周边功能丰富长文本,以及用 Claude Code 工作推理与便宜的 API推进回答之后的工作
在自己的电脑上运行中小规模模型可以ChatGPT 本身不行(OpenAI 的公开模型可以)不行旧一代的小型版可以可让电脑上的 Claude Code 担任执行者
起点你来要求你来要求你来要求你来要求SIMY 从会议和聊天中拾取

怎么选

  • 不想让数据外流:可在本地运行的 Qwen3.8-27B 等开放权重版本。
  • 想压低 API 费用、大量运行:Qwen 或 DeepSeek 的 API。对比地域和单价来选。
  • 看重周边功能和公司内的使用习惯:ChatGPT 或 Claude。公司规定已有要求时,以规定为准。

分工:给出回答和草稿的,可以是包括 Qwen 在内的任何 AI。之后的负责人、期限、回复、分享,如果每次都要你自己跟进,就是 SIMY 出场的时候。中国 AI 的整体区别整理在中国 AI(LLM)对比:DeepSeek、Kimi、GLM 等中,ChatGPT 的用法见 ChatGPT 使用指南。

09 / FAQ

常见问题

Qwen 是什么?

Qwen(通义千问)是中国阿里巴巴集团开发的大语言模型(LLM)系列。有三种用法:免费聊天服务 Qwen Chat、云端 API,以及可以在自己电脑上运行的开放权重模型。

Qwen 和通义千问是什么关系?

Qwen 是“通义千问(Tongyi Qianwen)”的简称和英文名。它既是聊天 AI 的名字,也指整个模型系列。

Qwen 是哪个国家的 AI?

中国的 AI。由阿里巴巴集团开发;国际版 Qwen Chat 由新加坡的 Alibaba Cloud (Singapore) 提供,隐私政策说明输入内容在新加坡处理。

Qwen 可以免费使用吗?

可以。网页版 Qwen Chat 和手机应用可以免费使用。API 按用量计费;开放权重模型在自己的电脑上运行则不产生使用费(电脑和电费另计)。

Qwen 支持哪些语言?

Qwen3 发布时宣称支持 119 种语言和方言,中文、英文都在其中。翻译、摘要、邮件草稿都可以直接用中文提要求。

Qwen 能在本地(自己的电脑)运行吗?

可以。用 Ollama 输入 ollama run qwen3.8 即可运行 27B 模型(约 18GB),LM Studio 也能使用公开模型。不同模型的许可证和所需内存不同,请参阅在本地运行 Qwen 的方法。

输入 Qwen Chat 的内容会被用于 AI 训练吗?

有可能。隐私政策说明,可能会把匿名化后的内容用于改进模型,通过邮件申请即可停止用于训练(截至 2026 年 10 月)。处理机密信息时,建议考虑可选择地域的 API,或数据不出本地的本地部署。

Qwen API 的价格是多少?

因模型和地域而异。截至 2026 年 10 月,最高端的 qwen3.8-max 每百万 token 输入 1.65 美元、输出 4.951 美元(东京等地域)。Alibaba Cloud Model Studio 按用量计费,思考模式和缓存也会影响单价,请以官方价格页为准。

Qwen Code 是什么?

Qwen 团队开源的编程智能体。可以在终端中读写代码,除了 Qwen,也能接入其他公司的模型和本地模型。

Qwen 和 ChatGPT、Claude、DeepSeek 有什么不同?

主要区别在于能否在自己的电脑上运行模型,以及数据流向哪里。Qwen 以开放权重形式公开了中小规模模型,可以在本地运行。与 DeepSeek 的区别整理在中国 AI(LLM)对比中。

SIMY 用 Qwen 运行吗?

不是。目前 SIMY 不接入 Qwen,而是通过你的 ChatGPT(Codex)账户,以及经由 SIMY 桌面应用驱动电脑上的 Claude Code 运行。可以这样分工:翻译和草稿照旧用 Qwen,已定事项的后续安排交给 SIMY。

Qwen 给出回答之后的工作,每次都要去拜托 SIMY 吗?

不用。SIMY 会自己从会议记录和聊天中找出已定事项、负责人和截止日期。它从对话中学习你的做法,只把需要判断的事交回给你。

10 / SOURCES

参考资料

Qwen 的模型、计费方式、许可证和数据处理,依据以下官方信息确认(确认日期:2026 年 10 月 1 日)。语言能力也参考了第三方评测。模型名称和规格变化频繁,最新信息请以各官方页面为准。

Qwen 给出回答之后,
接下来交给 SIMY。

Qwen 照旧做它擅长的事。从会议和聊天中拾取的工作由 SIMY 推进,交回的只有判断。谈判,依然是你大显身手的地方。