Cherry Studio
文档

对话-助手

对话界面是 Cherry Studio 最常用的页面,但其结构包含 两个层次:助手 → 对话。理解这一结构有助于更高效地使用各类对话功能。

助手与对话的关系

简单类比:

  • 助手 = 一个角色(如"产品文档助理"、"代码 reviewer")
  • 对话 = 与该角色的一段交流(如周一讨论"重构方案"、周二讨论"bug 报告")

也就是说:一个助手下可创建多个对话,所有对话共用该助手的人设与参数(提示词、模型、温度等),无需每次重新设定 AI 的角色与风格。

助手

助手为 AI 设定固定角色 —— 由系统提示词 + 模型参数预设组成。

  • 系统默认助手:通用助手,未设特殊提示词,可直接使用
  • 更专项的助手:在下方 助手库 浏览现成预设,或自行创建

对话

每个助手下可创建多个对话(即多段独立聊天)。各对话之间相互独立,但共享所属助手的设置。

适用场景示例:

  • 同一个"代码助手"下分别开"项目 A 重构"、"项目 B bug"两个对话,独立管理
  • 同一个"翻译助手"下开多个对话,分别处理不同文章

每个助手下可展开多个对话(图中「市场营销」助手下展开了两个对话)

助手库

助手列表里的助手从哪来?除了系统默认助手,你可以从 助手库 添加,或自己创建。助手库是一个 助手预设市场,提供大量"角色 + 提示词 + 参数"模板,添加后就会出现在对话页的助手列表里。

进入助手库

  1. 在对话页左侧的助手列表顶部,点击 展示方式 图标(漏斗状),在弹出菜单中选择【管理助手】。
  2. 在打开的「管理助手」页面右上角,点击【助手库】按钮,即可进入助手预设市场。

助手库 —— 按用途分类(带数量徽标)浏览助手卡片,顶部提供搜索框

在助手库中查找助手

  • 分类筛选:按 全部 / 精选 与多个用途分类(职业、商业、工具、语言、办公、通用、写作、编程、情感、教育、创意、学术、设计、艺术、娱乐、生活 等)筛选,分类名旁的数字为该类的助手数量
  • 搜索:顶部搜索框可在所有分类内按关键词查找
  • 预览:点击助手卡片可看到该助手的系统提示词、推荐模型、参数预设

添加到我的助手

  • 点击助手卡片上的 添加 按钮,即可把该预设加入你的助手列表
  • 之后在对话页助手列表中即可看到该助手

创建自己的助手

在「管理助手」页面右上角点击【新建助手】,会打开与 编辑助手 相同的对话框,可分标签页填写:

  • 基础:头像、名称、描述、该助手的默认模型、分组
  • 模型:温度、Top-P、最大 Token 数等模型参数(详见下方 助手设置
  • 提示词:决定该助手的角色与行为;输入框右上角的闪电按钮即【AI 优化提示词】,可用 全局默认助手模型 把当前内容改写得更结构化
  • 知识库:关联已建好的 知识库
  • MCP:为该助手启用 MCP 工具

新建 / 编辑助手对话框,左侧为 基础 / 模型 / 提示词 / 知识库 / MCP 五个标签页

导入与管理

「管理助手」页面右上角提供三个动作按钮:

  • 新建助手:打开 编辑助手对话框 从零创建一个助手
  • 助手库:进入上面介绍的助手预设市场
  • 导入助手:打开「从外部导入」对话框,导入他人分享的助手

「管理助手」页面本身用于集中管理已添加的助手,支持批量删除、批量导出。

【从外部导入】对话框提供三种一次性导入方式,导入完成后助手即出现在你的助手列表中:

  • 文件上传:拖入或选择一个 JSON 文件
  • 剪贴板:直接粘贴助手的 JSON 文本
  • URL 导入:填入 JSON 链接(出于安全考虑,当前仅支持 GitHub Gist、raw.githubusercontent.com 等来源)

从外部导入对话框 —— 文件上传 / 剪贴板 / URL 导入

何时使用助手库,何时使用智能体?

场景推荐
个性化"角色"快速对话(写作、翻译、技术问答等)助手库
让 AI 自主调用工具、读写文件、跨步骤完成任务智能体
定时执行、跨平台消息推送智能体 + 定时任务 + 频道

对话框内按钮

输入框工具栏默认只放 4 个常用工具,其余功能都在【+】输入快捷面板里

输入框下方的工具栏 默认只显示 4 个常用工具,其余功能收在末尾的 【+】输入快捷面板 中。想改默认显示哪些工具,点【+】→【自定义工具栏】。

默认工具栏

名称作用
新对话在当前助手内创建一个新对话
网络搜索把网页搜索结果作为上下文返回给模型,需先在 联网模式 中配置;部分模型也可改用「模型内置」搜索
知识库把一个已建好的 知识库 作为上下文
+(输入快捷面板)打开下面这一组更多工具与操作

输入快捷面板(+)

点击 +,或直接在输入框里输入 /,都会打开这个面板。面板支持 ↑↓ 选择、Tab / 回车 确认、ESC 关闭。

名称作用
上传附件上传图片或文档;图片需模型支持视觉能力,文档会被解析为上下文
生成图片让当前对话模型生成图片;需先在【设置】→【默认模型】中配置画图模型。专门的生图请去 绘画
提示词管理插入并管理预设提示词,详见 输入工具栏与效率工具
MCP查看并启用当前对话可用的 MCP 服务器
引用笔记笔记 中选一篇作为附件引用
清除上下文保留消息,但让模型"忘掉"之前的对话(截断上下文)
自定义工具栏选择默认工具栏上显示哪些工具

已添加到输入框的图片会显示为附件标记。鼠标悬停可快速预览;点击附件,或用键盘聚焦后按 Enter / Space,可打开完整图片预览。

输入框右侧

  • 展开 / 收起(输入框右上角):放大输入框,便于输入长文
  • 思考(右下角下拉,显示为「默认」):调整模型的推理强度,仅在所选模型支持推理时可调;不支持的模型会提示「当前模型不支持调整推理强度」
  • 发送:发送消息(默认 Enter,可在 快捷键 中改)

通过键盘触发

输入框的提示里已经写明了两个快捷输入:

  • /:打开输入快捷面板,选择工具或操作(与点击 + 等价)
  • @:引用一个已有话题,把它的内容带进当前对话

对话设置

对话界面的 消息显示输入相关 偏好现在统一放在 设置 → 外观 中,对所有助手的所有对话全局生效;模型参数 则按助手单独设置。

消息显示与输入设置

以下偏好都在 设置 → 外观 里调整,完整说明见 外观:

  • 消息显示:消息样式(气泡 / 简洁)、使用衬线字体、消息字体大小、思考内容自动折叠、显示消息大纲、代码显示行号 / 代码块可折叠 / 代码块可换行、代码风格、数学公式渲染等
  • 输入相关:发送快捷键、显示预估 Token 数、Markdown 渲染输入消息、删除消息前确认等

模型参数

温度、Top-P、最大 Token 数、流式输出、上下文管理、自定义参数等 模型参数是按助手设置的,位于 编辑助手 对话框的「模型」标签页,具体见下方 助手设置

助手设置

在助手列表中 右键点击 需要设置的助手,在弹出菜单中选择【编辑助手】,即可打开助手编辑对话框。

编辑助手

编辑对话框左侧分为五个标签页:

  • 基础:头像、名称、描述、该助手的默认模型、分组
  • 模型:温度、Top-P、最大 Token 数、流式输出、上下文管理、自定义参数等模型参数
  • 提示词:即 prompt,可以参照 智能体 页面的提示词写法来编辑内容
  • 知识库:关联已建好的 知识库
  • MCP:为该助手启用 MCP 服务器

编辑助手对话框(基础标签页)

默认模型(基础标签页)

在「基础」标签页可为该助手固定一个默认模型;不设置时则跟随 全局默认对话模型

模型参数(模型标签页)

以下参数都在「模型」标签页中调整。

温度 (Temperature)

温度参数控制模型生成文本的随机性和创造性程度(默认值为 0.7)。具体表现为:

  • 低温度值(0-0.3):
    • 输出更确定、更专注
    • 适合代码生成、数据分析等需要准确性的场景
    • 倾向于选择最可能的词汇输出
  • 中等温度值(0.4-0.7):
    • 平衡了创造性和连贯性
    • 适合日常对话、一般性写作
    • 推荐用于聊天机器人对话(0.5 左右)
  • 高温度值(0.8-1.0):
    • 产生更具创造性和多样性的输出
    • 适合创意写作、头脑风暴等场景
    • 但可能降低文本的连贯性

Top P (核采样)

默认值为 1,值越小,AI 生成的内容越单调,也越容易理解;值越大,AI 回复的词汇范围越大,越多样化。

核采样通过控制词汇选择的概率阈值来影响输出:

  • 较小值(0.1-0.3):
    • 仅考虑最高概率的词汇
    • 输出更保守、更可控
    • 适合代码注释、技术文档等场景
  • 中等值(0.4-0.6):
    • 平衡词汇多样性和准确性
    • 适合一般对话和写作任务
  • 较大值(0.7-1.0):
    • 考虑更广泛的词汇选择
    • 产生更丰富多样的内容
    • 适合创意写作等需要多样化表达的场景

上下文管理

控制随请求一起发送给模型的历史上下文如何处理。开启后此助手使用自定义的上下文管理设置(如自动压缩较长历史、按阈值截断),关闭时跟随全局设置。上下文越长,模型记住的信息越多,但消耗的 token 也越多。

最大工具调用轮次

限制助手在一次回复中连续调用工具的轮数。新建助手默认使用 100 轮,可在 1–1000 之间设置;已有助手会保留原来的值,旧配置常见为 20 轮。

如果出现“达到工具调用轮次上限”一类提示,可适当提高此项,或把任务拆小后重试。轮数越高,工具链运行可能越久,也可能消耗更多 Token;普通对话无需主动调高。

开启消息长度限制 (MaxToken)

单次回答最大 Token 数,在大语言模型中,max token(最大令牌数)是一个关键参数,它直接影响模型生成回答的质量和长度。

如:在 CherryStudio 当中填写好 key 后测试模型是否连通时,只需要知道模型是否有正确返回消息而不需特定内容,这种情况下设置 MaxToken 为 1 即可。

多数模型的 MaxToken 上限为 32k Tokens,当然也有 64k,甚至更多的,具体需要到对应介绍页面查看。

具体设置多少取决于自己的需要,当然也可以参考以下建议。

流式输出(Stream)

流式输出是一种数据处理方式,它允许数据以连续的流形式进行传输和处理,而不是一次性发送所有数据。这种方式使得数据可以在生成后立即被处理和输出,极大地提高了实时性和效率。

在 CherryStudio 客户端等类似环境下简单来说就是打字机效果。

关闭后(非流):模型生成完信息后整段一次性输出(想象一下微信收到消息的感觉);

打开时:逐字输出,可以理解为大模型每生成一个字就立马发送给你,直到全部发送完。

自定义参数

在请求体(body)中加入额外请求参数,如 presence_penalty 等字段,一般人一般情况下用不到。

上述 top-p、maxtokens、stream 等参数就是这些参数之一。

填法:参数名称—参数类型(文本、数字等)—值,参考文档:点击前往


获取帮助与提交反馈

如果您在配置或使用过程中遇到任何疑问、Bug 或有功能改进建议,请参考 反馈与建议 中提供的官方渠道。

本页内容