聊天核心
围绕一条输入框和一列消息气泡展开:流式输出、多模型切换、工具调用、视觉辅助、Mood 内心独白与完整的会话管理。
流式输出与状态条
发送消息后,AI 的回复会一个字一个字地「流」出来,无需等待整段完成。流式回复过程中,顶部会出现可下拉的状态条,显示当前模型、已用时长、本轮 Token 数。若不需要流式,可在助手设置里关闭。
- 回复中发送按钮变成「停止」按钮,点击立即中断
- 中断后已生成的部分会保留,可继续编辑或重新生成
- 网络错误时会弹出重试按钮
多模型切换与能力标签
聊天页顶部显示当前模型名,点击弹出模型选择列表。列表按渠道分组,切换即时生效,下一条消息就会用新模型回复。每个模型旁会显示能力标签:是否支持视觉、推理、工具调用。
不同模型的输出风格差异很大。日常问答用轻量模型,复杂分析用推理模型,创意生成用高采样参数模型,Muse 的模型切换让每一种场景都能找到合适的大脑。
工具调用(Function Calling)
当问题需要外部信息或动作时,AI 会自动调用工具。调用过程在对话中显示为「任务卡片」,分步列出:调用工具 → 传入参数 → 结果 → 是否成功。
- 最多连续 25 轮工具调用
- 连续 3 次失败会自动终止,避免空转
- 同一轮多个工具支持并行执行
- 高风险工具(发短信、拨电话等)首次调用会弹窗审批
视觉辅助:让纯文本模型也能看图
向不支持多模态的模型发送图片时,Muse 不会直接丢弃或报错,而是自动启动视觉辅助:用你配置的视觉模型(如 GPT-4o、Gemini)分析图片,生成八维度结构化描述,再注入到消息中。纯文本模型读到的是「图片说了什么」,而非像素。
- 多图并发分析,界面实时显示进度
- 图片预压缩(2000×2000、JPEG 80%),超大图不再被丢弃
- 单图 60 秒超时 + 网络错误自动重试 3 次
- 按「图片 + 请求 + 提示词版本」缓存,重复发送秒级返回
Mood 系统:思想的四维空间
Muse 每次回复前会生成一个 mood 块,这是 AI 的「内心独白」。默认折叠为一张小卡片,展开后能看到四个维度:
| 维度 | 含义 |
|---|---|
| Vibe 氛围 | AI 此刻最直接的感受与情绪 |
| Sparks 火花 | 脑中自然冒出的联想、比喻、新角度 |
| Reflections 反思 | 对自己的质疑、不确定的点、想追问的洞察 |
| Will 意志 | 经过感受、发散、反思后凝聚下来的行动方向 |
四个维度从直觉到行动层层递进,让每次回复不只是生成文本,而是经历一次完整的思维过程。
消息分支、重新生成与导出
每条 AI 回复下方都有「重新生成」按钮。多次重新生成会产生多个版本,可在消息右下角的版本标签里左右切换。也可以在某条用户消息上「从此处分支」,改写后续走向。删除消息时可选择只删单条还是连带后续全部。
长按单条消息可复制纯文本 / Markdown、转发到其他会话、分享到系统菜单。整段会话可导出为 Markdown、TXT、JSON,或渲染成长截图分享。
深度思考(Reasoning)
对 DeepSeek-R1、o1、Claude Thinking 等推理模型,可在输入框上方切换「思考等级」:关 / 自动 / 低 / 中 / 高 / 极高。思考过程以可折叠的灰色区块显示在正文上方,点开可看推理细节。
隐私脱敏(PII)
开启隐私脱敏后,发送前会自动扫描手机号、身份证号、邮箱、银行卡号等敏感信息,替换为占位符(如 [PHONE])。AI 看不到真实号码,但回复中的占位符会还原为原值,保证你阅读正常。可在聊天设置里自定义脱敏规则。
输入栏与附件
输入栏支持多行自适应高度(最高 6 行后内部滚动),左侧「+」可插入图片、文件、快捷消息、记忆、知识库引用。支持草稿(切换会话时保留未发送输入)。
- 快捷消息:预设常用句子,一键插入
- 斜杠命令:
/new、/compact、/reset、/pin、/archive - 语音输入:DashScope Paraformer / Step Whisper API,边说边出字,长按录音上滑取消,波形可视化