> For the complete documentation index, see [llms.txt](https://tinyhumans.gitbook.io/openhuman/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://tinyhumans.gitbook.io/openhuman/zh/gong-neng/mascot.md).

# 实时吉祥物

OpenHuman 有一张脸。这个吉祥物是一个动画角色，常驻在你的桌面上，作为代理的可见表层，展示它在说什么、在想什么、空闲时是什么状态、忙碌时是什么状态，以及当它有话要告诉你时的状态。

它不是一个花瓶式的装饰品。这个吉祥物与代理的其余部分连接在同一套组件上：语音、记忆、 [潜意识循环](https://github.com/tinyhumansai/openhuman/tree/main/gitbooks/features/subconscious.md)，以及 [Google Meet 集成](/openhuman/zh/gong-neng/native-tools/voice.md)。当代理说话时，说话的就是吉祥物；当代理在思考时，思考的也是吉祥物。

## 它做什么

### 它会说话，并与自己的声音同步口型

当代理回复时，音频会通过托管的 TTS 模型生成，并流式传输到你的扬声器。同时，吉祥物会根据音频驱动 viseme 映射，使嘴型与输出的文字相匹配。这里没有单独的“说话头像”视频，你听到的同一条音频流就是驱动动画的那条。

参见 [原生语音](/openhuman/zh/gong-neng/native-tools/voice.md) 关于吉祥物所依托的语音转文字、文字转语音和会议底层连接。

### 它作为真实参与者加入你的会议

### 它会移动并对周围环境做出反应

吉祥物有不同的情绪状态（空闲、思考、聆听、说话、惊讶、做梦），并会根据代理正在做的事情在这些状态之间切换。你开始输入时，它会切换到聆听姿态。模型在推理时，它会表现出这一点。工具调用返回有价值的信息时，它会做出反应。你一段时间不再交互时，它会慢慢进入空闲状态。

一轮对话结束后，桌面吉祥物还会读取聊天结果中附带的对话级提示。成功提示会生成一个短促的开心回应，不确定提示会生成困惑回应，而警告或失败结果会生成担忧回应。如果没有明显提示，它会保持现有平静的轮次结束回应，并回落到空闲状态。

它的设计目标是让人感觉它是活的，而不是按脚本动画。

### 它会记住你

这个吉祥物是一个代理的可见部分，而这个代理下面有一棵 [记忆树](/openhuman/zh/gong-neng/obsidian-wiki/memory-tree.md) 。它会记住你们谈过什么、你生活里有哪些人、你手头正在处理什么、哪些事情已经决定、哪些事情仍待完成，并会综合你连接的每一个来源中的信息。当它早上向你打招呼时，它并不是从零开始。

正是这种记忆让它的人格在数周和数月之间保持一致。今天和你交谈的吉祥物，知道你上周二和它交谈时它所知道的内容。

### 它在后台思考，也就是潜意识

即使你已经停止输入，吉祥物仍会继续思考。 [潜意识循环](https://github.com/tinyhumansai/openhuman/tree/main/gitbooks/features/subconscious.md) 是一个后台滴答流程，会：

* 加载你的待办任务和常驻目标。
* 读取你工作区的当前状态和最近记忆。
* 决定如何处理每一项（自主执行、保留，或升级给你审批）。
* 把结果写回你可以审计的活动日志。

所以当你回到桌前时，吉祥物可能已经起草好了邮件、刷新了仪表盘，或者排好了需要问你的问题。屏幕上的那张脸，就是完成这些工作的那个。

### 它会做梦

当你离开足够久后，吉祥物会进入做梦状态。做梦是代理的离线整合过程，会把当天的信息块提炼成更长周期的摘要，刷新那些变得活跃的实体的主题树，并浮现出那些无法归入任何单一来源的模式。吉祥物在做梦时会以不同方式动画化，因此你一眼就能看出：它不是空闲，而是在处理。

当你回来时，这些梦已经被整合进记忆树。吉祥物醒来时比入睡时更聪明。

## 为什么还要有一个吉祥物？

大多数助手只是一个闪烁的文本输入框。作为工具，这没问题。但对于一个要整天陪伴你、持续记住你的生活并代表你采取行动的东西，这就不够了。

之所以存在这个吉祥物，是因为：

* **存在感胜过面板。** 你只要瞥一眼一张脸，就能在一瞬间知道代理是在忙、空闲、做梦，还是在试图引起你的注意。
* **它让语音通话更像一次对话。** 一个动画角色对着自己的语音做口型的摄像头画面，与一个黑色方块里的机械声音带来的体验截然不同。
* **人格就是一种 UX 表层。** 屏幕上一个一致的角色，比一个没有面孔的 API 更容易让人信任、交谈，以及在它犯错时原谅它。

## 另请参见

* [原生语音](/openhuman/zh/gong-neng/native-tools/voice.md)，吉祥物所依托的 STT / TTS 底层连接。
* [记忆树](/openhuman/zh/gong-neng/obsidian-wiki/memory-tree.md)，吉祥物记住了什么，以及如何记住。
* [潜意识循环](https://github.com/tinyhumansai/openhuman/tree/main/gitbooks/features/subconscious.md)，当你离开时它会思考什么。
* [Chromium 嵌入式框架](/openhuman/zh/kai-fa-zhong/cef.md)，摄像头到 Meet 的管线（开发者参考）。
