> For the complete documentation index, see [llms.txt](https://tinyhumans.gitbook.io/openhuman/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://tinyhumans.gitbook.io/openhuman/zh/gong-neng/mascot.md).

# 实时吉祥物

OpenHuman 的屏幕形象：一个会说话、会反应、会加入你的会议，并且即使你没有看它也会在后台思考的桌面吉祥物。

OpenHuman 有一张脸。这个吉祥物是一个驻留在你桌面上的动画角色，作为智能体的可见表层：它在说什么、在想什么、它空闲时、忙碌时，或是有话要告诉你时。

它不是一个镀铬装饰品。这个吉祥物与智能体的其他部分接入的是同一套组件：语音、记忆， [定时运行](/openhuman/zh/gong-neng/native-tools/cron.md)，以及 [Google Meet 集成](/openhuman/zh/gong-neng/native-tools/voice.md)。当智能体说话时，是吉祥物在说话；当智能体在思考时，是吉祥物在思考。

## 它的作用

### 它会说话，并让嘴型与自己的声音同步

当智能体回复时，音频通过托管的 TTS 模型生成并流式传输到你的扬声器。同时，吉祥物会根据音频驱动 viseme 映射，使其嘴型与发出的词语相匹配。这里没有单独的“会说话的头像”视频，你听到的同一音频流就是驱动动画的那一条。

参见 [原生语音](/openhuman/zh/gong-neng/native-tools/voice.md) ，了解吉祥物所依托的语音转文字、文字转语音以及会议底层管线。

### 它会以真实参会者的身份加入你的会议

### 它会移动并对周围环境做出反应

吉祥物有情绪状态（空闲、思考、聆听、说话、惊讶、做梦），并会根据智能体正在做什么在这些状态之间切换。当你开始输入时，它会切换成聆听姿态。当模型在推理时，它会显示这一点。当一次工具调用返回了值得注意的内容时，它会做出反应。当你有一段时间停止交互后，它会进入空闲状态。

在一轮结束后，桌面吉祥物还会读取随聊天结果到达的会话级提示。成功提示会产生简短的开心回应，不确定提示会产生困惑回应，而警告或失败结果会产生担忧回应。如果没有明显的提示，它会保留现有的平静轮次后回应，并回到空闲状态。

它的目标是让人感觉它是活的，而不是按脚本驱动的动画。

### 它记得你

这个吉祥物是一个智能体的可见部分，而这个智能体拥有 [记忆树](/openhuman/zh/gong-neng/obsidian-wiki/memory-tree.md) 其底层能力。它会记住你们聊过什么、你生活中的人是谁、你手头有哪些待办、已经决定了什么，以及还有哪些未完成事项，涵盖你连接的每个来源。当它早晨向你打招呼时，并不是从零开始。

正是这种记忆，让个性在数周和数月中保持一致。你今天交谈的吉祥物知道上周二你交谈的那个吉祥物所知道的内容。

### 它会在你离开时工作

即使你停止输入，工作也可以继续代表你进行： [定时例程](/openhuman/zh/gong-neng/native-tools/cron.md) 基于 cron 表达式运行， [触发器](/openhuman/zh/gong-neng/integrations/triggers.md) 在传入事件发生时触发，并且 [工作流](/openhuman/zh/gong-neng/workflows.md) 执行持久化、受审批门控的图。因此，当你回到桌前时，吉祥物可能已经起草好了邮件、刷新了仪表板，或者排好了它需要问你的问题。屏幕上的那张脸就是完成这些工作的那一个。

### 它会做梦

当你离开足够久后，吉祥物会进入做梦状态。做梦是智能体的离线整合过程，会将当天的片段提炼成更长期的摘要，刷新已经变得活跃的实体的主题树，并浮现出那些无法归入任何单一来源的模式。吉祥物在做梦时的动画也会不同，因此你可以一眼看出：它不是空闲，它在处理。

当你回来时，这些梦境已经被折叠进记忆树中。吉祥物醒来时比入睡时更聪明。

## 为什么还要有吉祥物？

大多数助手只是一个闪烁的文本输入框。作为工具，这没问题。但对于那种要整天陪在你身边、持续记住你的生活、替你采取行动的东西来说，这就不够了。

之所以有这个吉祥物，是因为：

* **存在感胜过面板。** 你只需瞥一眼这张脸，就能在一个画面里看出智能体是忙碌、空闲、做梦，还是想引起你的注意。
* **它让语音通话更像在对话。** 一个动画角色对着自己的语音做口型的摄像头画面，和一个只有黑色方块的机器人声音，是截然不同的体验。
* **个性本身就是一种 UX 表层。** 屏幕上一个始终一致的角色，比一个无脸的 API 更容易让人信任、交谈，以及在它出错时原谅它。

## 另请参见

* [原生语音](/openhuman/zh/gong-neng/native-tools/voice.md)，以及吉祥物所依托的 STT / TTS 底层管线。
* [记忆树](/openhuman/zh/gong-neng/obsidian-wiki/memory-tree.md)，吉祥物记住了什么，以及它是如何记住的。
* [Chromium 嵌入式框架](/openhuman/zh/kai-fa/cef.md)，以及摄像头接入 Meet 的管线（开发者参考）。
