AIRI 能做什么:陪聊、桌宠、语音和游戏陪玩一次讲清
这一页只讲「现在就能做到的事」,全部来自官方文档与说明书(对应 0.12.0-beta.5 说明书口径),功能可能随版本变化,以官方最新版为准。
第一层:装好就能用
- 文字聊天:配好任意一个聊天服务来源后即可对话,支持多段对话管理。
- 角色人设:内置角色卡「ReLU」,也可以自己写卡——名字、性格、问候语、每个模块用什么模型都由卡决定。
- 形象显示:内置与导入的 Live2D、VRM 模型均可使用,自动眨眼、视线跟随。
- 语音合成与识别:接上 TTS 她能开口说话;接上 STT 她能听你说话,还能自动发送转录文本。
- 桌宠交互(桌面版):系统托盘、窗口置顶、点击穿透、悬停淡化、移动缩放、字幕浮窗、快速操作一应俱全。
第二层:要多一步配置
- 网络搜索:填入 Tavily 的 API Key,她能在聊到最新信息时自己查网。
- 图像理解:配置视觉模型并通过 Vision Capture 捕获屏幕或窗口画面,让她「看见」你在做什么(桌面端调试工作流)。
- AI 绘图:给支持工具调用的聊天模型配一个图像服务,她可以按对话内容生成图片。
- 官方提供商:不想自己申请 API Key,可以直接登录官方账号用电量开聊。
第三层:进阶玩法(需要源码部署)
- Minecraft 智能体:通过 Mineflayer 进服务器,陪你挖矿盖房。
- 异星工厂(Factorio):结合视觉识别与大模型决策的演示级玩法。
- Discord / Telegram 机器人:以机器人身份驻进社群的消息与语音频道。
接下来
- 每一项的具体配置都在后面的分组里:从三端形态对比开始。
- 先说清楚她做不到什么:AIRI 的能力边界。