麦克风录音进入识别流程,适合桌面端和硬件端触发。
PC Web UI
把对话、声音和角色状态放在一个界面里。
MiniBox 的核心界面运行在本地浏览器里,负责 LLM 对话、GPT-SoVITS / MiniMax / Edge-TTS 声音输出、麦克风输入和角色模型切换。
Voice Pipeline
从一句话到角色回应。
LLM 按角色设定和上下文生成回复,保留连续聊天状态。
GPT-SoVITS、MiniMax 或 Edge-TTS 生成角色语音。
Web UI 和 ESP32 屏幕同步展示状态、文字与播放进度。
ESP32 Client
把语音角色放进实体底座。
ESP32-S3 客户端通过 WiFi 连接 PC 服务,支持按键唤醒、自动语音检测、OLED 状态、动画和扬声器播放。仓库内置烧录工具,可配置 WiFi 与服务地址。
INMP441 microphone
MAX98357A speaker amp
SSD1306 OLED status
Quick Start
本地启动,浏览器开始聊天。
pip install -r requirements.txt
python webui.py
http://127.0.0.1:7860