GPU 状态未查询
孤独女孩
你的爱人在这里。
🌸上传照片后开始
唤醒你的爱人
正在加载图片并预热模型,请稍候…
Configuration
GPU 会话状态
状态未查询
人物照片
📸 点击上传照片
用于 FlashHead Lite 口型驱动
如果点击上方区域无效,直接使用这里的原生文件选择框,选择后会自动上传并应用。
尚未选择图片
口型质量
推理步数 6
极速(2)精细(12)
嘴部幅度 5.0
保守夸张
色彩矫正 0.8
牙齿锐化 0.6
TTS 语音合成
说话人
API Key
Access Key
Secret Key
App ID
音色
服务地址
本地 ChatTTS,启动服务后自动连接
Base URL
API Key
ASR 语音识别
识别语言
需要 Chrome 浏览器麦克风权限。HTTP 本地访问 localhost 可用,IP 地址需要 HTTPS。
唤醒词
用 ; 分隔,识别到任意一个自动发送。
不填则任何语音都触发发送。
对话模型
提供商
模型名称
Base URL
API Key
角色设定
📷 摄像头视觉模式:摄像头图像 + 语音输入 → VLM 回复。完全独立于 LLM。
VL 提供商
VL 模型名称
Base URL
API Key
角色设定
⚡ 语音→语音,绕过 LLM+TTS,延迟最低。麦克风按钮直接录音发送,无需 ASR。
E2E 提供商
模型
回复音色
API Key(通义千问 sk-xxx)
APP ID (豆包语音控制台→服务接口认证信息,纯数字)
Access Token (同一页面,UUID格式)
回复音色
角色设定(系统词)