🧠 实时语音对话
端到端 S2S · 免提自由对话 ·
v1.5
未连接
⚠️ 已打断
纯文字对话测试
ASR + DeepSeek,不合成语音、不渲染画面
未开始
🔍 系统提示词
✏️ 编辑
♻️ 恢复自动
(人设/场景填好后自动显示)
可直接改这段 system(保存后生效,历史会重置)
保存并应用
取消
场景
目前关系
发送
‹
›
形象加载中
0
%
正在加载模型与素材…
🔄 重启形象
发送
✕ 退出全屏
⛶ 全屏
⏺ 录制
🎤 麦克风开
🧠 我听到
(等待说话...)
发送
模式:
驱动与形象
形象驱动
标准驱动
模型:
蒸馏 (distilled)
非蒸馏
▶ 进入通话
💬 桌面打字
表情优化
✨ 表情优化: 关
▸
口型响应:
2.0
↺
头部平滑:
0.00
口型去抖:
0.30
特征降采样:
加权
ODE步数:
6
语音引导:
2.0
聆听引导:
2.0
关键点引导:
3.0
抬头置零:
0.00
情绪
情绪:
😊 开心
0.0
😲 惊讶
0.0
😢 难过
0.0
🎬 素材模式
模型与音色
链路:
端到端(默认)
ASR-LLM-TTS(豆包ASR+DeepSeek+TTS)
纯文字对话(ASR+LLM,不合成语音/不渲染画面)
说话style:
style1
style2
引擎:
豆包
Grok Voice
千问实时
Gemini Live
版本:
O2.0(精品音色)
SC2.0(角色扮演)
TTS:
MiniMax
Qwen(默认)
音色:
默认(vv女声)
vv 女声
小荷 女声(台湾口音)
云舟 男声
晓天 男声
角色设定
人设:
✕
+增加角色
自定义音色:
📤 上传音频复刻
🔄 轮播素材
▶ 插播素材(点三角插入)
🎭 情绪插播
🧑
数字人
正在接通
‹
数字人
通话中
00:00
增加角色
角色名字
人设内容
取消
保存