➜
⇄
聆听中…
原 文 · English
译 文 · 中文
译文与原文将以“句子卡片”形式实时流出
说话停顿约 0.7s 后自动成段(可在设置中调节)
录音 → 识别 → 句子级流式翻译 → 语音播报 · 全程并行流水线
译文与原文将以“句子卡片”形式实时流出
说话停顿约 0.7s 后自动成段(可在设置中调节)
两种用法:① 管理员在服务端 profiles.json 预置好 API 配置,使用者只需选上面“代号”,密钥由服务端保管、不进浏览器; ② 无代号时手动填写(密钥仅存本机浏览器)。解析顺序:手动填写 > 预设代号 > 服务端 .env。
“测试识别通道”不经过麦克风:向服务商的 /audio/transcriptions 发一段无声样本探测。 中文草稿与识别都依赖该通道——OpenAI / 硅基流动 / Groq 等支持;DeepSeek、Moonshot 等纯对话服务不支持,会提示切换。
默认开启「实时中文草稿」:开口后约 1 秒中文即出现,并随你的语音不断修正、变长,说完整句停顿后定稿为新卡片 (无需等整段讲完)。嫌草稿占位置:关掉开关后恢复“成段才出译文”。想更快成句:「静音成段」调到 400–500ms;讲完一句稍作停顿。 MOCK 演示模式为模拟节奏,不代表真实 API 延迟。
架构参照讯飞听见同传 / Google 口译模式 / 微软翻译官等成熟平台:
① 说话停顿即成段,边录边传(分段并行);② 按句子流水翻译并即刻播报,不等整段讲完;
③ 播报同时继续收音,实现“同声”体验。详见项目 README。