Mr.Mou @ ShiShi AP Center

SpeakDeck 英语口语转写与练习音频生成工具

当前版本:打开 SpeakDeck

旧版:V2 · V1


更新记录

2026-09-15

2026-07-03

2026-07-02

2026-06-23

2026-06-22

2026-06-20

2026-06-13

2026-06-08

2025-08-14


SpeakDeck 是什么

SpeakDeck 是一个为英语口语练习设计的浏览器工具箱,目前包含两个互补的工作流:

工具 用途
语音转写 / Transcribe 上传自己的录音,用 Whisper 本地转写并逐句复听
语音合成 / TTS 输入英文稿件,用 Kokoro 生成练习音频并跟读模仿

它们组合起来,可以形成一个简单的口语练习闭环:

写稿
↓
听标准读法
↓
跟读 / 录音
↓
Whisper 转写
↓
对照检查
↓
AI 润色
↓
再次练习

主要功能


如何使用

语音转写

  1. 打开 SpeakDeck,等待 Whisper 模型自动准备完成;
  2. 选择学生录音;
  3. 点击 开始转写;
  4. 在「转写回放」中逐句听取、搜索和检查;
  5. 需要进一步修改时,点击 复制 AI 润色提示。

如果自动下载模型失败,可以展开「模型设置」,手动下载并导入 tiny.en、base.en 或 small.en。

语音合成

  1. 切换到 语音合成;
  2. 输入或粘贴英文练习稿;
  3. 选择美式 / 英式男女声;
  4. 点击 生成语音;
  5. 在线预听,或下载 WAV 用于跟读和 shadowing。

隐私

Whisper 转写和 TTS 推理主要在用户自己的浏览器中完成。

SpeakDeck 不会把学生录音上传到自己的服务器。

复制 AI 润色提示只会把文本复制到剪贴板;AI 快捷入口也只负责打开对应网站,不会自动提交任何内容。

如果用户自行将文本发送给 ChatGPT、DeepSeek、Kimi 等第三方服务,则适用相应平台自己的隐私政策。


浏览器建议

推荐使用最新版 Chrome 或 Microsoft Edge。

部分 Safari / iOS Safari 对某些 .m4a 音频编码的兼容性可能较差。如果音频无法解析,可以先转换为 MP3 或 WAV。

ffmpeg -i input.m4a -ac 1 -ar 16000 output.wav

技术实现

GitHub Pages
HTML + CSS + Vanilla JavaScript
Whisper.cpp + WebAssembly
Kokoro TTS + ONNX / WASM
IndexedDB model cache

项目保持静态网页、本地优先的设计,不需要账号或独立后端服务器。