🔍 一、本机环境检测
🔄 正在检测本地转写服务...
说明:浏览器无法直接检查您电脑上的 Python / Whisper / ffmpeg,因此以下「前提条件」需您在本机命令行自行确认;本页可自动检测的是「本地转写服务」是否已在运行。
组件说明(均可由「一键安装」脚本自动搞定,一般无需手动确认):
- ① Python 3.9~3.13:安装脚本会自动安装——优先使用本机已有兼容 Python,若没有则自动下载内嵌版 Python 3.13,无需您手动装。
- ② ffmpeg:Windows / macOS 上音频解码(PyAV)自带,一般无需安装;仅 Linux 上如报错可
apt install ffmpeg。
- ③ faster-whisper / flask / flask-cors / av:由「一键安装」脚本自动安装。
- ④ funasr / torch(方言识别用):同样由「一键安装」脚本自动安装;若只需普通话可忽略,不影响普通话转写。
⚠️ 若上述命令提示「不是内部或外部命令」,说明对应组件未安装,请先按下方步骤安装。
📦 二、下载插件
点击下方按钮,一次性下载整个插件压缩包(zip,含 server.py / install.* / start.* / README):
📥 下载说明:点击后浏览器会下载一个 zip 文件,解压到任意文件夹即可,无需逐个下载。解压后运行里面的 install 脚本会自动装好全部依赖。
⚙️ 三、一键安装依赖
- 把下载的 zip 解压到任意文件夹(如
D:\meeting-plugin\)。
- Windows:双击运行
install.bat;Mac / Linux:在终端执行 bash install.sh。
- 脚本会自动安装 Python 3.13(如本机没有)与全部依赖:
faster-whisper、flask、flask-cors、av、funasr + torch。请保持窗口打开直到出现「安装完成」(funasr/torch 约数百 MB,耗时稍长)。
- 方言模型(SenseVoice,约 230MB)会在您首次选择方言(上海话/粤语/四川话/自动检测)转写时自动从 ModelScope 下载,请保持网络畅通;之后缓存复用。
- 极少数 Linux 环境若提示缺少 ffmpeg,请
apt install ffmpeg;Windows / macOS 一般无需处理。
🚀 安装脚本已默认使用阿里云 PyPI 镜像(mirrors.aliyun.com)加速依赖下载,并在无兼容 Python 时自动下载内嵌版 Python 3.13,无需手动切换或配置。
▶️ 四、启动本地服务
- Windows:双击
start.bat;Mac / Linux:终端执行 bash start.sh。
- 首次启动会自动下载 Whisper 模型(约 150MB~1.5GB,取决于模型大小),请耐心等待,不要关闭窗口。
- 出现「Running on http://127.0.0.1:8765」即表示服务已启动。保持该窗口常开。
🌐 模型下载已通过 HF_ENDPOINT=https://hf-mirror.com 自动走国内 HuggingFace 镜像加速,无需翻墙或手动配置;网络正常时通常几分钟即可完成。
💡 启动后回到「会议纪要」页面,刷新即可看到「✅ 本地转写服务已连接」。
📝 五、回到 AIPM 使用
- 打开 AIPM → 施工监理 → 会议纪要。
- 在「会议录音本地转写」卡片,切到 📁 文件转写,点击或拖拽上传多个录音文件。
- 上传区可选择 识别模型(普通话:medium / small / base)与 识别语言:普通话走 faster-whisper;上海话 / 粤语 / 四川话 / 自动检测 走 FunASR(原生支持方言,CPU 实时)。
- 本机服务会自动逐个转写并将多个录音合并为一个文档;转写进行时会弹出桌面悬浮进度窗,关闭网页也不影响。
- 点击「⬆️ 汇总文本上传」,即把合并文本上传 AIPM,由管理员配置的 AI 按所选模板与参与单位生成会议纪要(默认只讲结论)。
- 也可使用 🎤 实时录音(需 Chrome / Edge)或 📋 粘贴文字。
🛠️ 六、常见问题
- 页面提示「需要安装本地转写插件」:本地服务未启动或未安装。请先完成第三、四步,再刷新页面。
- 首次转写很慢 / 卡住:正在下载 Whisper 模型(普通话)或 SenseVoice 方言模型(首次选方言时),等待其下载完成即可;之后复用缓存。
- 选了方言却提示「未安装 funasr」:安装脚本未完整执行。请重新运行
install.bat / install.sh,确认出现「安装完成」且含 funasr。
- 录音文件转写失败:确认已安装
ffmpeg,且录音格式受支持(MP3/M4A/WAV/FLAC/OGG/WEBM/AAC)。
- 实时录音无反应:Web Speech API 仅 Chrome / Edge 支持中文,请更换浏览器,或改用文件转写 / 粘贴文字。
- 端口被占用:若 8765 被占用,可编辑
server.py 中的端口后重启服务。
← 返回会议纪要页开始使用