首页
/
行业洞察
/
正文
INDUSTRY INSIGHT · 深度
FunASR Windows 安装教程:10 分钟跑通离线语音识别
📅 2026/9/7 1:54:05
✍️ 爱科研究院
👁 阅读 3,247
FunASR Windows 安装教程10 分钟跑通离线语音识别【免费下载链接】FunASROpen-source speech recognition toolkit for training, inference, streaming ASR, VAD, punctuation, speaker diarization pipelines, and OpenAI-compatible/MCP serving.项目地址: https://gitcode.com/GitHub_Trending/fun/FunASRFunASR 是阿里巴巴达摩院开源的语音识别工具包。这篇指南帮你在 Windows 上完成 FunASR 安装把一段音频文件转成带标点的文字并顺手验证服务是否真的部署成功。全程用官方示例脚本不用写一行代码。先说它能做什么离线文件转写批量音频转文字、实时语音听写边说边出结果句尾用离线模型修正、语音端点检测自动判断哪里是说话、哪里是静音、标点恢复。下面的主线是装好 → 看到第一条识别结果 → 确认没装错 → 排掉常见坑。动手前的环境检查一次过掉四个前提能省下后面一半的排查时间。64 位 Windows 10/1164 位系统在设置 → 系统 → 系统信息里能看到系统类型32 位版本装不了需要换系统。Python 3.8 及以上FunASR 的服务端是 Python 脚本python --version能正常输出版本号即可。磁盘留 3GB 以上空间首次启动会自动从 ModelScope 拉取 Paraformer 等模型下载完成前别关终端。端口 10095 空闲这是 FunASR 服务的默认端口被别的程序占着就先停掉占用者或者启动时换一个端口。如果你打算处理 mp3 这类封装格式顺手装一下 ffmpegwinget install ffmpeg纯 wav 文件则不需要。从克隆到出结果的完整闭环这一节照抄命令就行。FunASR 仓库提供了现成的 websocket 服务端和客户端脚本位于runtime/python/websocket/目录服务端负责推理客户端负责送音频、收文字。克隆仓库并装依赖git clone https://gitcode.com/GitHub_Trending/fun/FunASR cd FunASRpip install -U modelscope funasrcd runtime/python/websocket pip install -r requirements_server.txt国内网络慢的话第二条命令可以加-i https://mirror.sjtu.edu.cn/pypi/web/simple换源。启动识别服务python funasr_wss_server.py --port 10095 --certfile 0首次运行会下载 VAD、ASR、标点三类模型耗时视网速而定。看到终端提示服务就绪说明服务端已监听 10095 端口。--certfile 0用来关闭 SSL 加密——默认服务带 SSL 证书新手本地测试先关掉少一类连接报错将来要跨机器访问再打开。连上客户端拿到第一条识别结果python funasr_wss_client.py --host 127.0.0.1 --port 10095 --mode offline --audio_in ../../funasr_api/asr_example.wav--mode offline表示走离线链路整段音频送入返回带标点的完整文字。终端开始逐句打印识别文本就是跑通了。仓库里自带了测试音频runtime/funasr_api/asr_example.wav不需要自己找素材。想试实时效果把--mode offline换成--mode 2pass不传--audio_in客户端会直接读麦克风。装完后如何确认一切正常验证分三步每一步都有明确预期看服务端终端无 Traceback模型加载日志走完进程一直在跑别关这个窗口。查端口另开一个终端执行netstat -ano | findstr 10095能查到一条 LISTENING 记录说明服务真的在监听。跑一次完整识别按上一节的客户端命令再跑一遍输出文字内容和你音频里说的话一致、且带标点——中文里出现的、。就说明标点模型也加载了。三步都过部署就算完成。想多验证一次把--audio_in换成自己的 wav 文件再跑结果写入--output_dir ./results目录方便核对。卡住了先查这四件事按出现概率从高到低排。装不上或报 DLL 错误基本是 32 位 Python 或 32 位系统python -c import struct; print(struct.calcsize(P)*8)输出 64 才算正常。客户端连不上九成是端口或 SSL 不匹配。服务端关了--certfile 0客户端才能走ws://明文连接两边要一致端口号两端也要一致。端口 10095 被占用服务端启动时报 address already in use。用netstat -ano | findstr 10095找到占用进程或者服务端、客户端同时改成别的端口比如 10096。杀软拦截模型下载模型文件从网络拉取时偶尔会被实时防护拦掉表现为下载卡住或文件校验失败。把 FunASR 目录加入信任区重新运行服务端即可。进阶玩法热词、自定义模型与 API三个方向各给一个入口够你下一步查下去。热词在模型目录下放一个hotwords.txt每行一个词格式是词语 权重例如达摩院 20启动服务端时加--hotword指向它专有名词的识别率会明显上来。自定义模型服务端用--asr_model指定你在 ModelScope 上的模型名或直接给本地目录把自己微调过的 Paraformer 换进去即可其余参数不动。API 集成服务端本身就是一个 websocket 服务任何语言都能当客户端。仓库里有现成的 Python 封装类三步完成创建识别器 → 送入音频 → 取最终结果参考 websocket 客户端示例。C# 调用可看 runtime/csharp/协议细节在 websocket_protocol_zh.md。接下来往哪里看部署总览和各版本软件包说明runtime/readme_cn.md快速上手含 Docker 部署方式runtime/quick_start_zh.md服务端/客户端全部参数表runtime/python/websocket/README.md模型清单model_zoo/modelscope_models.md把上面三个入口的示例各跑一遍你就同时拥有了离线转写、实时听写和服务化部署三种用法。遇到问题先去 runtime/readme_cn.md 对照版本号查再进官方社区群提问。【免费下载链接】FunASROpen-source speech recognition toolkit for training, inference, streaming ASR, VAD, punctuation, speaker diarization pipelines, and OpenAI-compatible/MCP serving.项目地址: https://gitcode.com/GitHub_Trending/fun/FunASR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📌 标签:
工业官网
设计趋势
AI 建站
SEO
获取完整报告 →
RELATED ARTICLES
推荐阅读
2026/9/7 1:49:04
纯Win32 GDI实战:从零构建一个极简画图工具
2026/9/7 1:49:04
奶茶品牌战略规划实战:从定位到落地的92页方案拆解
2026/9/7 1:49:04
LTspice仿真RC吸收电路:从振铃原理到参数扫描与功耗权衡
2026/9/7 3:59:13
上门取件快递小哥迟迟不来?8年老鸟教你几招搞定
2026/9/7 3:59:13
RuView 的 api-docs Agent 设计:一份受控的 OpenAPI 文档专家工作流
2026/9/7 3:59:13
Spring Boot整合Hibernate与MySQL:手把手实现增删改查接口
2026/9/7 3:59:13
字符排序器:决定排序先后顺序的隐藏规则,中文拼音、数据库COLLATE一次讲清
2026/9/7 3:59:13
Claude Code 并非永久免费:API 按量计费与本地开发工具解析
2026/9/7 3:54:13
MySQL Connector/NET 6.8.3 免安装版实战:从DLL引用到部署排查
2026/9/7 0:03:59
基于YOLOv8和PyQt5的麦穗稻穗检测识别系统设计与实现
2026/9/7 0:03:59
UL 1642锂电池安全标准全解析:测试项目、认证流程与避坑指南
2026/9/7 0:03:59
BS EN 13814-1-2019游乐设施安全标准:设计与制造核心要点解析
2026/9/7 0:22:31
超人会飞不算本事:系统稳定依赖清晰规则与边界设计
2026/9/7 0:44:48
超人VS蜘蛛侠:拆解超级IP的影响力与传播方法论
2026/9/7 1:55:33
基于CNN的调制信号识别:MATLAB实现时频图分类实战