同一局域网

配置识别与模型

在同一局域网直连模式下,语音转文字的识别引擎运行在您的电脑本地,手机仅负责高质量近场声音采集。

若选用官方云端中继服务,转录由云端全托管,无需配置任何本地模型即可开箱即用。若希望在局域网内完全离线使用,请参考以下配置指南:

第一步:下载对应语言的本地语音模型

局域网模式下语音在电脑本地完成识别,因此电脑端需要下载对应语言的模型包(仅需下载一次)。软件内置了清晰的语音模型库,按说话语言分类,未经确认不会触发任何后台下载。

  1. 在电脑端:打开 FlowMic → 点击左侧「设置」→ 进入「语音识别」,找到「内置语音模型」配置卡片。
  2. 在「说话语言」下拉菜单中选择您日常口述的母语(不同语言对应各自优化的模型)。
  3. 点击「下载模型(一次性)」。界面会直观展示下载百分比与速度,支持断点续传。
  4. 存储路径调整:卡片下方的「下载文件夹」支持自定义(如系统 C 盘空间受限,建议迁移至大容量存储盘)。
电脑端 · 设置 · 语音识别
内置语音模型
说话语言中文
推荐尚未下载
sherpa-onnx-sense-voice-zh-en-ja-ko-yue-2024-07-17
下载模型(一次性)
下载文件夹D:\FlowMic\models更改

界面示意图:「内置语音模型」卡片支持选择语言、下载模型并管理存储路径。模型库随客户端升级持续丰富。

第二步:确认识别路由——设定语言处理引擎

打开电脑端 FlowMic → 进入「设置」→「语音识别」。所有参数调整实时自动保存并生效,无需多余确认。

电脑端 · 设置 · 语音识别路由配置

设置

改动即保存,立即生效已保存
以下设置作用于「本地局域网」通道(本机自托管服务)。云端中继的识别路由与模型请在网页控制台配置,这里的修改对云端中继无效。
语音识别

每种语言独立选择引擎;找不到配置时会明确报错,不会静默回退。

语言引擎预设Endpoint
zh
内置本地(离线) ▾
(内置引擎无端点)
🗑
*
内置本地(离线) ▾
(内置引擎无端点)
🗑
+ 添加语言测试连接
内置语音模型 ⌄
启用 AI 润色
已关闭 · 即改即存

出厂预置两行基础路由规则:默认包含 zh(中文)与 * (通配其他所有语言),均默认指向本地离线引擎,无需填写外部网络地址。

  1. 语言代码:默认配置常用语言与全局通配符 *,满足绝大多数需求;亦可点击「添加语言」单独配置特定语种。
  2. 引擎预设:选择负责该语言转录的引擎类型,出厂默认推荐「内置本地(离线)」。
  3. 服务地址 (Endpoint):外部服务的接口地址。使用内置离线引擎时无需填写(显示内置引擎无端点);接入局域网私有服务或第三方接口时填写对应服务地址。

完成配置后点击「测试连接」验证链路连通性,测试通过后即可拿起手机开始口述。

引擎预设支持的类型

引擎列表分为明确的几大类别:顶部为开箱即用的内置离线引擎,中间为局域网自建服务(如 FunASR、Whisper),接着是主流云端语音接口,最后提供「自定义」选项以兼容标准化协议。选择对应项会自动预填标准参数。

电脑端 · 引擎预设下拉菜单
内置(离线)
内置本地(离线)出厂默认推荐。直接在电脑 CPU/GPU 上本地运算,无需网络请求。
本地自托管
FunASR (self-hosted, streaming)适用于在局域网服务器上搭建的 FunASR 流式识别集群,填写对应服务器地址。
Whisper large-v3-turbo (self-hosted, batch)适用于局域网自建的 Whisper 识别服务,支持填写内网 API 地址。
SenseVoice-Small (self-hosted)
FunSpeech Paraformer (self-hosted, batch)
云服务
Deepgram使用您自有的 Deepgram 云端 API Key(适用于已有商业账号的团队)。
OpenAI Realtime使用您自有的 OpenAI Whisper 官方 API 接口。
自定义
自定义兼容符合标准协议的任何自建或专有识别网关,端点与参数自主定义。

示意图:下拉菜单清晰罗列了常见预设,选定后请确保端点地址与实际环境相匹配。

AI 润色 / 二次重转:位于语音识别页面底部。建议在基础识别稳定可用后再按需开启润色增强。

语言模型:翻译、整理与深度润色必备

基础文字听写仅依赖语音模型;「跨语种翻译」、「口语结构整理」以及「AI 润色」则由大语言模型(LLM)驱动。只需配置一次,三大高级模式共用。

在电脑端:打开 FlowMic → 点击「设置」→ 语言模型。在「模型预设」下拉中选择您习惯使用的服务商:接口协议、标准端点以及推荐的模型名将自动补全,初次安装默认显示为「请选择」。

支持接入哪些模型服务?

菜单涵盖主流生态:「云服务」包含国内外顶尖商用大模型;「本地自托管」支持完全运行于本地硬件的私有模型;「自定义」支持接入任何兼容 OpenAI 标准的私有网关。

电脑端 · 设置 · 语言模型预设列表
云服务
OpenAI
OpenRouter
DeepSeek
Anthropic Claude
Google Gemini
Groq
Mistral
xAI Grok
本地自托管
vLLM (self-hosted)
Ollama (self-hosted)
LM Studio (self-hosted)
自定义
自定义
  • 接入商业大模型时需使用您在各平台申请的自有 API Key。FlowMic 绝不收集、代发或中转您的第三方密钥,计费由对应服务商独立结算。
  • 选择 Ollama、vLLM 或 LM Studio 等本地框架时,默认填写本地回环地址(如 127.0.0.1:11434)。请确保本地模型已在后台拉起并加载成功。
  • 任何兼容 OpenAI 接口规范的模型服务均可选择「自定义」。手动更改端点或模型名后,预设会自动切换为「自定义」,避免误解。
电脑端 · 设置 · 语言模型配置卡片

设置

改动即保存,立即生效已保存
以下设置作用于「本地局域网」通道(本机自托管服务)。云端中继的识别路由与模型请在网页控制台配置,这里的修改对云端中继无效。
语言模型

整理 / 翻译使用的大模型;「AI 润色」用的也是这一份配置。鉴权失败或模型不可用会明确报错。

模型预设
OpenAI ▾
协议
OpenAI 兼容 ▾
Endpoint
https://api.openai.com/v1
模型
gpt-4o
API Key
sk-••••••••••••••••

示意图:以 OpenAI 预设为例,端点与推荐模型名自动载入,填入您的 API Key 即可快速完成配置。

配置完毕后点击「测试连接」。系统将向端点发起握手请求,检验连通性、密钥合法性与模型有效性,并提供清晰的反馈。

  • API Key 授权说明:密钥由您所选择的模型托管方签发。本地私有模型(如 Ollama)通常无需填写任何密钥即可直接连通。
  • 「实时」模式完全独立:实时听写模式完全不依赖语言模型,即使未配置大模型亦可随时畅快使用。
  • 网络不可达、密钥无效或模型名称错误均有明确的分类错误提示,便于快速排查定位。

服务地址必须确保这台电脑能正常访问。若模型搭建在局域网内其他服务器上,可在浏览器中先行访问该 IP 进行排查。

内置本地识别必须确保已成功下载对应语种模型包。模型就绪前若按住说话将提示错误,期间可使用键盘手动投递备用。