跳过主要内容

实时转写

选择后才会启动麦克风

00:00

你的文字会显示在这里

开始录音,或打开预置演示查看说话人轮次和中英混合文字。

在线实时转写:边说边生成文字

在说话过程中把语音变成可读文字。上方工作台可在浏览器支持时调用麦克风,显示中间和最终识别结果、记录经过时间,并复制或下载 TXT 文本。它适合快速笔记和初稿,不需要先上传文件。

直接回答

实时转写是一种基于浏览器的语音转文字流程,会在你说话时把麦克风音频变成中间和最终文本。选择最接近的识别语言,点击开始并允许麦克风权限即可。浏览器支持、收音距离、噪声、口音、姓名和多人重叠说话都会影响结果,重要内容必须人工复核。

Muse Voice Transcribe 是独立的浏览器工具,与 Meta 没有关联。本页只描述上方可实际测试的能力。

最后更新:

录音前先检查真实输出格式

点击工作台中的“改为打开预置演示”,可载入一段固定的四轮对话。示例包含两个说话人标签、四个时间点和一段中英混合文本,可以复制或下载为 TXT。它是产品样例,不是客户录音、准确率测试或用户评价。

预置输出
Speaker A [00:04]: Thanks for joining. Let us start with the interview questions.
Speaker B [00:09]: 当然,我已经准备好了。The first topic is the launch timeline.
Speaker A [00:15]: Great. I will keep the transcript open while we talk.
Speaker B [00:21]: Perfect. We can review the final text before sharing it.

预置内容只证明界面和导出格式。麦克风模式由浏览器返回实时识别结果,并统一标记为“你”,不会在这个纯浏览器流程中自动区分多人。浏览器不支持识别时,工作台会明确提示。

本工作台的可核验事实

本工作台的可核验事实
项目
预置转写4 个轮次 / 21 秒
识别语言5 种选择
实时说话人标签
预置说话人标签Speaker A / Speaker B
导出格式仅 TXT
浏览器兼容范围未发布
识别延迟未测量
音频录音库不提供

来源:本页可见工作台和预置转写。核验日期:2026 年 9 月 3 日。

实时转写工作台能做什么

每项能力都可以直接在页面上验证,不依赖隐藏功能。

浏览器麦克风识别

只有点击开始并授权后才会调用麦克风。识别引擎会返回中间或最终文字,页面加载时不会静默打开麦克风。

五种识别语言

可选择美式英语、英式英语、普通话、西班牙语或法语。这是识别语言设置,不是自动语言检测或翻译。

暂停、完成和重开

对话暂停时停止识别,完成后进入复查,也可以清空文本开始新会话。计时器只提供时间参考,并不对应已保存的录音。

复制和 TXT 下载

有文字后可以复制或下载纯文本。本页暂不提供字幕、DOCX、摘要、录音保存或分享链接。

如何使用实时转写

正式开始前先做简短测试,比在嘈杂环境中直接录入更可靠。

  1. 01

    选择主要语言

    选择最符合主要说话人的语言。如果中途更换语言,建议结束当前会话、调整设置后重新开始。

  2. 02

    开始并允许麦克风

    点击开始,响应浏览器权限提示,靠近麦克风并尽量一次只让一个人说话。

  3. 03

    观察实时初稿

    中间结果会随着上下文而变化。发现姓名、数字或关键决定有误时,先做标记,结束后对照来源复核。

  4. 04

    完成、复查并导出

    停止后通读全文,核对重要细节,再复制或下载 TXT。需要逐字准确时应另行保留合规录音。

实时语音转文字适合哪些场景

它适合即时看到初稿比等待精修稿更重要的场景。

会议和工作讨论

为短会生成持续文字初稿,结束后人工提取决定和行动项,并向参与者确认负责人。

采访和用户研究

边听边查看回答,标记需要追问的段落。引用前仍需对照经同意保存的原始录音。

课堂、口述和辅助阅读

生成课堂提纲、口述初稿或视觉文字辅助。它不是经过认证的字幕或紧急沟通服务。

实时转写的限制与保护措施

使用前应明确以下边界。

准确率取决于音频

噪声、距离、回声、语速、口音、专业词、姓名、数字和重叠说话都会造成错误。

并非所有浏览器都支持

实时流程依赖麦克风权限和兼容的语音识别接口,不支持时请使用预置样例检查界面。

敏感内容先确认隐私规则

本页不承诺识别始终在设备本地完成。请检查浏览器和网站隐私政策并取得参与者同意。

麦克风模式不是说话人分离

实时结果统一标为“你”。预置样例中的两个标签只展示格式,不代表自动多人识别。

浏览器语音识别参考来源

实时流程依赖浏览器 API。以下公开文档说明本页涉及的权限和识别接口。

常见问题

可以免费试用实时转写吗?+

可以,无需账号即可打开预置样例或尝试麦克风。实时能力仍取决于浏览器支持和权限。

页面会保存我的音频吗?+

当前工作台只生成文字,不提供音频下载或录音库,也不代表识别始终在本地完成。

为什么文字在说话时会变化?+

实时引擎会先返回中间猜测,再结合后续上下文修正。停止后应复核最终内容。

能自动区分不同说话人吗?+

不能。麦克风模式统一标记为“你”,两个说话人只存在于预置格式样例中。

能上传音频或导出字幕吗?+

不能。当前仅支持兼容浏览器的麦克风输入和 TXT 导出。

继续选择合适的转写流程

需要理解多人标签时查看说话人分离页面,需要会议复查清单时查看会议转写页面,也可以返回 Muse Voice Transcribe 产品介绍。

在浏览器中开始实时转写

选择语言,点击开始并说一句测试内容,确认结果后再进行较长会话。

返回转写工作台