在线文字自由发言
将语音转换为 AI 授权转录文本 。 上传音频文件、 麦克风记录或粘贴 URL. 100+ 语言、 10+ 模式、 98+ 准确性 。
1. 上传语音录音
上传音频或视频文件,粘贴URL,或通过麦克风录音。
2. AI将语音转为文字
从10多种AI模型中选择。包含说话人检测和语言自动识别。
3. 导出您的转录文本
支持6种格式下载。分享带音频播放的转录链接。
语音转文字模型
选择适合您需求的AI模型——或让我们为您选择最佳模型。
支持100多种语言的语音转文字
准备好将语音转为文字了吗?
免费开始 →常见问题
文字演讲(也称为语音识别或ASR)自动将口头音频转换成书面文字。 STT.ai通过AI模式记录您的录音,该模式收听音频和输出的可编辑文本,并配有时标和扬声标签——不需要打字。
音响模型将声波形状映射成通电话,然后语言模型将这些组合成最可能的单词和标点。STT.ai在GPU上用Whiseper 大型V3和NVIDIA 加那利等模型进行88,000次,因此通常在2-3分钟内进行一小时录音。
是的,每个访客都有600分钟的自由时间开始,无需注册,第一个文件无需登记。支付计划从每月5美元开始,增加较长的文件、私人记录和优先处理。
在清洁的演讲中,我们的最佳模式达到95-97%的准确度(基准值是字误差率的3-5% ) 。 使用像样的麦克风和安静的房间,以背景噪音、重口音、交叉话语或低位音频的准确性下降 — — 带来最大的不同。
是的。 请对您的麦克风和 STT.ai 流说, 记录稿通过现场浏览工具现场直播。 您也可以上传已完成的记录, 进行批次抄录, 如果您在谈话时不需要逐字抄录 。
STT.ai承认100+语言,并自动检测大多数音频所用的口语。您也可以手动设定语言,进行小精度升降,混合语言录音则由中剪切处理。
是的。 议长对角化标记每个声音( 发言者1, 发言者2,...) 您可以在编辑中重新命名它们。 这在每一个支持的模式和语言中都起作用 。
STT.ai接受20+格式,包括MP3、WAV、M4A、FLAC、OGG、MP4、MKV、MOV、WebM和AVI。 TXT、SRT、VTT、DOCX、JSON或PDF输出到TXT、SRT、VTT、DOCX、JSON或PDF。
给文字转录的讲稿用词;语音识别(语音识别)决定了卫生组织说。 STT.ai既用文字抄录,又用语音对称,但这两个词都描述了不同的任务。
是的。 音频会默认地被处理和删除。 Pro 计划添加客户端加密, 这样没有您的密钥便无法读取记录誊本, 甚至到 STT.ai, 您的数据也不会在没有明确选择使用的情况下用于示范培训 。
是 STT.ai 有 REST API 与 Python 和 Node.js SDKs 以及 Claude 和 Cursor 的 MCP 服务器 。 免费 API 级别包括 100 分钟/ 月, 每秒开单次超过 100 分钟 。
是的。 每一份笔录都在一个内置编辑器中打开, 您可以在编辑器中修正错误听到的单词, 重命名扬声器, 调整时间戳, 并添加注释。 编辑会持续到每个导出格式中 。