在线文字自由发言

将语音转换为 AI 授权转录文本 。 上传音频文件、 麦克风记录或粘贴 URL. 100+ 语言、 10+ 模式、 98+ 准确性 。

使用公开的音频和视频工作。 DRM 保护的内容不支持 。

增强的升级
私人笔记
与笔录聊天
以 Pro 解锁 →
在此拖放文件或单击以浏览文件
MP3、WAV、M4A、FLAC、MP4、MKV、MOV、WebM-至多2GB
增强的升级
私人笔记
与笔录聊天
以 Pro 解锁 →
增强的升级
录音: 0:00
实时 伏( 即时)
增强 耳语( 准确)
公共链接:24小时,仅文本 · 签名 7d+音频 · 职业 用于私人链接的私人链接

文本的实时演讲。 AI 自动校正, 使用较长的演讲, 准确性会提高 。

先测试一下麦克风
❤️ 爱你的STT. AI 告诉你的朋友!
你用的是免费的抄本

免费报名获得600分钟, 或升级为每月5美元,

每天10分钟免费 600分钟免费,有注册 无信用卡 已加密
免费签名 →

1. 上传语音录音

上传音频或视频文件,粘贴URL,或通过麦克风录音。

2. AI将语音转为文字

从10多种AI模型中选择。包含说话人检测和语言自动识别。

3. 导出您的转录文本

支持6种格式下载。分享带音频播放的转录链接。

支持的语音输入格式

语音转文字使用场景

准备好将语音转为文字了吗?

免费开始 →

常见问题

文字演讲(也称为语音识别或ASR)自动将口头音频转换成书面文字。 STT.ai通过AI模式记录您的录音,该模式收听音频和输出的可编辑文本,并配有时标和扬声标签——不需要打字。

音响模型将声波形状映射成通电话,然后语言模型将这些组合成最可能的单词和标点。STT.ai在GPU上用Whiseper 大型V3和NVIDIA 加那利等模型进行88,000次,因此通常在2-3分钟内进行一小时录音。

是的,每个访客都有600分钟的自由时间开始,无需注册,第一个文件无需登记。支付计划从每月5美元开始,增加较长的文件、私人记录和优先处理。

在清洁的演讲中,我们的最佳模式达到95-97%的准确度(基准值是字误差率的3-5% ) 。 使用像样的麦克风和安静的房间,以背景噪音、重口音、交叉话语或低位音频的准确性下降 — — 带来最大的不同。

是的。 请对您的麦克风和 STT.ai 流说, 记录稿通过现场浏览工具现场直播。 您也可以上传已完成的记录, 进行批次抄录, 如果您在谈话时不需要逐字抄录 。

STT.ai承认100+语言,并自动检测大多数音频所用的口语。您也可以手动设定语言,进行小精度升降,混合语言录音则由中剪切处理。

是的。 议长对角化标记每个声音( 发言者1, 发言者2,...) 您可以在编辑中重新命名它们。 这在每一个支持的模式和语言中都起作用 。

STT.ai接受20+格式,包括MP3、WAV、M4A、FLAC、OGG、MP4、MKV、MOV、WebM和AVI。 TXT、SRT、VTT、DOCX、JSON或PDF输出到TXT、SRT、VTT、DOCX、JSON或PDF。

给文字转录的讲稿用词;语音识别(语音识别)决定了卫生组织说。 STT.ai既用文字抄录,又用语音对称,但这两个词都描述了不同的任务。

是的。 音频会默认地被处理和删除。 Pro 计划添加客户端加密, 这样没有您的密钥便无法读取记录誊本, 甚至到 STT.ai, 您的数据也不会在没有明确选择使用的情况下用于示范培训 。

是 STT.ai 有 REST API 与 Python 和 Node.js SDKs 以及 Claude 和 Cursor 的 MCP 服务器 。 免费 API 级别包括 100 分钟/ 月, 每秒开单次超过 100 分钟 。

是的。 每一份笔录都在一个内置编辑器中打开, 您可以在编辑器中修正错误听到的单词, 重命名扬声器, 调整时间戳, 并添加注释。 编辑会持续到每个导出格式中 。