Edite o son editando o texto

Envie o son e a súa transcrición, e logo edite o texto para editar o son. Borra palabras, reordene seccións, elimine palabras de enchido e exporte o son limpo.

1Enviar a & transcripción do son

Solte aquí o ficheiro ou prema para examinar
MP3, WAV, M4A, FLAC, MP4, WebM

2Editar a transcrición

Arrastre os bloques para reorganizalos. Prema no X para borrar un segmento. As edicións non son destrutivas.

segundos
Os segmentos eliminados aparecen tachados. Arrastre para reordenar.

3Previsualizar e exportar

A procesar...

Gratuito & middot; Non se require rexistro & middot; Procesamento 100% do lado do cliente

← Todas as ferramentas
❤️ Como STT.ai?

Precisa a transcrición completa, non só unha ferramenta?

Envíe son ou vídeo ou pegue unha ligazón: transcrición AI en máis de 100 idiomas con detección de falantes. 10 minutos gratuítos ao día, sen rexistro.

Preguntas frecuentes

edición de son executase no navegador: apega un URL, envía un ficheiro ou grava co micrófono. STT.ai escolle o modelo de IA e devolve a transcrición en menos de 5 minutos. Exporta como TXT, SRT, VTT, DOCX, JSON ou PDF.

Si, cada visitante recibe 600 minutos libres para comezar en STT.ai, utilizábeis para edición de son igual que calquera outro fluxo de traballo. Os plans de pago que comezan en $5/ mes desbloquean ficheiros máis longos, transcricións privadas e filas prioritarias.

edición de son funciona cos mesmos modelos de IA que o resto de STT.ai. Os nosos mellores modelos alcanzan o 95- 97% de precisión na fala clara (3- 5% de taxa de erros de palabra nos benchmarks). Troca de modelo ao instante se a primeira pasada está por baixo do obxectivo.

edición de son pode executarse en calquera dos máis de 10 modelos de STT.ai: STT.ai Enhanced (máis preciso), Whisper Large V3 (99 linguas), NVIDIA Canary (# 1 WER nos lang soportados), Whisper Turbo (rápido), Moonshine (ligeiro) e máis.

Si. Todas as transcricións exportanse como SRT ou VTT, funciona con YouTube, Vimeo, TikTok, VLC e todos os principais reprodutores de vídeo. A ferramenta de gravación de subtítulos sobrepónos ao vídeo como subtítulos hardsub.

Si. A diarización dos oradores etiqueta automaticamente cada voz (Orador 1, Orador 2,...) e pode mudarlles o nome no editor incorporado. Funciona en todos os modelos e linguas.

A maioría dos edición de son traballos rematan en menos de 5 minutos. Un ficheiro de son de 1 hora normalmente remata en 2- 3 minutos cos nosos modelos máis rápidos. A velocidade depende do modelo escollido e da carga actual da GPU.

edición de son acepta máis de 20 formatos: MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI e outros. A saída é TXT, SRT, VTT, DOCX, JSON ou PDF.

Si. Os ficheiros de son enviados a edición de son son procesados e eliminados por omisión. Os plans Pro engadirán cifrado do lado do cliente - mesmo se a base de datos de STT.ai é violada, as súas transcricións son ilexibles sen a súa chave. Os datos nunca se empregan para adestramento de modelos sen unha opción explícita.

Si. STT.ai ofrece unha API REST con SDK de Python e Node. js, ademais dun servidor MCP para Claude e Cursor, todo útil para edición de son fluxos de traballo. O nivel de API gratuíto inclúe 100 minutos/ mes.

Si. Cada transcrición ábrese no editor incorporado onde pode corrixir palabras, mudar o nome dos oradores, axustar marcas de tempo e engadir notas. Todos os cambios gárdanse automaticamente.

Cada transcrición obtén un URL único compartible. Exportar a DOCX ou PDF para correo electrónico. Os plans Pro engadirán ligazóns permanentes e protexidas por contrasinal, útiles para o traballo do cliente.

STT.ai xestiona máis de 1300 plataformas, incluíndo YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, hosts de podcasts e máis. A transcrición de URL só funciona con contidos dispoñibles publicamente; non se poden transcreber fontes protexidas por DRM.