Vapaa tekoäly Puhe tekstille

Kuvaa ääni ja video tekstiksi 100+ kielellä. Useita Whisper-malleja. Kaiuttimen tunnistusta ei tarvita.

12K
Transkriptiot
290.3K
minuutteja kaiverrettu
100+
kielet
70+
ilmaisia työkaluja

Toimii julkisesti saatavilla olevan äänen ja videon kanssa. DRM-suojattua sisältöä ei tueta.

Parannuksia parannuksiin
Yksityinen asiakirja
Juttele transkriptin kanssa
Avaa Pron kanssa →
Jätä tiedosto tähän tai napsauta selataksesi
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM – enintään 2GB
Parannuksia parannuksiin
Yksityinen asiakirja
Juttele transkriptin kanssa
Avaa Pron kanssa →
Parannuksia parannuksiin
Tallennus: 0:00
Reaaliaikainen Vosk (instant)
Tehostettu Kuiskaaja (tarkka)
Julkiset linkit: 24h, vain teksti · Rekisteröidy 7d+-äänelle · Pro yksityisille linkeille

Reaaliaikainen puhe tekstiksi. Tekoäly korjaa automaattisesti puhuessasi – tarkkuus paranee pidemmällä puheella.

Testaa mikrofonisi ensin
❤️ Love STT.ai? Tell your friends!
Käytit ilmaisia transkriptioitasi.

Rekisteröidy ilmaiseksi 600 minuuttia tai päivitä $5 kuukaudessa tuhansille muille.

10 ilmaista min/päivä 600 min ilmaiseksi ilmoittautumalla Ei luottokorttia Salattu
Rekisteröidy ilmaiseksi →
Client-Side Salattu Varasto — Selostuksesi on salattu selaimeesi, emmekä edes me pysty lukemaan niitä. Opi, miten se toimii →

Miten STT.ai toimii

Kolme askelta tarkassa transkriptiossa

1. Lataa, tallenna tai liitä URL

Vedä ja pudota kaikki ääni- tai videotiedostot (MP3, WAV, MP4 ja 20+ formaatit). Tallenne mikrofonista reaaliaikaisesti. Tai liitä linkki YouTubesta, Vimeosta, TikTokista ja 1300+-alustoista.

2. Tekoäly kirjoittaa mallivalintaasi

Valitse Whisper-malli, joka sopii: Parannettu (iso-v3, tarkin), Turbo (nopea, oletus), Keski- tai Pieni. Automaattinen kieli 99 vaihtoehdosta. Kaiuttimen diarisointi tunnistaa, kuka sanoi mitäkin.

3. Vie, Jaa tai Integrate

Lataa TXT-, SRT-, VTT-, DOCX-, JSON- tai PDF-muodossa. Jaa linkin kautta. Käytä API-rajapintaamme, jotta voit integroida transkriptiosi sovellukseesi. Täydellinen tekstitykseen, kokousmuistiinpanoihin, podcastiin ja muuhun.

100+
Kieliä tuetaan
70+
Vapaat työkalut
1,300+
Alustat tuettu
7
Vie muodot

Kehittäjä-Ensimmäinen API

Integroi puheento-teksti sovellukseen muutamassa minuutissa. Restful API reaaliaikaisella WebSocket-suoratoistolla.

REST + WebSocket — Tiedoston lataaminen ja reaaliaikainen suoratoisto
Useita malleja — Whisper Turbo, suuri V3, keskikokoinen ja pieni
Kaiuttimen diarisointi — Automaattitunnistin, joka sanoi mitä
Joustava ulostulo — JSON, TXT, SRT, VTT ja aikaleimat
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Oletko valmis kirjoittamaan?

Lataa ensimmäinen tiedosto ilmaiseksi. Ei luottokorttia, ei ilmoittautumista. 600 minuuttia aikaa aloittaa vapaalla.

Aloita uudelleen kirjoittaminen

Usein kysyttyjä kysymyksiä

puhe tekstiin toimii selaimessasi: liitä URL, lataa tiedosto tai tallenna mikkiisi. STT.ai valitsee tekoälymallin ja palauttaa sen alle 5 minuutissa. Vie TXT:nä, SRT:nä, VTT:nä, DOCX:nä, JSONina tai PDF:nä.

Kyllä – jokainen vierailija saa 600 vapaaminuuttia aloittaakseen STT.ai:sta, jota voidaan käyttää puhe tekstiin samaan kuin mitä tahansa muuta työnkulkua. Maksamattomat suunnitelmat alkaen 5 dollarista kuukaudessa avaavat pidemmät tiedostot, yksityiset selostukset ja jonotuksen.

puhe tekstiin kulkee samoilla tekoälymalleilla kuin muut STT.ai – parhaat mallimme saavuttavat 95-97 prosentin tarkkuuden puhtaassa puheessa (3-5 % Word Error Rate on betabices). Vaihda lennossa olevia malleja, jos ensimmäinen syöttö on alle tavoitteesi.

puhe tekstiin voi pyöriä millä tahansa Whisper-mallilla STT.ai isäntää: STT.ai Enhanced (Whisper large-v3, tarkin, maksullisilla suunnitelmissa), Whisper large V3, Whisper Turbo (nopea), Whisper Medium ja Whisper Small.

Kyllä. Jokainen SRT:n tai VTT:n transkriptiovienti toimii YouTuben, Vimeon, TikTokin, VLC:n ja kaikkien suurten videoiden kanssa. Kirjoitustekstin työkalu peittää ne videolle kovakuorisina.

Kyllä. Kaiuttimen diaariointi määrittää automaattisesti jokaisen äänen (kaiuttimet 1, Speaker 2,...) ja voit nimetä ne uudelleen sisäänrakennetussa editorissa. Toimii kaikissa malleissa ja kielissä.

Useimmat puhe tekstiin työt päättyvät alle viidessä minuutissa. 1 tunnin äänitiedosto on yleensä valmis 2-3 minuutissa nopeimmilla malleissamme. Nopeus riippuu valitusta mallista ja nykyisestä GPU-kuormasta.

puhe tekstiin hyväksyy 20+ formaattia: MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI ja paljon muuta. Teho TXT:lle, SRT:lle, VTT:lle, DOCX:lle, JSON:lle tai PDF:lle.

Kyllä. Äänitiedostoja, jotka lähetetään puhe tekstiin-palvelimelle, käsitellään ja poistetaan oletuksena. Pro-suunnitelmat lisäävät asiakaspuolen salausta – vaikka STT.ai:n tietokantaa rikottaisiin, transkriptiosi eivät ole luettavissa ilman avainta. Tietoja ei koskaan käytetä mallikoulutukseen ilman selkeää opt-in-järjestelmää.

Kyllä. STT.ai tarjoaa REST API:n, jossa on Python ja Node.js SDK:t sekä MCP-palvelimen Claudelle ja Cursorille. Kaikki on käyttökelpoista puhe tekstiin työnkulkuun. Vapaa API-taso sisältää 100 minuuttia kuukaudessa.

Kyllä. Jokainen transkripti avautuu sisäänrakennetussa muokkaimessa, jossa voit korjata sanoja, nimetä kaiuttimet uudelleen, säätää aikaleimat ja lisätä muistiinpanoja. Kaikki muutokset tallentuvat automaattisesti.

Jokainen transkripti saa ainutlaatuisen jaettavan URL-osoitteen. Vie DOCX- tai PDF-muodossa sähköpostiin. Pro suunnittelee lisäävänsä salasanasuojattuja ja pysyviä linkkejä, jotka ovat hyödyllisiä asiakastyön kannalta.

STT.ai käsittelee 1 300+ alustaa, kuten YouTubea, Vimeota, TikTokia, SoundCloudia, Zoomia, Google Meetiä, podcast-palvelimia ja muuta. URL-transkriptio toimii vain julkisesti saatavilla olevalla sisällöllä – DRM-suojattuja lähteitä ei voi kirjoittaa.