གསལ་བཤད་པ་ངོས་འཛིན & Diarization

སྒྲ་སྙན་དང་པར་གཞི་ནང་ལུ་ ཁ་སླབ་མི་སོ་སོ་ཚུ་ ངོས་འཛིན་འབད་དེ་ མིང་བཏགས་ ངོ་སྤྲོད་འབད། གང་ཞིག་སླབ་མི་དེ་ཤེས་ལ།

ཡོངས་ཁྱབ་ཀྱི་སྒྲ་འཕྲིན་དང་པར་འཕྲིན་དང་གཅིག་ཁར་ལཱ་འབད་དོ། DRM གིས་སྲུང་སྐྱོབ་འབད་དེ་ཡོད་མི་ནང་དོན་ཚུ་རྒྱབ་སྐྱོར་འབད་མི་ཚུགས།

གོང་འཕེལ་གྱི་དོན་ལས་ཡར་རྒྱས་གཏོང་བའི་
སྒེར་གྱི་ཡིག་སྒྱུར་
ཁ་སླབ་པའི་སྐབས་ཀྱི་ཡིག་སྒྱུར་
རྩོལ་མེད་ Pro →
ཡིག་ཆ་འདི་འདིར་བཀལ་ཡང་ན་བལྟ་སྐོར་གྱི་དོན་ལུ་བལྟ།
དྲ་རྒྱའི་ཡིག་གཟུགས་ཀྱི་ནང་དོན་ལ་ MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM སོགས་ཀྱི་ཡིག་གཟུགས་ཀྱི་ནང་དོན་ཚུད་དོ།
གོང་འཕེལ་གྱི་དོན་ལས་ཡར་རྒྱས་གཏོང་བའི་
སྒེར་གྱི་ཡིག་སྒྱུར་
ཁ་སླབ་པའི་སྐབས་ཀྱི་ཡིག་སྒྱུར་
རྩོལ་མེད་ Pro →
གོང་འཕེལ་གྱི་དོན་ལས་ཡར་རྒྱས་གཏོང་བའི་
དྲན་ཐོ་: 0:00
དུས་རྒྱུན་ ཝོསི་ཀི (དུས་ཡུན་ཐུང་ཀུ)
རྒྱ་སྐྱེད་ སྒྲ་དྲི་རོ་རེག་བྱ (ཐད་ཀར་)
ཡོངས་ཁྱབ་ཀྱི་འབྲེལ་མཐུད་: 24h, ཡིག་ཆ་རྐྱངམ་གཅིག་ · ཐོ་བཀོད་འབད། བོད་ཡིག་གི་ཡིག་ཚགས་ · ཁྱད་ཆོས་ སྒེར་གྱི་འབྲེལ་བའི་དོན་ལུ་

ངོ་མའི་དུས་སྐབས་ཀྱི་སྐད་ཡིག་ཡིག་ཆ་. AI རང་དབང་-བཟོ་བཅོས་འདི་སྐད་ཡིག་འདི་སྐད་བཤད་ - ཐད་ཀར་སྒྲ་

འགོ་དང་པ་རང་རང་གི་མའི་ཀོརོ་ཕིཊ་ཊིཀ་འདི་བརྟག་དཔྱད་འབད།
❤️ STT.ai ལ་དགའ་བ་ཡིན་ན། ប្រាប់ཨང་གྲངས་འདི་ཁྱོད་ཚོའི་ཆ་རོགས་ལ་ཡང་བཤད།
ཁྱེད་ཀྱིས་རང་དབང་གི་ཡིག་སྒྱུར་འདི་བེད་སྤྱོད་བཏང་སྟེ་འདུག

600 នាទីཐོབ་ནི་དོན་དམ་མེད་དུ་ཐོ་བཀོད་འབད། ཡང་ན་ གོང་འཕེལ་བཏང་སྟེ་ $5/month ལས་ སྟོང་ཕྲག་མང་པོ་ལྷག་མ་ཐོབ་ཅི།

10 སྒེར་གྱི་མནན/ཉིན། 600 នាទីམྱུར་ལམ་ནས་བལྟས་ དངུལ་དངུལ་ཁང་མེད་པར་ ཡིག་ཆ་གཏན་ལ་ཕབ་པ།
ཐོ་བཀོད་ ཐོ་བཀོད་ →

སྐད་བརྡ་རིག་པའི་སྐད་བརྡ་རིག་པ་ཟེར་བ་དེ་ག་དེ་ཡིན་ནམ།

སྐད་བརྡ་མཁས་པ་ད་རེས་ནངས་པའི་སྐད་བརྡ་མཁས་པ་ཚོའི་ནང་དོན་དང་འབྲེལ་བའི་གནད་དོན་ཁག་ཅིག་ལ་གཙོ་བོར་བསྟེན་དོ་ཡོདཔ་མས། སྐད་བརྡ་མཁས་པ་ད་རེས་ནངས་པའི་སྐད་བརྡ་མཁས་པ་ཚོའི་ནང་དོན་དང་འབྲེལ་བའི་གནད་དོན་ཁག་ཅིག་ལ་གཙོ་བོར་བསྟེན་དོ་ཡོདཔ་ཨིན། This is essential for multi-speaker recordings like meetings, interviews, podcasts, conference calls, and legal proceedings where knowing who said what is just as important as what was said.

STT.ai uses advanced neural speaker diarization models that can detect and label speakers in real time. The system creates speaker embeddings -- numerical representations of each voice's unique characteristics -- and clusters them to distinguish between different people. This works even when speakers have similar voices or frequently interrupt each other.

གསལ་བཤད་པ་ངོས་འཛིན་བྱེད་པའི་ཐབས་ལམ་

1. སྒྲ་འཕྲིན་གྱི་ལས་སྣོན་བརྟག་དཔྱད་

ལམ་ལུགས་འདི་གིས་ སྒྲ་བརྒྱུད་ཀྱི་ནང་ལུ་ གསལ་བཤད་དང་ སྒྲ་མེད་པའི་ སྙན་ཆ་ ཡང་ན་ རྒྱབ་རྟེན་གྱི་སྒྲ་བརྒྱུད་ཚུ་ ངོས་འཛིན་འབདཝ་ཨིན།

2. སྒྲ་སྐད་བཀོལ་སྤྱོད་

སྐད་ཡིག་ཆ་ཤས་རེ་རེ་ སྒྲ་སྐད་ནང་འཛུགས་པའི་ སྒྲ་སྐད་ཅིག་ལུ་འགྱུར་བཅོས་འབད་དོ་ཡོདཔ་ཨིན། སྒྲ་སྐད་ཀྱི་ཁྱད་ཆོས་ངོ་མ་ཚུ་ སྒྲ་སྐད་ནང་འཛུགས་པའི་ སྒྲ་སྐད་ཅིག་ལུ་འགྱུར་བཅོས་འབད་དོ་ཡོདཔ་ཨིན།

3. སྡེ་ཚན་བཟོ་ & རྟགས་བཀོད

embeddings ཚུ་སྡེ་ཚན་དུ་བསྡོམས་ཏེ་ ཅོག་འཐདཔ་ཡོད་མི་ speaker གི་ segment ཚུ་སྡེ་ཚན་དུ་བསྡོམས་ཏེ་ རེ་རེ་བཞིན་ label རེ་རེ་ asignated འབད་དོ་ཡོདཔ་ཨིན། (Speaker 1, Speaker 2, etc.)

སྒྲ་སྐད་ངོས་འཛིན་བྱེད་པའི་ ལག་ལེན་གྱི་གནད་དོན་

ཚོགས་འདུའི་ཡིག་སྒྱུར་
ཚོགས་འདུའི་ཐོ་བཀོད་ནང་ལུ་ བཅའ་མར་གཏོགས་མི་ག་རའི་མིང་ཐོ་ རང་དབང་དུ་བཏོན་ཚུགས། གསལ་ཏོག་ཏོ་དང་ གསལ་ཏོག་ཏོ་ཡོད་མི་གི་ཐོག་ལས་ གྲོས་ཆོད་བཟོ།
སྙན་ངག་སྙན་ངག་ཡིག་སྒྱུར་
སྙན་ཞུའི་དུས་རིམ་ནང་ འགོ་འཁྲིད་དང་ བཅའ་མར་གཏོགས་མི་གཉིས་ཀྱི་ཁྱད་པར་ཕྱེ། སྙན་ཞུའི་ཐོ་བཀོད་ གསལ་བཤད་པ་གི་མིང་དང་ གསལ་བཤད་ཀྱི་དུས་ཚོད་དང་ དུས་ཚོད་ཀྱི་གནས་ཚད་སོགས་ཀྱི་ཐོག་ལས་བཟོ།
དྲི་བ་དྲིས་ལན་གྱི་ཡིག་སྒྱུར་
ཞིབ་འཚོལ་, གསར་ཤོག་དང་ ཉོ་སྤྱོད་ཡིག་ཆའི་དོན་ལས་ དྲི་བ་དྲིས་ལན་འབད་མི་དང་དྲི་བ་དྲིས་ལན་འབད་མི་གི་ལན་སོ་སོ་སྦེ་བཞག་དགོ
ཁྲིམས་ལུགས་དང་མཐུན་སྒྲིག
གསལ་བཤད་ཀྱི་གཞུང་འབྲེལ་ཐོ་བཀོད་ གྲོས་བསྡུར་དང་ གསལ་བཤད་པ་ངོ་རྟགས་གསལ་པོར་ མཐུན་སྒྲིག་གི་སླབ་ཁུང་བཟོ།

སྒྲ་སྐད་ངོས་འཛིན་བྱེད་པའི་ STT.ai

Speaker detection is available on all paid plans. When you transcribe audio or video with speaker detection enabled, the transcript will include speaker labels inline with the text. You can also export speaker-labeled transcripts in all supported formats including SRT, VTT, DOCX, JSON, and PDF.

Speaker 1 [00:00:01]: Welcome to the meeting, everyone. Let's start with the quarterly review. Speaker 2 [00:00:05]: Thanks. I have the numbers ready. Revenue is up 23% quarter over quarter. Speaker 1 [00:00:12]: That's great news. Can you walk us through the breakdown?

The system can detect up to 20 distinct speakers in a single recording. For best results, ensure each speaker has at least a few seconds of solo speech. Overlapping speech is handled but may reduce accuracy in heavily cross-talked segments.

སྐད་བརྡ་ཤེས་ཚུགས་ཐབས་འདི་བརྟག་དཔྱད་འབད་

སྒྲ་སྐད་མང་བའི་སྒྲ་ཐོ་བཀོད་ དྲན་ཐོ་

འགོ་བཙུགས་ ཡིག་སྒྱུར་སྒེར་གྱི་

འཕྲལ་འཕྲལ་དྲི་བ་དྲིས་པའི་ལན་

སྒྲ་སྐད་ངོས་འཛིན runs in your browser: paste a URL, upload a file, or record from your mic. STT.ai picks the AI model and returns the transcript in under 5 minutes. Export as TXT, SRT, VTT, DOCX, JSON, or PDF.

Yes — every visitor gets 600 free minutes/month on STT.ai, usable for སྒྲ་སྐད་ངོས་འཛིན the same as any other workflow. Paid plans starting at $5/month unlock longer files, private transcripts, and priority queueing.

སྒྲ་སྐད་ངོས་འཛིན འདི་ STT.ai གི་ནང་ལས་ གཞན་མི་ཚུ་དང་འདྲ་ AI གི་ དཔེ་ཚད་ ཅོག་འཐདཔ་ ཐོག་ ལས་ འགོ་འདྲེན་འཐབ་དོ་ཡོདཔ། ང་བཅས་ཀྱི་ དཔེ་ཚད་ དྲག་ཤོས་ ཚུ་ གསལ་བཤད་ གསལ་ཏོག་ཏོ 95-97% གི་ གཏན་འབེབས་ ཐོབ་དོ་ཡོདཔ་ཨིན། (3-5% ཚིག་ འཛོལ་བ་ ཚད་ གཞི་ ཐོག་ ) དཔེ་ཚད་ ཚུ འགྱུར་ བཅོ ས་ འབད་ ས་ དང་ བསྟུན་ ནས་ འགོ་ ནས་ མ་ གྲུབ་ ན་ དམིགས་ ཡུལ་ དེ་ འོག་ ལུ་ གནས་ དོ་ཡོདཔ་ཨིན།

སྒྲ་སྐད་ངོས་འཛིན འདི་ STT.ai གི་ 10+ གི་དཔེ་ཚད་གང་རུང་ཐོག་ལས་ འགྲུལ་སྐྱོད་ཚུགས། STT.ai གོང་འཕེལ་ (ངེས་གཏན་ཆེ་ཤོས་), Whisper Large V3 (99 སྐད་ཡིག་), NVIDIA Canary (#1 WER on supported langs), Whisper Turbo (fast), Moonshine (lightweight), དང་གཞན་ཡང་།

ང་བཅས་ཀྱིས་ YouTube, Vimeo, TikTok, VLC, དང་ གཞན་ཡང་ཡོངས་གྲགས་ཅན་གྱི་ ཝིཌོ་འཁྲབ་སྟོན་ ལས་སྡེ་ཚུ་དང་མཉམ་དུ་ ཡིག་སྒྱུར་འདི་ SRT དང་ VTT གཉིས་ཆ་ར་ ནང་འཁོད་ བཀྲམ་སྤེལ་ འབད་དོ་ཡོདཔ་མས།

Yes. Speaker diarization automatically labels each voice (Speaker 1, Speaker 2, ...) and you can rename them in the built-in editor. Works across all models and languages.

མང་ཤོས་ སྒྲ་སྐད་ངོས་འཛིན ལས་ཀ་ ༥ នាទីནང་མཇུག་བསྡུ་དོ་ཡོདཔ་ཨིན། ༡ ཆུ་ཚོད་ཀྱི་སྒྲ་འཕྲིན་ཡིག་ཆ་འདི་ སྤྱིར་བཏང་ ༢-༣ នាទីནང་མཇུག་བསྡུ་དོ་ཡོདཔ་ཨིན། མགྱོགས་ཚད་འདི་ གདམ་ཁ་རྐྱབ་ཡོད་མི་དཔེ་ཚད་དང་ ད་ལྟའི་ GPU གི་ལཱ་ཁག་དང་འཁྲིལ་ཨིན།

སྒྲ་སྐད་ངོས་འཛིན accepts 20+ formats — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, and more. Output to TXT, SRT, VTT, DOCX, JSON, or PDF.

ང་བཅས་ཀྱིས་ སྒྲ་འཕྲིན་ཡིག་ཆ་ཚུ་ སྒྲ་སྐད་ངོས་འཛིན ལུ་འབུལ་ འབད་དེ་ སྔོན་འགྲོའི་ཐོག་ལས་ བཟོ་སྐྲུན་དང་ རྩ་བསྐྲད་གཏང་དོ་ཡོདཔ་ཨིན། དམིགས་བསལ་འཆར་གཞི་འདི་གིས་ ཁ་ལཱན་ཊེཊ་ ཕྱོགས་ཀྱི་ ཡིག་ཆ་བཀོལ་སྤྱོད་ བཀོལ་སྤྱོད་འབད་དོ་ཡོདཔ་ཨིན། STT.ai གི་ གནས་སྡུད་བལྟ་ གནས་སྡུད་འདི་ ང་བཅས་ཀྱི་ གོ་མཚོན་མེད་པའི་སྐབས་ལུ་ མ་ཀློག་ཚུགས། གནས་སྡུད་འདི་ མ་པ་ལས་ དཔེ་སྟོན་སྦྱོང་བརྡར་ ནང་ལུ་ ལག་ལེན་འཐབ་མི་ཚུགས།

STT.ai གིས་ Python དང་ Node.js SDK དང་ཅིག་ཁར་ REST API དང་ Claude དང་ Cursor གི་དོན་ལས་ MCP ཞབས་ཞུ་ དེ་ལས་ སྒྲ་སྐད་ངོས་འཛིན ལས་རིམ་ནང་ལུ་ ཡོངས་རྫོགས་ལག་ལེན་འཐབ་བཏུབ་པའི་ ཞབས་ཞུ་ ཚུ་བྱིན་དོ་ཡོདཔ་ཨིན། སྒེར་གྱི་ API ནང་ལུ་ ༡༠༠ នាទី/ཟླཝ་ ཚུད་དོ་ཡོདཔ་ཨིན།

Yes. Every transcript opens in the built-in editor where you can correct words, rename speakers, adjust timestamps, and add notes. All changes save automatically.

ཡིག་སྒྱུར་རེ་རེ་བཞིན་གཅིག་མཚུངས་ཡོད་པའི་ URI ཐོབ་དོ་ཡོདཔ་ཨིན། དྲོ་ཀི་སི་དང་ཕིཌ་ཊིབ་ གཉིས་ཀར་ ཐོན་སྐྱེད་འབད་དོ་ཡོདཔ་ཨིན། དམིགས་བསལ་ལས་རིམ་ནང་ གསང་ཚིག་དང་ རྒྱུན་ལྡན་གྱི་ འབྲེལ་མཐུད་ ཚུ་བཙུགས་དོ་ཡོདཔ་ཨིན།

STT.ai གིས་ YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts དང་གཞན་མི་མུ་མཐུད་ 1,300+ གི་མཉེན་ཆས་ཚུ་ལུ་ དབང་བསྒྱུར་འབད་ཚུགས། URL ཡིག་སྒྱུར་འདི་ མི་དམངས་ཀྱིས་ཐོབ་ཚུགས་པའི་ ནང་དོན་ཚུ་ལུ་རྐྱངམ་ཅིག་ ལག་ལེན་འཐབ་ཚུགས། DRM གིས་སྲུང་སྐྱོབ་བྱས་པའི་ ཐོན་ཁུངས་ཚུ་ ཡིག་སྒྱུར་མི་ཚུགས།