Convert MKV to Text

Convert MKV video files to text with AI. Transcribe movies and video files with subtitle export. Free online MKV transcription.

هنوز صداهای TTS برای زبان شما نداریم. به ما کمک کنید تا صداهای خودتان را اضافه کنیم! فروش صدای خود

بارگذاری صدا یا ویدئو

پروندۀ خود را به اینجا بکشید و بگذارید ، یا مرور

از فرمت‌های MP3، WAV، FLAC، OGG، M4A، MP4، WebM، AVI، MOV، MKV پشتیبانی می‌کند.

پرونده.mp3

0 MB
یا از میکروفون خود ضبط کنید
00:00

تنظیمات

1,000/min نویسه‌ها ثبت نام برای ردیابی استفاده

رونوشت

یک پرونده صوتی یا ویدئویی را بارگذاری کنید و برای شروع رونوشت را فشار دهید

. دارم رونوشت ميکنم. ممکنه يه لحظه طول بکشه

شناسایی شد:

چطور کار میکنه

بارگذاری صدا یا ویدئو

پرونده‌های صوتی یا ویدئویی خود را بارگذاری کنید. ما از فرمت‌های MP3، WAV، FLAC، OGG، M4A، MP4، WebM، AVI، MOV و MKV تا ۱۰۰ مگابایت پشتیبانی می‌کنیم.

2. AI رونوشت

مدل‌های هوش مصنوعی ما صدای شما را پردازش می‌کنند، زبان را تشخیص می‌دهند، گویندگان را شناسایی می‌کنند و متن دقیقی با مهر زمان تولید می‌کنند.

3. رونوشت رو بگير

رونوشت خود را رونوشت کنید یا آن را به صورت زیرنویس TXT یا SRT بارگیری کنید. به صورت مورد نیاز ویرایش و اصلاح کنید.

موارد استفاده

رونوشت صوتی برای هر صنعت و جریان کاری

جلسات و کنفرانسها

به صورت خودکار ضبط‌های Zoom، Teams و Google Meet را رونوشت کنید. دیگر هیچ‌گاه یک مورد عمل را از دست ندهید. به عنوان یادداشت‌های جلسه یا زیرنویس‌ها صادر کنید.

مصاحبه و روزنامه‌نگاری

مصاحبه‌ها را برای مقالات، مقالات پژوهشی و مستندها رونوشت کنید.

پادکست و رسانه

تولید رونوشت و نمایش یادداشت‌ها برای قسمت‌های پادکست. ایجاد آرشیوهای قابل جستجو از محتوای صوتی خود. اضافه کردن زیرنویس به پادکست‌های ویدئویی.

سخنرانی و آموزش

تبدیل سخنرانی‌های ضبط شده به یادداشت‌های مطالعه. محتوای آموزشی را با عنوان‌های دقیق قابل دسترس کنید. از دانش آموزان با اختلالات شنوایی پشتیبانی کنید.

یوتیوب و شبکه‌های اجتماعی

تولید زیرنویس و زیرنویس‌های بسته برای ویدئوهای یوتیوب، TikToks و محتوای رسانه‌های اجتماعی. دسترسی و SEO را با رونوشت‌های دقیق بهبود دهید.

حقوقی و پزشکی

رونوشت از اظهارات، جلسات، مشورت‌ها و دیکتات. مهر زمان دقیق برای مراجعه. صادرات به قالب‌های مناسب برای مستندات.

قالبهای پشتیبانی‌شده

رونوشت هر پرونده صوتی یا ویدئویی — ما به طور خودکار صدا را استخراج می‌کنیم

قالبهای صوتی

MP3 WAV FLAC OGG M4A AAC WMA OPUS

قالبهای ویدئو

MP4 WebM AVI MOV MKV WMV FLV M4V

صوت به صورت خودکار از فایل‌های ویدئویی برای رونویسی استخراج می‌شود.

مدل‌های رونویسی

Whisper

مدل تشخیص گفتار قوی اوپن‌آی از ۹۹ زبان پشتیبانی می‌کند.

  • 99 زبان
  • ترجمه
  • مهرهای زمانی
  • مقاوم در برابر نویز
OpenAI

Faster Whisper

4x سریعتر از Whisper با بهینه‌سازی CTranslate2، همان دقت.

  • ۴ برابر سریعتر
  • حافظه پایین
  • تمام اندازه‌های مدل
  • پردازش گروهی
  • پالایش VAD
SYSTRAN

SenseVoice

مدل درک گفتار با تشخیص احساسات، ۵۰+ زبان.

  • 50+ زبان
  • تشخیص احساسات
  • رویدادهای صوتی
  • تحلیل گوینده
  • فراداده‌های غنی
Alibaba (FunAudioLLM)

پرسشهای متداول

پروندۀ MKV خود را بارگذاری کنید. رونوشت‌گر ما شیار صوتی را از ظرف a flexible Matroska container that can hold multiple audio tracks and subtitles alongside H.264/H.265 video استخراج می‌کند، آن را به Faster Whisper در یک GPU می‌فرستد، و یک رونوشت با علامت زمان همراه با صادرات زیرنویس‌های اختیاری SRT و VTT را برمی‌گرداند. نیازی نیست که خودتان صدا را دموکس یا استخراج کنید — این کار در سمت کارساز انجام می‌شود.

MKV a flexible Matroska container that can hold multiple audio tracks and subtitles alongside H.264/H.265 video است. این معمولاً توسط high-resolution video releases, Blu-ray rips, and multi-track downloads تولید می‌شود.

MKV با از دست دادن است (a flexible Matroska container that can hold multiple audio tracks and subtitles alongside H.264/H.265 video)، اما از دست دادن در باندهای صوتی رخ می‌دهد که اطلاعات زیادی از گفتار را حمل نمی‌کنند. فاستر ویسپ MKV را در 2-20 Mbps total در حدود ~۱٪ دقت WAV در همان ضبط منبع رونوشت می‌کند. دقت واقعی کیفیت ضبط اصلی (میکروفون، اتاق، شفافیت بلندگو) است ، نه کدک MKV.

پرونده‌های MKV معمولاً 10-50 MB/min, often with selectable audio languages هستند، بنابراین بیشتر بارگذاری‌ها در حد ۵۰۰ مگابایت ما قرار می‌گیرند. حساب‌های رایگان می‌توانند تا ۵ دقیقه در هر بارگذاری رونوشت کنند. برنامه‌های پرداختی تا ۲ ساعت ادامه می‌یابند. اگر در پرونده‌های طولانی به حداکثر می‌رسید، ابزار کتاب صوتی / فرم طولانی را ببینید که رونوشت چند ساعته را مدیریت می‌کند.

بله — فاستر ویسپ از ۹۹ زبان پشتیبانی می‌کند و زبان گفتاری را در پرونده MKV خودکار تشخیص می‌دهد. همچنین می‌توانید زبان منبع خاصی را از طریق تنظیمات پیشرفته اجبار کنید ، اگر تشخیص خودکار یکی اشتباه را انتخاب کند (معمولاً با انگلیسی با لهجه که به اشتباه به عنوان زبان مادری شنونده طبقه‌بندی می‌شود ، یا با کلیپ‌های بسیار کوتاه).

ما پرونده‌های زیرنویس SRT و VTT را در کنار رونوشت متن ساده بازگردانیم. برای جاسازی آن‌ها در پرونده‌ی MKV خود، از ابزاری مانند ffmpeg یا HandBrake برای فشرده سازی SRT/VTT به عنوان یک شیار زیرنویس نرم استفاده کنید. ما خود ویدئو را دوباره کدگذاری نمی‌کنیم — این با از دست دادن خواهد بود.

MKV می‌تواند چندین آهنگ صوتی را حمل کند، اما برای دیاریزاسیون بلندگوها ما آن‌ها را ابتدا به یک آهنگ واحد مخلوط می‌کنیم. اگر MKV شما آهنگ‌های صوتی جداگانه برای هر بلندگو دارد (ندرتاً خارج از تولید حرفه‌ای)، تمیزترین جریان کار استخراج هر آهنگ به MP3، رونویسی به صورت جداگانه و ادغام رونویسی‌ها است - که ۱۰۰٪ دقیق است بدون نیاز به دیاریزاسیون.

نه. رونوشت‌گر ما مستقیماً MKV را مدیریت می‌کند — تبدیل به MP4 ابتدا یک مرحله کدگذاری مجدد (با احتمال از دست دادن) اضافه می‌کند و زمان شما را هدر می‌دهد. تنها استثنا این است که اگر پرونده MKV شما از یک کدک غیرمعمول استفاده می‌کند که رمزگشایی‌کننده ما آن را تشخیص نمی‌دهد (نایاب)؛ ما این را در بارگذاری به شما می‌گوییم و می‌توانید از طریق مبدل صوتی رایگانمان تبدیل کنید.

بله ، این معمول‌ترین الگو برای بارگذاری MKV است. فایر ویسپر ضبط‌های تمیز ، پر سر و صدا ، و گفتار با لهجه را مدیریت می‌کند — نیازی نیست که صدا را اول تمیز کنید. اگر دقت آنچه انتظار دارید نیست ، پرونده را از طریق تقویت‌کننده صدای ما اجرا کنید (برای یک گذر رایگان) تا نویز پس زمینه را حذف کنید ، سپس دوباره تلاش کنید رونوشت را انجام دهید.

رونوشت برای پرونده‌هایی که کمتر از ۵ دقیقه هستند رایگان است. برنامه‌های پرداختی از ~۱۰۰۰ کاراکتر در دقیقه صدای MKV استفاده می‌کنند. یک جلسه ۶۰ دقیقه‌ای برای ۶۰۰۰ کاراکتر رونوشت می‌شود؛ یک یادداشت صوتی ۳ دقیقه‌ای رایگان است. توجه خاص MKV: اگر پرونده شما بیشتر سکوت است (مثلاً توقف‌های طولانی در ضبط جلسه)، تشخیص فعالیت صدا را فعال کنید تا سکوت را رد کنید و فقط برای بخش‌های گفتار پرداخت کنید.

بله. پرونده‌های MKV بارگذاری شده در کارگزارهای GPU ما پردازش می‌شوند و به صورت خودکار در عرض ۲ روز حذف می‌شوند. ما هرگز صدا را برای مدت طولانی ذخیره نمی‌کنیم، مدل‌ها را بر روی داده‌های کاربر آموزش نمی‌دهیم، یا با افراد سوم اشتراک نمی‌گذاریم. رونوشت تا زمانی که بخواهید در حساب شما باقی می‌ماند.

بله. پروندۀ MKV خود را به /api/v1/transcribe/ به عنوان داده‌های فرم چندبخشی POST کنید. نقطه پایانی مستقیماً ویدئوی را قبول می‌کند — نیازی به استخراج صدای اول نیست؛ ffmpeg demux را در سمت سرور مدیریت می‌کند. پاسخ شامل رونوشت، مهرهای زمانی و یک UUID کار است که می‌توانید برای نشانی‌های وب صادراتی SRT/VTT پرس و جو کنید.
5.0/5 (1)

چه چیزی میتونیم بهتر کنیم؟ بازخورد شما به ما کمک میکنه مشکلات رو حل کنیم.

رونوشت صدا و ویدئو با هوش مصنوعی

رونوشت دقیق در ۹۹ زبان دریافت کنید. رایگان ثبت نام کنید و ۱۵۰۰۰ کاراکتر برای شروع دریافت کنید.