ابزار فایل ها

انتقال دهنده صدا و تصویر به متن

یک فایل صوتی یا تصویری را انتخاب کنید و یک رونوشت متنی به صورت محلی، بدون آپلود فایل ضبط شده ایجاد کنید.

در مرورگر شما اجرا می شود. بدون آپلود

در مرورگر شما اجرا می شود. بدون آپلود

برای رسانه های طولانی یا با وضوح بالا، دسکتاپ یا لپ تاپ توصیه می شود. این برگه را باز نگه دارید؛ سرعت، حافظه و باتری به دستگاه شما بستگی دارد.

ابتدا از دانلودهای حدود 58 مگابایت مدل و موتور محلی استفاده کنید. ضبط شما آپلود نشده است. اگر حافظه پنهان آن پاک شود، مرورگر ممکن است دوباره آنها را دانلود کند.

در مرورگر شما اجرا می شود. بدون آپلود

در مورد این ابزار

انتقال دهنده صدا و تصویر به متن ساده ساخته شده است.

تشخیص گفتار به صورت محلی در مرورگر شما با مدل چند زبانه Whisper Tiny اجرا می‌شود. در اولین استفاده، مرورگر حدود 43 مگابایت فایل مدل باز را از Hugging Face دانلود می کند. خود ضبط هرگز به آنجا یا به UsefulVerse ارسال نمی شود. مرورگر شما ممکن است مدل را برای بعداً کش کند، اما می تواند آن کش را حذف کند. مدل فشرده است، بنابراین نام، اعداد و علائم نگارشی را برای اشتباهات بررسی کنید. هیچ سهمیه ای برای اندازه یا مدت زمان فایل سرور ثابت وجود ندارد. محدودیت های عملی به دستگاه، مرورگر، حافظه، کدک های رسانه ای پشتیبانی شده، باتری و فضای ذخیره سازی موجود بستگی دارد. دسکتاپ یا لپ تاپ برای ضبط طولانی یا با وضوح بالا به شدت توصیه می شود. دسترسی به اینترنت برای دانلود مدل بار اول مورد نیاز است.

سوالات متداول

درباره انتقال دهنده صدا و تصویر به متن.

چگونه یک فایل صوتی یا تصویری را به متن رونویسی کنم؟

ضبط یا ویدیویی را با تراک صوتی انتخاب کنید، زبان گفتاری یا تشخیص خودکار را انتخاب کنید، سپس رونویسی را شروع کنید. تشخیص گفتار در دستگاه شما اجرا می شود.

آیا ضبط من برای رونویسی آپلود شده است؟

نه. رسانه در مرورگر شما رمزگشایی و رونویسی شده است. در اولین استفاده، حدود 58 مگابایت فایل مدل و موتور محلی دانلود می شود. مرورگر شما ممکن است آنها را دوباره دانلود کند اگر کش آن پاک شود.

رونوشت چقدر دقیق است؟

مدل جمع و جور چند زبانه می تواند نام ها، اعداد و علائم نگارشی را به اشتباه بشنود. رونوشت را قبل از تکیه کردن یا اشتراک گذاری آن مرور کنید.