أداة تفريغ البودكاست — كيف تفرغ البودكاست الخاص بك باستخدام Fish Audio
تقوم أداة تفريغ البودكاست من Fish Audio بتحويل الصوت إلى نص مع وسوم تلقائية للمشاعر، وتسميات للمتحدثين، وطوابع زمنية — ثم تصديرها إلى صيغ SRT أو VTT أو JSON. تتوفر باقة مجانية ولا تتطلب أي خبرة في البرمجة.
مارس 2026 | خدمة Fish Audio STT متاحة الآن على fish.audio/app/speech-to-text
كل حلقة بودكاست تنشرها بدون تفريغ نصي تضيع عليك فرصاً كبيرة لزيادة عدد الزيارات. فالتفريغ النصي يجعل حلقتك قابلة للبحث على Google، ويوفر لك ملاحظات العرض بنقرة واحدة، ويسمح لك بإنشاء ترجمات (subtitles) تلقائياً — لليوتيوب، أو موقعك الإلكتروني، أو أي مكان آخر تنشر فيه. كما يجعل محتواك متاحاً لضعاف السمع. يعتمد محررو البودكاست والفرق الإعلامية ومنشئو محتوى YouTube على التفريغ النصي لإنشاء محتوى متوافق مع محركات البحث (SEO)، وأرشيفات قابلة للبحث، وصفحات حلقات يسهل الوصول إليها. معظم أدوات تفريغ البودكاست تعطيك كتلة من النص العادي فقط. لكن أداة Fish Audio تذهب إلى أبعد من ذلك: كل تفريغ يأتي مع وسوم تلقائية للمشاعر ولغة الجسد الصوتية، وتسميات للمتحدثين، وطوابع زمنية، وثلاث صيغ للتصدير. يرافقك هذا الدليل في سير العمل الكامل، من الرفع إلى التصدير، في حوالي ثلاث دقائق.
ما الذي يجعل أداة تفريغ البودكاست جيدة؟
قبل اختيار أي أداة تفريغ، من المفيد معرفة المعايير التي تقيمها على أساسها. يجب أن توفر أداة تفريغ البودكاست الجيدة أربعة أشياء:
-
دقة تفريغ عالية عبر مختلف اللهجات وجودة الصوت وبيئات التسجيل.
-
تحديد المتحدثين حتى تتمكن من تمييز المضيف عن الضيف في النص.
-
صيغ تصدير متعددة — على الأقل SRT لترجمة الفيديو، ويفضل VTT و JSON أيضاً.
-
أسعار شفافة ومعقولة مع باقة مجانية صالحة فعلياً للاستخدام في حلقة حقيقية.
تدعم أداة Fish Audio لتفريغ البودكاست أكثر من 100 لغة، وتقبل 24 صيغة صوت وفيديو، وتضع وسوماً تلقائية للمشاعر وأحداث لغة الجسد الصوتية ضمن النص — دون أي تدخل يدوي. تم تحسين نموذج تحويل الكلام إلى نص (STT) للمحادثات الصوتية والتسجيلات متعددة المتحدثين مثل البودكاست والمقابلات والمناقشات المباشرة. إليك كيف يعمل الأمر من الناحية العملية.
كيف تفرغ البودكاست باستخدام Fish Audio — خطوة بخطوة
الوقت المطلوب: حوالي 3 دقائق الأدوات المطلوبة: ملف صوتي (MP3، MP4، WAV، M4A، وغيرها) النتيجة: تفريغ مع وسوم + ملف ترجمة جاهز للتصدير
الخطوة 1 — افتح Fish Audio STT
انتقل إلى fish.audio/app/speech-to-text. سترى سجل مهامك — جميع عمليات التفريغ السابقة مدرجة مع اسم الملف، التاريخ، الحالة، الرصيد المستخدم، وعدد المتحدثين. انقر فوق Create task لبدء تفريغ جديد.
الخطوة 2 — ارفع حلقتك وحدد المتحدثين
في نافذة إنشاء مهمة التفريغ (Create transcription task)، ارفع ملف الصوت أو الفيديو الخاص بك. تقبل Fish Audio جميع الصيغ الرئيسية — MP3، MP4، WAV، FLAC، M4A، OGG، MOV، AVI، WEBM، وغيرها.
تحت قسم number of speakers، اتركه على الخيار التلقائي (Auto) إذا لم تكن متأكداً من عدد الأشخاص في التسجيل. ستقوم Fish Audio باكتشاف المتحدثين تلقائياً. إذا كنت تعرف العدد الدقيق — مثلاً، اثنان لتنسيق المضيف والضيف التقليدي — يمكنك ضبطه يدوياً للحصول على تسميات متحدثين أكثر دقة.
قبل التأكيد، تعرض لك الواجهة المدة المقدرة، الدقائق القابلة للفوترة، والرصيد (credits) المقدر لهذه المهمة. لن يتم خصم الرصيد حتى تنقر على Create task.
الخطوة 3 — مراجعة التفريغ النصي
بمجرد اكتمال المهمة، انقر فوق Open viewer. يتم عرض التفريغ في ثلاثة أعمدة: SPK/TAGS (تسمية المتحدث)، TIME (نطاق الطابع الزمني)، و TEXT (النص مع الوسوم المضمنة).
كل جزء محدد بطابع زمني بدقة الثانية. تظهر أحداث المشاعر ولغة الجسد الصوتية كـ وسوم أرجوانية مضمنة مباشرة داخل النص — سترى أشياء مثل [pause] (توقف مؤقت)، [sigh] (تنهد)، [emphasis] (تشديد)، و [breath] (نفس) في النقطة الدقيقة التي حدثت فيها في التسجيل.
انقر فوق أي جزء لتشغيل ذلك المقطع من الصوت مباشرة في المتصفح. هذا يسهل التحقق من الدقة أو فحص لحظات معينة دون الحاجة لسماع الملف كاملاً.
تُظهر لوحة التحكم (Controller) على اليمين ملخصاً: المدة الإجمالية، عدد المتحدثين المكتشفين، عدد الأجزاء، وتأكيداً على أن فصل الصوت (voice separation) ووسم أحداث الصوت (Tag audio events) قيد التشغيل.
الخطوة 4 — التصدير بالصيغة التي تفضلها
انقر فوق Export في الركن السفلي الأيمن من لوحة التحكم. اختر صيغتك وقم بتهيئة خيارات التصدير قبل التنزيل.
هل أنت مستعد لتفريغ حلقتك الأولى؟ ابدأ مهمة تفريغ مجانية ←
الوسوم التلقائية — ما تلتقطه Fish Audio وتفتقده الأدوات الأخرى
هنا تبرز Fish Audio وتختلف بشكل واضح عن البدائل.
عندما يتنهد شخص ما قبل الإجابة على سؤال، أو يضحك في منتصف الجملة، أو يتوقف مؤقتًا للتأكيد، أو يأخذ نفسًا مسموعًا — تتجاهل أدوات التفريغ القياسية كل ذلك. تحصل فقط على الكلمات، مجردة من كل شيء آخر.
تقوم Fish Audio بدمج هذه الأحداث كوسوم مضمنة في النقطة الدقيقة التي تحدث فيها في النص. يتم إنشاء هذه الوسوم تلقائياً — لا يوجد تدخل يدوي أو خطوة معالجة لاحقة. تُظهر لوحة التحكم خيار Tag audio events: On بشكل افتراضي.
ما الذي يتم وسمه
لغة الجسد الصوتية (Paralanguage) — الأصوات غير اللفظية التي تحدث جنباً إلى جنب مع الكلام.
المشاعر (Emotion) — النغمة العاطفية للإلقاء، والتي يتم التقاطها من السياق ونبرة الصوت.
لماذا يهم هذا أصحاب البودكاست
في معظم سير عمل البودكاست، تخدم الوسوم ثلاثة أغراض عملية. أولاً، تجعل التفريغ النصي أكثر فائدة كمصدر لملاحظات العرض (Show notes) — التفريغ الذي يلتقط [laugh] و [pause] يمنح المحرر مادة أغنى للعمل عليها مقارنة بملف نصي جامد. ثانياً، تجعل التنقل في التسجيلات الطويلة أسرع — يمكنك البحث عن لحظات [sigh] أو [emphasis] للعثور على الأجزاء ذات الأهمية العاطفية في الحلقة دون إعادة الاستماع. ثالثاً، والأكثر تميزاً، هذه الوسوم متوافقة مع نموذج تحويل النص إلى كلام (TTS) من Fish Audio — مما يعني أن التفريغ يمكن استخدامه مباشرة في سير عمل إنتاج صوتي دون الحاجة لإعادة التنسيق.
هل تريد رؤية الوسوم وهي تعمل؟ ارفع ملفك الصوتي الأول ←
شرح صيغ التصدير — أيها تحتاج؟
تدعم خدمة Fish Audio STT ثلاث صيغ للتصدير. اختيار الصيغة يعتمد على ما ستفعله بالتفريغ لاحقاً.
SRT هي الخيار الصحيح لمعظم أصحاب البودكاست الذين يوزعون محتوى فيديو. إنها صيغة الترجمة الأكثر دعماً — متوافقة مع YouTube، و Premiere Pro، و Final Cut Pro، ومعظم منصات الفيديو.
VTT (WebVTT) هي الصيغة الأصلية للويب — استخدمها عندما تقوم بتضمين الفيديو في موقعك الخاص وتحتاج إلى توقيت الكلمات المضمنة.
JSON تمنحك مخرجات STT الخام دون تحويلات الترجمة. استخدم هذه الصيغة إذا كنت ستدخل التفريغ في أداة أخرى أو تبني شيئاً مخصصاً.
خيارات التصدير
عند تصدير SRT أو VTT، لديك أربعة إعدادات إضافية:
-
Include tags — يبقي الأحداث بين الأقواس مثل
[pause]و[sigh]في ملف الترجمة. قم بإيقاف هذا الخيار للحصول على ترجمة نظيفة؛ اتركه إذا كنت تريد الاحتفاظ بالبيانات الوصفية التعبيرية. -
Include speaker — يسبق كل عبارة ترجمة بتسمية المتحدث المكتشف (SPK_0, SPK_1). مفيد للحلقات التي تضم عدة متحدثين.
-
Punctuation — يبقي علامات الترقيم في النص المصدر. قم بإيقافه للحصول على تدفق كلمات أنقى إذا كنت ستقوم بمعالجة إضافية.
-
Split mode — اختر بين Segment (يحافظ على حدود STT الحالية) أو Max words (يعيد تجميع العبارات حسب عدد الكلمات وعلامات الترقيم وتغييرات المتحدث). خيار Max words مع حد أقصى 7 كلمات لكل عبارة يميل لإنتاج ترجمات أسهل في القراءة للكلام السريع.
اكتشاف المتحدثين — التمييز بين المضيف والضيف
في مقابلات البودكاست والمناقشات الجماعية، يعد اكتشاف المتحدثين أحد أكثر الميزات فائدة التي يمكن أن تقدمها أداة تفريغ البودكاست. تقوم Fish Audio تلقائياً بفصل المتحدثين في التسجيلات متعددة الأشخاص. يتم تمييز كل جزء في عارض التفريغ بـ SPK_0، SPK_1، وهكذا — بما يتوافق مع الأصوات المتميزة المكتشفة في الصوت.
عند إنشاء مهمة، يمكنك إما ترك number of speakers على التلقائي (Auto) أو ضبطه يدوياً. ضبط العدد الدقيق يميل لإنتاج حدود أنظف للمتحدثين، خاصة في التسجيلات التي يكون فيها أحد المتحدثين أهدأ بكثير من الآخر.
عند التصدير، يؤدي تمكين Include speaker إلى إضافة تسمية المتحدث كبادئة لكل عبارة ترجمة. وهذا يجعل من السهل البحث في التفريغ أو تحريره أو إعادة تنسيقه حسب المتحدث — وهو أمر مفيد إذا كنت تقتبس جملاً لملاحظات العرض أو تحرر تفريغاً للتركيز على حوارات رئيسية.
ملاحظة: يتوفر اكتشاف المتحدثين والتفريغ المسمى حسب المتحدث في واجهة ويب Fish Audio. وتنتقل تسميات المتحدثين مع التصدير في صيغ SRT و VTT و JSON عند تمكين خيار Include speaker.
كم تبلغ تكلفة تفريغ البودكاست؟
يتم احتساب تكلفة Fish Audio STT بالدقيقة من الصوت المعالج بمعدل 300 رصيد (credit) لكل دقيقة.
تتلقى الحسابات المجانية 8,000 رصيد شهرياً — وهو ما يكفي لحوالي 26 دقيقة من الصوت. يغطي هذا حلقة قصيرة أو بضعة مقاطع من مقابلة.
تعرض لك واجهة الويب الرصيد المقدر بالضبط قبل تأكيد المهمة، لذلك لا توجد مفاجآت.
بالنسبة للفرق أو الإنتاج كبير الحجم، تتضمن الخطط المدفوعة مجمعات أرصدة أكبر. راجع تفاصيل الأسعار الكاملة على fish.audio/plan/.
فرغ حلقة البودكاست التالية في دقائق. ابدأ التفريغ مجاناً ←
Fish Audio مقابل أدوات تفريغ البودكاست الأخرى
يجد العديد من أصحاب البودكاست الذين يبحثون عن أفضل أداة تفريغ أن الخيار الصحيح يعتمد على ما إذا كانوا يحتاجون إلى تفريغ نصي عادي أو بيانات وصفية أغنى مثل وسوم المشاعر والتصدير بصيغ متعددة. إليك مقارنة بين Fish Audio والخيارات الشائعة الأخرى:
| الميزة | Fish Audio | Otter.ai | Happy Scribe | Adobe Podcast |
|---|---|---|---|---|
| وسوم مشاعر تلقائية | ✅ | ❌ | ❌ | ❌ |
| وسوم لغة الجسد الصوتية | ✅ | ❌ | ❌ | ❌ |
| اكتشاف المتحدثين | ✅ | ✅ | ✅ | ✅ |
| تصدير SRT | ✅ | ✅ | ✅ | ❌ |
| تصدير VTT | ✅ | ❌ | ✅ | ❌ |
| تصدير JSON | ✅ | ❌ | ❌ | ❌ |
| تكامل TTS / Studio | ✅ | ❌ | ❌ | ❌ |
| اللغات | 100+ | متعدد اللغات | 120+ | محدودة |
| الباقة المجانية | ✅ 8,000 رصيد/شهر | ✅ 300 دقيقة/شهر | ✅ محدودة | ✅ |
البيانات مأخوذة من Otter.ai، و Happy Scribe، و Adobe Podcast اعتباراً من مارس 2026.
تركز معظم أدوات تفريغ البودكاست على تقديم مخرجات نصية عادية. Fish Audio هي واحدة من الأدوات القليلة التي تدمج وسوم المشاعر ولغة الجسد الصوتية مباشرة داخل التفريغ — وهي من الأدوات القليلة التي تربط التفريغ بسير عمل إنتاج الصوت عبر تكامل Studio.
إذا كنت بحاجة إلى نص عادي نظيف لملاحظات العرض أو لمحتوى SEO، فإن أيًا من هذه الأدوات سيعمل. ولكن إذا كنت بحاجة إلى تفريغ موسوم، أو تصدير بصيغ متعددة، أو مسار من التفريغ إلى إنتاج الصوت، فإن Fish Audio هو الخيار الأكثر اكتمالاً.
خيار مفيد آخر لأصحاب البودكاست هو Podsqueeze، وهي منصة ذكاء اصطناعي تساعد في تحويل حلقات البودكاست إلى ملاحظات عرض، طوابع زمنية، ملخصات، منشورات اجتماعية، ونشرات إخبارية. إنها مفيدة بشكل خاص للمبدعين الذين يرغبون في توفير الوقت بعد التسجيل وتحويل كل حلقة إلى أصول محتوى متعددة لجمهورهم.
ما التالي — من التفريغ النصي إلى Studio
التفريغ النصي الموسوم هو أكثر من مجرد وثيقة. إنه نص (script) يعرف مسبقاً كيف يجب أن يبدو صوته.
الوسوم التي تدمجها Fish Audio في تفريغ البودكاست الخاص بك — مثل [calm, reflective]، [breath]، [determined]، [pause] — تستخدم نفس التنسيق الذي يستخدمه نموذج S2 TTS من Fish Audio. وهذا يعني أن التفريغ يمكن استخدامه مباشرة في نظام إنتاج الصوت دون أي إعادة تنسيق.
تأخذ Fish Audio Studio هذا الأمر إلى أبعد من ذلك. في Studio، تصبح النصوص الموسومة مشاريع صوتية قابلة للتحرير بالكامل: يمكنك التحرير حسب الفصل، وتبديل نماذج الصوت، وتعديل طريقة الإلقاء على مستوى الكلمة، وإنتاج صوت متعدد المسارات — كل ذلك مع الحفاظ على البيانات الوصفية التعبيرية من تسجيلك الأصلي.
ميزة الاستيراد المباشر من STT إلى Studio قادمة قريباً. صيغة التفريغ متوافقة بالفعل — الوسوم في مخرجات STT هي نفسها التي يقرأها Studio. سيكون الاستيراد خطوة واحدة بمجرد إطلاق الميزة.
ابدأ بتفريغ البودكاست الخاص بك مجاناً ← — أو استكشف Fish Audio Studio إذا كنت مستعداً للإنتاج.
مواضيع ذات صلة:
الأسئلة المتكررة
ما هي أفضل أداة مجانية لتفريغ البودكاست؟
ما مدى دقة أداة تفريغ البودكاست من Fish Audio؟
هل يمكن لـ Fish Audio تفريغ عدة متحدثين؟
ما هي صيغ التصدير التي تدعمها Fish Audio؟
كم من الوقت تستغرق عملية التفريغ؟
هل يمكنني استخدام Fish Audio STT بدون حساب؟
ما هي اللغات التي تدعمها Fish Audio؟
ما هي صيغ الصوت التي تقبلها Fish Audio؟
Sabrina is part of Fish Audio's support and marketing team, helping users get the most out of AI voice products while turning launches, updates, and customer insights into clear, practical content.
اقرأ المزيد من Sabrina Shu