منصوبے کے بارے میں
یوٹیوب ٹرانسکرپٹ API ایک پایتھن لائبریری ہے جو یوٹیوب ویڈیوز سے ٹرانسکرپٹس اور سب ٹائٹلز حاصل کرنے کے لیے استعمال ہوتی ہے۔ سیلینیم پر مبنی حل کے برعکس، اسے ہیڈلیس براؤزر کی ضرورت نہیں ہوتی، جس سے یہ ہلکی پھلکی اور قابلِ نشر کرنے میں آسان ہے۔ یہ انسانی طور پر بنائی گئی اور خودکار طور پر تیار کردہ دونوں قسم کے سب ٹائٹلز کے ساتھ کام کرتی ہے۔
انسٹالیشن pip کے ذریعے سیدھی سادی ہے: `pip install youtube-transcript-api`
کور API میں `YouTubeTranscriptApi` کلاس شامل ہے جس میں `fetch()` میتھڈ ہے جو یوٹیوب ویڈیو ID قبول کرتا ہے (مکمل URL نہیں)۔ یہ `FetchedTranscript` آبجیکٹ واپس کرتا ہے جس میں متن، شروعاتی وقت، اور مدت کے ساتھ snippet کا ایک صف ہوتا ہے۔ نتیجہ iterative، indexable، اور length والا ہوتا ہے۔
اہم خصوصیات:
- `languages` پیرامیٹر کو زبان کے کوڈز کی فہرست (جیسے `['de', 'en']`) کی شکل میں پاس کرکے مخصوص زبانوں میں ٹرانسکرپٹس حاصل کرنا۔
- `preserve_formatting=True` کے ساتھ اطالیک اور بولڈ جیسے HTML فارمیٹنگ کو برقرار رکھنا۔
- `list()` کے ذریعے کسی ویڈیو کے لیے دستیاب تمام ٹرانسکرپٹس کی فہرست بنانا، پھر زبان یا ٹرانسکرپٹ کی قسم (انسانی بنائی ہوئی بمقابلہ خودکار) کے لحاظ سے فلٹر کرنا۔
- `Transcript` آبجیکٹ پر `translate()` میتھڈ کا استعمال کرکے موجودہ ٹرانسکرپٹس کو دیگر زبانوں میں ترجمہ کرنا۔
- `formatters` سب ماڈیول میں built-in فارمیٹرز کے ذریعے آؤٹ پٹ کو JSON، SRT، WebVTT، CSV، یا سادہ متن میں فارمیٹ کرنا۔
- زبانوں، آؤٹ پٹ فارمیٹ، ترجمے، اور خودکار یا انسانی ٹرانسکرپٹس کو خارج کرنے کے آپشنز کے ساتھ CLI ٹول (`youtube_transcript_api`)۔
- IP بلاکس سے نمٹنے کے لیے پروکسی سپورٹ، جس میں Webshare rotating residential proxies یا generic HTTP/SOCKS پروکسی کانفیگریشن شامل ہے۔
یہ پروجیکٹ یوٹیوب کے web-client API کے بغیر دستاویز حصے کا استعمال کرتا ہے اور اس میں انتباہ موجود ہے کہ یہ YouTube کے داخلی نفاذ میں تبدیلی کی صورت میں رُک سکتا ہے۔ یہ MIT لائسنس کے تحت دستیاب ہے اور PyPI پر دستیاب ہے۔
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.