استخراج عناوين URL من النص
الصق سجل محادثة أو مستند Markdown أو سلسلة رسائل بريد إلكتروني أو نسخة خام من HTML، وستحصل على قائمة نظيفة بكل روابط http:// وhttps:// الموجودة فيها. تعمل الأداة على إزالة علامات الترقيم الطرفية، وتتعامل مع صيغة روابط Markdown وHTML، وتستبعد التكرارات المتطابقة تمامًا، بحيث يمكنك تمرير القائمة مباشرة إلى أداة استكشاف أو أداة أرشفة.
كيفية استخراج عناوين URL
-
1
لصق المصدر
أدخل النص أو ملف HTML مباشرة؛ حيث تتم معالجة علامات الاقتباس والأقواس الزاوية وصيغة روابط Markdown وعلامات الترقيم الطرفية تلقائيًا.
-
2
تشغيل المسح
يتم العثور على كل روابط `http://` و`https://`، وإزالة علامات الترقيم الطرفية، واستبعاد التكرارات المتطابقة تمامًا.
-
3
مراجعة العدد
سترى عدد عناوين URL الفريدة التي تم العثور عليها والقائمة الكاملة لها.
-
4
نسخ أو تصدير
رابط واحد في كل سطر، جاهز للاستخدام مع `curl -I` أو أداة أرشفة أو خدمة التقاط الشاشة أو قوائم البذور الخاصة بـ Screaming Frog.
ما يُعد عنوان URL؟
اكتشاف عناوين URL أصعب مما يبدو، وتلتزم هذه الأداة عمدًا بقاعدة واحدة آمنة: فهي تلتقط الروابط الكاملة من نوع http:// وhttps:// فقط، ويبقى كل ما عدا ذلك في نصك.
الأشكال التي يتم التعرف عليها
| الشكل | مثال |
|---|---|
| HTTPS مطلق | https://example.com/path?q=1 |
| HTTP مطلق | http://example.com |
| هدف رابط Markdown | [text](https://example.com) |
| href مطلق داخل HTML | href="https://example.com" |
قواعد القص
تتم إزالة علامات الترقيم الطرفية، لذلك يتحول (https://example.com). إلى https://example.com. المسافات وعلامات الاقتباس والأقواس الزاوية والأقواس الدائرية والمربعة والفواصل والفواصل المنقوطة توقف المطابقة. يتم قص عنوان URL الذي يحتوي على أقواس عند أول قوس فتح، لذلك لا يُلتقط عنوان بأسلوب ويكيبيديا إلا حتى قوس الفتح.
ما يتم تجاهله
mailto:وtel:وftp:وأي مخطط آخر ليسhttpأوhttps.- الروابط النسبية للبروتوكول مثل
//cdn.example.com/asset.js. - النطاقات المجردة والعناوين المبدوءة بـ
www.بدون مخطط، مثلexample.com/docs/introأوwww.example.com/page. - الأجزاء الموجهة إلى مرساة فقط مثل
#sectionوروابط JavaScript الزائفة.
كيفية التعامل مع التكرارات
يتم استبعاد التكرارات المتطابقة تمامًا: https://example.com يُحتسب مرة واحدة مهما تكرر ظهوره، بينما يظل Example.com وexample.com مدخلين منفصلين. تحتفظ القائمة بترتيب الظهور الأول لكل عنوان URL.
نصائح المعالجة اللاحقة
- حوّل إلى أحرف صغيرة لإزالة التكرار المعياري. إذا كنت تريد اعتبار
Example.comوexample.comمضيفًا واحدًا، حوّل الناتج إلى أحرف صغيرة ثم أزل التكرارات مرة أخرى. - جرّد معلمات التتبع باستخدام أداة تنظيف UTM قبل الأرشفة، وإلا ستحصل على عشرات من النسخ شبه المتطابقة.
- تحقق من الحالة. مرّر القائمة عبر أداة فحص الروابط التالفة لإزالة أخطاء 404 قبل اعتماد القائمة.
الأسئلة الشائعة
فقط عندما يُكتب الرابط المختصر بالمخطط الكامل. bit.ly/xyz وحده لا يُلتقط، بينما يُعامل https://bit.ly/xyz كعنوان URL عادي. لا تتبع الأداة عمليات إعادة التوجيه؛ عالجها بشكل منفصل إذا كنت بحاجة إلى الوجهة النهائية.
نعم، عندما يكون href عنوان URL كاملًا من نوع http:// أو https://. يتم استخراج القيمة نظيفة دون الوسم المحيط؛ ولا تُلتقط عناوين href النسبية.
يتم الاحتفاظ بها كما هي. إذا أردت إزالة utm_* ومعاملات التتبع المماثلة، فاستخدم أداة تنظيف عناوين URL بعد عملية الاستخراج.
لا. تتم معالجة النص أثناء الطلب، ولا يتم حفظ المحتوى أو تسجيله.
أدوات ذات صلة
عداد الكلمات
عُد الكلمات والأحرف والجمل والفقرات مع وقت القراءة ووقت التحدث وكثافة الكلمات المفتاحية ودرجة سهولة القراءة بمقياس فليش، للمقالات والمنشورات والتعليقات التوضيحية وأوصاف الميتا.
رموز أسهم للنسخ
انسخ أسهم Unicode شائعة بنقرة واحدة: أسهم مستقيمة ومزدوجة وقطرية ومعقوفة ودائرية ومثلثة للمستندات والدردشة والتصميم.
مولد أسماء المستخدمين
أنشئ أفكارًا لأسماء مستخدمين من كلمة أساس مع أرقام وفواصل اختيارية. مفيد للحسابات الجديدة وأسماء اللاعبين والملفات البديلة.
محوّل النص الملائم لعسر القراءة
أعد تنسيق النص الملصق في فقرات قصيرة وأسطر من نحو 72 حرفًا لتسهيل القراءة. انسخ النتيجة إلى أي مستند أو بريد إلكتروني أو محرر.
مولد أسماء النطاقات
ولّد أفكار أسماء نطاقات من كلمة مفتاحية واحدة: بادئات ولواحق وأحرف مكررة ونهايات رقمية عبر ستة نطاقات علوية شائعة.
رمز أقل من أو يساوي
انسخ علامة ≤ ورموز المقارنة الرياضية المرتبطة بها. يشمل ذلك رموز Unicode وكيانات HTML وترميز LaTeX للجداول الحسابية والأوراق البحثية وصفحات الويب.
الأداة متاحة بلغات أخرى
- Ekstrak URL dari Teks [ID]
- Trích xuất URL từ văn bản [VI]
- Extrair URLs do Texto [PT]
- Wydobywanie URL-ów z tekstu [PL]
- テキストからURL抽出 [JA]
- Metinden URL'leri Çıkarma [TR]
- 텍스트에서 URL을 추출합니다 [KO]
- ดึง URL จากข้อความ [TH]
- Extraer URLs del Texto [ES]
- 从文本中提取 URL [ZH]
- Extrahera URL:er från text [SV]
- Extraire des URL du texte [FR]
- URL's extraheren uit tekst [NL]
- URLs aus Text extrahieren [DE]
- Extract URLs from Text [EN]
- Estrai URL dal testo [IT]
- Извлечение URL из текста [RU]