ملخّص PDF

الخطوة 1 من 3

جارٍ فتح جلسة التلخيص الخاصة...

اختر ملف PDF نصياً

استخدم ملف PDF واحداً حتى 20 MiB و150 صفحة. تقرأ الأداة طبقة النص الموجودة؛ وتحتاج الصفحات الممسوحة ضوئياً إلى OCR أولاً.

أو أفلت ملف PDF واحداً هنا

جارٍ التحميل...

قد تستغرق المستندات الكبيرة بعض الوقت. يمكنك الإيقاف بأمان من دون الاحتفاظ بنتيجة جزئية.

صفحة

تقرأ هذه الأداة طبقة النص المضمّنة في ملف PDF، ثم ترتّب الجمل بحسب الكلمات المتكررة وتعرض الجمل المختارة بترتيب استخراجها. وهي لا تستخدم الذكاء الاصطناعي، ولا تعيد الصياغة، ولا تتحقق من صحة المعلومات. يبقى الملف والنص المستخرج داخل المتصفح، لذلك تصلح النتيجة كقراءة أولية لا كبديل عن مراجعة المصدر.

كيفية تلخيص ملف PDF

  1. 1

    اختر ملف PDF نصياً

    اختر ملفاً حقيقياً لا يتجاوز 20 MiB و150 صفحة. يحتاج الملف الممسوح ضوئياً أو المكوّن من صور فقط إلى OCR أولاً.

  2. 2

    استخرج النص في المتصفح

    تقرأ الأداة النص المضمّن محلياً وتتوقف إذا تجاوز النص المستخرج 2,000,000 حرف. ولا تقبل الملفات المحمية بكلمة مرور أو التالفة أو غير المقروءة.

  3. 3

    حدّد طول الملخص

    اختر من 3 إلى 20 جملة. إذا كان المستند أقصر، تعرض الأداة كل الجمل المتاحة من دون اختلاق نص إضافي.

  4. 4

    راجع النتيجة وانسخها

    قارن الجمل والكلمات المتكررة بالمستند الأصلي قبل نسخ الملخص واستخدامه.

ما الذي يفعله الملخص الاستخلاصي فعلاً؟

يحتفظ الملخص الاستخلاصي بجمل من المصدر بدلاً من كتابة نص جديد. تحسب الأداة الكلمات المفيدة، وتمنح الجمل الأولى زيادة بسيطة، ثم تختار الجمل الأعلى درجة وتعيدها إلى ترتيب استخراجها.

مثال بسيط

لنفترض أن موجز مشروع من أربع جمل يقول:

  1. خفّض المشروع التجريبي متوسط وقت انتظار الدعم.
  2. أعاد الفريق أيضاً تصميم دليل التدريب.
  3. انخفض وقت الانتظار مرة أخرى بعد المرحلة الثانية من الإطلاق.
  4. يوصي التقرير بمراقبة وقت الانتظار كل شهر.

لأن عبارة وقت الانتظار تتكرر، فقد تحصل الجمل 1 و3 و4 على ترتيب أعلى من الجملة 2. وعند اختيار ملخص من ثلاث جمل، تحتفظ النتيجة بهذه الجمل بالترتيب 1 و3 و4. ولا تكتب الأداة استنتاجاً جديداً ولا تقرر ما إذا كان التقرير صحيحاً.

آلية المعالجة

المرحلة السلوك الفعلي
قراءة PDF قراءة طبقة النص المضمّنة باستخدام PDF.js، من دون OCR
فصل الجمل استخدام Intl.Segmenter وفق لغة الصفحة عند توفره، مع بديل يعتمد علامات ترقيم Unicode
فصل الكلمات استخدام التقسيم اللغوي عند توفره وتجاهل قائمة صغيرة من الكلمات الشائعة
الترتيب حساب درجة من تكرار الكلمات مع زيادة متواضعة للجمل الأولى
الإخراج إبقاء الجمل المختارة بترتيب استخراجها وعرض ما يصل إلى 12 كلمة متكررة

حدود مهمة

  • قد تؤدي الأعمدة والجداول والرؤوس والتذييلات والخطوط غير المعتادة إلى ترتيب استخراج مختلف عن ترتيب القراءة المرئي.
  • لغة الصفحة هي التي توجه فصل الجمل والكلمات؛ لا تكتشف الأداة لغة المستند كاملاً تلقائياً.
  • اختيار جملة صحيحة من المصدر قد يحذف سياقاً مهماً من الفقرة أو الجدول المحيط بها.
  • الأداة لا تتحقق من الوقائع ولا تحل التناقضات ولا تقيّم الأدلة.
  • الحدود القصوى هي 20 MiB و150 صفحة و2,000,000 حرف مستخرج.

الخصوصية في المسار ذي الخطوات الثلاث

يبقى ملف PDF والنص المستخرج في تخزين المتصفح. يشير معرّف مبهم في الرابط إلى السجل المحلي، وتنتهي صلاحيته بعد 30 دقيقة. تنزّل الصفحة ومكتبة PDF ملفاتها المعتادة، لكن ملفك لا يُرسل مع تلك الطلبات ولا إلى خوادمنا ولا إلى خدمة تحويل.

الأسئلة الشائعة

لا. يختار الجمل من النص المستخرج بحساب حتمي لتكرار الكلمات. ولا يعيد صياغة المصدر أو ينشئ ادعاءات جديدة أو يتحقق من الوقائع.

ليس وحده. إذا كانت الصفحات صوراً فقط فلن توجد طبقة نص يمكن قراءتها. شغّل OCR أولاً ثم استخدم ملف PDF الناتج القابل للبحث.

يخزن PDF النص في مواضع لا كفقرات عادية. وقد تجعل الأعمدة والجداول والرؤوس والخطوط غير المعتادة ترتيب الاستخراج مختلفاً عن ترتيب القراءة المرئي.

يطلب المتصفح فصل الجمل والكلمات وفق لغة الصفحة، بما في ذلك اللغات التي لا تفصل كل كلمة بمسافة. يوجد بديل بعلامات Unicode، لكن لغة ملف PDF لا تُكتشف تلقائياً.

استخدم ملف PDF واحداً لا يتجاوز 20 MiB و150 صفحة و2,000,000 حرف مستخرج. تُرفض الملفات المحمية بكلمة مرور أو التالفة أو غير المقروءة.

لا. يبقى الملف والنص في المتصفح. في المسار ذي الخطوات الثلاث يبقى سجل محلي خاص حتى 30 دقيقة، ولا يحتوي الرابط إلا على معرّفه المبهم.

أدوات ذات صلة