مستخرج المقالات
استخرج النص الكامل للمقالات والعناوين والكتّاب والتواريخ والصور من المواقع الإخبارية والمدونات. مصمم لخطوط RAG ومراقبة الإعلام وأبحاث المحتوى.
بصفتنا شركاء لـ Apify، قد نحصل على عمولة من عمليات الشراء المؤهلة التي تتم من خلال روابطنا، دون أي تكلفة إاضافية عليك. نحن نوصي فقط بالأدوات التي نثق بها.
نظرة عامة
تحوّل أداة مستخرج المقالات المقالات الإخبارية وتدوينات المدونات والمنشورات الإلكترونية إلى بيانات منظمة نظيفة. يستخرج محرك تحليل HTML النص الكامل للمقال مع التنسيق والعناوين ومعلومات الكاتب وتواريخ النشر والصور المميزة وتقديرات وقت القراءة وبيانات SEO الوصفية — مع إزالة الإعلانات وعناصر التنقل والمحتوى الزائد. يعالج آلاف الروابط بالتوازي لعمليات الجمع واسعة النطاق. يقبل كل تشغيل قائمة روابط مقالات وخيارات مثل المحلل البديل وحفظ HTML المقال والترويسات المخصصة وتوليد الترويسات والبروكسيات السكنية. صدّر النتائج بصيغ JSON أو CSV أو XML أو RSS أو HTML مباشرة إلى خطوط التحليل وأنظمة المحتوى وقواعد معرفة RAG وقواعد بيانات الأبحاث.
الميزات الرئيسية
حالات الاستخدام
بناء قواعد معرفة RAG
مراقبة الأخبار والإعلام
تدقيق محتوى SEO
مجموعات تجميع المحتوى
جمع بيانات تدريب الذكاء الاصطناعي
إعدادات الإدخال
| المعلمة | النوع | مطلوب | الوصف |
|---|---|---|---|
| startUrls | Array | مطلوب | قائمة روابط المقالات المراد استخراج محتواها. |
| alternativeParser | Boolean | اختياري | استخدام المحلل البديل الذي يحافظ على تنسيق أكثر؛ أفضل لبعض المواقع. |
| saveArticleHtml | Boolean | اختياري | حفظ HTML قسم المقال لكل نتيجة. |
| proxyConfiguration | Object | اختياري | إعدادات البروكسي؛ يُنصح بالبروكسيات السكنية للمواقع الإخبارية الكبيرة. |
عينة مخرجات
[
{
"url": "https://example.com/news/sample-article",
"title": "Sample Extracted Article",
"author": "Jane Reporter",
"published": "2026-09-01T10:00:00.000Z",
"ttr": 240,
"source": "example.com",
"extracted_at": "2026-09-11T14:30:00Z"
}
] كيفية الاستخدام
- 1
سجّل مجاناً: أنشئ حساب ParseFlow مجاني للوصول إلى أدوات الاستخراج الاحترافية.
- 2
اضبط المعاملات: الصق روابط المقالات في إعدادات مستخرج المقالات.
- 3
حمّل بياناتك: اضغط بدء، وانتظر بضع دقائق، ثم حمّل مجموعة البيانات بصيغة JSON أو CSV أو Excel.
مثال واجهة برمجة التطبيقات
import { ApifyClient } from 'apify-client';
const client = new ApifyClient({ token: 'YOUR_API_TOKEN' });
const input = {
"startUrls": [{"url": "https://example.com/news/sample-article"}],
"alternativeParser": false
};
const run = await client.actor("web.harvester/articles-extractor").call(input);
const { items } = await client.dataset(run.defaultDatasetId).listItems();
console.log(items); هيكل الأسعار
اشتراك شهري ثابت بدءاً من 15$ بالإضافة لاستهلاك منصة Apify، الذي ينخفض في الخطط الأعلى. راجع تبويب الأسعار في المتجر لأسعار الاستخدام الحالية.
القيود
- المقالات المحجوبة باشتراك مدفوع أو تسجيل الدخول لا يمكن استخراجها إلا إذا كانت متاحة دون مصادقة.
- الصفحات التفاعلية بكثافة قد تناسبها أكثر أدوات السحب بالمتصفح الكامل.
الأسئلة الشائعة
ما المحتوى الذي يعيده مستخرج المقالات؟
هل يتعامل مع آلاف المقالات دفعة واحدة؟
ما صيغ التصدير المدعومة؟
تفاصيل البيانات المستخرجة
عرض على متجر Apify
أدوات ذات صلة
أداة سحب أخبار جوجل
استخرج المقالات الإخبارية والعناوين وبيانات الناشرين من أخبار جوجل لمراقبة وسائل الإعلام. أتمت الاستخراج المجدول وصدّر النتائج إلى Excel أو JSON.
أداة سحب بحث جوجل
استخرج نتائج البحث العضوية (Organic Pages) والإعلانات وقسم 'الأشخاص يسألون أيضًا' من بحث جوجل لتحليلات تحسين محركات البحث SEO.
أداة سحب الويب العامة
اسحب أي موقع باستخدام متصفح واستخرج بيانات منظمة باستخدام كود JavaScript مخصص. أتمت الاستخراج المجدول وصدّر النتائج إلى Excel أو JSON.
مستخرج المقالات
paid