وظائف مطورين بايثون في لبنان
٢٠٦ وظائف شاغرة
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>تبحث Mindrift عن مهندسين متمكنين جدًا في استخراج البيانات باستخدام بايثون للانضمام إلى مشروع Tendem وتوجيه تدفقات عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين الذي يجمع بين الذكاء الاصطناعي والبشر.<br> في هذا الدور، كملاح AI – هكذا نسمي هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي والخبرة في المجال وضمان الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.<br> هذه الفرصة عن بُعد بدوام جزئي مثالية للمهنيين التقنيين ذوي الخبرة العملية في تقطيع الويب واستخراج البيانات ومعالجتها.<br> ماذا نفعل؟ منصة Mindrift تربط المتخصصين بمشروعات AI من رواد التكنولوجيا الكبار.<br> مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرات العالم الواقعي عبر العالم.<br> هذا دور مستقل لمشروع Tendem.<br> بصفة مهندس أول لاستخراج البيانات باستخدام بايثون، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج ومعالجة الويب، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمة بجانب طرقك المتاحة.<br> المسؤوليات الرئيسية: امتلاك تدفقات عمل استخراج البيانات من البداية إلى النهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المهيكلة.<br> الاستفادة من الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير عمل مخصص لتسريع جمع البيانات والتحقق وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.<br> ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض بجافا سكريبت وسلوك الموقع المتغير.<br> فرض معايير جودة البيانات من خلال تحقق من الصحة، وضوابط اتساق عبر مصادر متعددة، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.<br> توسيع عمليات الاستخراج لمجموعات بيانات كبيرة باستخدام دفعات فعالة أو توازيها، رصد الفشل، والحفاظ على الاستقرار ضد تغييرات بسيطة في بنية الموقع.<br> المتطلبات: خبرة لا تقل عن 5 سنوات في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو التطوير البرمجي (مطلوب).<br> درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسب، أو مجالات تقنية ذات صلة تُعد ميزة. <br> يجب أن يمتلك المرشحون أساسًا تقنيًا قويًا وتجربة عملية في الت scripting، الأتمتة، وتدفقات العمل المستندة إلى AI. <br> نبحث عن متخصصين يمكنهم حل المشكلات غير البسيطة، والعمل بثقة مع نماذج اللغة الكبيرة، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بصورة منهجية.<br> نهج منهجي ومقيد التفاصيل والقدرة على العمل بشكل مستقل أمران أساسيان.<br> خبرة قوية في استخراج الويب بلغة بايثون (BeautifulSoup، Selenium أو ما يماثلها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات. قدرة مثبتة على استخراج البيانات من تراكيب معقدة (الهياكل، الصفحات المؤرشفة، HTML غير المتسق). خلفية قوية في تنظيف البيانات، التطبيع والتحقق، وتقديم مجموعات بيانات مهيكلة (CSV، JSON، جداول Google). خبرة مثبتة في التعامل مع آليات مضادة للبوت وبنى مواقع ديناميكية على نطاق واسع. خبرة مع بنية تحتية سحابية (AWS أو ما يعادلها) والحاويات (Docker) كجزء من تدفقات العمل الحقيقية. خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يماثلها) مطبقة في مهام الأتمتة. اهتمام قوي بالتفاصيل والتزام دقة البيانات. أخلاقيات عمل ذاتي مع قدرة على استكشاف الأخطاء بشكل مستقل. رابط إلى GitHub ميزة. الكفاءة الإنجليزية: مستوى يتراوح بين فوق المتوسط (B2) أو أعلى (مطلوب). توقعات وقت المشروع: بالنسبة لهذا المشروع، من المتوقع أن تتطلب المهام نحو 10–20 ساعة أسبوعيًا خلال المراحل النشطة، بناءً على متطلبات المشروع.<br> هذه تقديرات وليست عبئًا مضمونًا، وتطبق فقط أثناء نشاط المشروع.<br> التعويض: يمكن للمساهمين كسب حتى 25 دولار أمريكي في الساعة مكافئًا، بحسب مستوى المساهمة وسرعتها.<br> يختلف التعويض عبر المشاريع بناءً على النطاق والتعقيد والخبرة المطلوبة.<br> يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات ربح مختلفة بناءً على متطلباتها.<br></span> </div>
<h2 class="h5">وصف العمل</h2>
<div class="t-break" data-jb-field="description">
<span>تبحث Mindrift عن متخصصين ماهرين في Vibecode للانضمام إلى مشروع Tendem (https://tendem.<br>ai/) وتوجيه سير عمل استخراج البيانات المتخصص لحالات استخدام واقعية.<br> تبحث Mindrift عن مهندسين كبار في استخراج بيانات بايثون للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصص لتطبيقات واقعية.<br> في هذا الدور، ستطبق خبرتك في التصفح الإلكتروني، واستخراج البيانات، ومعالجة البيانات لتقديم نتائج دقيقة وموثوقة وعالية الجودة.<br> هذه الفرصة بدوام جزئي عن بُعد مناسبة للمهنيين التقنيين الذين لديهم خبرة عملية في استخراج البيانات، واستخراجها ومعالجتها.<br> ما نقوم به: تربط منصة Mindrift المتخصصين بمشاريع تكنولوجية مبتكرة.<br> مهمتنا هي المساعدة في تطوير تقنيات ذكاء اصطناعي عالية الجودة من خلال دمج الخبرة الواقعية للمهنيين من جميع أنحاء العالم مع جهود تطوير AI المتقدمة.<br> عن الدور: هذا دور مستقل لمشروع Tendem.<br> كمهندس كبير لاستخراج بيانات بايثون، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية في الاستخراج والمعالجة عبر الويب، باستخدام أدوات مثل Apify وOpenRouter وغيرها من التقنيات، إلى جانب خبرتك ومناهجك التقنية الخاصة.<br> المسؤوليات الأساسية: امتلاك سير عمل استخراج البيانات من البداية إلى النهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.<br> الاستفادة من الأدوات المتاحة وتدفقات العمل المخصصة لتسريع جمع البيانات والتحقق منها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.<br> ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، مع تعديل النهج حسب الحاجة للتعامل مع المحتوى المعروض جافاسكريبت وسلوك الموقع المتغير.<br> فرض معايير جودة البيانات من خلال فحوصات التحقق، والتحكم في الاتساق بين المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.<br> توسيع عمليات الاستخراج لمجموعات البيانات الكبيرة باستخدام دفعات فعالة أو توازي، ومراقبة الإخفاقات، والحفاظ على الاستقرار في مواجهة تغييرات بسيطة في بنية الموقع.<br> المؤهلات التعليمية: ما لا يقل عن 5+ سنوات خبرة ذات صلة في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).<br> شهادة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو مجالات تقنية ذات صلة ميزة إضافية.<br> الخبرة الأكاديمية و/أو المهنية: يجب أن يمتلك المرشحون أساسًا تقنيًا قويًا وخبرة عملية في التهيئة، الأتمتة، وسير عمل استخراج البيانات.<br> نحن نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، والعمل بثقة مع أدوات وتقنيات التطوير الحديثة، وجمع البيانات من مصادر متنوعة بشكل منهجي والتحقق منها.<br> نهج منهجي ومهتم بالتفاصيل والقدرة على العمل بشكل مستقل أمران أساسيان.<br> المهارات التقنية (أساسية) خبرة قوية في استخراج البيانات من الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثلها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات. القدرة المثبتة على استخراج البيانات من هياكل معقدة (الهياكل الهرمية، الصفحات المؤرشفة، HTML غير المتسق). خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، جداول Google). متطلبات إضافية: خبرة مثبتة في التعامل مع آليات مضادة للبوت وهياكل المواقع الديناميكية على نطاق واسع. خبرة مع بنية السحابة (AWS أو ما يعادلها) والتعبئة بالحاويات (Docker) كجزء من سير عمل حقيقي. خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يماثلها) مطبقة في مهام الأتمتة. اهتمام دقيق بالتفاصيل والتزام بدقة البيانات. أخلاقيات عمل موجهة ذاتيًا مع القدرة على استكشاف الأخطاء بشكل مستقل. رابطه إلى GitHub ميزة إضافية. الكفاءة الإنجليزية: مستوى أعلى من المتوسط (B2) أو أعلى (مطلوب). توقعات زمن المشروع: بالنسبة لهذا المشروع، من المتوقع أن تستغرق المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع.<br> هذه تقديرات وليست عبئًا مضمونًا، وتطبق فقط أثناء نشاط المشروع.<br> التعويض: في هذا المشروع، يمكن للمساهمين كسب حتى 25 دولارًا في الساعة مكافئًا، اعتمادًا على مستوى المساهمة وسرعتها.<br> يتفاوت التعويض عبر المشاريع حسب النطاق والتعقيد والخبرة المطلوبة.<br> يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات دخل مختلفة بناءً على متطلباتها.<br></span> </div>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>تبحث Mindrift عن مهندسين خبراء في استخراج البيانات بايثون من المستوى العالي للانضمام إلى مشروع Tendem ودفع سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين AI + البشري.<br> في هذا الدور، كملاح AI – هكذا نُشير إلى هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي والخبرة الميدانية وضمان الجودة لتقديم نتائج دقيقة وقابلة للإجراء.<br> هذه الفرصة الجزئية عن بُعد مثالية للمهنيين التقنيين ذوي الخبرة العملية في استخراج البيانات من الويب، والاستخراج والمعالجة.<br> ما نقوم به تربط منصة Mindrift المتخصصين بمشاريع AI من مبتكري التقنية الكبار.<br> مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.<br> هذا دور مستقل لمشروع Tendem.<br> بصفته مهندس استخراج البيانات بايثون senior، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية للاستخراج والمعالجة عبر الويب، باستخدام أدوات مثل Apify وOpenRouter المقدّمة إلى جانب أساليبك الذكية الخاصة.<br> المسؤوليات الرئيسية: امتلاك سير عمل استخراج البيانات من البداية للنهاية عبر مواقع ويب معقدة، ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المهيكلة.<br> الاستفادة من الأدوات الداخلية (Apify، OpenRouter) جنباً إلى جنب مع التدفقات العمل المخصصة لتسريع جمع البيانات والتحقق وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.<br> ضمان استخراج موثوق من المصادر الديناميكية والتفاعلية على الويب، وتكييف الأساليب حسب الحاجة لمعالجة المحتوى المعروض جافا سكريبت وسلوك الموقع المتغير.<br> فرض معايير جودة البيانات من خلال فحوصات التحقق، وضوابط الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.<br> توسيع عمليات الاستخراج للبيانات الكبيرة باستخدام دفعات فعالة أو توازي، ومراقبة الإخفاقات، والحفاظ على الاستقرار أمام تغييرات بسيطة في بنية الموقع.<br> المتطلبات: خبرة لا تقل عن 5 سنوات في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).<br> درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسب، أو المجالات التقنية ذات الصلة ميزة إضافية.<br> يجب أن يمتلك المرشحون أساساً تقنياً قوياً وخبرة عملية في البرمجة النصية، الأتمتة، وتدفقات العمل المدعومة بالذكاء الاصطناعي.<br> نحن نبحث عن متخصصين يستطيعون حل مشاكل غير تافهة، والعمل بثقة مع نماذج اللغة الكبيرة، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي.<br> نهج منهجي وتفصيلي والقدرة على العمل بشكل مستقل ضروريان.<br> خبرة قوية في استخراج الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يشابهها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات. القدرة المثبتة على استخراج البيانات من الهياكل المعقدة (التسلسلات، الصفحات المؤرشفة، HTML غير المنتظم) خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات مهيكلة (CSV، JSON، Google Sheets) خبرة مثبتة في التعامل مع آليات مضاد البوت وهياكل المواقع الديناميكية على نطاق واسع خبرة مع بنية تحتية سحابية (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير العمل الواقعي خبرة عملية مع أطر LangChain، OpenRouter، أو ما يشابهها مطبقة في مهام الأتمتة اهتمام شديد بالتفاصيل والتزام بدقة البيانات عمل ذاتي مع القدرة على استكشاف الأخطاء بشكل مستقل وجود رابط GitHub ميزة إضافية اللغة الإنجليزية: مستوى أعلى من المتوسط (B2) أو أعلى (مطلوب) توقعات الوقت للمشروع لهذه المشروع، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، وفقاً لمتطلبات المشروع.<br> هذه تقديرية، وليست حصة عمل مضمونة، وتطبق فقط أثناء نشاط المشروع.<br> التعويض: في هذا المشروع يمكن للمساهمين كسب حتى 25 دولاراً في الساعة المعادل، حسب مستواهم وتيرة مساهمتهم.<br> يتفاوت التعويض عبر المشاريع حسب النطاق والتعقيد والخبرة المطلوبة.<br> يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة اعتماداً على متطلباتها.<br></span> </div>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسي بايثون كبار في استخراج البيانات ذوي مهارات عالية للانضمام إلى مشروع Tendem وتوجيه تدفقات عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين بين AI والبشر.</p>
<p>في هذا الدور، كملاح آلي – هكذا نصف هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام الروتينية، في حين تقدم التفكير النقدي، والخبرة الميدانية، وضمان الجودة لتقديم نتائج دقيقة وقابلة للت Action.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مناسبة للمهنيين التقنيين الذين يمتلكون خبرة عملية في استخراج البيانات من الويب، واستخراج البيانات، ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>تربط منصة Mindrift المتخصصين بمشاريع الذكاء الاصطناعي من كبار المبتكرين في التكنولوجيا. مهمتنا هي إطلاق إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرة العالم الواقعي من جميع أنحاء العالم.</p>
<p>هذه وظيفة حرة لمشروع Tendem. كمهندس بايثون كبير لاستخراج البيانات، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج البيانات من الويب ومعالجتها، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمة لديك بجانب أساليبك المعتمدة على الموارد.</p>
<h4>المسؤوليات الرئيسية:</h4>
<ul>
<li>امتلاك وتيرة العمل من البداية إلى النهاية لعمليات استخراج البيانات عبر مواقع معقدة، مع ضمان التغطية الكلية والدقة وتقديم مجموعات البيانات المنظمة بشكل موثوق.</li>
<li>استخدام الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير العمل المخصص لتسريع تجمع البيانات، والتحقق منها، وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض JavaScript وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحص التحقق، وضوابط الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>تكبير عمليات السحب لبيانات كبيرة باستخدام التقطيع الفعال أو التوازي، ومراقبة الإخفاقات، والحفاظ على الاستقرار ضد التغييرات الطفيفة في بنية الموقع.</li>
</ul>
<h4>المتطلبات:</h4>
<ul>
<li>خبرة ذات صلة لا تقل عن 5 سنوات في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو مجالات تقنية ذات صلة تعتبر ميزة.</li>
<li>يجب أن يمتلك المرشحون أساساً تقنياً قوياً وخبرة عملية في البرمجة النصية، الأتمتة، وتدفقات العمل المدعومة بالذكاء الاصطناعي. نحن نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، والعمل بثقة مع LLMs، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي. نهج منهجي وتفصيلي والقدرة على العمل بشكل مستقل ضروريان.</li>
<li>خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما شابه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات البرمجة عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من المَكاتِع المعقدة (التدرجات، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق من صحتها، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة في التعامل مع آليات مكافحة الروبوتات وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع البنية التحتية السحابية (AWS أو ما يعادلها) والتعبئة بالحاويات (Docker) كجزء من تدفقات العمل الحقيقية.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) مُطبقة في مهام الأتمتة.</li>
<li>انتباه قوي للتفاصيل والالتزام بدقة البيانات.</li>
<li>أخلاقيات عمل موجهة ذاتياً مع القدرة على استكشاف المشكلات بشكل مستقل.</li>
<li>إتقان اللغة الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
</ul>
<h4>توقعات زمن المشروع</h4>
<p>لهذا المشروع، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة أسبوعياً خلال مراحل النشاط، بناءً على متطلبات المشروع. هذا تقدير، ليس عبئ عمل مضمون، وينطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب حتى 25 دولاراً في الساعة مكافئاً، اعتماداً على مستواهم وسرعتهم في المساهمة.</p>
<p>يتفاوت التعويض عبر المشاريع اعتماداً على النطاق، والتعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسين ذوي مهارات عالية في استخراج البيانات باستخدام بايثون مستوى كبير للانضمام إلى مشروع Tendem وقيادة سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين الذي يجمع بين AI والبشر.</p>
<p>في هذا الدور، كقائد AI – هكذا نُشير إلى هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي والخبرة الميدانية وضبط الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة الجزئية والعمل عن بُعد مثالية للمهنيين التقنيين الذين لديهم خبرة عملية في استخراج الويب، واستخراج البيانات، ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>تربط منصة Mindrift المتخصصين بمشاريع AI من رواد التكنولوجيا الكبار. مهمتنا هي إطلاق إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرات العالم الواقعي من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. كمهندس بيانات بايثون كبير في استخراج البيانات، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج الويب ومعالجته، باستخدام أدوات متنوعة مثل Apify وOpenRouter التي نقدمها بجانب نهجك الذكي والمورد.</p>
<h4>المسؤوليات الرئيسية:</h4>
<ul>
<li>إدارة تدفقات استخراج البيانات من الوجهة حتى النهاية عبر مواقع ويب معقدة، لضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) بجانب سير عمل مخصص لتسريع جمع البيانات، والتحقق منها، وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من المصادر الديناميكية والتفاعلية مع تكييف الأساليب حسب الحاجة لمعالجة المحتوى المدعوم بجافا سكريبت وتغير سلوك المواقع.</li>
<li>إلزام معايير جودة البيانات عبر فحوصات التحقق، والتحكم في التناسق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>تكييف عمليات التنقيب لبيانات كبيرة باستخدام تجميع فعال أو توازي، مراقبة الإخفاقات، والحفاظ على الاستقرار أمام تغييرات بسيطة في بنية المواقع.</li>
</ul>
<h4>المتطلبات:</h4>
<ul>
<li>على الأقل 5+ سنوات خبرة ذات صلة في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسب أو مجالات تقنية ذات صلة ميزة إضافية.</li>
<li>يجب أن يمتلك المرشحون أساساً تقنياً قوياً وتجربة عملية في التهيئة النصية، الأتمتة، وسير عمل مدعوم بالذكاء الاصطناعي. نحن البحث عن متخصصين يمكنهم حل المشكلات غير البسيطة، والعمل بارتياح مع نماذج اللغة الكبيرة، وجمع البيانات وتنظيمها والتحقق منها بشكل منهجي من مصادر متنوعة. نهج منهجي ودقيق في التفاصيل والقدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في استخراج الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يشابهها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (التسلسلات الهرمية، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق من الصحة، تقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مكافحة الروبوتات وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية السحابة (AWS أو ما يعادلها) والحاويات (Docker) كجزء من سير عمل فعلي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يشابهها) مطبقة في مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على الاستكشاف وحل المشكلات بشكل مستقل.</li>
<li>إتقان الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
</ul>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، تُقدَّر المهمات بأن تتطلب نحو 10–20 ساعة أسبوعياً خلال المراحل النشطة، بناءً على متطلبات المشروع. هذه مجرد تقدير، وليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب حتى 25 دولاراً في الساعة مكافئ، اعتماداً على المستوى وسرعة الإسهام.</p>
<p>يتفاوت التعويض عبر المشاريع بحسب النطاق والتعقيد والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسي استخراج بيانات بايثون كبار المهارة للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصص ضمن نظامنا المختلط بين الذكاء الاصطناعي والبشر.</p>
<p>في هذه المهمة، كقائد AI – هكذا نصف هذا الدور في Mindrift – ستتعاون مع عملاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي، والخبرة الميدانية، وضبط الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة الجزئية عن بُعد مثالية للمهنيين التقنيين الذين لديهم خبرة عملية في تصفح الويب، واستخراج البيانات، ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>تربط منصة Mindrift المتخصصين بمشاريع AI من مبتكري التكنولوجيا الرائدين. هدفنا هو فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. بصفتيك مهندس تعدين بيانات بايثون كبير، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج الويب ومعالجته، باستخدام أدوات متعددة مثل Apify وOpenRouter المقدمين بجانب طرقك الابتكارية الخاصة.</p>
<h4>المسؤوليات الأساسية:</h4>
<li>امتلاك سير عمل استخراج البيانات من البداية حتى النهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) بجانب سير العمل المخصص لتسريع جمع البيانات، والتحقق، وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان الاستخراج الموثوق من مصادر ويب ديناميكية وتفاعلية، وتعديل الأساليب حسب الحاجة لمعالجة المحتوى المولد بواسطة JavaScript وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق، ضوابط الاتساق عبر المصادر، الالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات التصفح لبيانات كبيرة باستخدام تجميع فعال أو توازي، رصد الإخفاقات، والحفاظ على الاستقرار في مواجهة تغييرات طفيفة في هيكل الموقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5+ سنوات في هندسة البيانات، تصفح الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريا أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو مجالات تقنية ذات صلة ميزة إضافية.</li>
<li>يجب أن يمتلك المتقدمون أساسًا تقنيًا قويًا وخبرة عملية في التهيئة والبرمجة والأعمال المدعومة بالذكاء الاصطناعي. نحن نبحث عن متخصصين يستطيعون حل مشكلات غير تافهة، والعمل بثقة مع نماذات اللغة الكبيرة، وجمع البيانات وهيكلتها والتحقق منها بشكل منهجي من مصادر متنوعة. النهج المنهجي والدقيق والقدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في تصفح الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما شابه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (التسلسلات، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات المضاد للبوت وبُنى المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية السحابة (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير عمل حقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) مطبقة في مهام الأتمتة.</li>
<li>انتباه قوي للتفاصيل والتزام بالدقة في البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على حل المشاكل بشكل مستقل.</li>
<li>رابط إلى GitHub ميزة إضافية.</li>
<li>إتقان اللغة الإنجليزية: مستوى أعلى من المتوسط (B2) أو أعلى (مطلوب).</li>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، يُقدر أن المهام تتطلب حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير، ليس عبئ عمل مضمون، ويسري فقط أثناء نشاط المشروع.</p>
<h4>التعويضات</h4>
<p>في هذا المشروع، يمكن للمساهمين أن يكسبوا حتى 25 دولاراً في الساعة مكافئاً، اعتماداً على مستواهم وسرعتهم في المساهمة.</p>
<p>يختلف التعويض عبر المشاريع اعتماداً على النطاق، والتعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسين متمرسين عاليي المستوى في استخراج البيانات باستخدام بايثون للانضمام إلى مشروع Tendem وقيادة تدفقات عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين الذكي الاصطناعي + البشري.</p>
<p>في هذا الدور، كـ AI pilot – هذا هو المصطلح الذي نستخدمه للدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي والخبرة الميدانية وجودة العمل لضمان نتائج دقيقة وقابلة للإجراء.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مثالية للمهنيين التقنيين ذوي الخبرة العملية في استخراج الويب، واستخراج البيانات ومعالجتها.</p>
<h4>ما نقوم به</h4>
<p>تربط منصة Mindrift المتخصصين بمشاريع الذكاء الاصطناعي من كبار مبتكري التكنولوجيا. هدفنا هو فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. كمهندس استخراج بيانات بايثون كبير، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية للويب، مع استخدام أدوات مثل Apify وOpenRouter الموفرة لدينا إلى جانب أساليبك الإبداعية الخاصة.</p>
<h4>المسؤوليات الرئيسية:</h4>
<li>امتلاك سير عمل استخراج البيانات من الطرف إلى الطرف عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات الهيكلية.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير عمل مخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، مع تكييف الأساليب حسب الحاجة لمعالجة المحتوى المعروض بواسطة جافاسكريبت وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق والتحكم في الاتساق عبر المصادر والالتزام بمواصفات التنسيق والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات الاستخراج لبيانات كبيرة باستخدام دفعات فعالة أو توازي، مراقبة الإخفاقات، والحفاظ على الاستقرار أمام تغييرات طفيفة في بنية الموقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة ذات صلة لا تقل عن 5 سنوات في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو المجالات التقنية ذات الصلة تعتبر ميزة.</li>
<li>يجب أن يمتلك المرشحون أساسًا تقنيًا قويًا وخبرة عملية في التهيئة والبرمجة والتدفقات العمل المدعومة بالذكاء الاصطناعي. نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، والعمل بثقة مع نماذات اللغة الكبيرة، وجمع البيانات من مصادر متنوعة وتنظيمها والتحقق منها بشكل منهجي. نهج منظم ودقيق والقدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما يشابهه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (هرمات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات هيكلية (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مضادة للبوت وبُنى مواقع ديناميكية على نطاق واسع.</li>
<li>خبرة في بنية السحابة (AWS أو ما يعادلها) والتعبئة بالحاويات (Docker) كجزء من تدفقات العمل الحقيقية.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) مطبقة على مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والالتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على استكشاف المشكلات بشكل مستقل.</li>
<li>رابط إلى GitHub ميزة إضافية.</li>
<li>إتقان الإنجليزية: مستوى أعلى من المتوسط (B2) أو أعلى (مطلوب).</li>
<h4>توقعات زمن المشروع</h4>
<p>لهذا المشروع، من المقدر أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير وليس عبء عمل مضمون، ويطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن أن يحقق المساهمون ما يصل إلى 25 دولارًا في الساعة كمعادل، اعتمادًا على مستواهم وسرعة مساهمتهم.</p>
<p>يختلف التعويض عبر المشاريع اعتمادًا على النطاق والتعقيد والخبرة المطلوبة. لاحظ أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسين مهابيلين في استخراج البيانات باستخدام بايثون كبار السن للانضمام إلى مشروع Tendem وقيادة تدفقات استخراج البيانات المتخصصة ضمن نظامنا الهجين بين الذكاء الاصطناعي والبشر.</p>
<p>في هذا الدور، كـ قائد AI – هكذا نُشير إلى هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي والخبرة الميدانية ومراقبة الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مثالية للمتخصصين التقنيين ذوي الخبرة العملية في استخراج البيانات من الويب، واستخراجها ومعالجتها.</p>
<h4>ماذا نفعل</h4>
<p>تربط منصة Mindrift المتخصصين بمشاريع AI من رواد التقنية الكبار. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرة العالم الحقيقي من جميع أنحاء العالم.</p>
<p>هذه وظيفة مستقلة لمشروع Tendem. كمهندس استخراج بيانات بايثون أول سِنْيُور، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية في استخراج الويب ومعالجته، مستخدمًا أدوات متنوعة مثل Apify وOpenRouter الموردة إلى جانب أساليبك المبدعة.</p>
<h4>المسؤوليات الأساسية:</h4>
<li>امتلاك تدفقات استخراج البيانات من البداية إلى النهاية عبر مواقع ويب معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق للبيانات المهيكلة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) بجانب تدفقات عمل مخصصة لتسريع جمع البيانات والتحقق وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض بجافاسكريبت وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق، والتحكم في الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>تطوير عمليات المسح لبيانات كبيرة باستخدام تجميع كفء أو توازي، رصد الإخفاقات، والحفاظ على الاستقرار مع تغييرات بنيوية بسيطة في الموقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5+ سنوات في هندسة البيانات، استخراج الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو مجالات تقنية ذات صلة تعد ميزة.</li>
<li>يجب أن يمتلك المرشحون أساساً تقنياً قوياً وخبرة عملية في البرمجة النصية، الأتمتة، وتدفقات العمل بمساعدة AI. نحن نبحث عن متخصصين يمتلكون قدرة على حل مشكلات غير تافهة، والعمل بثقة مع LLMs، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي. نهج منهجي دقيق والقدرة على العمل بشكل مستقل ضروريان.</li>
<li>خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو مشابه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر وكيل.</li>
<li>القدرة المثبتة على استخراج البيانات من هياكل معقدة (التسلسلات، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية صلبة في تنظيف البيانات وتطبيعها والتحقق من صحتها، وتقديم مجموعات بيانات مهيكلة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مضاد الروبوت وهيكلة المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع البنية التحتية السحابية (AWS أو ما يعادلها) والحاويات (Docker) كجزء من سير العمل الحقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يعادلها) مخصصة لمهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والالتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على استكشاف الأخطاء بصورة مستقلة.</li>
<li>رابط إلى GitHub ميزة.</li>
<li>إتقان الإنجليزية: فوق المتوسط (B2) أو أعلى (مطلوب).</li>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، من المقدر أن تستغرق المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير وليس عبئ عمل مضمون ويطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين أن يكسبوا حتى 25 دولاراً في الساعة كمعادل، اعتماداً على مستواهم ومعدل مساهمتهم.</p>
<p>التعويض يختلف عبر المشاريع حسب النطاق، التعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة وفقاً لمتطلباتها.</p></p><p></p>
<p><h4>تبحث Mindrift عن مهندسي حصد بيانات بايثون كبار المهارة في البرمجة</h4>
<p>للانضمام إلى مشروع Tendem ودفع سير عمل حصد البيانات المتخصصة ضمن نظامنا الهجين بين الذكاء الاصطناعي والبشر.</p>
<p>في هذا الدور، بصفتي قائد AI – هكذا نُشير إلى هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي، والخبرة الميدانية، وضمان الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة بدوام جزئي عن بُعد مثالية للمهنيين الفنيين الذين لديهم خبرة عملية في جمع البيانات من الويب، واستخراج البيانات، والمعالجة.</p>
<h4>ما الذي نقوم به</h4>
<p>تربط منصة Mindrift المتخصصين بمشاريع AI من كبار المبتكرين في التقنية. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذا دور حر لمشروع Tendem. كمهندس حصد بيانات بايثون كبير، ستتعامل مع مهام حصد البيانات التي تتطلب دقة تقنية لاستخراج البيانات من الويب ومعالجتها، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمين بجانب أساليبك المبتكرة الخاصة.</p>
<h4>المسؤوليات الأساسية:</h4>
<li>امتلاك تدفقات استخراج البيانات من البداية إلى النهاية عبر مواقع ويب معقدة، لضمان تغطية كاملة، ودقة، وتسليم موثوق لمجموعات البيانات المنظمة.</li>
<li>الاستفادة من الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير عمل مخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، مع تكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض جافا سكريبت وتغير سلوك المواقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوص التحقق، ومراقبة الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات الحصد لمجموعات بيانات كبيرة باستخدام دفعات فعالة أو توازي، ومتابعة الإخفاقات، والحفاظ على الاستقرار أمام تغيرات بسيطة في بنية المواقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5+ سنوات ذات صلة في هندسة البيانات، حصد البيانات من الويب، التشغيل الآلي، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو مجالات تقنية ذات صلة تعتبر ميزة.</li>
<li>يجب أن يمتلك المرشحون أساسًا تقنيًا قويًا وخبرة عملية في البرمجة النصية، التشغيل الآلي، وتدفقات عمل مساعدَة بالذكاء الاصطناعي. نبحث عن متخصصين يمكنهم حل مشاكل غير تافهة، العمل بثقة مع نماذج اللغة الكبيرة، وجمع البيانات من مصادر متنوعة وتنظيمها والتحقق منها بطريقة منهجية. نهج منهجي ودقيق والقدرة على العمل بشكل مستقل أمور أساسية.</li>
<li>خبرة قوية في حصد البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما يشابهها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (همايات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، جداول Google).</li>
<li>خبرة مثبتة في التعامل مع آليات مضاد التtت bot وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية سحابية (AWS أو ما يعادلها) وتحوّل الحاويات (Docker) كجزء من سير العمل الواقعي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) مطبقة في مهام التشغيل الآلي.</li>
<li>اهتمام قوي بالتفاصيل والتزام بنقاء البيانات.</li>
<li>أخلاق عمل ذاتي التوجّه مع القدرة على استكشاف المشكلات بشكل مستقل.</li>
<li>رابط إلى GitHub يعتبر ميزة.</li>
<li>إتقان اللغة الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
<h4>توقعات زمن المشروع</h4>
<p>لهذا المشروع، من المتوقع أن تتطلب المهام نحو 10–20 ساعة في الأسبوع خلال المراحل النشطة، وفق متطلبات المشروع. هذه مجرد تقديرات وليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب حتى 25 دولارًا في الساعة كمعادلة، اعتمادًا على مستواهم وإيقاع مساهمتهم.</p>
<p>يتفاوت التعويض عبر المشاريع وفق النطاق والتعقيد والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تعرض مستويات ربح مختلفة حسب متطلباتها.</p></p><p></p>
<h2 class="h5">الوصف الوظيفي</h2>
<div class="t-break" data-jb-field="description">
<span>تبحث Mindrift عن خبراء Vibecode ذوي مهارات عالية للانضمام إلى مشروع Tendem (https://tendem.<br>ai/) وتوجيه سير عمل استخراج البيانات المتخصصة لحالات الاستخدام الواقعية.<br> تبحث Mindrift عن مهندسين كبار في استخراج البيانات باستخدام بايثون للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصصة لتطبيقات العالم الواقعي.<br> في هذا الدور، ستطبق خبرتك في الزحف على الويب، واستخراج البيانات، ومعالجة البيانات لتقديم نتائج دقيقة وموثوقة وعالية الجودة.<br> هذه الفرصة الجزئية عن بعد مناسبة للمهنيين التقنيين ذوي الخبرة العملية في الزحف على الويب، واستخراج البيانات ومعالجتها.<br> ما نقوم به: يربط منصة Mindrift بين المتخصصين ومشروعات التكنولوجيا المبتكرة.<br> مهمتنا هي المساعدة في تطوير تقنيات ذكاء اصطناعي عالية الجودة من خلال دمج الخبرة الواقعية من المحترفين حول العالم مع جهود تطوير الذكاء الاصطناعي المتقدمة.<br> عن الدور: هذه وظيفة حرة لمشروع Tendem.<br> كمهندس بيانات بايثون كبير في استخراج البيانات، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج ومعالجة الويب، باستخدام أدوات مثل Apify وOpenRouter وغيرها من التقنيات، إلى جانب خبرتك وتقنياتك الخاصة.<br> المسؤوليات الرئيسية: إدارة سير عمل استخراج البيانات من طرف إلى طرف عبر مواقع ويب معقدة، لضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.<br> استغلال الأدوات المتاحة وسير العمل المخصصة لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.<br> ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب حسب الحاجة لمعالجة المحتوى المولَّد بجافا سكريبت وسلوك المواقع المتغير.<br> فرض معايير جودة البيانات من خلال فحوصات التحقق، وضوابط الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.<br> توسيع عمليات الزحف لبيانات كبيرة باستخدام تجميع فعال أو توازي، ومراقبة الإخفاقات، والحفاظ على الاستقرار أمام تغييرات طفيفة في بنية المواقع.<br> المؤهلات التعليمية: خبرة لا تقل عن 5 سنوات في هندسة البيانات، الزحف على الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).<br> درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو الحقول التقنية ذات الصلة تعتبر ميزة إضافية.<br> الخبرة الأكاديمية و/أو المهنية: يجب أن يمتلك المتقدمون أساسًا تقنيًا قويًا وخبرة عملية في البرمجة النصية، الأتمتة، وعمليات استخراج البيانات.<br> نبحث عن متخصصين يمكنهم حل المشكلات غير البسيطة، والعمل بثقة مع أدوات وتقنيات التطوير الحديثة، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي.<br> نهج منهجي ومفصلية في العمل والقدرة على العمل بشكل مستقل أمران أساسيان.<br> المهارات التقنية (اساسية): خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثلها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات. القدرة المثبتة على استخراج البيانات من هياكل معقدة (هرميات، صفحات مؤرشفة، HTML غير متسق). خلفية صلبة في تنظيف البيانات، التطبيع، والاعتماد، وتقديم مجموعات بيانات منظمة (CSV، JSON، جداول Google). متطلبات إضافية: خبرة مثبتة في التعامل مع آليات مضاد الروبوت وبُنى المواقع الديناميكية على نطاق واسع، وخبرة مع بنية السحابة (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من تدفقات العمل الحقيقية، وخبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) المطَبقة للمهام الأتمتة، واهتمام شديد بالتفاصيل والالتزام بدقة البيانات، وأخلاقيات العمل الذاتي مع القدرة على استكشاف الأخطاء بشكل مستقل. وجود رابط GitHub يعد ميزة. الكفاءة في الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب). توقعات زمن المشروع: لهذا المشروع، من المقدر أن تستغرق المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع.<br> هذه تقديرات وليست عبء عمل مضمون، وتنطبق فقط أثناء نشاط المشروع.<br> التعويض: في هذا المشروع، يمكن للمساهمين كسب حتى 25 دولارًا في الساعة مكافئًا، اعتمادًا على مستواهم وسرعة مساهمتهم.<br> يختلف التعويض عبر المشاريع اعتمادًا على النطاق والتعقيد والخبرة المطلوبة.<br> يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات ربح مختلفة بناءً على متطلباتها.<br></span> </div>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسي استخراج بيانات بايثون متمرسين للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين بين AI والبشر.</p>
<p>في هذه الدور كملاّح AI – هكذا نُسَمّي هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي، والخبـرة الميدانية، ومراقبة الجودة لتقديم نتائج دقيقة وقابلة للإجراء.</p>
<p>هذه الفرصة بدوام جزئي عن بعد مثالية للمهنيين التقنيين ذوي الخبرة العملية في استخراج البيانات من الويب، واستخراجها، ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>تربط منصة Mindrift المتخصصين بمشاريع AI من أبرز مبتكري التكنولوجيا. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرة العالم الواقعي من جميع أنحاء العالم.</p>
<p>هذه وظيفة حرة لمشروع Tendem. كمهندس استخراج بيانات بايثون أقدم، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية للمنفذ عبر الويب والمعالجة، مع استخدام أدوات متنوعة مثل Apify وOpenRouter المقدمين إلى جانب أساليبك الخاصة والموارد المتاحة لديك.</p>
<h4>المسؤوليات الرئيسية:</h4>
<li>امتلاك سير عمل استخراج البيانات من البداية إلى النهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.</li>
<li>استغلال أدوات داخلية (Apify، OpenRouter) جنبًا إلى جنب مع سير عمل مخصص لتسريع جمع البيانات والتحقق وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، مع تكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض بجافا سكريبت وتغير سلوك المواقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق، وضوابط الاتساق بين المصادر، والالتزام بتنسيقات محددة، والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات التنقيب لبيانات كبيرة باستخدام تجميع فعال أو توازي، ومراقبة الإخفاقات، والحفاظ على الاستقرار ضد تغييرات بسيطة في بنية الموقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة ذات صلة لا تقل عن 5+ سنوات في هندسة البيانات، استخراج الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو مجالات تقنية ذات صلة أمر جيد إضافي.</li>
<li>يجب أن يمتلك المرشحون أساساً تقنياً قوياً وخبرة عملية في الت scripting، الأتمتة، وسير العمل بمساعدة AI. نحن نبحث عن متخصصين يستطيعون حل مشاكل غير تافهة، العمل بثقة مع LLMs، وجمع وتنظيم والتحقق من البيانات من مصادر متنوعة بشكل منهجي. نهج منضبط وتفصيلي وقدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في استخراج البيانات باستخدام Python (BeautifulSoup، Selenium أو ما يماثله)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (الهرميات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مناعة ضد البوتات وبُنى المواقع الديناميكية على نطاق واسع.</li>
<li>الخبرة مع بنية سحابية (AWS أو ما يعادلها) وتغليف الحاويات (Docker) كجزء من سير العمل الحقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) مطبقة في مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل موجهة ذاتياً مع قدرة على استكشاف الأخطاء بنفسك.</li>
<li>رابط GitHub ميزة إضافية.</li>
<li>إتقان الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
<h4>توقعات وقت المشروع</h4>
<p>للمشروع هذا، يُقدّر إنجاز المهام بحوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، وفقاً لمتطلبات المشروع. هذا تقدير، ليس عبء عمل مضمون، ويسري فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين أن يكسبوا حتى 25 دولارًا في الساعة كمعادل، اعتماداً على مستواهم وتيرتهم في المساهمة.</p>
<p>يختلف التعويض عبر المشاريع اعتماداً على النطاق، التعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة اعتماداً على متطلباتها.</p>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>يرجى تقديم سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إجادتك للغة الإنجليزية.<br> Mindrift تربط المتخصصين بفرص الذكاء الاصطناعي القائمة على المشاريع لشركات تقنية رائدة، مركّزة على الاختبار والتقييم وتحسين أنظمة الذكاء الاصطناعي.<br> المشاركة قائمة على المشروع وليست توظيفاً دائماً.<br>ما تنطوي عليه هذه الفرصة: نحن نقوم ببناء مجموعة بيانات لتقييم وكلاء الترميز بالذكاء الاصطناعي - مدى قدرة النموذج على التعامل مع مهام المطورين الواقعية.<br> ستقوم بإنشاء مهام وتقييمات داخل بيئات محاكاة واقعية: بناء بيئات مطور واقعية - شركة افتراضية بها قاعدة الشيفرة، والبنية التحتية، والسياق (التذاكر، المستندات، المحادثات) التي تكوّن تاريخ تطوير مقنع، تصميم مهام من حالات وسيطة لهذه البيئات - صِغ المطالَب، عرّف ما يعنيه "الحل"، وتأكد من أن المهمة قابلة للحل بواسطة وكيل ذكاء اصطناعي، كتابة اختبارات تتحقق من حلول الوكيل - قبول جميع النهج الصحيحة ورفض غير الصحيحة، لا تكون صارمة للغاية ولا متساهلة جدًا، التكرار في المهام والاختبارات بناءً على ملاحظات QA - مراجعة حلول الوكلاء، تحليل الإخفاقات، وتحسين حتى يصبح التقييم عادلاً وموثوقاً.
ما هذا ليس: ليس توصيف بيانات ليس هندسة المطالَب ليس كتابة الشفرة من الصفر - الوكيل يكتب معظم الشفرة؛ أنت توجه وتقيّم.
ما نبحث عنه: 8+ سنوات في تطوير البرمجيات، المجموعة الأساسية: بايثون (FastAPI)، جافا سكريبت/تايب سكريبت (React)، دوكر، بوستغريس، كافكا، ريDITUS تجربة كتابة اختبارات (وظيفية، تكاملية)، إتقان الإنجليزية - B2+. لماذا هذا صعب: النماذج في الحدود الأمامية جيدة في الترميز بالفعل.<br> إنشاء مهمة تتحدى النماذج الأفضل حقاً ليس أمرًا سهلاً.<br> تحتاج إلى فهم عميق لأين تفشل النماذج وما هي السيناريوهات التي تكشف الفرق بين حل جيد وحل سيئ.<br> لدى المهام العديد من الحلول الصحيحة - كتابة اختبارات تقبل جميع الحلول الصحيحة وترفض غير الصحيحة أصعب مما يبدو.<br> كيف يعمل الأمر: التقديم → اجتياز التأهيل → الانضمام إلى مشروع → إتمام المهام → الدفع التفكير في الجهد: تقدير المهام لهذا المشروع قد يستغرق 30 ساعة لإكمالها، حسب التعقيد.<br> هذا تقدير وليس متطلب جدول زمني؛ تختار متى وكيف تعمل.<br> يجب تقديم المهام قبل الموعد النهائي وتلبية معايير القبول المدرجة ليتم قبولها.<br> التعويض: حتى 150 دولار/ساعة مكافئ، وفقاً للمستوى والوتيرة.<br> تُقدَّر المهام حوالي 30 ساعة لكل منها؛ أنت تحدد جدولك الخاص.<br></span> </div>
<p><h4>يرجى إرسال سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إتقانك للغة الإنجليزية.<\/h4>\n<p>Mindrift يربط المتخصصين بفرص الذكاء الاصطناعي القائمة على المشاريع مع شركات التكنولوجيا الرائدة، مع التركيز على الاختبار وتقييم وتحسين أنظمة الذكاء الاصطناعي. المشاركة قائمة على المشروع وليست توظيفاً دائماً.<\/p>\n<h4>ما تنطوي عليه هذه الفرصة:<\/h4>\n<p>نحن نبني مجموعة بيانات لتقييم وكلاء التشفير/البرمجة بالذكاء الاصطناعي - مدى جودة تعامل النموذج مع مهام المطورين الواقعية.<\/p>\n<p>ستقوم بإنشاء مهام وتقييمات معيارية ضمن بيئات محاكاة واقعية:<\/p>\n<ul>\n <li>بناء بيئات مطور واقعية - شركة افتراضية تتمتع بقاعدة رمز وبنية تحتية وسياق (تذاكر، مستندات، محادثات) تشكل تاريخ تطوير يمكن تصديقه<\/li>\n <li>تصميم مهام من حالات وسيطة لهذه البيئات - صغ الطلب، عرّف ما يعني <strong>"حل"<\/strong>، وتأكد من أن المهمة قابلة للحل بواسطة وكيل ذكاء اصطناعي<\/li>\n <li>كتابة اختبارات تتحقق من حلول الوكلاء - تقبل جميع الأساليب الصحيحة وترفض الأساليب الخاطئة، لا تكون صارمة للغاية ولا متساهلة جداً<\/li>\n <li>التكرار على المهام والاختبارات بناءً على ملاحظات QA - مراجعة حلول الوكلاء، تحليل الإخفاقات، والتحسين حتى تكون التقييم عادل وقوي<\/li>\n<\/ul>\n<h4>ما ليس عليه:<\/h4>\n<ul>\n <li>ليس تصنيف بيانات<\/li>\n <li>ليس هندسة المطالبات<\/li>\n <li>ليس كتابة كود من الصفر - الوكيل يكتب معظم الكود؛ أنت ترشد وتقيّم<\/li>\n<\/ul>\n<h4>ما نبحث عنه:<\/h4>\n<ul>\n <li>8+ سنوات في تطوير البرمجيات<\/li>\n <li>المكدس الأساسي: بايثون (FastAPI)، جافاسكريبت/تايب سكريبت (React)، دوكر، بوستغريسك، كافكا، رييديس<\/li>\n <li>خبرة في كتابة اختبارات (وظيفية، تكامل)<\/li>\n <li>إتقان الإنجليزية - B2+<\/li>\n<\/ul>\n<h4>لماذا هذا صعب:<\/h4>\n<p>النماذج المتقدمة جيدة بالفعل في الترميز. إنشاء مهمة تتحدى أفضل النماذج بشكل حقيقي ليس سهلاً. تحتاج إلى فهم عميق أين تفشل النماذج وما هي السيناريوهات التي تكشف الفرق بين حل جيد وحل سيئ. لدى المهام عدة حلول صالحة - كتابة اختبارات تقبل كل الحلول الصحيحة وترفض الصحيحة غيرها أصعب مما تبدو.<\/p>\n<h4>كيف يعمل الأمر<\/h4>\n<p>التقديم ? اجتياز التأهيل/التأهيلات ? الانضمام إلى مشروع ? إكمال المهام ? الدفع<\/p>\n<h4>تقدير الجهد<\/h4>\n<p>تُقدَّر المهام لهذا المشروع أن تستغرق 30 ساعة لإكمالها، حسب التعقيد. هذا تقدير وليس شرطاً زمنياً؛ تختار متى وكيف تعمل. يجب تقديم المهام بحلول الموعد النهائي وتلبية معايير القبول المدرجة ليتم قبولها.<\/p>\n<h4>التعويض:<\/h4>\n<p>حتى 150$/ساعة مكافئ، اعتماداً على المستوى والسرعة. تُقدَّر المهام بحوالي 30 ساعة لكل منها؛ أنت تحدد جدولك الخاص.<\/p><\/p><p><\/p>
<p><h4>يرجى تقديم سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إتقانك للإنجليزية.<\/h4>\n<p>تربط Mindrift المتخصصين بفرص AI قائمة على المشاريع للشركات التقنية الرائدة، تركز على الاختبار والتقييم والتحسين لأنظمة الذكاء الاصطناعي. المشاركة قائمة على المشروع وليست توظيفاً دائماً.<\/p>\n<h4>ما تتضمنه هذه الفرصة:<\/h4>\n<p>نحن نبني مجموعة بيانات لتقييم وكلاء الترميز بالذكاء الاصطناعي - إلى أي مدى يتعامل النموذج مع مهام المطورين الواقعية.</p>\n<p>ستقوم بإنشاء مهام وتقييمات ضمن بيئات محاكاة واقعية:<\/p>\n<ul>\n <li>إنشاء بيئات مطور واقعية - شركة افتراضية بقاعدة كود وبنية تحتية وسياق (تذاكر، مستندات، محادثات) تشكل تاريخ تطوير قابل للتصديق</li>\n <li>تصميم المهام من حالات وسيطة لهذه البيئات - صوغ المطالب، وتحديد ما يعني <strong>"تمت الإحالة"</strong>, والتأكد من أن المهمة قابلة للحل بواسطة وكيل ذكاء اصطناعي</li>\n <li>كتابة اختبارات تتحقق من حلول الوكلاء - قبول جميع الأساليب الصحيحة ورفض الأساليب الخاطئة، ليس صارماً جدًا ولا متساهلاً جدًا</li>\n <li>التكرار على المهام والاختبارات بناءً على ملاحظات QA - مراجعة حلول الوكلاء، تحليل الإخفاقات، والتحسين حتى تكون التقييم عادلًا وقويًا</li>\n</ul>\n<h4>ما ليس هذا:</h4>\n<ul>\n <li>ليس تعريف البيانات</li>\n <li>ليس هندسة المطالب</li>\n <li>ليس كتابة كود من الصفر - يكتب الوكيل معظم الكود؛ أنت توجه وتقيم</li>\n</ul>\n<h4>ما نبحث عنه:</h4>\n<ul>\n <li>8+ سنوات في تطوير البرمجيات</li>\n <li>المكدس الأساسي: بايثون (FastAPI)، جافاسكريبت/تايب سكريبت (ريأكت)، Docker، PostgreSQL، Kafka، Redis</li>\n <li>خبرة في كتابة الاختبارات (وظيفية، تكاملية)</li>\n <li>إتقان الإنجليزية - B2+</li>\n</ul>\n<h4>لماذا هذا صعب:</h4>\n<p>نماذج Frontier جيدة في الترميز فعلاً. إنشاء مهمة تتحدى النماذج الأفضل حقًا ليس بسيطاً. تحتاج إلى فهم عميق للأماكن التي تفشل فيها النماذج وما هي السيناريوهات التي تكشف الفرق بين حل جيد وحل سيئ. للمهام حلول كثيرة صحيحة - كتابة اختبارات تقبل جميع الحلول الصحيحة وترفض غير الصحيحة أصعب مما يبدو.</p>\n<h4>كيف يعمل:</h4>\n<p>التقديم؟ اجتياز التأهيل؟ الانضمام إلى مشروع؟ إكمال المهام؟ الدفع</p>\n<h4>تقدير الجهد:</h4>\n<p>يُقدّر أن تستغرق المهام لهذا المشروع حوالي 30 ساعة لإكمالها، حسب التعقيد. هذا تقدير وليس جدولاً زمنياً؛ تحدد أنت متى وكيف تعمل. يجب تقديم المهام بحلول الموعد النهائي وتلبية معايير القبول المدرجة حتى يتم قبولها.</p>\n<h4>التعويض:</h4>\n<p>حتى 150 دولار/ساعة مكافئ، بناءً على المستوى والإيقاع. تُقدَّر المهام بحوالي ~30 ساعة لكل مهمة؛ أنت تحدد جدولك الخاص.</p>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>تبحث Mindrift عن مهندسي استخراج بيانات باحثين من مستوى Senior في بايثون للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصص ضمن نظامنا الهجين للذكاء الاصطناعي والبشري.<br> في هذا الدور، كمخطط AI – هكذا نُشير إلى هذا الدور في Mindrift – ستت تعاون مع وكلاء Tendem الذين يُعالجون المهام المتكررة، بينما تقدم التفكير النقدي وخبرة المجال ومراقبة الجودة لتسليم نتائج دقيقة وقابلة للإجراء.<br> هذه الفرصة عن بُعد بدوام جزئي مثالية للمحترفين التقنيين ذوي الخبرة العملية في استخراج البيانات من الويب واستخراجها ومعالجتها.<br> ما الذي نقوم به تربط منصة Mindrift المتخصصين بمشاريع الذكاء الاصطناعي من مبتكري التكنولوجيا الرائدين.<br> رسالتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.<br> هذا دور مستقل لمشروع Tendem.<br> كـ مهندس Python Senior لاستخراج البيانات، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لعملية الاستخراج من الويب والمعالجة، باستخدام أدوات مختلفة مثل Apify وOpenRouter إلى جانب نهجك المبتكر الخاص.<br> المسؤوليات الرئيسية: امتلاك سير عمل استخراج البيانات من البداية إلى النهاية عبر مواقع ويب معقدة، وضمان التغطية الكاملة والدقة والتسليم الموثوق لبيانات مُهيكلة.<br> استغلال الأدوات الداخلية (Apify، OpenRouter) جنبًا إلى جنب مع سير عمل مخصصة لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع تلبية المتطلبات المحددة.<br> ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتعديل الأساليب حسب الحاجة للتعامل مع محتوى يتم عرضه بواسطة JavaScript وتغير سلوك الموقع.<br> فرض معايير جودة البيانات من خلال فحوص التحقق، والتحكم في الاتساق بين المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.<br> توسيع عمليات الاستخراج لبيانات كبيرة باستخدام دفعات فعالة أو توازي، ورصد الإخفاقات، والحفاظ على الاستقرار أمام تغيّرات بسيطة في بنية الموقع.<br> المتطلبات: خبرة لا تقل عن 5+ سنوات في هندسة البيانات أو استخراج البيانات من الويب أو الأتمتة أو تطوير البرمجيات (مطلوب).<br> درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو مجالات تقنية ذات صلة إضافة. <br> يجب أن يمتلك المرشحون أساسًا تقنيًا قويًا وتجربة عملية في البرمجة النصية، الأتمتة، وسير العمل المدعوم بالذكاء الاصطناعي.<br> نحن نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، والعمل بثقة مع نماذج اللغة الكبيرة، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي.<br> نهج منهجي وتهتم بالتفاصيل والقدرة على العمل بشكل مستقل أمران أساسيان.<br> خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما يشابهها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللامحدود) وواجهات برمجة التطبيقات عبر البروكسيات، القدرة المثبتة على استخراج البيانات من هياكل معقدة (التدرجات، صفحات الأرشيف، HTML غير المتسق)، خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات مُهيَّأة (CSV، JSON، جداول Google)، خبرة مُثبتة في التعامل مع آليات مضادة للبوت وبُنى مواقع ديناميكية على نطاق واسع، خبرة مع بنية سحابية (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير عمل حقيقي، خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو مشابهة) مطبّقة في مهام الأتمتة، انتباه عالي للتفاصيل والتزام بالدقة، أخلاقيات عمل ذاتية التوجيه مع القدرة على حل المشكلات بشكل مستقل، وجود رابط لGitHub ميزة إضافية، الكفاءة الإنجليزية: مستوى أعلى من المتوسط (B2) فأكثر (مطلوب). توقعات وقت المشروع:
لهذا المشروع، يعتبر وجود المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل الفعّالة، استناداً إلى متطلبات المشروع.<br> هذه مجرد تقديرات وليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع.<br> التعويض:<br> في هذا المشروع، يمكن للمساهمين كسب حتى 25 دولاراً في الساعة مكافئاً، وفقاً لمستوى مساهمتهم وسرعتهم في الإسهام.<br> يختلف التعويض عبر المشاريع حسب النطاق والتعقيد والخبرة المطلوبة.<br> يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات دخل مختلفة وفقاً لمتطلباتها.<br></span> </div>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>يرجى إرسال سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إتقانك للإنجليزية.<br> تواصل Mindrift المتخصصين مع فرص الذكاء الاصطناعي القائمة على المشاريع لشركات تقنية رائدة، مع التركيز على الاختبار والتقييم وتحسين أنظمة الذكاء الاصطناعي.<br> المشاركة قائمة على المشروع، وليست توظيفاً دائماً.<br> ما تنطوي عليه هذه الفرصة: عملاء البرمجة Frontier بارعون بالفعل في اجتياز الاختبارات.<br> نقيس ما إذا كانوا يتخطونها بالطريقة الصحيحة .<br> نحن نبني مجموعة بيانات لتقييم السلامة وسلوك وكلاء البرمجة بالذكاء الاصطناعي — ليس فقط ما إذا كانوا يكملون مهمة ما، بل ما إذا كانوا يفعلون ذلك بصدق، ضمن النطاق، وبدون تسريع الترام. <br> ستصمم مهام حيث الطريق السهل هو الطريق غير الآمن، وتكتب الاختبارات التي تلتقط ذلك: بناء بيئات مطور واقعية — شركة افتراضية بمع قاعدة كود وبنيةunder، وسياق (تذاكر، مستندات، محادثات) تشكل تاريخ تطوير قابل للتصديق صِف مهام تقارن هدف تطوير برئي بخيار اختياري غير آمن يجتذب فقدان النطاق: (متابعة، انتهاكات السياسة، فساد البيانات، تغييرات واسعة جدًا) اكتب اختبارات تتحقق مما إذا كان الوكيل أكمل المهمة بالطريقة الصحيحة — التقاط التقطعات التي تم تجاهلها، ليس فقط فحص المخرجات. Iterate على المهام والاختبارات بناءً على ملاحظات QA — راجع حلول الوكلاء، حلل الإخفاقات، وصقل حتى تكون التقييم عادلًا وقويًا. ما ليس هذا: ليس وضع بيانات؛ ليس هندسة المطالبات؛ ليس الأمن السيبراني أو اختبار الاختراق — لا يوجد مُهاجم في السيناريو.<br> خبرة الأمن السيبراني ميزة لكنها ليست مطلباً. <br> نبحث عن مهندسين يفهمون كيف يجب أن يتصرف الكود، لا مختبري اختراق. <br> مهندسون برمجيات قويون، ليس متخصصي أمن؛ ليس كتابة كود من الصفر — يكتب الوكيل معظم الكود؛ أنت تصمم الوضع وتقيّم النتيجة؛ ما نبحث عنه: 4–5+ سنوات في تطوير البرمجيات؛ التكدس الأساسي: بايثون، جافاسكريبت/تايب سكريبت؛ مهارات تصميم اختبارات قوية — اختبارات وظيفية وتكاملية تفصل بين الإكمال الآمن وغير الآمن، وليس فقط الصحيح من غير الصحيح؛ خبرة عملية مع وكلاء التشفير (Claude Code، GitHub Copilot CLI، Codex، أو ما يماثلها)؛ الإلمام بـ GitHub PRs وCI كـ مستخدم؛ نطاق المعرفة مرحب به، ليس فِلترًا. <br> تحاكي المهام مستودعات حقيقية بها قواعد بيانات، خطوط CI، وسكربتات النشر، لذا فإن التعرض الأوسع للخلفية والبنية التحتية مفيد حقًا — لكن ليس من الضروري أن تكون خبيراً في كل طبقة؛ الكفاءة في الإنجليزية — مستوى B2+. لماذا هذا أمر صعب: نماذ Frontier جيدون في البرمجة بالفعل. <br> إنشاء مهمة تتحدى النماذج الأفضل حقًا ليس سهلاً. <br> الصعوبة الحقيقية هي بناء الإغراء — سيناريو حيث المسار غير الآمن أو خارج النطاق هو طريق الحد الأدنى من المقاومة — ثم كتابة اختبارات تلتقط بموثوقية وكيلًا سلكه. <br> لدى المهام العديد من الحلول الصحيحة؛ يجب أن تقبل الاختبارات جميعها وترفض السيئة منها. <br> كيف يعمل: التقديم → اجتياز التأهيل → الانضمام إلى مشروع → إكمال المهام → الدفع. توقعات وقت المشروع: بالنسبة لهذا المشروع، تُقدر المهام بـحوالي 20-25 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. <br> هذه تقدير وليست عبء عمل مضمون، وتطبق فقط أثناء تفعيل المشروع. <br> يجب تقديم المهام قبل الموعد النهائي وتلبي معايير القبول المذكورة ليتم قبولها. <br> التعويض: في هذا المشروع، يمكن للمساهمين أن يكسبوا حتى 50 دولاراً في الساعة كمعادل للدفع، حسب مستواهم وسرعتهم في المساهمة. <br> يتفاوت التعويض عبر المشاريع حسب النطاق والتعقيد والخبرة المطلوبة. <br> يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات ربح مختلفة بناءً على متطلباتها. <br></span> </div>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>يرجى تقديم سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى كفاءتك في اللغة الإنجليزية.<br> تربط Mindrift المتخصصين بفرص الذكاء الاصطناعي القائمة على المشاريع لشركات التكنولوجيا الرائدة، مع التركيز على الاختبار والتقييم وتحسين أنظمة الذكاء الاصطناعي.<br> المشاركة قائمة على المشاريع، وليست توظيفاً دائماً.<br> ماذا تشمل هذه الفرصة؟ وكلاء البرمجة المتقدمة في النهاية يجيدون اجتياز الاختبارات بالفعل.<br> نقيس ما إذا كانوا يجتازونها بالطريقة الصحيحة .<br> نبني مجموعة بيانات لتقييم سلامة وسلوك وكلاء برمجة الذكاء الاصطناعي — ليس فقط ما إذا أكملوا المهمة، بل إذا قاموا بذلك بشفافية، ضمن النطاق، وبغير تقطيع الزوايا.<br> ستصمم مهام تكون المسار السهل فيها غير آمن، وتكتب الاختبارات التي تلتقط ذلك: بناء بيئات مطور واقعية — شركة افتراضية بها قاعدة كود وبنية تحتية وسياق (التذاكر، المستندات، المحادثات) تشكل تاريخ تطوير مقنع صِف مهام تجمع هدف تطويري آمن مع اختصار غير آمن وجذاب: نطاق الإزاحة، انتهاكات السياسة، تلف البيانات، تغييرات واسعة الامتثال اكتب اختبارات تتحقق من أن الوكيل أكمل المهمة بالطريقة الصحيحة — مع رصد الأركان المقطوعة، وليس فقط التحقق من المخرجات تكرار المهام والاختبارات بناءً على ملاحظات QA — مراجعة حلول الوكيل، تحليل الإخفاقات، وتحسينها حتى تكون التقييمات عادلة وقوية ما هذا ليس: ليس تصنيف بيانات؛ ليس هندسة المطالبات؛ ليس الأمن السيبراني أو فريق الاختبار الأحمر — لا يوجد خصم في السيناريو.<br> خبرة الأمن السيبراني ميزة لكنها ليست مطلباً.<br> نبحث عن مهندسين يفهمون كيف يجب أن يتصرف الكود، لا مختبرين اختراق. <br> مهندسون برمجيات أقوياء، ليسوا متخصصين في الأمن؛ ليس كتابة شفرة من الصفر — الوكيل يكتب معظم الشفرة؛ أنت تصمم الوضع وتقيّم النتيجة؛ ما الذي نبحث عنه 4–5+ سنوات في تطوير البرمجيات؛ التكديس الأساسي: بايثون، جافا سكريبت/تايب سكريبت؛ مهارات تصميم اختبارات قوية — اختبارات وظيفية وتكامل تفصل بين الإكمال الآمن وغير الآمن، وليس فقط الصحيح من غير الصحيح؛ خبرة عملية مع وكلاء الترميز (Claude Code، GitHub Copilot CLI، Codex، أو ما شابه)؛ الإلمام بـ PRs وCI في GitHub كمستخدم؛ اتساع التكديس مقبول، ليس كفلتر.<br> تحاكي المهام مستودعات حقيقية بها قواعد بيانات، وخطوط CI، وسكربتات النشر، لذلك التعرض الأوسع للجهة الخلفية والبنية التحتية مفيد حقاً — لكن ليس عليك أن تكون خبيراً في كل طبقة؛ الطلاقة بالإنجليزية — B2+ لماذا هذا صعب Frontier models بالفعل بارعون في البرمجة.<br> إنشاء مهمة تتحدى النماذج الأفضل حقاً ليس أمراً سهلاً.<br> الصعوبة الحقيقية هي بناء الإغراء — سيناريو حيث المسار غير الآمن أو خارج النطاق هو طريقه الأقل معارضة — ثم كتابة الاختبارات التي تقنع الوكيل الذي سلكه.<br> لدى المهام عدة حلول صالحة؛ يجب أن تقبل الاختبارات جميعها وترفض السيئة منها.<br> كيف يعمل الأمر: تقديم → اجتياز التأهيل → الانضمام إلى مشروع → إتمام المهام → الدفع المتوقّع من المشروع<
> الوقت المتوقع للمشروع في هذه الفترة: تُقدر المهام في هذا المشروع بأنها تستغرق نحو 20-25 ساعة أسبوعياً خلال المراحل النشطة، وفقاً لمتطلبات المشروع.<br> هذه تقدير، وليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع.<br> يجب تقديم المهام قبل الموعد النهائي وتلبية معايير القبول المذكورة ليتم قبولها.<br> التعويض: في هذا المشروع، يمكن للمساهمين أن earns حتى 50 دولاراً في الساعة المعادلة، حسب مستواهم وتيرة مساهمتهم.<br> يختلف التعويض عبر المشاريع حسب النطاق والتعقيد والخبرة المطلوبة.<br> الرجاء ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.<br></span> </div>
<p><h4>تبحث Mindrift عن مهندسين رفيعي المستوى في استخلاص البيانات من Python وبمهارة عالية</h4>
<p>للانضمام إلى مشروع Tendem وتوجيه سير عمل استخلاص البيانات المتخصصة ضمن نظامنا الهجين بين الذكاء الاصطناعي والبشر.</p>
<p>في هذا الدور، كمجرب ذكاء اصطناعي – هكذا نُشير إلى هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي وخبرة المجال وضبط الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة بدوام جزئي عن بُعد مثالية للمحترفين technical الذين لديهم خبرة عملية في تجميع الويب واستخراج البيانات ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>ت connects منصة Mindrift متخصصين مع مشاريع AI من قبل روّاد التكنولوجيا. مهمتنا هي إطلاق إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. كمهندس رفيع في استخلاص البيانات من Python، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج الويب ومعالجته، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمين بجانب أساليبك الإبداعية الخاصة.</p>
<h4>المسؤوليات الأساسية:</h4>
<li>امتلاك سير عمل استخراج البيانات من البداية إلى النهاية عبر مواقع ويب معقدة، لضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) بجانب سير عمل مخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان الاستخراج الموثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب كما يلزم للتعامل مع المحتوى المعروض بلغة JavaScript وتغيير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق وضوابط الاتساق بين المصادر والالتزام بمواصفات التنسيق والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات التجميع للبيانات الكبيرة باستخدام دفعات فعالة أو توازي، ومراقبة الإخفاقات، والحفاظ على الاستقرار ضد تغييرات طفيفة في بنية الموقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5+ سنوات ذات صلة في هندسة البيانات، تجميع الويب، التشغيل الآلي، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو المجالات الفنية ذات الصلة ميزة إضافية.</li>
<li>يجب أن يمتلك المرشحون أساسًا تقنيًا قويًا وخبرة عملية في البرمجة النصية، التشغيل الآلي، وسير عمل بمساعدة الذكاء الاصطناعي. نبحث عن متخصصين قادرين على حل مشاكل غير تافهة، والعمل بثقة مع LLMs، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي. نهج منهجي ودقيق مع القدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في تجميع الويب باستخدام Python (BeautifulSoup، Selenium أو ما شابه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانتهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (هرميات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، جوجل شيتس).</li>
<li>خبرة مثبتة في التعامل مع آليات مضادة للبوت وهياكل مواقع ديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية سحابية (AWS أو ما يعادلها) وحاويات (Docker) كجزء من سير عمل حقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابهها) مطبقة على مهام التشغيل الآلي.</li>
<li>انتباه قوي للتفاصيل والتزام بجودة البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على حل المشكلات بشكل مستقل.</li>
<li>رابط إلى GitHub ميزة.</li>
<li>إتقان الإنجليزية: مستوى بين المتوسط العلوي (B2) أو أعلى (مطلوب).</li>
<h4>توقعات وقت المشروع</h4>
<p>لأما projekt، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير، ليس عبء عمل مضمون، ويطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن أن يحصل المساهمون على ما يصل إلى 25 دولارًا في الساعة كمعادل، اعتمادًا على مستواهم وتيرتهم في المساهمة.</p>
<p>يختلف التعويض عبر المشاريع حسب النطاق والتعقيد والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.</p></p><p></p>
<h2 class="h5">Job description</h2>
<div class="t-break" data-jb-field="description">
<span>Mindrift is looking for highly skilled Vibecode specialists to join the Tendem project (https://tendem.<br>ai/) and drive specialized data scraping workflows for real-world use cases.<br> Mindrift is looking for highly skilled Senior Python Data Scraping Engineers to join the Tendem project and drive specialized data scraping workflows for real-world applications.<br> In this role, you'll apply your expertise in web scraping, data extraction, and data processing to deliver accurate, reliable, and high-quality results.<br> This part-time remote opportunity is ideal for technical professionals with hands-on experience in web scraping, data extraction and processing.<br> What We Do The Mindrift platform connects specialists with innovative technology projects.<br> Our mission is to help develop high-quality AI technologies by combining real-world expertise from professionals across the globe with advanced AI development efforts.<br> About the Role This is a freelance role for a Tendem project.<br> As a Senior Python Data Scraping Engineer , you'll handle data scraping tasks requiring technical precision for web extraction and processing, utilizing tools such as Apify, OpenRouter, and other technologies, alongside your own technical expertise and approaches.<br> Key Responsibilities Own end-to-end data extraction workflows across complex websites, ensuring complete coverage, accuracy, and reliable delivery of structured datasets.<br> Leverage available tools and custom workflows to accelerate data collection, validation, and task execution while meeting defined requirement.<br> Ensure reliable extraction from dynamic and interactive web sources, adapting approaches as needed to handle JavaScript-rendered content and changing site behavior.<br> Enforce data quality standards through validation checks, cross-source consistency controls, adherence to formatting specifications, and systematic verification prior to delivery.<br> Scale scraping operations for large datasets using efficient batching or parallelization, monitor failures, and maintain stability against minor site structure changes.<br> Educational qualifications At least 5+ years of relevant experience in data engineering, web scraping, automation, or software development (required).<br> Bachelor’s or Master’s Degree in Engineering, Applied Mathematics, Computer Science, or related technical fields is a plus.<br> Academic and/or Professional Experience Candidates should have a strong technical foundation and practical experience with scripting, automation, and data extraction workflows.<br> We are looking for specialists who can solve non-trivial problems, work confidently with modern development tools and technologies, and systematically collect, structure, and validate data from diverse sources.<br> A methodical, detail-oriented approach and the ability to work independently are essential.<br> Technical Skills (Essential) Strong experience in Python web scraping (BeautifulSoup, Selenium or similar), including dynamic content (JS, AJAX, infinite scroll) and APIs via proxies Proven ability to extract data from complex structures (hierarchies, archived pages, inconsistent HTML) Solid background in data cleaning, normalization, and validation, delivering structured datasets (CSV, JSON, Google Sheets) Additional requirements Demonstrated experience handling anti-bot mechanisms and dynamic site structures at scale Experience with cloud infrastructure (AWS or equivalent) and containerization (Docker) as part of real workflows Hands-on experience with LLM frameworks (LangChain, OpenRouter, or similar) applied to automation tasks Strong attention to detail and commitment to data accuracy Self-directed work ethic with ability to troubleshoot independently A link to GitHub is a plus English proficiency: Upper-intermediate (B2) or above (required) Project time expectations For this project, tasks are estimated to require around 10–20 hours per week during active phases, based on project requirements.<br> This is an estimate, not a guaranteed workload, and applies only while the project is active.<br> Compensation On this project, contributors can earn up to $25 per hour equivalent , depending on their level and pace of contribution.<br> Compensation varies across projects depending on scope, complexity, and required expertise.<br> Please note that other projects on the platform may offer different earning levels based on their requirements.<br></span> </div>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>يرجى إرسال سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إتقانك للغة الإنجليزية.<br> تربط ميندريف المتخصصين بفرص الذكاء الاصطناعي القائمة على المشاريع لصالح شركات تكنولوجيا رائدة، مع تركيز على الاختبار، والتقييم، وتحسين أنظمة الذكاء الاصطناعي.<br> المشاركة قائمة على المشروع وليست توظيفاً دائماً.<br> ما تنطوي عليه هذه الفرصة نقوم ببناء مجموعة بيانات لتقييم وكلاء التكويد الذكاء الاصطناعي - مدى قدرة النموذج على التعامل مع مهام المطورين الواقعية.<br> ستنشئ مهاماً وتقييمات صعبة في بيئات محاكاة واقعية: بناء بيئات مطور واقعية - شركة افتراضية بها كود وبنية تحتية وسياق (تذاكر، مستندات، محادثات) تشكل تاريخ تطوير مقنع Design مهام من حالات وسيطة لهذه البيئات - صِغ الطلب، عرّف ما يعنيه "الحل"، وتأكد من أن المهمة قابلة للحل بواسطة وكيل ذكاء اصطناعي اكتب اختبارات تتحقق من حلول الوكيل - اقبل جميع الأساليب الصحيحة واربِط بينها وبين الأساليب غير الصحيحة، لا تكون صارماً للغاية ولا متساهلاً للغاية كرر العمل على المهام والاختبارات بناءً على ملاحظات QA - راجع حلول الوكلاء، حلل الإخفاقات، وقم بتحسينها حتى تكون التقييمات عادلة وراسخة ما ليس هذا NOT NOT بيانات التع labeling Not هندسة التحفيز Not كتابة كود من الصفر - الوكيل يكتب معظم الكود؛ أنت تقود وتقيّم ما نبحث عنه 5+ سنوات في تطوير البرمجيات المكدس الأساسي: Python (FastAPI)، JavaScript/TypeScript (React)، Docker، Postgres، Kafka، Redis خبرة في كتابة الاختبارات (وظيفية، تكامل) مستوى الإتقان باللغة الإنجليزية - B2+ لماذا هذا صعب نماذج الحدود الأمامية جيدة بالفعل في البرمجة.<br> إنشاء مهمة تتحدى النماذج الأفضل حقاً ليست أمرًا بسيطاً.<br> تحتاج إلى فهم عميق لمكان فشل النماذج وما هي السيناريوهات التي تكشف الفرق بين حل جيد وآخر سيء.<br> لدى المهام العديد من الحلول الصحيحة - كتابة اختبارات تقبل جميع الحلول الصحيحة وترفض غير الصحيحة أصعب مما يبدو.<br> كيف يتم العمل تطبيق → اجتياز التأهيل → الانضمام إلى مشروع → إنهاء المهام → الدفع التعويض حتى 40 دولار/ساعة ما يعادل، وفقاً للمستوى وسرعة الإيقاع.<br> تُقدّر المهام بحوالي 20 ساعة لكل منها؛ تحدد جدولك الزمني بنفسك.<br></span> </div>