
AI delivery
RLHF ومواءمة النماذج
تدير كوربشور الإمارات التعلّم المعزّز من التغذية الراجعة البشرية (RLHF)، وعمليات بيانات التفضيل، وتقييم النماذج، ودعم الاختبار الهجومي من دبي وأبوظبي. تحتل كوربشور AI المرتبة الخامسة بين أفضل 50 شركة لتعهيد AI على مستوى العالم، وتوفّر هذه الممارسة المقيّمين البشريين المدرَّبين، والتغطية العربية والمتعددة اللغات، وانضباط السلامة الذي يتطلبه هذا العمل.
النموذج القادر ليس ذاته النموذج الآمن أو النافع. تُسدّ الفجوة بالتغذية الراجعة البشرية، وجودة تلك التغذية تقرّر إن كانت المواءمة ستصمد. RLHF وبيانات التفضيل ليست إلا بقدر المقيّمين والدليل والمعايرة خلفها. توفّر كوربشور مقيّمين مدرَّبين يفهمون المهمة ويعملون وفق دليل مُصدَّر ويُقاسون على درجة الاتفاق، فتكون الإشارة التي يتعلم منها النموذج متسقة لا مشوّشة.
تغطي الخدمة بيانات التفضيل والترتيب، والتقييم البشري مقابل دليل، ودعم الاختبار الهجومي للسلامة والاختبار العدائي، عبر اللغات واللهجات. يبقى العمل العربي والخاضع للتنظيم محلياً في دبي وأبوظبي، مع شبكة كوربشور AI الأوسع خلفه للتوسع وتغطية اللغات النادرة. ويجري العمل الحساس أمنياً في ظروف مضبوطة مع رعاية سلامة المقيّمين النفسية وتصعيد واضح مبنيين فيه.
What this service covers
عمليات بيانات التفضيل
مقارنة زوجية ومرتّبة لمخرجات النموذج وفق دليل محدد، فيتعلّم نموذج المكافأة من حكم بشري متسق بدلاً من آراء متناثرة.
جمع التغذية الراجعة البشرية
تقييم وترتيب وتصحيح ردود النموذج على نطاق واسع، مع مقيّمين مدرَّبين وأمثلة معمولة وقياس الاتفاق على المهام التي يتباين فيها الحكم.
تقييم النماذج
تقييم بشري منظم لمخرَج النموذج مقابل دليل للنفع والدقة والنبرة والسلامة، عبر اللغات واللهجات، قبل عمل المواءمة وبعده.
دعم الاختبار الهجومي
سبر عدائي للنموذج لكشف السلوك غير الآمن أو المتحيّز أو المخالف للسياسة، مع تسجيل النتائج مقابل تصنيف يستطيع العميل التصرف بناءً عليه.
وسم السلامة والسياسات
تصنيف المحتوى وسلوك النموذج مقابل سياسة سلامة، بما في ذلك فئات الأذى، فيمكن ضبط النموذج وحمايته من أنماط الفشل المعروفة.
بيانات التعليمات والإيضاح
إنشاء بيانات تعليمات-استجابة وإيضاح عالية الجودة للضبط الدقيق الخاضع للإشراف، بما في ذلك أمثلة عربية ومتعددة اللغات.
معايرة الدليل والإرشادات
بناء دليل التقييم وإصداره مع العميل، مع معايرة فيقيّم المقيّمون المخرَج نفسه بالطريقة نفسها عبر فريق كبير.
المواءمة متعددة اللغات
تغذية راجعة وتقييم عبر مزيج اللغات الذي يخدمه النموذج، بما في ذلك اللهجات العربية، فتصمد المواءمة في كل لغة لا في الإنجليزية وحدها.
How it is delivered from the UAE
Delivered from Dubai and Abu Dhabi with trained raters and native Arabic speakers, and the wider Corpshore AI network behind it for scale and over thirty languages. Work runs as managed evaluation and preference-data programmes or as dedicated rater teams, with safety-sensitive and regulated work kept onshore under controlled conditions.
Small
5 to 15 ratersA single rater pod with a project lead and a quality lead, suited to a preference-data pilot or a first evaluation cycle.
Mid-market
15 to 50 ratersDedicated rater and evaluation teams by language and task, each with a team lead, senior raters for adjudication, a dedicated quality lead running agreement metrics and an ML-ops engineer on tooling.
Enterprise
50 raters and aboveA multi-language alignment operation with a delivery manager, a red teaming function, a quality and calibration layer, safety and wellbeing oversight and an account director, blended across the UAE and the wider network.
Compliance and data handling
- تُعالَج البيانات الشخصية ضمن مجموعات التقييم والتغذية الراجعة بموجب المرسوم بقانون اتحادي رقم 45 لسنة 2021 (PDPL)، مع تطبيق قانون حماية البيانات في مركز دبي المالي العالمي 2020 (DIFC) أو أنظمة حماية البيانات في سوق أبوظبي العالمي 2021 (ADGM) حيثما كان العميل أو المعالجة هناك.
- يخضع النقل العابر للحدود لبيانات التقييم والتفضيل لأساس موثق واتفاقية معالجة بيانات، مع تطبيق اللائحة العامة لحماية البيانات في الاتحاد الأوروبي (GDPR) حيث يقع أصحاب البيانات تحتها، فتتحرك بيانات التغذية الراجعة التي تغادر الإمارات على نحو يمكن الدفاع عنه.
- يجري العمل الحساس أمنياً والاختبار الهجومي تحت وصول مضبوط وتحذيرات محتوى ودعم لسلامة المقيّمين النفسية وتصعيد واضح، فتُدار مواجهة المواد المؤذية بدلاً من تجاهلها.
- يُسجَّل مصدر بيانات التغذية الراجعة والتقييم وإسنادها إلى المقيّمين، فيتمكن العميل من إثبات كيف أُنتج كل حكم ومن أنتجه، على نحو مجمّع.
Technology
- The client's own RLHF, evaluation and MLOps platforms, operated by our teams
- Preference-ranking and human-feedback tooling
- Model-evaluation and rubric-scoring tooling
- Red teaming, safety-taxonomy and agreement-measurement tooling
KPIs and reporting
- Inter-rater agreement. Per task and per rubric version, with disagreement analysis feeding rubric and calibration updates.
- Evaluation throughput. By language and task, per shift and per cycle, against forecast.
- Quality and acceptance rate. Against the client's rubric, sampled by an independent quality lead.
- Red teaming coverage. Against the agreed harm taxonomy, with findings logged and severity-rated.
- Turnaround time. From task release to accepted delivery, per cycle, against the agreed service level.
Governance cadence
اجتماعات إنتاج يومية موجزة، ومراجعة تسليم أسبوعية تغطي الاتفاق ومعدل المعالجة والنتائج، ومراجعة أعمال شهرية مقابل اتفاقية مستوى الخدمة، وجلسات معايرة كلما تغيّر دليل أو سياسة سلامة. تُتتبَّع إصدارات الدليل بحيث يمكن ربط أي تحوّل في حكم المقيّمين بالتغيير الذي وراءه.
Industry applications
التقنية والشركات الناشئة
بيانات تفضيل وتقييم واختبار هجومي لفرق النماذج التي تواءم نموذجاً وتصلّبه قبل الإصدار وبعده.
الخدمات المصرفية والمالية
تقييم ووسم سلامة للمساعدات الخاضعة للتنظيم ودعم القرار، مع إخفاء وضبط وصول على المحتوى الحساس.
الحكومة والقطاع العام
تقييم عربي أولاً واختبار هجومي لنماذج مواجِهة للجمهور، مع إقامة بيانات ومصدر مبنيين في العمل.
الرعاية الصحية
تقييم بشري دقيق ومراجعة سلامة للنماذج السريرية والمواجِهة للمرضى، تحت نزع الهوية وإشراف سريري.
Pricing and engagement models
Frequently asked questions
ما RLHF ولماذا يهم الجانب البشري إلى هذا الحد؟
التعلّم المعزّز من التغذية الراجعة البشرية يواءم النموذج مع التفضيل البشري بالتعلم من مخرجات مقيَّمة ومرتّبة. الإشارة ليست إلا بقدر المقيّمين والدليل والمعايرة خلفها. التغذية المشوّشة تعلّم النموذج الدرس الخطأ، لذا فإن المقيّمين المدرَّبين والاتفاق المقاس هما جوهر الأمر كله.
هل يمكنكم إجراء RLHF والتقييم بالعربية؟
نعم. تُنفَّذ التغذية الراجعة والتقييم بالعربية واللهجات من دبي وأبوظبي بمتحدثين أصليين، فتصمد المواءمة بالعربية لا بالإنجليزية وحدها. النموذج الذي يحسن التصرف بالإنجليزية قد يفشل مع ذلك بلهجة خليجية، والتقييم متعدد اللغات مبني ليمسك ذلك بالضبط.
كيف تُبقون الحكم البشري متسقاً؟
عبر دليل مُصدَّر بأمثلة معمولة، وجلسات معايرة على الحالات الأصعب، وتتبّع الاتفاق بين المقيّمين لكل مهمة. يفصل كبار المقيّمين في الاختلاف، ويُتتبَّع أي تغيير في الدليل بحيث يمكن رؤية أثره على حكم المقيّمين بدلاً من تخمينه.
ماذا يتضمن دعم الاختبار الهجومي؟
يسبر مختبرون مدرَّبون النموذج عدائياً لكشف السلوك غير الآمن أو المتحيّز أو المخالف للسياسة، عاملين مقابل تصنيف أذى متفق عليه مع العميل. تُسجَّل النتائج وتُصنَّف بحسب الشدة وتُعاد في صورة يستطيع العميل التصرف بناءً عليها، فيمكن ضبط النموذج وحمايته من أنماط الفشل المعروفة.
كيف تحمون المقيّمين في العمل الحساس أمنياً؟
يجري عمل السلامة والاختبار الهجومي تحت وصول مضبوط وتحذيرات محتوى ودعم نفسي وتصعيد واضح. تُدار مواجهة المواد المؤذية عمداً بدلاً من معاملتها كمهمة عادية، وتُتفق ظروف تشغيل هذا العمل مع العميل أثناء تحديد النطاق.
هل تُعالَج بيانات تغذيتنا الراجعة بامتثال؟
نعم. تُعالَج بيانات التقييم والتفضيل بموجب قانون حماية البيانات الإماراتي (PDPL)، وحيثما كان ذلك مناسباً قانون DIFC أو ADGM واللائحة العامة الأوروبية. تعمل الحركة العابرة للحدود على أساس موثق واتفاقية معالجة بيانات، ويُسجَّل المصدر وإسناد المقيّمين فتستطيعون إثبات كيف أُنتج كل حكم.
هل يمكن أن يتصل هذا بنموذج تساعدوننا في بنائه أيضاً؟
نعم. يقع RLHF والتقييم إلى جانب خدمات الاستراتيجية والضبط الدقيق والتعليق التوضيحي، فيمكن للبرنامج نفسه أن يوفّر البيانات الموسومة وبيانات التفضيل والتقييم. يُبقي ذلك حلقة المواءمة مغلقة تحت عقد واحد ومعيار جودة واحد بدلاً من تقسيمها بين موردين.
بأي سرعة يمكن أن تبدأ دورة تقييم أو RLHF؟
يمكن أن تبدأ دورة تقييم أولى أو تجربة بيانات تفضيل رائدة خلال أسابيع من توقيع العقد والمراجعة الأمنية. يمر التوسّع بمعايرة الدليل وتجربة رائدة باعتماد جودة وتصعيد مضبوط، فيصمد الاتفاق والقبول مع نمو فريق المقيّمين.
Related services
- Ai delivery
- Data annotation and labelling
- Ai strategy and implementation
- Trust safety and content moderation
RLHF rater, model-evaluation and red teaming roles across the UAE and the wider network are on the jobs board.
Scope this for your operation
نردّ على كل استفسارات الإمارات خلال ست ساعات.
Or explore roles on this team