Leadify — AI leadership simulation platform
محرك التقييم من Leadify

علم قياس السلوك.

كل درجة في Leadify يُنتجها محرك نفسمتري معاير — لا رأي نموذج لغوي. هذه الصفحة تشرح كيف يعمل بالضبط.

محرك التقييم · إصدار 3.2 معاير
  • محادثة حيّةإشارة داخلة
  • مقياس معاير بـ IRTβ = 1.24
  • تحديث بايزيθ = 0.72
  • سجل موثّقSEM ±0.11
الفلسفة

نقيس ما يفعله الناس، لا ما يقولون إنهم سيفعلونه.

عيّنة سلوك · N = 1
θ posterior 0.7295% CI [0.61, 0.83]
أربع ركائز

كيف يحوّل المحرك المحادثة إلى دليل.

الركيزة 01

استثارة سلوكية

تُصمَّم السيناريوهات لاستثارة كفاءات محدّدة تحت ضغط واقعي، بمشاركة قيادات ميدانية وربطًا بنموذج كفاءات محدّد. لكل نبضة محادثية غرض قياسي.

موصول بالكفاءاتضغط تكيّفيمن تصميم القيادات
الركيزة 02

تسجيل معاير (IRT)

تُعاير الدرجات باستخدام نظرية استجابة المفردة — نفس الإطار النفسمتري الذي يقوم عليه اختبارا GRE وGMAT. كل سيناريو يحمل معامل صعوبة (β) ومعامل تمييز (α)، فتعني درجة 75 في سيناريو صعب أكثر من درجة 75 في سيناريو سهل.

صعوبة βتمييز αقابل للمقارنة عبر السيناريوهات
الركيزة 03

تقدير بايزي للقدرة

المحادثة الواحدة عيّنة، لا حكم. يستخدم Leadify التحديث البايزي: كل جلسة تصقل تقدير القدرة (θ) بفاصل ثقة صريح. نُظهر لك ليس الدرجة فقط، بل مدى يقيننا — واليقين ينمو مع الأدلة.

تقدير θفترات مصداقيةموزون بالأدلة
الركيزة 04

تحقّق مستمر

يُختبر المحرك عكسيًا على نتائج واقعية: قرارات الترقية، الاحتفاظ، تقييمات الأداء، تحقيق الإيرادات. تُعاد معايرة معلمات السيناريوهات مع نمو مجموعة البيانات السلوكية.

موصول بالنتائجإعادة معايرة دوريةمراقبة الأثر السلبي
خط أنابيب التسجيل

من محادثة حيّة إلى سجل سلوكي موثّق.

  1. الخطوة 01

    محادثة حيّة

    يخوض المشارك محادثة مع نظير ذكاء اصطناعي في سيناريو واقعي وتكيّفي.

  2. الخطوة 02

    استخراج الإشارات السلوكية

    تُلتقط المؤشرات اللفظية وشبه اللفظية من النص والصوت.

  3. الخطوة 03

    التسجيل وفق المقياس

    مقاييس معايرة متعدّدة الأبعاد تُقيّم السلوك القابل للملاحظة، لا التقييم الذاتي.

  4. الخطوة 04

    تعديل IRT

    معاملات الصعوبة والتمييز تزن الدرجة مقابل السيناريو.

  5. الخطوة 05

    تحديث بايزي

    يُصقل تقدير القدرة (θ) بفاصل ثقة صريح.

  6. الخطوة 06

    سجل سلوكي موثّق

    كل درجة قابلة للتتبّع رجوعًا إلى الدليل المحادثي الذي أنتجها.

بيانات سلوكية موثّقة

ماذا يعني "موثّق" فعلًا.

كل درجة هي ادّعاء يمكننا الدفاع عنه — أمام رئيس موارد بشرية، أو مجلس عمّال، أو مدقّق.

0.00
الصلاحية التنبؤية (r)
0%
اتفاق المقيّمين
0%
قابلية التدقيق للأدلة
  • مُلاحَظ لا مُبلَّغ ذاتيًاكل نقطة بيانات تأتي من سلوك حيّ.

  • موحّدنفس السيناريو ونفس النظير ونفس المقياس للجميع.

  • معايرمعدَّل بالصعوبة لتكون الدرجات قابلة للمقارنة.

  • محدودكل درجة تحمل فاصل ثقة صريحًا.

  • قابل للتدقيقكل درجة قابلة للتتبّع لدليل محادثي محدّد.

المعايير

مبني وفق معايير التقييم المهنية.

مصمَّم بما يتوافق مع معايير الاختبارات التربوية والنفسية (AERA وAPA وNCME) ومبادئ SIOP للتحقق من إجراءات اختيار الموظفين واستخدامها.

معايير APAمبادئ SIOPGDPRKVKKSOC 2 (قيد الإنجاز)
أسس بحثية مختارة
  • Schmidt, F. L., & Hunter, J. E. (1998). The validity and utility of selection methods in personnel psychology. Psychological Bulletin, 124(2), 262–274.
  • Sackett, P. R., Zhang, C., Berry, C. M., & Lievens, F. (2022). Revisiting meta-analytic estimates of validity in personnel selection. Journal of Applied Psychology, 107(11), 2040–2068.
  • Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems. Lawrence Erlbaum Associates.
  • Arthur, W., Day, E. A., McNelly, T. L., & Edens, P. S. (2003). A meta-analysis of the criterion-related validity of assessment center dimensions. Personnel Psychology, 56(1), 125–153.
  • Cohen, J. (1988). Statistical Power Analysis for the Behavioral Sciences (2nd ed.). Lawrence Erlbaum Associates.
  • Phillips, J. J. (2003). Return on Investment in Training and Performance Improvement Programs (2nd ed.). Butterworth-Heinemann.
الأسئلة الشائعة

إجابات مباشرة.

مراكز التقييم التقليدية توفّر صلاحية تنبؤية عالية، لكنها تكلّف 3000–8000 دولار للفرد ولا تُجرى إلا مرة سنويًا. Leadify يقدّم الفئة نفسها من الأدلة السلوكية عبر محاكاة الذكاء الاصطناعي، عند الطلب وبجزء يسير من التكلفة، مع معايرة نفسمترية مدمجة.
لا. Leadify ينتج أدلة سلوكية بفترات ثقة. البشر يتخذون القرارات؛ Leadify يزوّدهم بأدلة أدق لاتخاذها.
تُعاير كل رُبرِك مقابل مقيّمين بشريين خبراء قبل النشر، وتُراقَب موثوقية الاتفاق بين المقيّمين باستمرار. تحمل الدرجات فترات ثقة صريحة تتّسع عند شحّ الأدلة وتضيق مع تراكم الجلسات. يدقّق مقيّمون بشريون عيّنة عشوائية من كل دفعة سيناريوهات وتُغذّي الاختلافات إعادة معايرة الرُبرِك.
يقيس التقييم القائم على المحاكاة كيف يتصرّف الشخص في إعادة بناء واقعية لموقف عالي المخاطر، بدلًا من سؤاله عمّا سيفعله في استبيان ذاتي. إنه الصيغة الحديثة القابلة للتوسع من تقليد مراكز التقييم: سلوك قابل للملاحظة يُقيَّم وفق مقياس معاير.
كل سيناريو ومقياس يُراقَب للأثر السلبي عبر المجموعات الديموغرافية. تُراجَع بيانات المعايرة واتفاق المقيّمين وتوزيعات الدرجات دوريًا، وتُعاد معايرة أو تُسحب أي مفردة يُشار إليها بالأداء التفاضلي. كل درجة قابلة للتدقيق رجوعًا إلى الدليل المحادثي الذي أنتجها.
الحدودمحرك التقييم · مُعاير · v2.13

ما لا يفعله محرك التقييم.

أكثر مزودي التقييم قابلية للدفاع هم من يسمّون حدودهم صراحةً. كل ادعاء أدناه هو ادعاء يرفض Leadify تقديمه.

  • لا نتخذ قرارات التوظيف.

    البشر يتخذونها. يُنتج Leadify أدلة سلوكية — أما قرار الترقية أو التعيين أو الخلافة فيعود إلى صاحب القرار المسؤول.

  • لا نُقيِّم الشخصية.

    نُقيِّم السلوك القابل للملاحظة تحت ضغط مُقنَّن. لا سمات مُستنتَجة، ولا تصنيفات شخصية، ولا نماذج صندوق أسود.

  • لا ندّعي يقيناً لا نمتلكه.

    كل نتيجة تحمل فاصل الثقة الخاص بها. وحين تشحّ الأدلة يتّسع الفاصل، ويقول التقرير ذلك صراحةً — باللغة الرقمية نفسها التي تقرأها المالية ومجلس الإدارة.

ملف مؤسسي

تريد التوثيق الفني الكامل؟

يشرح فريقنا لفرق علم النفس التنظيمي والمشتريات تفاصيل المحرك كاملة: بيانات المعايرة، دراسات التحقق، مراقبة العدالة، ومسارات التدقيق.