الأخبار
ملخص بالذكاء الاصطناعي
١٣ شوال ١٤٤٧ هـ١ أبريل ٢٠٢٦
تقديم ADeLe: منهجية جديدة لتقييم نماذج الذكاء الاصطناعي

تقديم ADeLe: منهجية جديدة لتقييم نماذج الذكاء الاصطناعي

أطلق باحثون من مايكروسوفت وجامعة برينستون منهجية ADeLe لتقييم نماذج الذكاء الاصطناعي، والتي تقيم 18 قدرة أساسية. هذه المنهجية تتنبأ بأداء النماذج على مهام جديدة بدقة تصل إلى 88%، بما في ذلك نماذج مثل GPT-4o و Llama-3.1. تعمل ADeLe على بناء ملفات تعريف للقدرات، مما يساعد في تحديد نقاط القوة والضعف للنماذج. من خلال ربط النتائج بمتطلبات المهام، توضح ADeLe كيف يتغير الأداء مع زيادة تعقيد المهام، مما يوفر رؤى أعمق حول أداء النماذج. تعتبر هذه المنهجية خطوة مهمة نحو تحسين تقييم النماذج، حيث تتجاوز الدرجات التقليدية وتقدم تحليلاً أكثر تفصيلاً. من المتوقع أن تؤثر ADeLe بشكل كبير على كيفية تقييم النماذج في المستقبل، مما يسهل فهم قدراتها الحقيقية.

تابع هذه المواضيع

سجّل دخولك لمتابعة المواضيع التي تهمك

تسجيل الدخول للمتابعة

يُنتج هذا الملخص باستخدام تقنيات الذكاء الاصطناعي مع مراجعة تحريرية دورية، ويرجى الرجوع إلى المصدر الأصلي للتفاصيل الكاملة.

0
0 يقرأون الآن

تقييم الخبر

سيظهر متوسط التقييم بعد 3 تقييمات.

سجل الدخول للتفاعل والتقييم والحفظ. تسجيل الدخول
مقالات ذات صلة

مقالات ذات صلة

مزيج خفيف من الوسوم والموضوعات القريبة والزخم الحديث.

اكتشاف ثغرات دورية في نماذج اللغة من قبل بايت دانس
الأبحاثنماذج

اكتشاف ثغرات دورية في نماذج اللغة من قبل بايت دانس

حدد الباحثون في بايت دانس ثغرات دورية في نماذج اللغة، حيث تعتمد على ضغط ذاكرة المفتاح والقيمة في كتل ثابتة. في ورقة بحثية نش...

تلائم لغتك الحالية

اقرأ الرؤية
استخدام الذكاء الاصطناعي لتصميم أشكال حياة جديدة
الأبحاثنماذج

استخدام الذكاء الاصطناعي لتصميم أشكال حياة جديدة

في عام 2025، قدم طالب الدكتوراه في جامعة ستانفورد، صموئيل كينغ، إجابة أولية على سؤال: هل يمكن للذكاء الاصطناعي تصميم أشكال ح...

تلائم لغتك الحالية

اقرأ الرؤية
أوبن إيه آي تتجاوز إرشادات الباحثين الرياضيين في تقديم الأدلة
الأبحاثنماذج

أوبن إيه آي تتجاوز إرشادات الباحثين الرياضيين في تقديم الأدلة

تجاوزت أوبن إيه آي الإرشادات التي وضعتها مجموعة من الباحثين الرياضيين عند تقديم أدلة جديدة. تتعلق هذه الأدلة بمشاريع بحثية م...

تلائم لغتك الحالية

اقرأ الرؤية
إطلاق نموذج Mirror Particle في TechCrunch Disrupt لتوقع سلوك البشر
الأبحاثنماذج

إطلاق نموذج Mirror Particle في TechCrunch Disrupt لتوقع سلوك البشر

ستقوم شركة Mirror Particle بإطلاق نموذج جديد في حدث TechCrunch Disrupt، يهدف إلى توقع سلوك البشر. يعتمد النموذج على بناء عال...

تلائم لغتك الحالية

اقرأ الرؤية
أوبن إيه آي تنشر نتائج جديدة في الرياضيات على GitHub
الأبحاثنماذج

أوبن إيه آي تنشر نتائج جديدة في الرياضيات على GitHub

نشرت أوبن إيه آي نتائج جديدة تتعلق بمشكلات مفتوحة في الرياضيات من نموذج داخلي. تتضمن النتائج تفاصيل حول إثباتات Lean الرسمية...

تلائم لغتك الحالية

اقرأ الرؤية