• آخر امتحان للبشرية

    2025 | المؤلف: Long Phan وآخرون | المجلة: SuperIntelligence – Robotics – Safety & Alignment | المجال: الذكاء الاصطناعي (Artificial Intelligence)

    يقدم القسم نظرة عامة على المعيار الجديد الذي تم تقديمه، امتحان الإنسانية الأخير (HLE)، والذي يهدف إلى تقييم قدرات نماذج اللغة الكبيرة (LLMs) في سياق أكثر تحديًا. لقد أصبحت المعايير الحالية، مثل MMLU، أقل فعالية حيث تحقق نماذج اللغة الكبيرة دقة تزيد عن 90%، مما يؤدي إلى عدم تقديم تقييم دقيق لقدراتها. يعالج HLE هذه…


  • حول DeepSeek وضوابط التصدير

    في هذا القسم، يجادل المؤلف بضرورة فرض ضوابط تصدير أقوى على تكنولوجيا أشباه الموصلات في الولايات المتحدة، لا سيما في ضوء التقدمات الأخيرة التي حققتها شركة الذكاء الاصطناعي الصينية DeepSeek، التي يُزعم أنها حققت مستويات أداء قابلة للمقارنة مع نماذج الذكاء الاصطناعي الرائدة في الولايات المتحدة بتكلفة أقل. يؤكد المؤلف أن ظهور DeepSeek لا يضعف…