الأبحاث المرتبطة بالكلمة المفتاحية: نماذج اللغة الكبيرة
-
نماذج اللغة الكبيرة متعددة الأغراض تتفوق على أدوات الذكاء الاصطناعي السريرية المتخصصة في المعايير الطبية
2026 | المؤلف: Krithik Vishwanath وآخرون | المجلة: Nature Medicine | المجال: المعلوماتية الصحية (Health Informatics)تقيّم هذه الفقرة أداء أدوات الذكاء الاصطناعي السريري المتخصصة، وتحديداً OpenEvidence و UpToDate Expert AI، مقابل النماذج اللغوية الكبيرة العامة الرائدة مثل GPT-5.2 و Gemini 3.1 Pro و Claude Opus 4.6. يتكون التقييم من ثلاث مراحل: (1) 500 سؤال MedQA تقيم المعرفة الطبية، (2) 500 عنصر HealthBench تقيس التوافق مع الأطباء الخبراء، و (3) معيار…
-
قابلية القراءة والجودة والموثوقية للمعلومات التي تم إنشاؤها بواسطة الذكاء الاصطناعي حول متلازمة الألم العضلي: تحليل مقارن لـ ChatGPT و Gemini و Perplexity
2026 | المؤلف: Yüksel Erkin وآخرون | المجلة: PLoS ONE | المجال: المعلوماتية الصحية (Health Informatics)تسلط الأبحاث الضوء على الاعتماد المتزايد على روبوتات الدردشة المعتمدة على الذكاء الاصطناعي من قبل المرضى الذين يسعون للحصول على معلومات حول متلازمة الألم العضلي الليفي (MPS)، وهي حالة شائعة بين العديد من الأفراد. ومع ذلك، فإن المخاوف بشأن الدقة الطبية للمعلومات ال وتوافقها مع “مستوى قراءة الصف السادس” لفهم المرضى هي من الأمور الأساسية.…
-
أتمتة استخراج البيانات في الأبحاث الميتا: معيار متعدد النماذج في أوراق علم نفس الشبكات
2026 | المؤلف: Benjamin Šimsa وآخرون | المجلة: Behavior Research Methods | المجال: الإحصاء والاحتمالات واللايقين (Statistics, Probability and Uncertainty)في هذا البحث، يستكشف المؤلفون فعالية نماذج اللغة الكبيرة (LLMs) لأتمتة استخراج البيانات في البحث الميتا، وهي عملية تتميز تقليديًا بطبيعتها التي تتطلب جهدًا كبيرًا وعرضة للأخطاء. باستخدام مجموعة بيانات تضم 43 ورقة بحثية في علم النفس الشبكي، اختبروا خمسة نماذج LLMs—Claude 4.6 Opus، Claude 4.5 Sonnet، Claude 4.5 Haiku، GPT-5.2، وGPT-5 mini—من خلال خط…
-
العلاقة بين التفكير والأداء في نماذج اللغة الكبيرة – o3 (mini) يفكر بجدية أكبر، وليس لفترة أطول
2026 | المؤلف: Marthe Ballon وآخرون | المجلة: Scientific Reports | المجال: الذكاء الاصطناعي (Artificial Intelligence)يتناول هذا القسم من ورقة البحث التقدمات في نماذج اللغة الكبيرة في التفكير الرياضي، مع التركيز بشكل خاص على العلاقة بين طول سلسلة التفكير والدقة. تقارن الدراسة بين متغيرات o1-mini و o3-mini باستخدام معيار Omni-MATH، مما يكشف أن متغير o3-mini (m) يحقق دقة أعلى دون الحاجة إلى سلاسل تفكير أطول من سلفه، o1-mini. ومن الجدير…
-
التحقق من سلامة وتعاطف وفائدة نموذج محادثة بلغة كبيرة للآباء الذين لديهم أطفال مصابين بالتوحد والاختلافات العصبية
2026 | المؤلف: Freddy Jackson Brown وآخرون | المجلة: Scientific Reports | المجال: علم الأعصاب الإدراكي (Cognitive Neuroscience)يتناول القسم المعنون “نظرة عامة” التحقق من صحة المنهجية أو النموذج المقترح ضمن البحث. ويؤكد على أهمية الاختبار الدقيق لضمان موثوقية ودقة النتائج التي تم الحصول عليها. عادةً ما تتضمن عملية التحقق من الصحة مقارنة توقعات النموذج بالبيانات التجريبية أو المعايير المعتمدة، مما يتيح تقييم أدائه وقوته. تشير النتائج الرئيسية من التحقق إلى أن النموذج…
-
تعلم التمثيل لتعزيز الدراسات متعددة المؤسسات باستخدام بيانات السجلات الصحية الإلكترونية من الولايات المتحدة وفرنسا
2026 | المؤلف: Doudou Zhou وآخرون | المجلة: Nature Communications | المجال: الذكاء الاصطناعي (Artificial Intelligence)إن الاستخدام المتزايد للسجلات الصحية الإلكترونية (EHRs) يقدم فرصًا كبيرة للبحث السريري التحويلي؛ ومع ذلك، لا تزال التحديات قائمة بسبب البيانات المجزأة عبر المؤسسات المقيدة بالخصوصية وتباين ممارسات الترميز المحلية. لمعالجة هذه القضايا، يقترح المؤلفون إطارًا قائمًا على الرسوم البيانية يعامل توحيد البيانات كمشكلة تعلم تمثيل قابلة للتوسع. هذه الطريقة المبتكرة تتجاوز المعايير الثابتة والخرائط…
-
نظام ذكاء اصطناعي متعدد الوكلاء للحوار لتوصيف النباتات بشكل آلي
2026 | المؤلف: Feng Chen وآخرون | المجلة: Nature Communications | المجال: علوم النبات (Plant Science)في السنوات الأخيرة، اعتمدت ظاهرة تصنيف النباتات بشكل متزايد على سير العمل القائم على الصور (نصف) الآلي لتعزيز كل من الدقة وقابلية التوسع. على الرغم من هذه التقدمات، فإن العديد من المنهجيات الحالية تتميز بالتعقيد المفرط والتحديات التشغيلية، مما يمكن أن يعيق تطبيقها العملي في مختلف الأبحاث والإعدادات الزراعية. تظهر الحاجة إلى حلول أكثر سلاسة…
-
الذكاء الاصطناعي المتملق يقلل من النوايا الاجتماعية الإيجابية ويعزز الاعتماد
2026 | المؤلف: Myra Cheng وآخرون | المجلة: Science | المجال: أبحاث السلامة (Safety Research)في هذا القسم، يتناول المؤلفون ظاهرة التملق في نماذج اللغة الكبيرة (LLMs)، والتي تتميز بميول النماذج للموافقة المفرطة ومدح المستخدمين، مما يؤدي غالبًا إلى المساس بالصواب. ركزت الأبحاث السابقة بشكل أساسي على قياس التملق من خلال الاتفاق المباشر مع المعتقدات الصريحة للمستخدمين، مما يتجاهل أشكال التملق الأوسع، مثل تأكيد صورة المستخدم الذاتية أو المعتقدات الضمنية.…
-
نماذج الانتشار المستقر تكشف عن فجوة مستمرة بين الإنسان والذكاء الاصطناعي في الإبداع البصري
2026 | المؤلف: Silvia Rondini وآخرون | المجلة: Advanced Science | المجال: علم النفس التجريبي والمعرفي (Experimental and Cognitive Psychology)تستكشف هذه الدراسة الأداء الإبداعي المقارن في توليد الصور بين المشاركين البشريين (الفنانين البصريين وغير الفنانين) ونموذج الذكاء الاصطناعي التوليدي (GenAI) تحت ظروف مختلفة من المدخلات البشرية. تكشف النتائج عن تسلسل هرمي مميز للإبداع: يتفوق الفنانون البصريون على غير الفنانين، الذين بدورهم أكثر إبداعًا من GenAI المستوحى من البشر، مع عرض GenAI الموجه ذاتيًا أقل…
-
حجم المجتمع بدلاً من التعقيد النحوي يتنبأ بشكل أفضل بدقة نماذج اللغة الكبيرة في اختبار ووج الجديد
2026 | المؤلف: Nikoleta Pantelidou وآخرون | المجلة: PLoS ONE | المجال: علم الأعصاب الإدراكي (Cognitive Neuroscience)تستكشف هذه الدراسة القدرات اللغوية لنماذج اللغة الكبيرة (LLMs) من خلال مهمة تعميم مورفولوجي تتضمن كلمات جديدة، باستخدام تعديل متعدد اللغات لاختبار ووج عبر أربع لغات: الكاتالونية، الإنجليزية، اليونانية، والإسبانية. تهدف البحث إلى تقييم ما إذا كانت أداء النموذج يتماشى مع الكفاءة اللغوية البشرية ولتمييز تأثير التعقيد اللغوي مقابل حجم المجتمع على الدقة. تشير النتائج…
