الأبحاث المرتبطة بالكلمة المفتاحية: المعايرة
-
نماذج اللغة الكبيرة متعددة الأغراض تتفوق على أدوات الذكاء الاصطناعي السريرية المتخصصة في المعايير الطبية
2026 | المؤلف: Krithik Vishwanath وآخرون | المجلة: Nature Medicine | المجال: المعلوماتية الصحية (Health Informatics)تقيّم هذه الفقرة أداء أدوات الذكاء الاصطناعي السريري المتخصصة، وتحديداً OpenEvidence و UpToDate Expert AI، مقابل النماذج اللغوية الكبيرة العامة الرائدة مثل GPT-5.2 و Gemini 3.1 Pro و Claude Opus 4.6. يتكون التقييم من ثلاث مراحل: (1) 500 سؤال MedQA تقيم المعرفة الطبية، (2) 500 عنصر HealthBench تقيس التوافق مع الأطباء الخبراء، و (3) معيار…
-
أتمتة استخراج البيانات في الأبحاث الميتا: معيار متعدد النماذج في أوراق علم نفس الشبكات
2026 | المؤلف: Benjamin Šimsa وآخرون | المجلة: Behavior Research Methods | المجال: الإحصاء والاحتمالات واللايقين (Statistics, Probability and Uncertainty)في هذا البحث، يستكشف المؤلفون فعالية نماذج اللغة الكبيرة (LLMs) لأتمتة استخراج البيانات في البحث الميتا، وهي عملية تتميز تقليديًا بطبيعتها التي تتطلب جهدًا كبيرًا وعرضة للأخطاء. باستخدام مجموعة بيانات تضم 43 ورقة بحثية في علم النفس الشبكي، اختبروا خمسة نماذج LLMs—Claude 4.6 Opus، Claude 4.5 Sonnet، Claude 4.5 Haiku، GPT-5.2، وGPT-5 mini—من خلال خط…
-
معايير خدمات الرعاية الصحية في المملكة المتحدة لعام 2026 للبالغين والأطفال الذين يعيشون مع مرض كرون والتهاب القولون التقرحي
2026 | المؤلف: Christopher A Lamb وآخرون | المجلة: BMJ Open Gastroenterology | المجال: علم الوراثة (Genetics)تهدف معايير مرض الأمعاء الالتهابي (IBD) في المملكة المتحدة لعام 2026 إلى تعزيز جودة الرعاية للمرضى الذين يعانون من مرض الأمعاء الالتهابي، بما في ذلك مرض كرون والتهاب القولون التقرحي، من خلال معالجة التباينات المحددة في الرعاية من خلال المقارنة الوطنية ومشاركة المرضى. قامت مجموعة عمل متعددة التخصصات، تضم محترفي الرعاية الصحية (HCPs) وأفراد لديهم…
-
تقييم استنتاج مسار إشارة EGF باستخدام الفوسفوبروتيوميات وتفاعلات الكيناز-الركيزة
2026 | المؤلف: Martín Garrido‐Rodríguez وآخرون | المجلة: Nature Communications | المجال: الفيزياء الحيوية (Biophysics)يقدم قسم “النتائج” النتائج الرئيسية للدراسة، مع تسليط الضوء على النتائج المهمة المستمدة من الإجراءات التجريبية أو التحليلية المستخدمة. تشير البيانات إلى أن الفرضية الرئيسية كانت مدعومة، حيث كشفت التحليلات الإحصائية عن وجود ارتباط ملحوظ بين المتغيرات قيد التحقيق. على وجه التحديد، تظهر النتائج أن التدخل أدى إلى تحسين قابل للقياس في المتغير التابع، مع…
-
يظهر التقييم المنهجي أن نماذج اللغة الكبيرة لم تصل بعد إلى دقة التشخيص لأدوات دعم القرار التقليدية للأمراض النادرة
2026 | المؤلف: Justin Reese وآخرون | المجلة: European Journal of Human Genetics | المجال: علم الوراثة (Genetics)تقيّم هذه القسم أداء نماذج اللغة الكبيرة (LLMs) في تشخيص الأمراض الوراثية من خلال تقييمها مقابل 5213 تقرير حالة منشور. باستخدام مخطط فينوباكيت، وأطلس الظواهر البشرية، وأطلس الأمراض موند، شمل البحث إرسال مطالبات مستمدة من فينوباكيت إلى سبعة LLMs، بما في ذلك النماذج العامة والمتخصصة في الطب. أشارت النتائج إلى أن أفضل أداء لـ LLM…
-
تقييم مرجعي لنماذج اللغة الكبيرة في تقييم جودة مقاطع الفيديو الخاصة بتعميم العلوم لعيون جافة
2026 | المؤلف: Shiqi Zhou وآخرون | المجلة: Scientific Reports | المجال: المهن الصحية العامة (General Health Professions)لقد حول الانتشار السريع لمنصات الفيديو القصير نشر المعلومات الصحية، خاصة في سياق جفاف العين، وهو اضطراب عيني شائع. تتناول هذه الدراسة الحاجة الملحة لطرق فعالة لتحديد وتخفيف المعلومات المضللة في المحتوى الصحي عبر الإنترنت. تم اقتراح إطار عمل جديد يستخدم نماذج اللغة الكبيرة للفيديو (VideoLLMs) للتقييم الآلي لمقاطع الفيديو الخاصة بتعميم العلوم. تم تقييم…
-
تقييم ومعايير المجتمع لاكتشاف الميكرو بروتينات غير المعلّمة بواسطة البروتيوميات المعتمدة على مطيافية الكتلة
2026 | المؤلف: Aaron Wacholder وآخرون | المجلة: Nature Communications | المجال: التحليل الطيفي (Spectroscopy)يتناول هذا القسم من ورقة البحث تحديد إطارات القراءة المفتوحة القصيرة (sORFs) والميكروبروتينات المشفرة لها من خلال تقنيات البروتيوميات المعتمدة على مطيافية الكتلة (MS). يبرز المؤلفون التباين الكبير في عدد البروتينات البشرية غير الموصوفة المبلغ عنها عبر دراسات مختلفة، مع اختلافات تمتد عبر ثلاثة أوامر من الحجم. من بين ما يقرب من 10,000 ببتيد مشفر…
-
تقييم أداء التعلم الآلي لتصنيف أنماط أصوات الأمعاء – من الميزات الجدولية إلى النماذج المدربة مسبقًا
2026 | المؤلف: Zahra Mansour وآخرون | المجلة: PLoS ONE | المجال: طب الرئة والجهاز التنفسي (Pulmonary and Respiratory Medicine)تسلط الأبحاث الضوء على التقدم في التحليل الآلي لأصوات الأمعاء (BS) من خلال استخدام السماعات الإلكترونية وأجهزة الاستشعار القابلة للارتداء، مما يسهل التحقيقات المعتمدة على البيانات في أنماط BS وعلاقتها بمختلف الأمراض. باستخدام مجموعة بيانات من 16 موضوعًا صحيًا، تم تصنيفها إلى أربعة أنماط من BS، تقيم الدراسة فعالية نماذج التعلم الآلي المختلفة، بما في…
-
تقييم منهجي لمنصات النسخ الجزيئي الفرعي عالية الإنتاجية عبر الأورام البشرية
2025 | المؤلف: Pengfei Ren وآخرون | المجلة: Nature Communications | المجال: علم الأحياء الجزيئي (Molecular Biology)أدت التطورات الأخيرة في علم النسخ الجزيئي المكاني إلى تحسين الدقة والإنتاجية، مما يستلزم تقييمًا منهجيًا لهذه التقنيات. تقيم هذه الدراسة بيانات النسخ الجزيئي المكاني التي تم إنشاؤها من مقاطع الأنسجة المتسلسلة من عينات سرطان الغدة الدرقية، وسرطان الكبد، وسرطان المبيض عبر أربعة منصات عالية الإنتاجية: Stereo-seq v1.3، Visium HD FFPE، CosMx 6K، وXenium 5K.…
-
معيار أخلاقيات LLM: نظام تقييم ثلاثي الأبعاد لتقييم التفكير الأخلاقي في نماذج اللغة الكبيرة
2025 | المؤلف: Junfeng Jiao وآخرون | المجلة: Scientific Reports | المجال: علم الأعصاب الإدراكي (Cognitive Neuroscience)تقدم هذه الدراسة إطارًا شاملاً لتقييم قدرات التفكير الأخلاقي لنماذج اللغة الكبيرة (LLMs)، مع معالجة قصور منهجيات التقييم الحالية في التقاط اتخاذ القرارات الأخلاقية الدقيقة. يقيس الإطار المقترح التوافق مع المعايير الأخلاقية البشرية عبر ثلاثة أبعاد: المبادئ الأخلاقية الأساسية، قوة التفكير، وتناسق القيم في سيناريوهات متنوعة. من خلال تحديد نقاط القوة والضعف الأخلاقية في LLMs،…
