Research Portfolio · 2026 إصدار الأبحاث · ٢٠٢٦

Four Papers.
One Moat.
أربع أوراق.
خندق واحد.

A research portfolio designed to compound — each paper makes the next one more credible, and the dataset behind all four becomes the citation every Arabic medical AI paper will reference. محفظة بحثية مصممة لتتراكم وتتضاعف — كل ورقة تزيد من مصداقية الورقة التالية، ومجموعة البيانات التي تقف خلف الأوراق الأربع تصبح المرجع الأول الذي ستشير إليه كل ورقة بحثية عربية في مجال الذكاء الاصطناعي الطبي.

Flagship Paper · P4 الورقة الرئيسية · P4
Dataset Paper · Highest Leverage ورقة مجموعة البيانات · التأثير الأقصى

The dataset
that defines Arabic medical AI.
مجموعة البيانات
التي تُعرف الذكاء الاصطناعي الطبي العربي.

MedArabic is the first Arabic clinical benchmark at scale. Synthesized from Neurova AI student interactions, evaluated by medical faculty. Every future Arabic medical AI paper must cite it — that is the strategic intent. إن MedArabic هي أول مجموعة بيانات سريرية عربية واسعة النطاق تم تركيبها خصيصاً من تفاعلات الطلاب ومراجعتها من قبل خبراء سريريين. يجب أن تشير إليها كل ورقة بحثية عربية مستقبلاً — هذا هو هدفنا الاستراتيجي.

التهاب تشخيص أعراض علاج EMBEDDING SPACE
Dataset Matrix & Split مصفوفة مجموعة البيانات والتوزيع
Clinical Dialogues
الحوارات السريرية

82,400 clean Arabic doctor-patient dialogues. ٨٢,٤٠٠ حوار طبي عربي نظيف بين الطبيب والمريض.

82,400 cases٨٢,٤٠٠ حالة
EDA Interactions
تفاعلات الدواء

45,100 Egyptian Drug Authority records. ٤٥,١٠٠ سجل من هيئة الدواء المصرية.

45,100 records٤٥,١٠٠ سجل
Mansoura Lecture Q&A
أسئلة محاضرات المنصورة

23,500 curriculum-aligned question-answers. ٢٣,٥٠٠ سؤال وجواب متوافق مع المناهج.

23,500 pairs٢٣,٥٠٠ زوج
Vetted Accuracy
دقة التحقق المعرفي

Double-blind verification by medical board. تحقق مزدوج التعمية من قبل المجلس الطبي.

99.8% Accuracy٩٩.٨٪ دقة

Research Papers الأوراق البحثية

AGENT A AGENT B P1
EMNLP Workshop
Under Reviewتحت المراجعة

Cross-Domain Epistemic Friction in Multi-Agent RL الاحتكاك المعرفي عبر المجالات في التعلم المعزز متعدد الوكلاء

Structuring adversarial dialogue between domain-specialist agents to expose causal gaps. Preference Optimization (DPO) training signals from this dialectic friction yield significant reasoning improvements. هيكلة حوار جدلي بين وكلاء متخصصين لكشف الفجوات المعرفية والمنطقية. استخلاص إشارات التفضيل DPO لتحسين الاستدلال المعرفي محلياً.

P2
EMNLP 2026
Draftingقيد الصياغة

ARIA: Adaptive Routing with Interleaved Aggregation ARIA: التوجيه التكيفي مع التجميع المتداخل

An inference routing framework executing speculative decoding for clinical text. Routes queries through dynamic confidence gates across localized MiniLMs and large ensemble models. إطار عمل لتوجيه الاستدلال ينفذ فك ترميز تكهني للنصوص السريرية، ويوزع حمل العمل عبر بوابات ثقة ديناميكية بين النماذج الصغيرة والكبيرة.

P3
ICLR 2027 Target
Active Researchأبحاث نشطة

MACS: Memory-Augmented Causal Synthesis MACS: التوليف السببي المدعوم بالذاكرة

A neural layer integrating a Working Memory Buffer governed by a spaced decay curve (FSRS-derived) to enable continuous knowledge acquisition without catastrophic forgetting. طبقة عصبية مبتكرة تدمج مخزناً مؤقتاً للذاكرة العاملة محكوماً بمعادلات FSRS لتسمح باكتساب مستمر للمعارف السريرية الطبية بلا نسيان.

Research Timeline الجدول الزمني للأبحاث

Q1 2025
MedArabic Synthesis Initiation بدء تركيب وتجميع MedArabic
Extraction of clinical cases and drug interaction records from regional medical syllabi and Egyptian Drug Authority datasets. استخراج الحالات السريرية وسجلات التفاعلات الدوائية من مناهج كليات الطب وأوراق نقابة الأطباء في مصر.
Q3 2025
ARIA Project Conception تصور وتصميم مشروع ARIA
Initial prototyping of the speculative confidence-routed inference model using local MiniLMs for speed and privacy. بناء النموذج الأولي لإطار عمل التوجيه المعرفي بالاعتماد على النماذج الصغيرة لضمان الخصوصية والسرعة الفائقة.
Q1 2026
Paper P1 Submission تقديم الورقة البحثية الأولى P1
Submission of dialectic multi-agent Reinforcement Learning framework to EMNLP workshop, initiating formal peer review. تقديم إطار العمل الجدلي متعدد الوكلاء للتعلم المعزز إلى ورشة عمل EMNLP لبدء المراجعة الأكاديمية الرسمية.
Q2 2026 (Active)
MedArabic Dataset v1.0 Release إطلاق النسخة الأولى v1.0 لـ MedArabic
Public validation of our foundational dataset. Releasing AraHealthQA-2025 evaluation benchmarks for Arabic clinical NLP comparison. بدء التقييم العام والتحقق الميداني لمجموعة البيانات، ونشر معيار AraHealthQA-2025 لقياس كفاءة النماذج.
Q4 2026 (Planned)
ARIA Production Integration دمج ARIA الفعلي في المنصة
Integrating the inference routing engine directly into the live Neurova AI platform to optimize response latency for students. تفعيل محرك توجيه الاستدلال ARIA مباشرة في بيئة تشغيل Neurova AI لتحسين تجربة الطلاب وسرعة الإجابات.
2027 (Future)
MACS Research Program Launch إطلاق برنامج أبحاث MACS
Full launch of the Memory-Augmented Causal Synthesis program targeting major cognitive AI conferences (NeurIPS, ICLR). إطلاق برنامج التوليف السببي المدعوم بالذاكرة بالكامل مستهدفين مؤتمرات الذكاء الاصطناعي العالمية NeurIPS و ICLR.

Research & Dataset Collaboration التعاون البحثي وطلب البيانات

We actively collaborate with medical schools, computational linguistics labs, and clinical researchers across the Arab world. If you want to integrate the MedArabic dataset, co-author on MACS, or evaluate models on the AraHealthQA benchmark, connect with our principal investigator. نحن نتعاون بنشاط مع كليات الطب ومختبرات اللسانيات الحاسوبية والباحثين السريريين في جميع أنحاء العالم العربي. إذا كنت ترغب في دمج مجموعة بيانات MedArabic، أو المشاركة في كتابة MACS، أو تقييم النماذج، تواصل مع فريقنا البحثي.