حوسبة وقت الاختبار
2 published articles
نماذج اللغات الكبيرة3 min read
أبحاث الذكاء الاصطناعي
بينيلوب تخفي استدلالها في طبقة مفكك ترميز واحدة لخفض تكاليف الاستدلال
بينيلوب، إطار عمل للاستدلال الكامن لمحولات مفكك الترميز فقط، يحدد الحساب المتكرر في فاصل زمني ضيق لمفكك الترميز، مما يقلل زمن استجابة الاستدلال دون تأثير كبير على الدقة. تصف الورقة منهجًا دراسيًا ينقل الاستدلال من الرموز المرئية إلى حلقة GRU داخلية.
2026-08-04
الذكاء الاصطناعي4 min read
التقييم المحدد مقابل غير المحدد
لماذا يفشل التقييم الذاتي لنموذج الذكاء الاصطناعي في الجودة البصرية
يقدم بحث جديد مفهوم 'التمييز' كمتغير رئيسي يحكم محورًا ثالثًا لحساب زمن الاختبار: التوسع التفاعلي. وتظهر النتائج أن أداة محددة تقيس التخطيط الفعلي تتفوق على تقييم VLM عبر لقطة الشاشة، حيث تصلح 73-74% من العيوب في الوضعيات البصرية بينما لا يرى المقياس القياسي شيئًا.
2026-07-31