اختيار النموذج قرار هندسي، لا مودّة. ابدأ من طبيعة المهمة: توليد نص عربي طويل، تصنيف قصير، استدعاء أدوات، أم تحليل مستندات؟ لكل نوع عتبات مختلفة.

المعيار الأول: جودة العربية على أمثلتك أنت. خمسين مثالاً حقيقياً من عملك أهم من أي لوحة صدارة. شغّلها على نموذجين أو ثلاثة وقارن بقرار بشري محايد.

المعيار الثاني: نافذة السياق الفعلية لا المعلنة. النموذج الذي يفعل مئة ألف رمز قد يتدهور بعد العشرين ألفاً. اختبر بسؤال في آخر المستند وآخر فيه.

المعيار الثالث: التكلفة لكل مهمة مكتملة، لا لكل رمز. المهمة الواحدة قد تحتاج خمس محاولات على نموذج رخيص لتوازي محاولة واحدة على أغلى — فالعبرة بالسعر النهائي للنتيجة.

المعيار الرابع: الاستدعاء البنيوي والأدوات. إن كان عملك يعتمد على JSON صارم أو استدعاء دوال، فاختبر هذا تحديداً؛ التدهور هنا لا يظهر في المحادثة الطبيعية.

الخلاصة: نموذج لكل فئة مهمة. نموذج قوي للمسودات والتحليل، ونموذج سريع صغير للتصنيف والتحويل. هذه البنية تخفض التكلفة وترفع الثبات معاً.