
طُوِّر لفريق المالية والتحليلات في شركة Tractafric Equipment، الذي كان يجيب سابقاً عن هذه الأسئلة يدوياً في Excel. لم يكن التحدي الحقيقي في ربط نموذج لغوي كبير بقاعدة بيانات، بل في ثلاثة مكامن خلل دقيقة في البيانات تُفشل الأساليب البسيطة لتحويل النص إلى SQL.
يحتوي المخطط على 50 عموداً غامضاً، من بينها ثلاثة حقول مختلفة لـ"الفئة الرئيسية"، وأربعة حقول GPM، ونسب مئوية مخزنة على شكل كسور. تتيح طرق عرض SQL دلالية مكتوبة يدوياً وبطاقات مخطط للنموذج ألا يلامس الجدول الخام مباشرة.
يحدد برنامجان من Caterpillar الدعم كمنحنى لنسبة GPM بدلاً من عتبة ثابتة. الربط الساذج يضاعف الصفوف أو يختارها بشكل خاطئ، مما يشوّه حوالي 26٪ من إجمالي الدعم (نحو 570 ألف دولار). يُصحَّح هذا عبر ربط بفرعية مترابطة حسب الشريحة، وهو بالضبط ما تغطيه فئة "join" في مجموعة الاختبار.
الفرنسية المهنية لا تطابق مفردات المخطط: يجب أن تُحلّ "pompes hydrauliques" إلى رموز PPC مثل HGP وHPM وHRP عبر 4,653 وصفاً لقطع الغيار بالفرنسية. يتكفل بذلك فهرس متجهي بطريقة القوة الغاشمة بلغة NumPy (لا حاجة لقاعدة بيانات متجهية عند حوالي 5,500 متجه) إلى جانب رسم بياني تصنيفي حتمي في NetworkX.
يعمل كل شيء دون اتصال بالإنترنت بالكامل: SQLite في وضع القراءة فقط، ونموذج Ollama محلي (qwen3.5:9b)، دون أي استدعاء سحابي، ودون خروج أي بيانات من الجهاز. يُظهر معيار قياس من 100 سؤال، مع تجارب حذف تُزيل طرق العرض والحل والرسم البياني واحداً تلو الآخر، أن طبقة طرق العرض الدلالية وحدها تساهم بنحو 47 نقطة دقة، وأن أصغر نموذج في المقارنة هو الأدق أيضاً: كل من وضع الاستدلال ونموذج بحجم 30B سجّلا نتيجة أضعف من النموذج الافتراضي بحجم 9B دون تفعيل الاستدلال.
Local-LLM chat assistant that turns a plain-language sales question into an auditable SQL query against 3.1M real Caterpillar-dealer records with guardrails built around five verified data traps that silently return a wrong number if ignored.
محرك لتقييم مخاطر فقدان العملاء لدى وكيل معدات، يعزل مجموعة موثوقة من 230 حسابًا من بيانات تضم 3.1 مليون سجل تأثرت بخلل في التصدير أدى إلى فقدان 63% من قاعدة العملاء بصمت، متفوقًا على النماذج المرجعية القائمة على الحداثة والتكرار بدقة PR-AUC بلغت 0.51 تم التحقق منها إحصائيًا بطريقة bootstrap.
تصنيف غير مُوجَّه لـ 2,635 عميلًا حقيقيًا ضمن 4 شرائح (بمعامل ARI بلغ 0.97)، يكشف عن قائمة لإعادة التنشيط بقيمة 668,810 دولارًا من بيانات مُقتَطعة عمدًا.