أطلقت مبادرة الأبحاث المتقدمة التابعة لـ Tether يوم الأربعاء QVAC Genesis III، وهي مجموعة بيانات اصطناعية تضم 191.43 مليار رمز، صُممت لتدريب نماذج ذكاء اصطناعي أصغر على الاستدلال في مجالات STEM وتحسين قدرتها على العمل على أجهزة الكمبيوتر المحمولة والهواتف والخوادم المحلية.
وفقًا لـ بيان، تضم مجموعة البيانات 159.6 مليون وثيقة تغطي 19 تخصصًا عبر مستويات التعليم الثانوي والجامعي والمهني. وتشمل هذه التخصصات الرياضيات والفيزياء والكيمياء وعلوم الكمبيوتر والطب.
قالت Tether إن مجموعة البيانات تعتمد على طريقتين للتدريب. الأولى، وهي تحليل الإخفاقات، تعيد إدخال أخطاء نموذج أصغر بوصفها مادة تدريبية، فيما يتتبع نموذج «المعلّم» الأكبر موضع فشل الاستدلال ويعمل على الوصول إلى الحل الصحيح.
أما الطريقة الأخرى فهي الاستدلال على مستوى الخيارات، إذ تشرح سبب صحة الإجابة الصحيحة وسبب خطأ كل بديل.
ووفقًا للبيان، وجد باحثو Genesis III أن النماذج المدرَّبة على مجموعة البيانات تفوقت على نماذج Cosmopedia-v2 المماثلة في التدريب عبر عدة بُنى، من بينها Qwen وLlama وSmolLM وGemma.
قالت Tether إن Genesis III حسّن النتائج، مقارنةً بنموذج Cosmopedia-v2 المطابق من حيث عدد الرموز، بمقدار 28.57 نقطة مئوية في ARC-Easy، و21.35 نقطة في ARC-Challenge، و15.03 نقطة في معيار MMLU STEM.
يأتي Genesis III بعد Genesis I في Oct. 24, 2025، وGenesis II في Dec. 22, 2025. وقد قُبلت ورقته البحثية للعرض في مؤتمر نمذجة اللغة 2026.
