@DarkCipher00 كان في تقرير قبل كدا ان قصاد كل دولار انت بتدفعه فاشتراك anthropic هما بيدفعو قصاده 2 دولار كcomputations وممكن اكتر كمان فهم لا مبيكسبوش نهائي.
الخيارات الخمسة المبدئية: كل بطل مجموعة (من الـ 8 المحددين لمواجهة الثوالث) يكون لديه بالفعل مسار محتمل يربطه بـ 5 مجموعات معينة.
تقليص الخيارات: بما أن هناك 4 مجموعات لن يصعد منها صاحب المركز الثالث (لأن 8 فقط يتأهلون من أصل 12)، فإن خيارات بطل المجموعة تتقلص تلقائياً إذا كانت المجموعات التي خرجت من ضمن خياراته الخمسة.
الاستقرار على خصم واحد (الجدول السحري): الفيفا يستخدم جدولاً رياضياً ثابتاً يضم كل الاحتمالات الممكنة لتأهل الثوالث (وهي 495 تركيبة مختلفة). بمجرد إطلاق صافرة نهاية آخر مباراة في دور المجموعات وتحديد الـ 8 ثوالث المتأهلين، يقوم هذا الجدول بتصفية الخيارات المتبقية ليمنح كل بطل مجموعة خياراً واحداً فقط، بناءً على قاعدتين صارمتين:
أن يحصل كل بطل من الأبطال الثمانية على خصم من الثوالث.
ألا يتواجه فريقان كانا معاً في نفس المجموعة خلال دور المجموعات.
النظام الحالي باختصار ان مثلا اول اي مجموعة بيبقا ليه انه يلاعب توالت 5 مجموعات ، من الخمس مجموعات دول فيه منهم مجموعات مبيصعدش منهم احسن توالت فممكن يبقا للمنتخب مثلا 3 اختيارات او اختيارين ، الاختيارات دي بتنتهي ع اختيار واحد بناء ع اولوية ان لازم عالاقل منتخب اول يلاعب تالت مجموعة
Full code, results, methodology:
🔗 GitHub: https://t.co/PICrfeoZsl
📄 Medium: https://t.co/9SFPfggHDE
If you work on RLHF or alignment, I'd love to hear your thoughts.
I ran AI responses through a brain model.
It could tell when the AI was just telling you what you want to hear.
100% accuracy. Zero training. No labels.
Here's how 🧵:
Honest limitations:
• 30 pairs only
• 3 min/text (not production-ready)
• Augmented model showed no improvement at n=30
This is exploratory. But 100% sycophancy detection with zero labels is worth investigating.
@omar_sheriff97@Mokhattab97@omarlebda مظبوط بس كدا كدا الagent الاساسي كان هيcall نفس الtools للتاسك دي لو انت مستخدمتش فيها sub agents + التوكينز بتاعت الcontext والhistory اللي بتتحرق وانا بعمل inference عشان اعمل الtool call هتخلي الcost اكتر لو بستخدم الagent الرئيسي