قد يكون إطلاق CLAUDE SONNET 5.5 وشيكاً
تستعد شركة Anthropic لإجراء تحديث رئيسي لسلسلة نماذج Sonnet الشهيرة.
-تفيد التقارير بأن نموذج Sonnet 5.5 في المراحل النهائية من التطوير.
-قد يتم الإطلاق في وقت مبكر من الشهر المقبل.
-يُتوقع تقديم استجابات أسرع ومعدل تأخير أقل (Latency).
أتفق تماماً مع ما ذكره المتحدث في المقطع؛ فشتان بين التنظير وكلام السعة في وسائل التواصل والواقع الفعلي.
ولو لم يسخر الله هؤلاء لهذه المهمة، لكان التمر يباع بالجرام في سوق الذهب.
فالحمد لله أولاً وآخراً، اللهم ارزق هذه البلاد المباركة وأهلها، وارزق منها ومن أهلها.
كخريطة من بره الموضوع محسوم لكن من جوه لسه بنقول يا هادي !
بفضل شبكات الأقمار الصناعية تم تصوير ومسح كل متر على اليابسة ..ولما نيجي للمحيطات اللي بتغطي أكتر من ٧٠٪ من مساحة الكوكب العلم لم يستكشف حتى الآن حوالي ٨٠٪ من الأعماق دي يعني احنا عندنا خرائط لسطح القمر والمريخ بتفاصيل أدق بكتير من اللي نعرفه عن قاع المحيط .. الضغط الساحق في الأعماق بيخلي إرسال غواصة أصعب هندسياً من إرسال مركبة للفضاء زي ما قولت قبل كده
وغير كده تحت القشرة الأرضية في أنظمة كهوف عملاقة لسه بنكتشفها فيه كهوف ضخمة لدرجة إن جواها سحاب من غازات ونظام مناخي خاص وعندنا كمان بحيرات ضخمة مدفونة تحت آلاف الأمتار من الجليد في القطب الجنوبي معزولة عن العالم من ملايين السنين ولسه بنحاول نوصلها عشان ندرس الحياة الميكروبية هناك
ودي صورة لأحد الكهوف في فيتنام
الي يحب الهندسة العكسية و بناء التطبيقات بالـ Ai
لقيت لكم طريقة جامدة تجيب فيها Reverse engineering prompt ✊
بكل بساطة استبدل رابط اي repo على قيت هب من github الى gitreverse و استمتع 😊
ابويس 5 في الطريق
- نافذة سياقية بسعة مليون رمز، مما يجعلها من بين أكبر نماذج السياق المتاحة للبرمجة وسير العمل مع المستندات الطويلة.
جهد استدلال قابل للتخصيص، بحيث يمكنك التضحية بزمن الاستجابة للحصول على نتائج أفضل بدلاً من دفع أقصى جهد في كل مرة.
@yousefrol كلود كنت الصق له النتائج وتتحول لشكل دفتر بسبب طولها ويجاوب وبعد فترة حسيت اجاباته غير مناسبة سألته ان تقراء النتائج اللى الصقها لك قال لا ما استطيع قرائتها عنده مشكلة واني ابني اجاباتي على محادثاتنا السابقة وذاكرتي 😂
Today we're announcing the completion of one of the largest engineering projects in the company's history:
We rebuilt the X Android app from scratch
It's faster, smoother and more reliable. But most of all: it will enable us to build new features at lightning speed.
Some updates on the creator rev share program:
1. Soliciting engagements (“I’ll follow everyone who replies”) 3 or more times will results in removal from the program and your account will be forwarded to the policy team for suspension. Grok now catches all of these.
Nearly 4000 accounts were removed from the program today.
2. Our new model now detects duplicated content at 3x the rate of the previous model. Adding watermarks, intros and other edits will send monetized impressions to the original uploader. This also includes copying viral text posts (most common one: “Twitter is like the smoking section of the internet”).
We detected 1.5 million posts that were stolen this cycle. Repeated or intentional circumvention will lead to removal from the program.
With these changes, over $1 million will be given back to original content creators.
مع كل الهالة والتمجيد المدفوع عن Kimi K3، خلونا نتكلم بصراحة "مو كل شيء يلمع ذهب" :
أول شي، الأداء الفعلي:
- يهلوس مرات: لسه فيه مشكلة "التوهم". يعطيك معلومات غلط وهو واثق من نفسه بزيادة، خصوصاً في المواضيع التخصصية العميقة.
- تراجع بمهارات: تخيل، في بعض التحديثات، أداءه يتدهور في أشياء زي البرمجة المعقدة والرياضيات المتقدمة، بدل ما يتحسن!
- ثقيل شوي: مع كل كلامهم عن السرعة، لكن في الاستخدام الفعلي تحسه أبطأ من منافسيه الطلبات معقدة.
حدود التصميم اللي فيه:
- السياق الطويل نظريًا: يدعي دعم ملايين التوكنات، بس في الواقع يضيع التركيز على التفاصيل المهمة لو المستند طويل مرة.
- يعتمد عالصيني: تدريبه الأساسي على بيانات صينية، وهذا يخلي أداءه بالعربي واللغات الثانية أقل دقة ومرونة مقارنة بالإنجليزي أو الصيني.
- صعب بالتعليمات المعقدة: لو أعطيته تعليمات كثيرة وفيها شروط متداخلة، ممكن يتجاهل جزء منها بدون ما يقولك شي.
مشاكل تجارية وتجربة المستخدم:
- وصوله محدود: مو متوفر لكل الناس، وقد يتطلب اشتراك أو يكون محدد بمناطق معينة، وفيه قيود على عدد الرسائل.
- تحديثات مفاجئة: تتغير فيه أشياء أو قدرات فجأة بدون أي تنبيه، وهذا يعفس شغل اللي يعتمدون عليه.
- دعمه للعربي "سطحي": يفهم، بس يتورط في فهم السياقات الثقافية واللهجات والتعابير المجازية اللي عندنا.
مقارنة بالمنافسين:
- ما فيه زود: في أغلب الاختبارات القياسية، أداءه قريب من GPT-4، ما فيه شي مميز يخليك تحوّل عليه.
- ناقص أدوات متكاملة: يفتقر لنظام بيئي متكامل من الأدوات والإضافات، عكس اللي نشوفه عند OpenAI أو Google.
في النهاية هذي ملاحظات بناءً على طبيعة هذي النماذج
من وجهة نظرك، هل هذي العيوب تخلي Kimi K3 خيار ثانوي لكم بالسوق بالتحديد؟