OpenAI, ileri seviye yapay zeka modellerini test ettiği sırada kontrolü kaybetti.
• Yapay zeka modelleri, test ortamından çıkıp internete erişim sağlamayı başardı.
• Kendilerine verilen testi tamamlamak için Hugging Face adlı yapay zeka platformunu hackledi.
• OpenAI, kısa sürede olayı kontrol altına aldı.
• Bu, AI güvenlik tarihinde benzeri görülmemiş bir olay olarak kaydedildi.
Claude Code on desktop now works with the iOS simulator.
Build and run your iOS app, and the simulator opens in a panel right next to your conversation. Available today in public beta.
Coding Benchmark 🔥 Faz 1: Modelin tek prompt'ta, çalışabilir ve uygulanabilir bir proje oluşturmasını hedefledim.
Models:
- Kimi K3 Thinking Max
- GPT5.6 Sol Ultra
- Fable 5 Max
- GLM 5.2 Max
Task: Kara delik ışık bükmesi (geodesic raytracer) - Gargantua
Detaylar: Bu görevde, tek bir HTML dosyası içinde (Three.js gibi harici kütüphane kullanmadan, raw WebGL2 ile) Schwarzschild kara deliklerini (örneğin "Gargantua") fiziksel olarak doğru şekilde ekrana getiren bir gerçek zamanlı ışın izleyici yazmak isteniyor. Tüm fizik simülasyonu, jeodezik integrasyon ve render pipeline'ı 60 FPS hedefiyle tek bir WebGL2 fragment shader'ının (GLSL ES 3.00) içinde çalışmalı. Null jeodezik denklemleri 4. derece Runge-Kutta ile çözülmeli, olay ufku, foton küresi, akresyon diski, kütleçekimsel lensleme, Doppler beaming ve kütleçekimsel kırmızıya kayma efektleri uygulanmalı. Ayrıca fare ile kamera kontrolü ve cam-morf cyberpunk stilde parametre slider'ları içeren bir kontrol paneli isteniyor; teslimat %100 eksiksiz, derlenebilir ve "siyah ekran/NaN" içermeyen tek bir dosya olmalı.
🎉Kazanan: GLM 5.2 Max🎉
Sebep: Bu benchmark’ta “crux” noktası artık sadece görsel kalite değil; numerical correctness + pressure projection doğruluğu + boundary handling + solver disiplini idi. GLM 5.2 Max bu dört alanı en dengeli sağlayan model: gerçek MAC grid, doğru divergence–gradient eşleşmesi, implicit diffusion + semi-Lagrangian + projection pipeline’ı en temiz kuran çözüm. Özellikle Poisson çözümünde SOR ve obstacle-aware stencil kullanımı, projection sonrası divergence’ı en düşük seviyede tutuyor.
Fable görsel olarak çok güçlü ama projection residual yüksek. GPT 5.6 Sol Ultra en iyi ürün/mimari ama fiziksel doğrulama tarafında “mass correction” gibi hilelere başvuruyor. GLM ise en “dürüst fizik + doğru numerics” çözümü.
Genel Puanlama:
- GLM 5.2 Max — 92/100
- GPT 5.6 Sol Ultra — 90/100
- Kimi K3 Thinking Max — 85/100
- Fable 5 Max — 80/100
Deepseek v4 Flash'a kapsamlı bir rapor dosyasını (PHP ile 1 milyondan fazla satırı olan DB'den veri çekiyor ve analiz yapıyor) incelemesini ve işlevini bana anlatmasını istedim. Sorunsuz bir şekilde raporladı ve istediğim refactor işlerini planlayarak onayıma sundu.
Maliyeti: $0.0070
Big news for AI on a budget. GLM 5.2 Colibri int4 is a Mixture of Experts model that runs entirely on your CPU. No GPU needed. It's fast, efficient, and opens up advanced language capabilities to anyone with a standard computer. This is a game changer for offline AI.
AI kod yazabilir. Ama yazılımın sorumluluğunu alamaz😉
Ciddi projelerde AI’ı geliştiricinin yerine değil, geliştiricinin yanında kullanın.
1-) Mimariye siz karar verin.
2-) Değişiklikleri küçük ve kontrollü tutun.
3-) PR Diff’lerini dikkatlice inceleyin.
4-) Test, Benchmark ve Race Test’i zorunlu tutun.
AI’a sadece “Kodu yaz.” demeyin.
Önce şunu isteyin:
“Bu değişikliğin mimariye etkisini, olası risklerini ve yan etkilerini analiz et.”
Kod yazmak artık kolay.
Üretimde yıllarca yaşayacak kod yazmak ise hâlâ yazılım mühendisliğidir. 🌻
Öncelikle beni takip edip inanan tüm dostlarıma, tüm tebrik edenlere çok teşekkür ederim 🙏🏻❤️ 3.5 sene önce LLM’ler ile tanışınca hayatımı adayacağım bir şeye bulaştığımı anlamıştım. Bu nedenle tüm birikimimle oldukça güçlü bir workstation oluşturmuştum. Ardından yetmemeye başlayınca Enterprise seviye GPU Kiralayıp finetuning çalışmalarımda dene yanıla baktım ki para yetiştiremeyince bu işin homelab’e çıkacağını sezerek 2 yıldır yanımdaki bu sistemimi oluşturmaya başladım. Birçok olumsuz yoruma, borca ve planlarımı konuştuğum insanların %99’unun inanmamasına rağmen, emeklerimi güzel sonuçlarla taçlandırmak çok güzel. Umarım kendini adayıp ilerleyen ve gerekirse dünyayı karşısına alan herkes bu güzelliği yaşar. Sevgilerimle ❤️
Dostlar Qwen3.6-35B modelini Siber Güvenlik özelinde finetune ederek oluşturduğum yeni Titus-35B-A3B parametreli MoE mimarili modelim Fudan Üniversitesi ve University of Chinese Academy of Science’ın geliştirdiği en kapsamlı Siber Güvenlik Ai Benchmark’larından CS-Eval'de Private ve Public modeller arasında Global'de 9. ve Açık Kaynaklı modeller arasında 1. en iyi LLM oldu 🎉🔥 Acta non Verba! 🔥🦾⚔️
Türklerin İslam’la tanışmasından günümüze kadar geçen sürenin Türkçü gözüyle özeti…
Yine alıcı ismine imzalı…
Sadece ön satış için
@yaziyolcusu ‘nun Göktürkçe hat eserlerinden kitap ayracı hediyeli.
Kapak görselleri yine Hakan Cengiz’in eseri.
Emeği geçen herkese, okuyucuya ve hediye ederek desteklerini esirgemeyen dostlara teşekkür ederim.
Buradan alınır:
https://t.co/0AalDpx4Fv