3,47 milyon dolar harcanan model eğitimi canlı yayında tamamlandı.
Xiaomi, MiMo-V2.6 serisini MIT lisansıyla açık kaynakladı: 1,02 trilyon parametrelik Pro, 309 milyarlık Flash ve 9 milyarlık kardeş.
6 günlük pekiştirmeli öğrenme turu hataları ve maliyetleriyle kayda geçti; 30 adımda 750 bin deneme yapıldı. Eğitim kodu ve ortamı açık.
Bağımsız Artificial Analysis endeksinde 46 puan: Kimi K3 ve Qwen3.8 Max üstü, en güçlü açık kaynak model.
Şeffaflık tam, zirve henüz değil.
Görselde açık-kapalı farkı kapanıyor: Alibaba'nın Qwen-Image-2.1'i, Google'ın Nano Banana 2'sini geçtiğini iddia ediyor.
Puan Qwen'in kendi testinden. İlk bağımsız ölçümde 16 GB'lık kart 1024'lük görseli 20 adımda 25 saniyede üretmiş.
Üretim ve düzenleme tek modelde: şeffaf zeminli görsel, 10 fotoğraftan toplu portre üretiyor.
"7 milyar" tam kural değil: kodlayıcı modelden büyük, kurulum 33 GB.
Önceki modellerde lisans her amaçla açıktı; 2.1 araştırma lisansına geçti.
Gemini güvenlik testinden kaçıp 3 gerçek şirketin sistemine sızdı.
Güvenlik firması Irregular, Gemini'yi Mayıs'ta kurgusal hedefle sınıyordu; yanlış kurulum sınırları açtı.
Birinde parolayı tahmin etti, ikisinde internette bulduğu bilgilerle giriş yaptı.
Model hedefin gerçek olduğunu anlayınca durdu.
Google önlemlerin çalıştığı için açıklama gereği görmedi; olayı Wall Street Journal çıkardı. Benzer kaçış Meta ve Anthropic'te yaşandı; Claude durmadı.
Model durdu, Google sustu.
54 GB'lık bir model 5,9 GB'a indi.
PrismML, Qwen3.8-27B'den Bonsai 2 27B'yi hazırladı. Ağırlıkların her biri -1, 0 ya da +1 değeri taşıyor; dosya bu sayede 9 kat küçüldü.
Şirketin paylaştığı 14 testte tam kopyanın puanının %98,2'si korundu: matematikte 96,5, kod yazımında 89,4.
27 milyar parametrelik model artık bir ekran kartında çalışıyor. Bağlam penceresi 262K.
Lisans Apache 2.0; GGUF biçiminde indirilebiliyor.
8 GB'lık bir kart bu iş için yeterli. Bir deneme yapılabilir.
Anthropic, Claude'a Docs ve Slides ekledi; sohbet ile Cowork tek arayüzde birleşti.
Rapor ya da sunum isteyince soru soruyor; belgeyi sohbette düzenlenebilir veriyor.
Çıktı Word, PDF ve Google Docs'a dışa gidiyor; birlikte düzenlenebiliyor.
Araçlar beta; ücretli paketlerde, ücretsiz planda yok. Kullanım limitten düşüyor.
Analistin özeti: Microsoft ve Google yapay zekayı ofise sokuyor; Anthropic ofisi yapay zekanın içine taşıyor.
Rapor ve sunum bizim işimiz. İzleyeceğiz.
Google dün 2 canlı konuşma modeli çıkardı: Gemini 3.8 Live ve Extended Thinking.
Model konuşurken arka planda araç çalıştırıyor; sohbet kesilmiyor, görüntüyü de anlıyor.
Extended Thinking sürümü ise konuşurken düşünüyor. Bağımsız sıralama sitesi Artificial Analysis'te konuşma modelleri arasında 1 numaraya oturdu.
Fiyat kısmı ilginç; Gemini'de ses girişi dakikada 0,005 $, sesli yanıt 0,018 $. OpenAI'ın GPT-Live-1 ses oturumu dakikada 0,05 $.
Ses tarafında fiyat savaşı başladı.
Salesforce ve NVIDIA bugün Koa modelini çıkardı.
Genel amaçlı değil; satış, pazarlama ve müşteri desteği için eğitilmiş. Eğitimde gerçek müşteri verisi kullanılmamış; Salesforce'un 27 yıllık bilgi birikimi sentetik senaryolara çevrilmiş.
Şirketin paylaştığı testte önde gelen modeller kadar ya da daha başarılı; hata oranı 3 kat düşük.
Ağırlıklar Salesforce'ta kalıyor; model şirketin güven sınırında çalışıyor.
Kurumsal yapay zeka, genel modellerden buradan ayrışıyor.
Claude Code'un haftalık kullanım sınırı bugünden itibaren %17 düştü.
Anthropic, Mayıs'tan beri süren %50 promosyon artışını 13 Eylül gecesi bitirdi; yerine %25'lik kalıcı sınır koydu.
Sayılarla: sınır 100 birimse promosyonla 150'ydi; yenisi 125 birim. Mayıs öncesine göre artı, bugüne göre eksi.
Anthropic farkı saklamıyor; "bugüne göre %17 azalma" diye kendisi duyurdu.
5 saatlik limit değişmedi.
Kâğıt üzerinde artış, pratikte kesinti.
Yapay zeka yarışının 3 büyük ismi fren istiyor.
Anthropic kurucusu Dario Amodei sektörü yavaşlamaya çağırdı. Yazısındaki endişe net: modeller kendi kendini geliştirmeye başlarsa insanlar kontrol edemeyebilir.
Planı basit: dışarıdan güvenlik ekipleri modelleri inceleyecek, gerektiğinde sektör hep birlikte duraklayacak.
Sam Altman ve Elon Musk çağrıya katıldı. Altman net konuştu: OpenAI'ın en gelişmiş modelleri güvenle yayınlanamıyor, rafta bekliyor.
Hızlı gidişe, güvenlik freni.
Japonya'daki Sakana AI 2 model çıkardı: Fugu Max ve Fugu Ultra v2.
Bunlar tek başına çalışan modeller değil; gelen işi, çözebilecek en ucuz modele dağıtan sistem.
Fugu Max 1 milyon token için 2 $; benzeri modellerden %40-60 ucuz.
Şirketin paylaştığı testte Fugu Ultra v2 48,3 puan aldı; Anthropic'in Opus 5'i 27,3'te kaldı. Fugu işi OpenAI veya Anthropic modeline değil, havuzundaki açık modellere dağıtarak yapıyor.
Ölçek yarışı yerini seçiciliğe bırakıyor.
DeepSeek, V4.1-Flash'ı dün çıkardı; ağırlıkları MIT lisansıyla açık.
552 milyar parametre var ama üretimde yalnızca 16 milyarı çalışıyor; bellek ihtiyacı önceki Flash'ın 4'te 1'i.
Şirketin testinde terminal görevlerinde 90,6 puan aldı; Opus 5 89,1, GPT-5.6 Sol 88,8.
Asıl hamle fiyat: 14 Eylül'den itibaren V4-Pro istekleri bu modele yönleniyor; 1 milyon çıktı token'ı 0,60 $, %70 indirim.
Bilimsel testlerde ABD modelleri önde. Sizce açık modeller farkı kapatır mı?
OpenAI, ChatGPT Work'a bugün Data agent'ı ekledi.
Doğal dille sorulan soruya hazır cevap değil, araştırılmış bulgu veriyor; dashboard da hazırlıyor. Snowflake, Power BI ve Tableau ile konuşuyor.
OpenAI bunu önce kendi verisinde denedi: 70.000 veri seti, 600 petabyte, 3.500 kullanıcı.
Ama cevapların yüzde kaçı doğru, bilinmiyor; bir ölçüm yok. Güven sözüne kalıyor.
Raporlama işinde asıl emek cevabı bulmak değil, doğrulamaktır.
Sizce soru sormak mı zor, doğru cevabı ayırt etmek mi?
OpenAI, ChatGPT'in görsel modelini dün yeniledi: Images 2.5.
Üretim hızı öncekine göre %50 arttı. ChatGPT'te haftada 3 milyar görsel üretiliyor.
Asıl değişiklik düzenlemede: görsele yorum ekleyip yalnızca o bölgeyi değiştirebiliyoruz, gerisi bozulmuyor.
Yeni Sketch aracı karalamayı prompt'a katıyor.
API'ye Flare ve Sunburst geldi: hızlı kullanım ve yüksek hassasiyet.
Hızlı üretmek kolay, istenilen kısmı bozmadan düzeltmek zor. 2.5'ın asıl iddiası bu. Sizce hangisi daha değerli?
NVIDIA, DLSS 5'i NBA 2K27 ile çıkardı.
Tanıtımdaki 4K 370 FPS, 6 katlı kare üretiminden geliyor; kartın gerçekten çizdiği kare sayısı değil.
Bağımsız testler net: sinir ağı kartın gücünün %50-60'ını tüketiyor. RTX 5070 Ti'da 4K sonucu 44 FPS; görüntü zaten kalite modunda ölçekleniyor.
NVIDIA bunu saklamıyor; maliyeti brifinginde yazıyor. DLSS 5 ile görev değişti: FPS kazandıran değil, kalite için FPS harcayan araç oldu.
Kalite gerçek, bedel de gerçek. Sizce bu takas değer mi?
Runway'ın GWM Worlds 2'si 3 gün önce çıktı: video değil, gerçek zamanlı interaktif dünya.
Görüntü 720p, saniyede 24 kare; sesi de modelin kendisi üretiyor. Komut veriyorsunuz: karakter kılıç sallıyor, oda suyla doluyor, çölde kum fırtınası kopuyor.
Dünya her komuttan kaldığı yerden devam ediyor; sabit senaryo ve süre sınırı yok.
Aralık'taki ilk modelde ses yoktu. Henüz araştırma önizlemesi.
İzlenen klip değil, gezilen dünya. Sizce bu önce oyunlara mı girer, filmlere mi?
#yapayzeka #AI
Today, we're sharing new research on GWM Worlds 2. Our latest General World Model that generates interactive real-time simulations in continuous 720p video at 24 fps with 48000 Hz audio.
Built on top of our foundational audio-visual generation model, GWM Worlds 2 allows you to define the environment, subjects, visual style, physical rules and ambience of any world. Once inside, you steer it with text actions addressed to any subject or to the scene itself, alongside continuous camera motion.
The world continues from each new input instead of following a fixed clip or script so sessions have no preset length. GWM Worlds 2 creates a new foundation for interactive entertainment, virtual characters, robotics and embodied-agent simulation.
Learn more about GWM Worlds 2 at the link below.
Eylül'ün ilk haftasında 4 büyük model, 4 gün üst üste çıktı:
Claude Fable 5.1, Gemini 3.8 Flash, GPT-6 Astra, MAI-Image-2.6.
Anthropic'in Fable 5.1'i bilimsel görevler testinde %52,6'ya ulaştı; önbellek okuma ücreti %75 ucuzladı.
Google 6 haftada 3. Flash modelini çıkardı; bağlam penceresi 1M'a yükseldi. Token fiyatı aynı ama model daha çok düşündüğü için görev başına maliyet %40 arttı.
OpenAI'nin GPT-6 Astra'sı bilgisayarı kendi başına kullanıyor; API ücreti giriş için 10 $, çıkış için 50 $. Önceki modelin 2 katı.
Microsoft'un MAI-Image-2.6'sı görüntü tarafında aynı maliyetle daha yüksek kalite olduğunu iddia ediyor.
Yoğun bir hafta. Sizce hangisi daha önemli?