Anthropic apre il codice di Claude Commerce Agents: due agenti AI per e-commerce che nei pilot hanno prodotto carrelli più grandi del 35% e completamenti d'acquisto in crescita del 60%.
Perché alcuni modelli generativi usano 100 step e altri solo uno? Un nuovo paper offre finalmente una spiegazione teorica sistematica, con ricadute pratiche su costi e architetture.
MiniMax H3 Max punta a essere abbastanza veloce da alimentare giochi interattivi in tempo reale. La latenza di inferenza diventa un criterio di prodotto, non solo tecnico.
Otto anni di ricerca mostrano che i modelli linguistici costruiscono strutture simboliche nei loro vettori: il confine tra statistica e ragionamento simbolico è meno netto di quanto si pensasse.
Pollen Robotics porta sul mercato un robot bipede addestrabile via simulazione a soli 399 dollari: una soglia di prezzo che potrebbe cambiare chi ha accesso alla robotica umanoide.
Google ha rilasciato GlucoFM, un modello AI che predice i pattern glicemici da dati di wearable senza richiedere etichette cliniche. Margine di +4,1 punti sui benchmark esistenti.
LAION ha pubblicato un dataset video open source da 10 milioni di ore per l'addestramento di modelli multimodali: una risorsa che era quasi esclusivo appannaggio dei grandi lab privati.
Anthropic ha rilasciato uno standard che permette agli agenti AI di controllare strumenti fisici da laboratorio. I primi test mostrano risultati importanti in ricerca farmaceutica e informatica quantistica.
Cerebras avvia le spedizioni del CS-4: inferenza fino a 30 volte più rapida delle GPU, con latenza wafer-to-wafer di 2 microsecondi e oltre 1.000 token al secondo su modelli da 10 trilioni di parametri.
I modelli AI frontier sono quasi 3 volte più efficaci dei professionisti umani nella raccolta fondi. Uno studio su 6.923 persone misura il vantaggio persuasivo dell'AI in contesti reali.