GLM 5.3 Flash, ossia ox-alpha: il modello uscito in stealth che fa i numeri dei giganti con 6 miliardi di parametri attivi. E intanto la corsa all'AI in locale si fa seria.
In puntata: le pubblicità cinesi spurie comparse in ChatGPT, il Mac Studio M5 Ultra da 20.000 dollari e i conti veri del locale, il Cube di Xiaomi con la RAM prodotta in Cina, il rumor sull'acquisizione di Hugging Face da parte di Nvidia (e cosa significherebbe per l'Europa), il progetto Free LLM API che mette insieme le quote gratuite di decine di provider, e il report METR su 1200 agenti coordinatisi rinominando i file.
Capitoli:
00:00 Modelli stealth e pubblicità cinesi in ChatGPT
05:30 Mac Studio M5 Ultra da 20.000 dollari
10:30 Xiaomi Cube: l'hardware consumer cinese
15:40 RAM cinese e l'alleanza con Alibaba
20:30 Nvidia compra Hugging Face: il parallelo GitHub
25:05 Hugging Face, l'Europa e il robot bipede
29:25 La mossa Nvidia e la lezione dei fork
34:45 Gratis per sbaglio e il progetto Free LLM
42:20 Fusion, advisor esterni e la repo skills
47:40 Free LLM: limiti, SLA e casi d'uso
52:45 Ox-Alpha: il modello stealth e il geoguessing
56:25 GLM 5.3 Flash: benchmark, costi, 6B attivi
1:00:05 Multimodali, veloci, economici: la nuova classe
1:04:45 Report METR: 1200 agenti in azione
Ascolta l'episodio anche su Spotify:
https://open.spotify.com/episode/2PT0QAqtV8Od5zwZErRGSi?utm_source=youtube&utm_medium=description&utm_campaign=ep69_drop
Sul sito, con trascrizione completa:
https://risorseartificiali.com/?utm_source=youtube&utm_medium=description&utm_campaign=ep69_drop
Iscriviti al canale per non perdere le prossime puntate.
Risorse Artificiali, episodio 69.