Kimi K3 è terzo al mondo, vicino a Fable, e costa un quarto. Intanto esce il primo open weight americano dopo Llama 4: Thinking Machine Lab di Mira Murati. È un cambio di scena nei modelli di frontiera.
Torniamo sul mercato dei modelli con Stefano, Paolo e Alessio. Moonshot AI ha rilasciato Kimi K3: 57 nell'indice di Artificial Analysis (tra Opus 4.8 a 56 e Fable a 60), ma con metà dei token e a un quarto del costo di Fable. I modelli cinesi chiudono il gap di settimana in settimana, e Paolo chiude con una sintesi: fine estate un fable level ce l'abbiamo tutti.
Parliamo anche dell'articolo di Demis Hassabis sulla governance dell'AI e sull'AGI (una questione di mesi o al massimo di cinque anni), del perché Thinking Machine Lab punta sul fine tuning di modelli specializzati per mix-of-agents, del caso della CLI di Grok che sfilava dati dai computer degli utenti, e della posizione di Torvalds: l'AI è uno strumento, è il 2026, chi non vuole usarla si fork il kernel.
Links:
https://x.com/demishassabis/status/2076957440109625718
https://x.com/maeste/status/2077733742584398029
https://x.com/miramurati/status/2077455974743593100?s=20
Per chi costruisce con LLM e guarda i costi di inferenza, è una puntata da non perdere.
CAPITOLI
00:00 Modelli nuovi e feedback dal vivo
06:58 Hassabis: AGI tra pochi mesi
13:52 Kimi K3: i cinesi chiudono il gap
22:36 Terzo al mondo: Kimi K3 in classifica
27:36 Costi e token: un quarto di Fable
31:47 Fable: memoria, rifiuti e switch a Opus
40:19 Provenienza umana, Fable e il business
44:53 Thinking Machine Lab: l'open weight di Murati
49:39 Inklings: open weight americano e fine tuning
54:14 Grok CLI ruba dati: bug o training?
57:40 Torvalds: l'AI è qui, usatela
1:05:54 La mossa 37 del codice
Ascolta su Spotify: https://open.spotify.com/episode/3SLjYEq7cLYgIkJbNZgdSJ?utm_source=youtube&utm_medium=description&utm_campaign=ep63_drop
Sito: https://risorseartificiali.com/?utm_source=youtube&utm_medium=description&utm_campaign=ep63_drop
Iscriviti al canale per non perdere le prossime puntate.
#63