Le notizie della settimana
2026-08-15
AI Daily Brief
Google lancia Gemini 3.7 Flash: velocità a metà prezzo
Google ha rilasciato Gemini 3.7 Flash, un modello progettato per la velocità piuttosto che per le prestazioni di frontiera, raggiungendo i 340 token al secondo. Sebbene il prezzo sia stato dimezzato, rimane circa otto volte più costoso delle opzioni ultra-economiche, posizionandosi in una zona intermedia tra costo e intelligenza. Questo lancio evidenzia una frammentazione della 'corsa ai modelli', dove la velocità sta diventando un fattore competitivo cruciale.
- Gemini 3.7 Flash raggiunge 340 token al secondo, più del doppio di GPT-5.6 Luna.
- Il prezzo è stato dimezzato ma il modello è ancora circa 8 volte più costoso di alternative economiche.
- Gli sviluppatori in produzione riportano guadagni reali in efficienza per lavori di codifica interattivi.
- Il mercato AI si sta frammentando, con la velocità che emerge come nuova dimensione competitiva.
- Google scommette che i clienti saranno disposti a pagare un premium per la rapidità di esecuzione.
Leggi la fonte
2026-08-15
AI Daily Brief
I modelli AI cinesi non sono più economici come sembrano
Uno studio di AlphaSense ha rivelato che i modelli AI statunitensi come GPT-5.6 Sol e Opus 4.8 sono in realtà più economici e performanti rispetto ai modelli cinesi come Kimi K3 e GLM-5.2, se valutati sul 'costo per compito'. Nonostante un prezzo per token più alto, i modelli occidentali si sono dimostrati più efficienti nell'uso dei token, rendendo il costo totale per le aziende inferiore. Questo suggerisce che gli acquirenti aziendali dovrebbero concentrarsi sull'efficienza complessiva piuttosto che sul prezzo per token.
- GPT-5.6 Sol è risultato il 13% più economico e il 20% migliore di Kimi K3 su compiti di analisi finanziaria.
- Opus 4.8 ha superato entrambi i modelli cinesi a un prezzo comparabile.
- I modelli con un prezzo per token più alto possono essere più economici complessivamente grazie a una maggiore efficienza nell'uso dei token.
- Le aziende dovrebbero valutare i modelli in base al costo per compito ('cost-per-task') anziché al prezzo per token ('sticker price').
- La percezione di maggiore economicità dei modelli cinesi non si traduce in risparmi reali per gli acquirenti enterprise.
Leggi la fonte
2026-08-15
AI Daily Brief
OpenAI lancia 'Ultrafast' per GPT-5.6 Sol: 750 token al secondo
OpenAI ha introdotto la modalità 'Ultrafast' per GPT-5.6 Sol, promettendo intelligenza di frontiera a una velocità 14 volte superiore al normale, raggiungendo i 750 token al secondo. Questa modalità, che sfrutta l'hardware di Cerebras, è attualmente disponibile solo tramite API per clienti selezionati. OpenAI la posiziona per flussi di lavoro sensibili alla latenza, come la voce in tempo reale e il supporto clienti, indicando che la velocità bruta sta diventando un nuovo asse competitivo nella corsa ai modelli AI.
- GPT-5.6 Sol raggiunge 750 token al secondo, più del doppio di Gemini 3.7 Flash.
- La modalità 'Ultrafast' è 14 volte più veloce della velocità normale del modello.
- Utilizza hardware Cerebras ed è disponibile solo tramite API per clienti selezionati.
- È destinata a casi d'uso che richiedono bassa latenza, come assistenza clienti e sicurezza.
- La velocità è sempre più un fattore chiave di differenziazione nel mercato dei modelli AI.
Leggi la fonte
2026-08-15
AI Daily Brief
OpenAI perde il secondo dirigente in una settimana, preoccupazioni per l'IPO
Denise Dresser, Chief Revenue Officer di OpenAI, ha annunciato la sua partenza dopo soli nove mesi, seguendo l'addio di Brad Lightcap nella stessa settimana. Queste dimissioni, insieme ad altre recenti uscite, alimentano le preoccupazioni sulla stabilità della leadership in vista di una IPO che è stata posticipata al prossimo anno. La narrazione è che il Presidente Greg Brockman stia costruendo il suo team, ma il turnover dirigenziale potrebbe influenzare la fiducia degli investitori.
- La CRO Denise Dresser lascia OpenAI dopo nove mesi, seguendo Brad Lightcap.
- Dresser era stata assunta per rafforzare la credibilità aziendale in vista dell'IPO.
- Il suo sostituto, Dali Rajic, è già stato nominato.
- Le partenze alimentano preoccupazioni sul turnover dirigenziale e sulla stabilità interna.
- L'IPO di OpenAI è stata posticipata al prossimo anno, e queste dinamiche potrebbero complicare il processo.
Leggi la fonte
2026-08-14
The Rundown AI
OpenAI presenta 'Ultrafast': un balzo in avanti per la velocità dei modelli di frontiera
OpenAI ha svelato 'Ultrafast', un nuovo livello API alimentato da Cerebras che accelera le risposte del suo modello di punta GPT-5.6 Sol fino a 14 volte, raggiungendo i 750 token al secondo. Questa partnership, annunciata a gennaio, mira a fornire una potenza di calcolo focalizzata sulla velocità. Sebbene il prezzo non sia ancora stato rivelato e l'accesso sia solo su invito, questa innovazione promette di rivoluzionare i flussi di lavoro e l'interazione con l'AI, specialmente in contesti dove la latenza è critica.
- Il modello GPT-5.6 Sol raggiunge fino a 750 token al secondo con la modalità 'Ultrafast'.
- La velocità è 14 volte superiore al ritmo normale del modello, grazie alla partnership con Cerebras.
- Un membro dello staff OpenAI ha descritto la velocità come 'genuinamente barare al mio lavoro'.
- La modalità 'Ultrafast' è attualmente una preview API solo su invito, senza prezzo di listino.
- Questa innovazione potrebbe cambiare radicalmente l'interazione con l'AI, specialmente per agenti e flussi di lavoro sensibili alla latenza.
Leggi la fonte
2026-08-14
AI Daily Brief
Cognition in trattative per un finanziamento da 40 miliardi di dollari
Cognition, la startup dietro agli agenti di codifica, sta cercando un nuovo round di finanziamento con una valutazione stimata di 40 miliardi di dollari, un aumento di quasi il 50% in un solo trimestre. Questa crescita è supportata da un raddoppio del fatturato annuale a un miliardo di dollari, spinto dalla forte domanda per i suoi agenti di codifica. Il successo di Cognition, paragonato all'acquisizione di Cursor da parte di SpaceX, evidenzia il valore crescente e la frenesia nel settore degli agenti AI per lo sviluppo software.
- Cognition sta negoziando un nuovo round di finanziamento con una valutazione di 40 miliardi di dollari.
- La valutazione sarebbe aumentata di quasi il 50% in tre mesi, da 26 miliardi di dollari.
- Il fatturato annuale della società è raddoppiato, raggiungendo un miliardo di dollari.
- La domanda per gli agenti di codifica è in forte crescita.
- Il settore degli agenti AI per la programmazione sta vivendo un boom di investimenti e acquisizioni.
Leggi la fonte
2026-08-14
AI Daily Brief
Lovable raccoglie 400 milioni di dollari, si posiziona come piattaforma di creazione software
Lovable ha annunciato un finanziamento di Serie C da 400 milioni di dollari, raggiungendo una valutazione di 13,3 miliardi di dollari. L'azienda si sta ridefinendo come una piattaforma di creazione software per chi è più vicino a un problema, con quasi l'80% degli utenti che costruiscono un'attività o un progetto secondario da monetizzare. Questo spostamento indica una transizione da un approccio di 'vibe coding' a una piattaforma che mira a trasformare le piccole imprese digitali, offrendo strumenti intuitivi per costruire e gestire attività.
- Lovable ha raccolto 400 milioni di dollari in un round di Serie C, con una valutazione di 13,3 miliardi di dollari.
- L'azienda si descrive ora come una piattaforma di creazione software per persone vicine a un problema.
- Quasi l'80% degli utenti sta costruendo attività o progetti secondari con l'intento di monetizzare.
- Più di un terzo degli utenti sta già generando entrate.
- Lovable si sta allontanando dal 'vibe coding' per diventare una piattaforma che abilita le piccole imprese digitali.
Leggi la fonte
2026-08-14
AI Daily Brief
Boom della domanda di Neocloud: CoreWeave e Nebius superano le aspettative
CoreWeave e Nebius hanno riportato risultati finanziari eccezionali, superando ampiamente le aspettative degli analisti. I ricavi di CoreWeave sono raddoppiati a 2,6 miliardi di dollari nel trimestre, con un arretrato di 104 miliardi di dollari. Nebius ha registrato una crescita dei ricavi del 454% a 582 milioni di dollari. Questi risultati indicano una domanda inarrestabile di capacità di calcolo AI, con i 'neocloud' che fungono da indicatori chiave della domanda marginale, anche in un periodo di 'austerità dei token'.
- CoreWeave ha raddoppiato i ricavi a 2,6 miliardi di dollari nel trimestre, con un arretrato di 104 miliardi di dollari.
- Nebius ha registrato una crescita dei ricavi del 454% a 582 milioni di dollari.
- Entrambe le aziende hanno superato le previsioni degli analisti, con le azioni in forte rialzo.
- I 'neocloud' sono indicatori chiave della domanda di calcolo AI, che continua a crescere.
- La domanda di capacità di calcolo AI non mostra segni di rallentamento, nonostante le strategie di ottimizzazione dei costi.
Leggi la fonte
2026-08-14
AI Daily Brief
Tencent triplica le spese in conto capitale per l'infrastruttura AI in Cina
Tencent ha investito 7,8 miliardi di dollari in infrastrutture AI nel trimestre precedente, triplicando le sue spese in conto capitale per potenziare le sue flotte di training e inferenza. Sebbene questa cifra sia ancora modesta rispetto ai giganti statunitensi come Meta (31,9 miliardi di dollari), segna un chiaro cambiamento di atteggiamento da parte delle aziende tecnologiche cinesi verso l'espansione dei data center. Tencent sta prioritizzando le proprie esigenze interne, ma questo boom di investimenti cinesi potrebbe avere un impatto significativo sull'ambiente globale degli investimenti.
- Tencent ha speso 7,8 miliardi di dollari in infrastrutture AI nell'ultimo trimestre.
- Le spese in conto capitale sono quasi triplicate, destinate a training e inferenza AI.
- Questo segna un impegno crescente delle aziende cinesi nella costruzione di data center per l'AI.
- Tencent sta dando priorità alle proprie esigenze interne di calcolo AI.
- Il boom di investimenti cinesi potrebbe influenzare l'ambiente globale degli investimenti in AI.
Leggi la fonte
2026-08-14
AI Daily Brief
Samsung ottiene enormi guadagni dall'uso di Claude Code nella progettazione di chip
Samsung ha registrato un successo straordinario nei primi tre mesi di integrazione di Claude Code nel suo stack software per semiconduttori. Il personale di sviluppo ha ridotto il tempo per completare compiti complessi come la verifica di system-on-chip da tre mesi a soli due giorni. Un esempio ha visto un ingegnere al secondo anno completare un compito di un mese in un solo giorno, dimostrando come l'AI possa permettere a dipendenti junior di contribuire ben oltre la loro esperienza, evidenziando l'adozione 'a macchia di leopardo' dell'AI in azienda.
- Claude Code ha ridotto il tempo per la verifica di system-on-chip da 3 mesi a 2 giorni.
- Un ingegnere junior ha completato un compito di un mese in un solo giorno.
- I guadagni di efficienza sono stati riscontrati in compiti altamente personalizzati.
- Questo dimostra come l'AI possa amplificare le capacità dei dipendenti, anche quelli meno esperti.
- L'adozione dell'AI in azienda sta avvenendo in modo 'a macchia di leopardo', con vittorie significative in aree specifiche.
Leggi la fonte
2026-08-14
The Batch
La Mappa delle Competenze di Ingegneria AI di Andrew Ng
Andrew Ng ha presentato una 'Mappa delle Competenze di Ingegneria AI', identificando quattro aree chiave per i professionisti del software: costruzione e deployment di applicazioni AI, fondamenti di ingegneria del software, uso di agenti di codifica e 'shaping the build'. Questa mappa, basata su un'analisi di oltre 10.000 offerte di lavoro e interviste con esperti, sottolinea come tutti gli sviluppatori debbano acquisire competenze AI per navigare il panorama tecnologico in evoluzione, dove l'AI permette di costruire software in modi radicalmente diversi rispetto al passato.
- Le quattro competenze chiave sono: costruire e distribuire applicazioni AI, fondamenti di ingegneria del software, utilizzare agenti di codifica e 'shaping the build'.
- L'analisi si basa su oltre 10.000 offerte di lavoro e decine di interviste con esperti del settore.
- Tutti gli sviluppatori, non solo gli 'ingegneri AI', avranno bisogno di queste competenze.
- Le applicazioni AI si distinguono per i loro output imprevedibili, richiedendo tecniche statistiche per la misurazione e la governance.
- L'uso efficace degli agenti di codifica richiede la comprensione dei loro limiti e la capacità di guidarli con precisione.
Leggi la fonte
2026-08-13
The Rundown AI
Grok 4.6 di SpaceXAI irrompe nel settore dei modelli di frontiera
SpaceXAI ha lanciato Grok 4.6, il suo nuovo modello di punta, che compete con opzioni di frontiera come Anthropic Fable 5 e OpenAI GPT-5.6 Sol, ma con un costo inferiore del 60%. Elon Musk ha dichiarato che è 'oggettivamente il numero 1 considerando intelligenza, velocità e costo'. Questo rappresenta un'enorme svolta per un modello che in passato era stato oggetto di scherno, e con Grok 4.7 in arrivo, SpaceXAI sta mettendo sotto pressione i suoi rivali sia sulle prestazioni che sui prezzi.
- Grok 4.6 ha ottenuto un punteggio di 61 sull'Intelligence Index di Artificial Analysis, superando Sol e avvicinandosi a Opus 5 e Fable 5.
- Il modello eccelle nel lavoro professionale e legale, e supera Sol in benchmark di codifica.
- Il costo è significativamente inferiore ai modelli di frontiera, a 2$/6$ per 1 milione di token.
- Elon Musk lo ha definito 'oggettivamente il numero 1 considerando intelligenza, velocità e costo'.
- Grok 4.7 è atteso tra 3-4 settimane e promette di superare tutti i modelli attuali.
Leggi la fonte
2026-08-13
Datapizza
La fiducia nell'AI è una scommessa epistemica: l'importanza dell'Explainable AI (XAI)
La newsletter di Datapizza esplora il concetto di Explainable AI (XAI), sostenendo che la fiducia nell'AI è una 'scommessa epistemica'. I modelli AI sono 'scatole nere' non perché i loro parametri siano invisibili, ma perché la loro complessità rende difficile comprendere il 'perché' delle loro decisioni. La 'Chain of Thought' si è rivelata inaffidabile come spiegazione interna. L'XAI è cruciale non solo per la conformità normativa (GDPR, AI Act) ma anche per l'affidabilità degli agenti, la capacità di correzione dei modelli e l'intercettazione di comportamenti nascosti, come dimostrato dai Natural Language Autoencoders di Anthropic.
- I modelli AI sono 'scatole nere' perché la comprensione dei loro meccanismi interni è complessa, non perché i dati siano inaccessibili.
- La 'Chain of Thought' è una spiegazione generata, non un resoconto fedele dei processi interni del modello, e quindi inaffidabile.
- L'XAI è fondamentale per la reliability degli agenti, l'accountability e la correzione chirurgica degli errori.
- Anthropic ha sviluppato i Natural Language Autoencoders (NLA) per tradurre le attivazioni interne in linguaggio naturale e verificarne l'affidabilità.
- Con gli NLA, i ricercatori hanno scoperto e corretto bug (es. un modello che rispondeva in russo) e persino modificato il piano di generazione di un modello (es. per le rime nelle poesie).
Leggi la fonte
2026-08-12
AI Daily Brief
Anthropic introduce watermark invisibili in tutto il testo generato dall'AI
Anthropic ha suscitato polemiche introducendo watermark invisibili in tutto il testo generato dai suoi nuovi modelli AI, inclusi quelli di Claude. Questi watermark, rilevabili da Anthropic e da rilevatori di terze parti, sono parte dell'impegno dell'azienda verso il Codice di Condotta dell'UE sui contenuti generati dall'AI. La controversia deriva dal fatto che i watermark sono incorporati nel testo stesso, non nei metadati, persistono attraverso il copia-incolla e alcune modifiche, e si applicano globalmente, sollevando interrogativi sull'integrità del testo e le implicazioni legali.
- Tutti i nuovi modelli Anthropic includono watermark invisibili nel testo generato.
- I watermark sono rilevabili da Anthropic e da strumenti di terze parti.
- L'iniziativa è parte dell'adesione di Anthropic al Codice di Condotta dell'UE sull'AI Act.
- I watermark sono incorporati nel testo, persistono attraverso copia-incolla e modifiche, e si applicano a livello globale.
- La mossa ha generato controversie per le potenziali implicazioni sull'integrità dei contenuti testuali e la libertà di modifica.
Leggi la fonte
2026-08-12
AI Daily Brief
Gemini di Google raggiunge un miliardo di utenti mensili
L'app Gemini di Google ha raggiunto un miliardo di utenti mensili, diventando il prodotto a più rapida crescita dell'azienda. Nonostante lo scetticismo sull'integrazione di Gemini in altri servizi Google, questo traguardo si riferisce specificamente all'app, con il 63% degli utenti che utilizza l'interfaccia vocale e 150 milioni di immagini generate al giorno. Questo successo suggerisce che la distribuzione può prevalere sulla qualità di frontiera dei modelli, poiché Google raggiunge un'enorme base di utenti anche senza avere un modello nella top 10 attuale.
- L'app Gemini ha raggiunto 1 miliardo di utenti mensili, il prodotto Google a più rapida crescita.
- Il 63% degli utenti utilizza l'interfaccia vocale di Gemini.
- Vengono generate 150 milioni di immagini al giorno tramite Gemini.
- Il successo dimostra che la distribuzione può essere un fattore più determinante della qualità di frontiera del modello per il mercato consumer.
- Molti utenti di Gemini potrebbero non essere consapevoli di utilizzare un modello non di punta.
Leggi la fonte
2026-08-12
AI Daily Brief
Manus torna indipendente dopo l'annullamento dell'accordo con Meta
Manus sta tornando a essere una società indipendente dopo aver finalizzato la separazione da Meta. L'acquisizione da 2 miliardi di dollari da parte di Meta, avvenuta a dicembre, era stata annullata ad aprile dalle autorità cinesi per motivi di sicurezza nazionale, preoccupate che un tale guadagno potesse incoraggiare le startup cinesi a cercare uscite in Occidente. La transizione richiederà la cancellazione di alcuni dati utente, ma l'azienda spera che l'indipendenza possa stimolare una maggiore innovazione rispetto a quanto avrebbe potuto fare sotto il gigante Meta.
- Manus torna indipendente dopo l'annullamento dell'acquisizione da 2 miliardi di dollari da parte di Meta.
- Le autorità cinesi hanno annullato l'accordo per motivi di sicurezza nazionale.
- La separazione comporta la cancellazione di alcuni dati utente generati dopo il 29 dicembre.
- I sistemi indipendenti saranno online dal 25 agosto.
- L'azienda spera che l'indipendenza favorisca una maggiore innovazione.
Leggi la fonte
2026-08-12
AI Daily Brief
La valutazione di OpenRouter da 10 miliardi di dollari scatena una guerra di offerte
La valutazione di OpenRouter, stimata a 10 miliardi di dollari, ha innescato una vera e propria guerra di offerte nel segmento dei 'router di token', con un interesse elevatissimo per le acquisizioni di infrastrutture da parte di grandi aziende software. Aziende come Snowflake, Baseten e Cloudflare sono sul mercato, e l'interesse si estende anche a piccole startup. Questo scenario indica che le aziende incumbent hanno deciso che la necessità di velocità supera la volontà di costruire internamente, spingendole ad acquisire rapidamente le tecnologie necessarie.
- OpenRouter è valutata 10 miliardi di dollari, scatenando una guerra di offerte nel settore dei router di token.
- Grandi aziende software come Snowflake, Baseten e Cloudflare sono interessate alle acquisizioni.
- Anche piccole startup stanno ricevendo proposte di investimento, acquisizione o partnership.
- Il mercato è favorevole ai venditori, con un'elevata domanda di infrastrutture AI.
- Le aziende incumbent preferiscono acquisire piuttosto che costruire internamente per accelerare l'integrazione delle tecnologie AI.
Leggi la fonte
2026-08-12
AI Daily Brief
Nvidia crea una piattaforma di finanziamento da 500 miliardi di dollari per i data center
Nvidia sta sviluppando una piattaforma di finanziamento da 500 miliardi di dollari per sostenere la costruzione e l'espansione di data center. Questa iniziativa mira a migliorare l'infrastruttura necessaria per l'addestramento e l'inferenza dei modelli AI, un'area in cui la domanda di capacità di calcolo è in costante aumento. L'impegno finanziario di Nvidia sottolinea la sua strategia di consolidare la propria posizione non solo come fornitore di chip, ma anche come facilitatore chiave dell'intera infrastruttura AI globale.
- Nvidia sta creando una piattaforma di finanziamento da 500 miliardi di dollari.
- L'obiettivo è migliorare e accelerare la costruzione di data center.
- Questo riflette la crescente domanda di infrastrutture per l'addestramento e l'inferenza AI.
- Nvidia si posiziona come attore centrale nell'ecosistema dell'infrastruttura AI.
- L'investimento massiccio evidenzia l'importanza strategica dei data center per il futuro dell'AI.