Gemini 4 Argon: Google torna in testa, ma lo provano prima i difensori cyber

5 min di lettura

Ascolta la rassegna in versione notiziario (3 min 10 s)

Google ha finalmente tirato fuori il suo nuovo modello di punta: Gemini 4 Argon è il primo vero salto di generazione dopo Gemini 3, e sulla carta si rimette davanti a OpenAI e Anthropic. Il dettaglio curioso è chi lo prova per primo: non noi sviluppatori, ma i difensori della sicurezza informatica. Nella rassegna di oggi ci sono anche OpenAI che accusa persone legate a Moonshot AI di aver provato a copiarle il ragionamento, la California che vieta i licenziamenti decisi solo da un algoritmo, Reddit che chiude RSS e API pubbliche per colpa dei bot, le proteine con la filigrana di DeepMind e DoorDash che ti fa ordinare la cena via SMS.

Gemini 4 Argon: Google torna in testa, ma parte dai difensori cyber

Nel post ufficiale Google presenta Argon come un modello pensato per lavori lunghi e complessi: sviluppo software, lavoro d’ufficio pesante tipo legale e finanza, e difesa informatica. I numeri dichiarati: 77,9% su DeepSWE v1.1, 68% su CWE-bench v1 (primo a pari merito), 91,7% su LVBench per la comprensione di video lunghi. La cosa che mi colpisce di più però è il limite di output: un milione di token, contro i 64mila di prima. Per chi fa migrazioni di codebase intere è un cambio di passo vero.

Il rilascio è prudente: per ora Argon arriva solo ai partner del programma Fairwind, cioè difensori cyber selezionati, e solo dopo arriverà ai clienti API a pagamento e agli abbonati Google AI Ultra. Il prezzo di lancio è di 2 dollari per milione di token in input e 10 in output, che poi saliranno a 4 e 20. Come racconta TechCrunch, Google rivendica il primo posto sull’indice di Vals davanti a GPT-6 Astra e ai modelli Claude. Da chi usa le API in produzione: i benchmark mi interessano fino a un certo punto, aspetto di provarlo su codice vero prima di cambiare fornitore.

OpenAI accusa utenti legati a Moonshot AI di aver estratto il suo ragionamento

OpenAI ha pubblicato un report su una campagna di “distillazione avversaria”: qualcuno copiava il ragionamento cifrato di una conversazione e chiedeva a un’altra istanza del modello di decifrarlo e trascriverlo in chiaro. L’attività è partita il 1° luglio a bassa intensità, il 24 e 25 luglio è esplosa con 16.000 richieste da oltre 4.000 utenti, e alla fine il cluster collegato superava i 15.000 account. Il nucleo, secondo OpenAI, porta a persone associate a Moonshot AI, quelli di Kimi.

OpenAI precisa che la cifratura non è stata rotta e che nessuna conversazione degli utenti è stata toccata; ha chiuso la falla di “replay”, bannato gli account e condiviso i dati col Frontier Model Forum. CyberScoop fa notare che prove tecniche dell’attribuzione non ne sono state mostrate. E, diciamolo, l’ironia di un’azienda che ha addestrato i suoi modelli sul web lamentandosi di essere “copiata” non è sfuggita a nessuno.

California: niente più licenziamenti decisi solo dall’IA

Gavin Newsom ha firmato un pacchetto di leggi sul lavoro e l’intelligenza artificiale, come riporta l’Associated Press. La più discussa è la SB 947, il “No Robo Bosses Act”: un datore di lavoro non può più basarsi solo su un sistema automatico per licenziare o sanzionare un dipendente, serve un essere umano che verifichi con altre informazioni. Nel pacchetto ci sono anche il divieto di usare dati biometrici per indovinare lo stato emotivo dei lavoratori, l’obbligo di avvisare per iscritto quando l’IA causa licenziamenti di massa e una valutazione dei rischi per chi gestisce chatbot.

Chicca finale: Newsom ha firmato anche un ordine esecutivo che impone agli enti statali di dire “intelligenza artificiale” e non “superintelligenza”, una frecciata diretta alla Casa Bianca. Per chi lavora in Europa niente di nuovo sotto il sole: con l’AI Act i sistemi usati per le decisioni sul personale sono già considerati ad alto rischio.


Pausa dalla rassegna, giusto il tempo di una vignetta.

Meme di Kung Fu Panda: Shifu urla che la produzione è giù, il maestro Oogway resta in silenzio e poi, sotto il pesco in fiore, dice che è arrivato il suo limite
Produzione giù, e il tuo unico piano di rollback ha appena finito i messaggi. Vignetta di ProgrammerHumor.io.

Reddit spegne RSS e API pubbliche: colpa dei bot IA

Reddit ha annunciato su r/modnews e r/redditdev che i feed RSS si spengono il 13 novembre 2026 e l’API pubblica a marzo 2027, perché sono diventati una via comoda per lo scraping massivo. Old Reddit resterà accessibile solo a chi ha fatto login negli ultimi sei mesi, e gli sviluppatori dovranno registrarsi entro il 12 gennaio 2027 per non perdere l’accesso. I dettagli sono su TechCrunch.

Il motivo vero è economico: i dati di Reddit valgono soldi, e le licenze alle aziende IA stanno facendo crescere i ricavi non pubblicitari. Mi dispiace per i tanti piccoli strumenti e lettori RSS che ci vivevano sopra: pagano loro il conto dello scraping fatto da altri.

SynthID Bio: DeepMind mette la filigrana alle proteine

Google DeepMind ha presentato SynthID Bio, che inserisce una filigrana invisibile e verificabile nelle proteine progettate dall’IA, sia nelle sequenze sia nelle strutture 3D previste. Il problema che risolve è concreto: chi sintetizza DNA oggi non ha un modo affidabile per capire se un ordine contiene una proteina naturale o una disegnata da un modello. Nei test di laboratorio su tre bersagli (PD-L1, VEGF-A e il dominio di legame della proteina spike di SARS-CoV-2) le versioni con filigrana hanno funzionato come quelle senza. È il tipo di ricerca sulla sicurezza che preferisco: poco clamore, utilità reale.

Chiudiamo in leggerezza: la cena si ordina via messaggio

DoorDash ha lanciato un agente IA che vive dentro Apple Messages: gli scrivi “ordina il solito” e lui ricostruisce l’ordine dai tuoi acquisti precedenti, ti suggerisce locali in zona, ti manda le foto dei piatti e gestisce anche gli ordini di gruppo con le varie esigenze alimentari. Per ora c’è solo una lista d’attesa negli Stati Uniti, racconta TechCrunch. Il venerdì sera in ufficio, con cinque persone che non si mettono d’accordo sulla pizza, lo proverei volentieri.

Questa è la rassegna di oggi. Voi che ne pensate di Gemini 4 Argon, e soprattutto della legge californiana: in azienda usate già strumenti automatici per valutare il personale? Se vi interessa il lato europeo della questione, ho scritto una guida su cosa deve fare davvero una PMI con l’AI Act. Scrivetemi nei commenti, ci vediamo domani.

Newsletter

Ti è stato utile? Il prossimo te lo mando io.

La rassegna AI ogni mattina oppure il digest della domenica: scegli tu.

Cosa vuoi ricevere
Che differenza c’è tra le due newsletter?

Rassegna AI quotidiana: ogni mattina alle 8:30, le notizie sull'IA del giorno.

Digest settimanale: la domenica, gli articoli e le rassegne della settimana in una sola mail.

Puoi sceglierle anche tutte e due.

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *