Tech Shots
Notizie su IA e robotica
Italiano

Notizie su IA e robotica – Pagina 3

mer 9 settembre 2026
Strumenti

OpenAI apre 5 milioni di dollari di borse per la ricerca su IA e adolescenti

OpenAI ha annunciato l’8 settembre 2026 un programma di finanziamenti da 5 milioni di dollari per la ricerca indipendente su come l’IA generativa influenzi gli adolescenti tra i 13 e i 17 anni, con premi individuali fino a 1 milione di dollari e un’attenzione particolare allo sviluppo sociale ed emotivo, alle tutele e alla progettazione adatta all’età. Le candidature sono aperte fino al 6 ottobre 2026 e le proposte selezionate saranno comunicate entro il 13 novembre; i fondi provengono da OpenAI Group PBC.

Strumenti

Copilot corregge in blocco i risultati di Code Quality

GitHub ha annunciato il 9 settembre 2026 che l’autofix agentico può correggere in blocco i risultati standard di GitHub Code Quality: si selezionano fino a 25 risultati in una pagina, si assegnano a Copilot con un’unica azione e Copilot li corregge in modo agentico su un branch, convalida le modifiche e apre una pull request per la revisione. «Assegna a Copilot» sostituisce «Genera correzione» per i singoli risultati, segue la policy enterprise di Code Quality esistente (nessuna policy separata) e consuma crediti IA; è disponibile su GitHub Team ed Enterprise Cloud (inclusa la residenza dei dati) quando Code Quality è attivo.

Modelli

AlphaGenome Atlas mappa 9 miliardi di varianti del DNA

Google DeepMind ha lanciato AlphaGenome Atlas l’8 settembre 2026: un database da circa 1 petabyte con le previsioni precalcolate di AlphaGenome per ogni possibile modifica di un singolo nucleotide nel genoma umano (circa 9 miliardi di varianti). Aggiunge un punteggio AlphaGenome Variant Impact (AVI) che combina i segnali di AlphaGenome e AlphaMissense per consentire ai ricercatori di classificare più rapidamente le varianti codificanti e non codificanti, oltre a un portale web no-code, all’API AlphaGenome e a una skill di Antigravity; l’accesso non commerciale è aperto da subito, mentre l’uso commerciale su Google Cloud è previsto a breve.

Modelli

ChatGPT Images 2.5: modello di immagini più nitido e veloce

OpenAI ha lanciato ChatGPT Images 2.5 l’8 settembre 2026, un nuovo modello di immagini con dettagli più nitidi, generazione più rapida, modifica multi-turno più precisa, disegno con Sketch (@ Sketch), modelli creativi come Poster e Merch e prompt condivisi facoltativi quando si pubblicano le immagini. Il rilascio è graduale per gli utenti di ChatGPT, ChatGPT Work e Codex in tutti i piani su desktop, mobile e web; nell’API arrivano GPT-Image-2.5 Flare (velocità) e GPT-Image-2.5 Sunburst (maggiore precisione, esecuzioni più lunghe). OpenAI cita una maggiore fedeltà alle foto di riferimento e uno stack di sicurezza aggiornato per il maggiore realismo.

Strumenti

Meta lancia Muse, agente IA personale, negli Stati Uniti

Meta ha dichiarato l’8 settembre 2026 di introdurre Muse, un agente IA personale che svolge compiti e obiettivi di più lungo periodo per conto di una persona, senza limitarsi a rispondere alle domande. È basato su Muse Spark e gira su Muse Secure VM, una VM cloud dedicata con un proprio browser e un gate Sentinel separato per le azioni in uscita. Gli utenti gli scrivono nell’app Muse o su WhatsApp, scelgono a quali app può accedere e Muse chiede conferma prima dei passaggi sensibili, come inviare un’e-mail o acquistare; al checkout si può usare Link by Stripe con carte monouso. Il rilascio è negli Stati Uniti su iOS, Android e muse.ai (occhiali IA più avanti), gratuito per la maggior parte degli usi, con piani a pagamento per i carichi più pesanti.

Modelli

Un modello OpenAI propone una soluzione per il problema del millennio di Navier–Stokes

OpenAI ha dichiarato l’8 settembre 2026 che un sistema interno più capace di GPT-6 Astra ha prodotto una soluzione al problema del Premio del Millennio sull’esistenza e la regolarità di Navier–Stokes: un fluido inizialmente liscio e fermo può sviluppare una singolarità in tempo finito sotto una forza liscia mentre l’energia resta finita, stabilendo gli enunciati C e D di Clay. L’azienda ha pubblicato una trattazione e una formalizzazione in Lean verificata con GPT-6 Astra, dopo circa 88 ore di ricerca multi-agente e 17 ore di formalizzazione, e dice di non voler rivendicare il Premio del Millennio. OpenAI cita il lavoro concomitante di Levent Alpöge e Tristan Buckmaster sull’equazione di Eulero forzata, riconosce la loro priorità su quel risultato e presenta la pubblicazione come prova del ritmo della ricerca sull’IA, non come lancio di un prodotto consumer.

dom 6 settembre 2026
Modelli

OpenAI: il saggio «An Alien Mind» invita alla cautela sull’auto-miglioramento ricorsivo

OpenAI ha pubblicato «An Alien Mind» il 6 settembre 2026, un saggio di Sicurezza/Ricerca del chief scientist Jakub Pachocki, che sostiene che, in base ai risultati interni, l’attuale ritmo di crescita delle capacità potrebbe proseguire fino all’auto-miglioramento ricorsivo (RSI), con sistemi futuri che guidano sempre più il proprio sviluppo. Pachocki scrive che ciò richiede estrema cautela, che OpenAI continuerà a perseguire allineamento, monitoraggio e sistemi difensivi e potrà trattenere unilateralmente ulteriori scalature quando necessario, e che servono comunque interventi più ampi; afferma inoltre, come tesi di OpenAI, che GPT-6 Astra è significativamente meglio allineato di GPT-5.6 Sol, sottolineando che serve molto più progresso sull’allineamento man mano che i modelli diventano più capaci. Dice di ritenere che nessun laboratorio abbia risolto allineamento e monitoraggio abbastanza da continuare a scalare alla massima velocità ancora a lungo, e invoca rallentamenti volontari fino a soglie di sicurezza condivise e coordinamento internazionale.

Modelli

OpenAI raggiunge l’obiettivo di uno stagista di ricerca automatizzato

OpenAI ha dichiarato il 6 settembre 2026 che, secondo le proprie misurazioni, ha raggiunto entro settembre l’obiettivo annunciato lo scorso autunno di uno stagista di ricerca automatizzato: un sistema in grado di svolgere compiti di ricerca ben definiti sotto la guida umana, incluso un lavoro che a un ricercatore esperto richiederebbe qualche giorno, e che sta facendo forti progressi verso un ricercatore IA automatizzato entro marzo 2028. La pubblicazione di ricerca descrive agenti di coding che rimodellano le giornate dei ricercatori: a metà agosto il ricercatore mediano usava oltre 600 dollari al giorno di inferenza ai prezzi API, il 90º percentile oltre 7.000 dollari al giorno, e circa 3,1 giornate lavorative di agenti per ogni giornata umana; sottolinea inoltre che sono ancora gli esseri umani a fissare le priorità e che non si sa ancora se l’auto-miglioramento ricorsivo pienamente allineato sia sicuro.

Strumenti

OpenAI Daybreak: 1 miliardo di dollari per i difensori cyber in prima linea

OpenAI ha dichiarato il 3 settembre 2026 di lanciare Daybreak for Frontline Defenders, un’iniziativa globale con un impegno di 1 miliardo di dollari in accesso sovvenzionato a Daybreak, formazione, supporto tecnico e partnership per i difensori cyber con risorse limitate, da utilizzare nei prossimi sei mesi, a partire dagli Stati Uniti con estensione ai paesi partner nelle prossime settimane. Il pacchetto include Daybreak for America (priorità a acqua e acque reflue, reti elettriche, governi statali e locali, banche comunitarie, organizzazioni no profit e manutentori open source), un progetto pilota per settore pubblico e acqua con MS-ISAC e oltre 35 prodotti di partner nella Daybreak Defense Network; Daybreak Blue usa i modelli principali per la difesa comune, mentre Daybreak Red aggiunge modelli cyber specializzati per organizzazioni verificate (OpenAI cita migliaia di difensori in 2.000 workspace approvati).

Modelli

Microsoft AI lancia MAI-Transcribe-2, il riconoscimento vocale

Microsoft AI ha dichiarato il 3 settembre 2026 che MAI-Transcribe-2 è disponibile per la prova in Microsoft Foundry, nel MAI Playground e su Open Router. L’azienda afferma che il modello aggiunge diarizzazione dei parlanti, timestamp a livello di parola, bias su parole chiave, stili verbatim e pulito e alternanza di codice linguistico, e rivendica il primo posto su FLEURS in 60 lingue (WER medio del 5,2%) e la frontiera di Pareto accuratezza-latenza di Artificial Analysis; tali classifiche sono citazioni di Microsoft alla data del post. Il prezzo di lancio è di 0,10 dollari per ora di audio fino a fine anno.

Modelli

Microsoft apre MAI-Image-2.6 agli sviluppatori di Foundry

Microsoft AI ha dichiarato il 4 settembre 2026 che MAI-Image-2.6, insieme a un modello gemello più veloce, MAI-Image-2.6-Flash, è disponibile per gli sviluppatori in Microsoft Foundry e nel MAI Playground. Entrambi i modelli aggiungono la modifica con più immagini di riferimento, il grounding sul web e proporzioni dinamiche (fino a circa 1,5K); Microsoft afferma che Flash genera immagini circa 2,8 volte più velocemente di GPT-Image-2-Medium con maggiore efficienza. Le classifiche di Arena e Artificial Analysis nel post sono citazioni di Microsoft a quella data.

Modelli

Lyria 3.5 arriva nell’app Gemini e nell’API

Google ha dichiarato il 4 settembre 2026 che Lyria 3.5, il suo modello di generazione musicale dal suono migliore, è disponibile nell’app Gemini e nell’API Gemini, con voci più espressive e arrangiamenti più ricchi. Nell’app Gemini si può scegliere o descrivere un genere, optare per voce o strumentale, usare nuovi modelli e scegliere brani brevi o più lunghi; è disponibile a livello globale sul web e su mobile. Artisti e creativi dell’IA lo trovano anche in Google Flow Music, e gli sviluppatori tramite Google AI Studio e Google Vids.

Strumenti

GPT-6 Astra ora è disponibile in GitHub Copilot

GitHub ha dichiarato il 4 settembre 2026 che GPT-6 Astra di OpenAI è disponibile in via generale in GitHub Copilot per gli utenti Pro+, Max, Business ed Enterprise in VS Code, Visual Studio, CLI, agente di coding, app Copilot, github.com, mobile, JetBrains, Xcode ed Eclipse (rilascio graduale). Nei test interni di GitHub si è distinto per la capacità di pianificare e validare mentre lavora, con un coding a lungo orizzonte più solido e meno passaggi rispetto ai precedenti modelli OpenAI in Copilot. Viene fatturato al prezzo di listino del provider con fatturazione a consumo; gli amministratori Business ed Enterprise gestiscono l’accesso tramite la policy dei modelli di Copilot (i nuovi modelli sono attivi per impostazione predefinita, a meno che l’abilitazione globale predefinita sia disattivata o questo modello sia bloccato).

Strumenti

GitHub ritirerà i vecchi modelli Copilot il 2 ottobre

GitHub ha dichiarato il 3 settembre 2026 che dismetterà Gemini 3.5 Flash, Gemini 3.6 Flash, Kimi K2.7 Code e Claude Opus 4.7 in tutte le esperienze di GitHub Copilot il 2 ottobre 2026, indirizzando gli utenti a Gemini 3.8 Flash, Kimi K3 e Claude Opus 5. Gli amministratori Business ed Enterprise potrebbero dover abilitare i modelli sostitutivi nella policy dei modelli di Copilot.

sab 5 settembre 2026
Modelli

OpenAI lancia GPT-6 Astra in ChatGPT e nell’API

OpenAI ha presentato GPT-6 Astra il 3 settembre 2026 come il suo modello più capace per uso del computer, coding, cybersicurezza, scienza e lavoro professionale. Il rilascio parte da un insieme limitato di organizzazioni e, nei prossimi giorni, arriva a ChatGPT Plus, Pro, Business ed Enterprise, oltre che all’API OpenAI, a Microsoft Azure e ad AWS Bedrock (ID modello gpt-6-astra; prezzo standard dell’API 10 $ / 50 $ per milione di token in ingresso / uscita). OpenAI afferma che Astra satura FrontierMath Tier 4 al 98%, ARC-AGI-3 al 99,9% ed ExploitBench al 100%, raggiunge la soglia critica per la cybersicurezza del suo Preparedness Framework con salvaguardie più forti e prevede accesso a Daybreak per flussi di difesa cyber più ampi nelle prossime settimane; Astra per Enterprise è disattivato per impostazione predefinita al lancio.

ven 4 settembre 2026
Strumenti

Gemini 3.8 Flash arriva in GitHub Copilot

GitHub ha dichiarato il 3 settembre che Gemini 3.8 Flash di Google è disponibile in Copilot per Pro, Pro+, Max, Business ed Enterprise in VS Code, Visual Studio, CLI, agente cloud, app Copilot, JetBrains, Xcode ed Eclipse (rilascio graduale). Nei primi test di GitHub si è comportato bene nel coding complesso da terminale e nel recupero da errori risolvibili. Su Business/Enterprise i nuovi modelli sono attivi per impostazione predefinita, a meno che un amministratore abbia disattivato l’abilitazione globale predefinita o questo modello; il prezzo introduttivo del provider vale fino al 31 dicembre 2026.

gio 3 settembre 2026
Modelli

Google mappa l’intero cervello di un moscerino della frutta maschio

Il 3 settembre 2026 Google Research, HHMI Janelia e collaboratori hanno pubblicato la prima mappa completa del cablaggio del cervello e del sistema nervoso centrale di un moscerino della frutta maschio adulto: oltre 166.000 neuroni e 11.691 tipi cellulari. L’IA ha ricomposto milioni di sezioni 2D in forme neuronali 3D; la mappa segue un precedente connettoma completo di una femmina ed è pensata come risorsa pubblica per le neuroscienze. Tre studi collegati usciti lo stesso giorno la applicano a visione, gusto e comportamento sociale; si tratta di ricerca sulla connettomica, non di un prodotto Gemini.

Strumenti

NVIDIA: PC RTX Spark a ottobre e un router PAIR locale

All’IFA 2026 NVIDIA ha dichiarato che i PC Windows RTX Spark arriveranno a ottobre, con i nuovi Lenovo Yoga Pro 9n e Yoga 9n 2-in-1 e un desktop compatto Acer; il superchip comprende una GPU RTX Blackwell da 1 petaflop, fino a 128 GB di memoria unificata e una CPU Grace a 20 core. NVIDIA ha inoltre rilasciato una beta gratuita e open source di PAIR, un Personal AI Router che distribuisce l’inferenza sui PC inattivi di una rete locale (Ollama e LM Studio; Windows, macOS e Linux). Nuove ottimizzazioni di llama.cpp e vLLM offrono fino a 1,9 volte più throughput locale, e Hermes Agent, OpenClaw e Perplexity Portable Computer avranno una configurazione locale più semplice su hardware NVIDIA — RTX Spark, non il Muse Spark di Meta né Grok di xAI.

Modelli

WeatherNext 3: previsioni globali orarie a 5 km di risoluzione

Google DeepMind e Google Research hanno lanciato WeatherNext 3, un modello meteorologico globale che si reinizializza ogni ora e assimila direttamente mosaici in tempo reale di satelliti geostazionari; Google lo definisce il modello meteo globale più accurato finora, citando valutazioni indipendenti dal vivo di Brightband. Risolve temperatura e umidità a 5 km, altre variabili di superficie a 10 km e variabili atmosferiche a 25 km, circa cinque volte più nitido della griglia a 25 km e a sei ore di WeatherNext 2, e aggiunge vento a 100 metri, copertura nuvolosa e radiazione per la pianificazione delle energie rinnovabili. Da oggi inizia ad alimentare la Ricerca Google, l’app Gemini, Maps, la Weather API di Google Maps Platform ed Earth Engine, con previsioni delle precipitazioni fino al 50% più accurate a un giorno o più; i dati sono interrogabili in BigQuery ed Earth Engine o scaricabili da Cloud Storage.

Business

NVIDIA acquisirà Hugging Face per 12,93 miliardi di dollari

NVIDIA ha dichiarato il 3 settembre 2026 di aver concordato l’acquisizione di Hugging Face per 12.930.300.000 dollari, in un post firmato dal CEO Jensen Huang. NVIDIA afferma che la piattaforma resta aperta: gli sviluppatori continueranno a scegliere i propri modelli, framework, cloud e provider di inferenza, e il calcolo NVIDIA non sarà necessario per sviluppare o distribuire tramite Hugging Face. Il post conta oltre 18 milioni di utenti, più di 3 milioni di modelli, 500.000 dataset e 200.000 aziende sulla piattaforma e dice che NVIDIA è il suo maggiore contributore di modelli e dati aperti.

Modelli

Meta lancia Muse Spark 1.3 per agenti e coding

Meta AI Research ha rilasciato Muse Spark 1.3 il 2 settembre 2026, con prestazioni più forti in compiti agentici e di coding, in distribuzione in Muse Code e nella Meta Model API. L’aggiornamento migliora i flussi di lavoro a più lungo orizzonte, il multitasking in thread confusi e l’efficienza nel coding (gli ingegneri di Meta riportano circa il 20% in meno di chiamate a strumenti e il 25% in meno di token rispetto alla 1.2). Le modalità di ragionamento arrivano subito; il ragionamento massimo seguirà dopo ulteriori test di sicurezza.

Strumenti

Le aziende Copilot possono impostare qualsiasi modello predefinito

GitHub consente ora agli amministratori enterprise di scegliere qualsiasi modello Copilot preferito come predefinito per le nuove conversazioni tramite le impostazioni gestite, dal 2 settembre 2026. I team possono avere un proprio predefinito quando la chiave del modello è contrassegnata come sovrascrivibile e team-mappings.json viene aggiornato; tutti gli altri ereditano il predefinito dell’azienda. La funzione è disponibile in via generale per Copilot Business e Copilot Enterprise nell’app Copilot, in Copilot CLI e in Visual Studio Code.

Strumenti

L'app e la CLI di Copilot ora rispettano le esclusioni di contenuto

GitHub ha reso generalmente disponibili le policy di esclusione dei contenuti nell'app Copilot e in Copilot CLI dal 2 settembre 2026. Le esclusioni impostate dagli amministratori di azienda, organizzazione o repository tengono i file elencati fuori dal contesto di Copilot nei flussi di lavoro con agenti. La modifica riguarda Copilot Business e Copilot Enterprise; si tratta di GitHub Copilot, non di Microsoft 365 Copilot.

Modelli

Google lancia Gemini 3.8 Flash Cyber tramite Fairwind

Google DeepMind ha presentato Gemini 3.8 Flash Cyber, un modello orientato alla difesa per la scoperta di vulnerabilità e le patch automatiche, disponibile solo per partner fidati tramite il nuovo Programma Fairwind. Fairwind abbina Flash Cyber al sistema CodeMender di Google, così governi e difensori aziendali possono trovare, verificare e correggere le falle nel proprio ambiente cloud sicuro. A differenza di Gemini 3.8 Flash per gli agenti, disponibile per tutti, Flash Cyber è ad accesso limitato; si tratta del modello Gemini, non dell'exchange di criptovalute.

Strumenti

NVIDIA e CrowdStrike lanciano SafeMind, stack di cybersicurezza agentico

A Fal.Con 2026 NVIDIA e CrowdStrike hanno annunciato SafeMind, un sistema di cybersicurezza agentico i cui modelli difensivi sono basati su NVIDIA Nemotron e addestrati ulteriormente sui dati sulle minacce di CrowdStrike. CrowdStrike afferma che Blue Solano (su Nemotron 3 Super) ha battuto i principali modelli di frontiera nelle valutazioni interne a un costo molto inferiore, e che SafeMind è integrato nativamente in Falcon, con accesso opzionale ai modelli tramite QuiltWorks.

mer 2 settembre 2026
Modelli

Google Research lancia TimesFM-3 per le previsioni multivariate

Google Research ha presentato TimesFM-3, un modello di base per serie temporali da 330 milioni di parametri, preaddestrato per previsioni multivariate zero-shot su oltre mille miliardi di punti temporali. Prevede congiuntamente serie correlate, con covariate passate e future note, in un solo passaggio, e si colloca tra i migliori modelli di base preaddestrati su Gift-Eval, FEV-Bench e Time. I pesi sono su GitHub e Hugging Face con licenza non commerciale; l'integrazione con BigQuery è in arrivo. Si tratta di TimesFM, non di Gemini né dell'exchange di criptovalute.

Strumenti

NVIDIA annuncia Jetson Orin Nano 2 per la robotica

NVIDIA ha annunciato Jetson Orin Nano 2, un computer per la robotica di fascia entry-level con il doppio dell'inferenza del Nano precedente a parità di dimensioni e il 40% di consumi in meno a parità di prestazioni in modalità da 15 watt. Offre 78 TOPS, 8 GB di memoria e una CPU Arm a 8 core per robot, droni e sistemi di visione. Il modulo e il kit di sviluppo sono attesi nel primo semestre del 2027; non sono ancora in vendita.

Strumenti

NVIDIA avvia la produzione dell'acceleratore di inferenza Groq 3 LPX

NVIDIA ha dichiarato che Groq 3 LPX, il suo acceleratore di inferenza interattiva, è ora in piena produzione come estensione di Vera Rubin. L'azienda cita 3.400 token di output al secondo su Gemma 4 31B con contesto da 100.000 token, quattro volte l'alternativa più vicina in un benchmark di Artificial Analysis.

Modelli

DeepMind lancia Gemini 3.8 Flash per il lavoro agentico

Google DeepMind indica Gemini 3.8 Flash come generalmente disponibile: il suo Flash più intelligente finora per programmazione e agenti, con 1 M di token in input e 64 k in output. È disponibile nell'app Gemini, nell'API Gemini, in Google AI Studio, in Antigravity, nella Modalità IA di Gemini e nella Gemini Enterprise Agent Platform. DeepMind afferma che supera 3.7 Flash nell'ingegneria del software a lungo orizzonte e nei benchmark per agenti, con il 54,9% su HLE-Verified; si tratta del modello Gemini, non dell'exchange di criptovalute.

Strumenti

GitHub Copilot in Visual Studio aggiunge i controlli dello sforzo di ragionamento

GitHub ha aggiunto in Visual Studio i controlli dello sforzo di ragionamento Basso, Medio e Alto per i modelli supportati, oltre agli agenti personalizzati a livello di organizzazione nel selettore. È possibile fissare i modelli, vedere finestra di contesto e costo e chiedere all'agente Git di rivedere le modifiche non ancora committate prima di una PR, anche nei repository Azure DevOps. È disponibile in tutti i piani Copilot, compreso Free.

Strumenti

Il plugin dell'agente di authoring per app canvas di Power Apps passa alla disponibilità generale

Il 1° settembre Microsoft ha reso generalmente disponibile la co-creazione di app canvas con gli agenti: creatori e agenti di coding condividono un unico modello di authoring tramite un plugin basato su MCP che può creare schermate, collegare connettori, scrivere Power Fx e sincronizzarsi con una sessione live. Il risultato resta una normale app canvas, con i connettori, la governance e la distribuzione esistenti; si sceglie cosa delegare e cosa modificare a mano per gestire i token.

Strumenti

OpenAI sostiene la legge SB 1119 della California sulla sicurezza dell'IA per i giovani

Il 31 agosto OpenAI ha dichiarato di sostenere il Senate Bill 1119 della California, che prevede tutele dell'IA adatte all'età per gli adolescenti mantenendo l'accesso educativo. L'azienda elenca i requisiti che appoggia: determinazione dell'età, valutazione dei rischi prima del rilascio, audit indipendenti, protezioni contro i contenuti ad alto rischio, strumenti per i genitori, link a risorse di crisi e limiti alla pubblicità mirata per i 13-17 anni applicati automaticamente. Collega il disegno di legge alle impostazioni predefinite di ChatGPT per i teenager e chiede al governatore Newsom di firmarlo.

Strumenti

GitHub Copilot in VS Code di agosto: sessioni agente e /btw

Il changelog di GitHub del 31 agosto per VS Code 1.132–1.135 aggiunge chat di agente affiancate, conversazioni laterali /btw che condividono contesto e cache del prompt, una timeline dei prompt, Agent Plugins 1.0 portabili, sessioni Agent Host su più finestre e seconde opinioni sperimentali con /rubber-duck. La chat ottiene la ricerca nell'intera trascrizione e i prompt fissi; il browser integrato può annotare elementi della pagina per l'agente; la dettatura sul dispositivo supporta più lingue e una pulizia consapevole della shell.

Modelli

DeepMind sperimenta valutazioni in doppio cieco dell'IA di frontiera

Il 27 agosto Google DeepMind ha dichiarato di sperimentare quella che definisce la prima valutazione in doppio cieco di un modello di frontiera proprietario: test esterni eseguiti all'interno di un ambiente crittografico Confidential Space, così i valutatori non vedono i pesi di Gemini e Google non vede i prompt dei valutatori. Tra i partner ci sono il Singapore AI Safety Institute, OpenMined, AVERI e MLCommons, a partire da un modello Gemini Flash Lite su benchmark riservati. L'obiettivo è ridurre la contaminazione dei benchmark e rafforzare la fiducia nei test di sicurezza sensibili; non è una nuova funzione consumer di Gemini, né Omni video, né l'exchange di criptovalute Gemini.

Strumenti

Claude Fable 5.1 arriva in GitHub Copilot

Il 1° settembre GitHub ha dichiarato che Claude Fable 5.1 è generalmente disponibile in Copilot per Pro+, Max, Business ed Enterprise su VS Code, Visual Studio, CLI, agente di coding, github.com, Mobile, JetBrains, Xcode ed Eclipse (rilascio graduale). Gli amministratori Business ed Enterprise devono abilitare una policy disattivata per impostazione predefinita. A differenza della maggior parte degli altri modelli Claude in Copilot, Fable 5.1 conserva per impostazione predefinita prompt e output per i classificatori di sicurezza di Anthropic (non per l'addestramento); le aziende idonee possono ottenere zero data retention a tempo limitato fino a EFS.

Strumenti

Photoshop lancia la beta dell'editor assistito dall'IA e Instruct Edit

Il 27 agosto Adobe ha dichiarato che l'editor assistito dall'IA di Photoshop è in beta: uno spazio di lavoro dedicato basato su prompt con Prompt to Edit, Riempimento/Espansione/Upscale generativi, Rimuovi e Markup IA. Instruct Edit con maschere (Firefly Image 5) consente di descrivere le modifiche proteggendo volti, loghi o asset di brand non mascherati; Prompt to Edit arriva anche nella barra delle attività contestuale dell'editor Pro come livelli generativi.

Strumenti

Antigravity Teamwork abbina agenti a Gemini 3.7 Flash

Il 31 agosto Google ha dichiarato che Antigravity Teamwork, un framework per team autonomi multi-agente che collaborano per ore o giorni, abbinato a Gemini 3.7 Flash ha accelerato il lavoro di matematica e ingegneria a lungo orizzonte. Il post cita sette problemi aperti di informatica teorica risolti (inclusa la Congettura dei cicli di Knuth, verificata in Lean), un simulatore RISC-V cycle-accurate che avvia xv6 e contributi accettati upstream in Eigen e ParlayHash.

Strumenti

Anthropic apre l'anteprima di ricerca del Model Hardware Standard

Anthropic ha aperto un'anteprima di ricerca del Model Hardware Standard (MHS), una specifica condivisa e indipendente dal modello che permette agli agenti IA di far funzionare dispositivi programmabili di laboratorio e produzione tramite protocolli come MCP. I primi partner spaziano da biotecnologie e microscopia al quantistico (tra cui Genentech, HHMI Janelia e QuEra); Anthropic prevede di rendere open source MHS dopo l'anteprima e sta sviluppando valutazioni di sicurezza fisica. Per ora solo lista d'attesa: è un'anteprima di ricerca, non una funzione generale di Claude per tutti.

Strumenti

Google Pics porta la modifica di immagini con IA in Docs e Slides

Google sta distribuendo Google Pics, uno strumento di creazione e modifica di immagini con IA basato sul modello Nano Banana, per gli abbonati a Google AI Pro e Ultra e la maggior parte dei clienti business di Workspace. Tra le funzioni ci sono l'isolamento degli oggetti, la modifica e la traduzione del testo nell'immagine, generazioni con più opzioni e la collaborazione; l'integrazione con Docs e Slides è disponibile oggi, Drive arriverà nelle prossime settimane. Si può provare su pics.new; si tratta di Workspace Pics, non della generazione video di Gemini.

Strumenti

ChatGPT Ads raggiunge 1 miliardo di dollari di ricavi annualizzati; Ads Manager si espande

OpenAI afferma che ChatGPT Ads ha raggiunto un run rate di ricavi annualizzato di 1 miliardo di dollari in meno di 200 giorni dal lancio, con decine di migliaia di inserzionisti. Dal 31 agosto gli inserzionisti possono acquistare annunci su ChatGPT direttamente tramite Ads Manager in India, Europa, Medio Oriente e Nord Africa; Israele non compare nell'elenco ufficiale dei paesi self-service. La pubblicità si affianca ai ricavi da abbonamenti, aziende e API e finanzia un livello gratuito sostenuto dagli annunci per oltre 1 miliardo di utenti attivi settimanali.