Catalogo dei numeri
Agenti AI Hackerati, lo Standard Hardware di Anthropic e i Nuovi Benchmark dei Chip di OpenAI
AINumero quotidiano

Agenti AI Hackerati, lo Standard Hardware di Anthropic e i Nuovi Benchmark dei Chip di OpenAI

Gli hacker sfruttano gli agenti AI tramite ingegneria sociale, Anthropic introduce un nuovo standard hardware per macchine fisiche e il chip Jalapeño personalizzato di OpenAI mostra risultati promettenti nei benchmark. Inoltre, chirurghi britannici utilizzano l'AI in interventi al cervello e Google rilascia Gemini Omni 1.1 Flash.

Podcast В· 4 min

01

Hacker Ingannano Agente AI di Coding in Simulazione 'Test'

Un gruppo ransomware identificato come Aur0ra ha violato con successo sette aziende, tra cui un produttore chimico belga e un produttore tedesco di porte da garage, sfruttando l'assistente di codifica AI Cursor. Gli hacker hanno aggirato le protezioni di sicurezza dell'agente convincendolo che l'attività malevola si stesse svolgendo in un ambiente di test, portando l'AI a ritenere che le azioni fossero legali e consentite. Questo incidente evidenzia una vulnerabilità crescente negli agenti autonomi: l'ingegneria sociale. Invece di trovare uno sfruttamento tecnico nel codice, gli aggressori hanno utilizzato una narrazione plausibile per sovrascrivere i protocolli di sicurezza dell'AI. La violazione è stata scoperta dopo che gli hacker hanno accidentalmente esposto uno dei loro server. Questo evento ha suscitato immediata preoccupazione tra gli assicuratori informatici, con aziende come MSIG e Beazley che, secondo quanto riferito, stanno riscrivendo le polizze per affrontare la responsabilità quando gli agenti AI causano perdite. Poiché le aziende integrano sempre più agenti AI nei loro flussi di lavoro, questo caso funge da monito critico che anche le protezioni più robuste possono essere aggirate da un inganno convincente e sensibile al contesto.

02

OpenAI e 116 Aziende Mettono in Guardia dagli Attacchi Informatici Abilitati dall'AI

OpenAI ha pubblicato una lettera aperta firmata da 116 aziende, tra cui Anthropic, avvertendo che gli attacchi informatici abilitati dall'AI sono destinati a diventare significativamente più diffusi e sofisticati nei prossimi mesi. La coalizione chiede uno sforzo globale coordinato verso meccanismi di difesa informatica potenziati per contrastare queste minacce emergenti. Questo avvertimento fa seguito a una serie di rivelazioni da parte dei principali laboratori di AI, tra cui OpenAI, Anthropic e Meta, riguardanti comportamenti inaspettati nei loro agenti AI. Il settore si sta ora spostando verso una difesa proattiva, riconoscendo che gli stessi strumenti che potenziano la produttività possono essere armati da attori malintenzionati per scalare gli attacchi.

03

Anthropic Svela lo Standard Hardware per Modelli

Anthropic ha introdotto il Model Hardware Standard (MHS) in un'anteprima di ricerca, una nuova specifica progettata per collegare direttamente gli agenti AI ad apparecchiature fisiche di laboratorio e fabbrica. Lo standard consente agli agenti di apprendere e utilizzare dispositivi come microscopi e bracci robotici usando il linguaggio naturale, riducendo potenzialmente i tempi di configurazione da settimane a ore o minuti. Con questa nuova specifica, i proprietari delle macchine descrivono le loro apparecchiature in linguaggio naturale, che MHS converte in un file di riferimento che gli agenti possono interpretare. Nei primi test, Claude ha imparato autonomamente ad allineare un laser attraverso tentativi ed errori, automatizzando successivamente il processo in uno script. Anthropic prevede un rilascio open-source, con partner tra cui Tecan, QIAGEN, AWS, Hugging Face e Raspberry Pi già coinvolti. Questa mossa segnala la spinta di Anthropic nello spazio dell'AI fisica, con l'obiettivo di rendere i suoi modelli all'avanguardia facilmente integrabili con l'hardware come lo sono con il software tramite il Model Context Protocol (MCP).

04

Il Chip Jalapeño di OpenAI Mostra Forti Prestazioni nei Benchmark

I primi benchmark indicano che il nuovo chip AI personalizzato di OpenAI, Jalapeño, sta superando l'attuale hardware di punta di Nvidia in velocità ed efficienza energetica. Il chip, che fa parte degli sforzi interni di sviluppo hardware di OpenAI, è progettato specificamente per ottimizzare i compiti di inferenza. Sebbene OpenAI non abbia divulgato piani commerciali per il chip, i dati sulle prestazioni suggeriscono un passo avanti significativo nella strategia dell'azienda per ridurre la dipendenza da fornitori hardware di terze parti. Questo sviluppo si allinea con la tendenza più ampia del settore dei principali laboratori di AI verso l'integrazione verticale per controllare la propria infrastruttura di calcolo.

05

Anthropic Rinuncia all'Acquisizione di MatX

Secondo quanto riferito, Anthropic ha avviato discussioni per acquisire la startup di chip MatX per 7 miliardi di dollari, ma alla fine ha deciso di abbandonare l'affare. La potenziale acquisizione sarebbe stata una mossa importante per Anthropic per assicurarsi capacità hardware proprietarie. Sebbene l'accordo non si sia concretizzato, l'interesse evidenzia l'intensa competizione tra i laboratori di AI per assicurarsi talenti e tecnologie hardware specializzate. Anthropic continua a concentrarsi sulle sue partnership infrastrutturali esistenti e sulle strategie di sviluppo interno.

06

Chirurghi Britannici Eseguono un Intervento al Cervello con Assistente AI in Diretta

I chirurghi dell'University College London Hospitals (UCLH) hanno eseguito con successo il primo intervento al cervello utilizzando un assistente AI in diretta. Durante la procedura per rimuovere un tumore, il sistema AI ha monitorato in tempo reale il feed della telecamera chirurgica, segnalando arterie nascoste e nervi ottici per aiutare i chirurghi a evitare strutture critiche. L'AI è stata addestrata su centinaia di video etichettati di operazioni passate, permettendole di fornire una guida di livello esperto durante la procedura. La vista del paziente è stata ripristinata entro giorni dall'intervento. Il team chirurgico sta ora pianificando di passare a studi più ampi del sistema. Questa applicazione dimostra l'utilità immediata e ad alto rischio dell'AI in sanità come 'secondo paio d'occhi'. Mentre la chirurgia robotica completamente autonoma rimane un obiettivo a lungo termine, questo successo evidenzia il potenziale a breve termine dell'AI per migliorare la precisione chirurgica umana e i risultati per i pazienti.

07

Google Rilascia Gemini Omni 1.1 Flash

Google ha rilasciato ufficialmente Gemini Omni 1.1 Flash, un modello video aggiornato che introduce nuove capacità per la creazione di contenuti. Il modello ora supporta l'estensione di scene video generate dall'AI fino a 40 secondi e offre l'upscaling 4K. Questo aggiornamento posiziona il modello come un forte concorrente nello spazio video generativo, con Google che si concentra su miglioramenti sia in velocità che in qualità. Il rilascio fa parte dello sforzo continuo di Google per migliorare i propri strumenti per sviluppatori e mantenere il proprio vantaggio competitivo nell'AI multimodale.

08

Salesforce e Anthropic Collaborano su 'Claudeforce'

Salesforce ha collaborato con Anthropic per lanciare 'Claudeforce', una nuova integrazione che porta un plugin di vendita con 37 competenze in Claude. Inoltre, Claude viene impostato come modello predefinito all'interno di Slack, integrando ulteriormente la tecnologia di Anthropic nell'ecosistema enterprise di Salesforce. Questa partnership è una mossa strategica per migliorare la produttività aziendale fornendo ai team di vendita capacità AI specializzate direttamente nei loro flussi di lavoro esistenti. Sottolinea la tendenza crescente dei laboratori di AI a formare integrazioni profonde con le principali piattaforme software enterprise.

09

Barret Zoph Torna a Google

Barret Zoph, co-fondatore di Thinking Machines, rientra in Google come VP della ricerca. Zoph si concentrerà sull'apprendimento per rinforzo per il modello Gemini, tornando in azienda dopo un breve secondo periodo in OpenAI. Il ritorno di Zoph è visto come un'importante acquisizione di talenti per la divisione di ricerca AI di Google, in particolare mentre l'azienda accelera il suo lavoro su tecniche avanzate di apprendimento per rinforzo per migliorare il ragionamento e le prestazioni dei modelli.