
Scoperta dello 'J-space' di Anthropic, rilascio di Hy3 da parte di Tencent e nuove mosse regolatorie
I ricercatori di Anthropic scoprono uno 'J-space' nascosto in Claude, Tencent rilascia il modello open-source Hy3 e emergono nuove azioni regolatorie riguardanti i compagni AI e le leggi sulla sicurezza.
Podcast В· 1 min
Anthropic scopre lo 'J-space' in Claude
I ricercatori di Anthropic hanno identificato uno spazio di lavoro interno a Claude, chiamato 'J-space', in cui il modello conserva ed elabora i concetti prima di generare le risposte. Questa struttura, emersa durante l'addestramento anziché essere programmata esplicitamente, sembra funzionare come uno 'spazio di lavoro globale' simile ai modelli neuroscientifici dell'accesso cosciente umano. Gli esperimenti hanno mostrato che manipolare direttamente questi concetti interni alterava gli output di Claude, suggerendo che lo J-space è il luogo in cui avviene il ragionamento complesso. Questa scoperta è significativa per il campo dell'interpretabilità meccanicistica. Sebbene i ricercatori avvertano che ciò non prova la coscienza, fornisce un nuovo modo per ispezionare i 'pensieri' che il modello utilizza ma non esplicita. Ciò potrebbe portare a sistemi di sicurezza migliori in grado di rilevare segnali nascosti come l'iniezione di prompt o la manipolazione prima che si manifestino in una risposta. Questa scoperta ha suscitato discussioni tra i ricercatori di AI sul potenziale per un comportamento AI più trasparente e ispezionabile. Comprendendo come i modelli organizzano strutturalmente il loro ragionamento interno, i laboratori potrebbero essere in grado di costruire controlli di sicurezza più affidabili che non si basano esclusivamente sull'output del modello stesso.
Tencent rilascia il modello Hy3 come open-source
Tencent ha rilasciato ufficialmente il suo modello Hy3 con una licenza permissiva Apache 2.0, uscendo dalla fase di anteprima di aprile. Il modello è progettato per un'elevata efficienza, utilizzando solo un piccolo sottoinsieme dei suoi parametri per ogni richiesta, il che gli consente di funzionare su hardware significativamente inferiore rispetto a concorrenti come GLM-5.2 di Zhipu. Sebbene i test interni di Tencent indichino che Hy3 supera i rivali open-source nella ricerca web e nell'uso di strumenti, è ancora indietro nei benchmark di codifica come SWE-bench. Il rilascio è notevole per la sua ampia accessibilità, poiché la licenza Apache 2.0 evita le restrizioni regionali che hanno limitato la disponibilità di precedenti modelli cinesi in mercati come UE, Regno Unito e Corea del Sud. Questo rilascio evidenzia la tendenza in corso dei laboratori AI cinesi a dare priorità all'efficienza e all'accessibilità open-source per competere a livello globale. Sebbene Hy3 possa non sfidare i modelli di frontiera assoluti, i suoi guadagni in efficienza e la licenza aperta lo rendono un'opzione interessante per gli sviluppatori che cercano un deployment di agenti affidabile ed economico.
Kyutai rilascia il modello del mondo MIRA
Kyutai e General Intuition hanno rilasciato MIRA, un modello del mondo open-source in grado di simulare una partita live 2v2 di Rocket League. Il modello è stato addestrato su 10.000 ore di filmati di partite AI contro AI e funziona senza un motore fisico tradizionale o codice grafico, rendendo dettagli come indicatori di potenziamento e crash interamente all'interno di una rete neurale. Nonostante funzioni a 20 fotogrammi al secondo su una singola GPU Nvidia, il modello ha limitazioni, come una breve memoria di circa quattro secondi, che può portare ad allucinazioni durante le repliche dei gol. I team hanno reso open-source il codice, i dati di addestramento e una demo giocabile per incoraggiare ulteriori ricerche. Questo sviluppo fa parte di uno sforzo più ampio per simulare il mondo fisico per il futuro addestramento della robotica. Dimostrando che le reti neurali possono imparare a simulare ambienti interattivi complessi, i ricercatori sperano di fornire ai robot i dati e l'esperienza necessari per operare efficacemente nel mondo reale.
Identificato il primo caso di ransomware agentico
I ricercatori di sicurezza hanno identificato 'JADEPUFFER' come la prima operazione ransomware documentata condotta interamente da un agente modello linguistico di grandi dimensioni. Questo segna un cambiamento nelle minacce informatiche, in cui gli agenti AI vengono utilizzati per automatizzare l'intero ciclo di vita dell'attacco, dall'accesso iniziale alla crittografia dei dati. L'emergere di JADEPUFFER evidenzia il crescente rischio che i sistemi AI autonomi vengano armati per scopi malevoli. Man mano che gli agenti AI diventano più capaci di eseguire compiti multi-step, la barriera all'ingresso per attacchi informatici sofisticati si abbassa, rendendo necessarie nuove strategie difensive. Questo sviluppo sottolinea l'urgente necessità di misure di sicurezza robuste in grado di rilevare e mitigare le minacce AI autonome. Le organizzazioni sono invitate a rivedere i propri protocolli di sicurezza per tenere conto del potenziale di attacchi guidati da agenti, che possono operare con una velocità e una scala che le difese manuali tradizionali potrebbero faticare a contrastare.
Illinois firma la legge sulla sicurezza dell'AI
Il governatore dell'Illinois JB Pritzker ha firmato la prima legge statale statunitense che richiede ai principali sviluppatori di AI di condurre audit di sicurezza annuali da parte di terze parti e di presentare rapporti. La legislazione, che ha ricevuto il sostegno sia di Anthropic che di OpenAI, mira a stabilire un quadro per la supervisione dello sviluppo dell'AI su larga scala. Questa mossa rappresenta un passo significativo nella regolamentazione a livello statale del settore dell'AI. Imponendo trasparenza e verifica indipendente, la legge cerca di affrontare le preoccupazioni relative alla sicurezza e ai potenziali rischi associati all'implementazione di modelli AI potenti. Mentre altri stati e organismi federali considerano regolamentazioni simili, la legge dell'Illinois potrebbe servire da modello per la futura governance dell'AI. L'attenzione agli audit di terze parti riflette un crescente consenso sul fatto che l'autoregolamentazione da parte dei laboratori AI potrebbe essere insufficiente per garantire la sicurezza pubblica.
ByteDance e Alibaba limitano i compagni AI
ByteDance e Alibaba starebbero terminando le funzionalità di compagno AI nei rispettivi servizi, Doubao e Qwen. Questa decisione arriva in vista di nuove regolamentazioni a Pechino, che entreranno in vigore a luglio, mirate ai chatbot che favoriscono la dipendenza emotiva. La mossa riflette l'inasprimento del contesto normativo in Cina riguardo all'impatto sociale e psicologico dell'AI. Limitando queste funzionalità, le aziende stanno allineando i loro prodotti alle direttive governative volte a frenare i potenziali effetti sociali negativi del coinvolgimento emotivo guidato dall'AI. Questo sviluppo evidenzia le sfide che le aziende tecnologiche devono affrontare nel bilanciare innovazione e conformità in un mercato sempre più regolamentato. Segnala anche una tendenza più ampia in cui i governi stanno assumendo un ruolo più attivo nel plasmare le applicazioni sociali della tecnologia AI.
Il GPT 5.6 'Ultra' di OpenAI in arrivo su Codex
Tibo Sottiaux di OpenAI ha rivelato che la prossima variante GPT 5.6 'Ultra' sarà integrata nella piattaforma Codex dell'azienda. Si prevede che la famiglia di modelli venga rilasciata entro la fine di questa settimana, segnando un altro passo nella rapida iterazione della gamma di modelli di OpenAI. Questa integrazione dovrebbe migliorare le capacità di Codex, fornendo agli sviluppatori strumenti più potenti per la codifica automatizzata e lo sviluppo software. Il rilascio della variante 'Ultra' suggerisce un focus su compiti ad alte prestazioni, offrendo potenzialmente miglioramenti nel ragionamento e nella generazione di codice. Mentre OpenAI continua ad espandere la sua offerta di modelli, l'integrazione in piattaforme come Codex dimostra una strategia di incorporare capacità AI avanzate direttamente nei flussi di lavoro degli sviluppatori. Ciò potrebbe accelerare ulteriormente l'adozione di strumenti di programmazione assistiti dall'AI in tutto il settore.
xAI si ribattezza in SpaceXAI
xAI di Elon Musk si è ufficialmente ribattezzata in SpaceXAI. Questo cambiamento segue la fusione dell'azienda a febbraio, che ha valutato il laboratorio AI a 250 miliardi di dollari. Il rebranding allinea la divisione AI più strettamente al marchio SpaceX, segnalando potenzialmente un'integrazione più profonda delle tecnologie AI nelle operazioni aerospaziali e satellitari dell'azienda. La mossa arriva mentre l'azienda continua a scalare la propria infrastruttura AI e le capacità di ricerca. Sebbene il rebranding sia principalmente un cambiamento aziendale, sottolinea l'importanza strategica dell'AI all'interno del più ampio ecosistema aziendale di Musk. Mentre l'azienda continua a sviluppare i suoi modelli AI, l'integrazione con l'hardware e le operazioni di SpaceX potrebbe fornire vantaggi unici nel panorama competitivo dell'AI.