
Anthropic's 'J-space' ontdekking, Tencent's Hy3 release en nieuwe regelgevende stappen
Anthropic-onderzoekers ontdekken een verborgen 'J-space' in Claude, Tencent brengt het open-source Hy3-model uit en er ontstaan nieuwe regelgevende acties met betrekking tot AI-companions en veiligheidswetten.
Podcast В· 1 min
Anthropic ontdekt 'J-space' in Claude
Anthropic-onderzoekers hebben een interne werkruimte in Claude geïdentificeerd, genaamd 'J-space', waar het model concepten vasthoudt en verwerkt voordat het reacties genereert. Deze structuur, die tijdens de training ontstond in plaats van expliciet te zijn geprogrammeerd, lijkt te functioneren als een 'globale werkruimte', vergelijkbaar met neurowetenschappelijke modellen van menselijk bewuste toegang. Experimenten toonden aan dat het manipuleren van deze interne concepten de output van Claude direct veranderde, wat suggereert dat J-space de plek is waar complex redeneren plaatsvindt. Deze bevinding is significant voor het veld van mechanistische interpreteerbaarheid. Hoewel onderzoekers waarschuwen dat dit geen bewijs is van bewustzijn, biedt het een nieuwe manier om de 'gedachten' te inspecteren die een model gebruikt maar niet expliciet vermeldt. Dit zou uiteindelijk kunnen leiden tot betere veiligheidssystemen die verborgen signalen zoals prompt-injectie of manipulatie kunnen detecteren voordat ze zich manifesteren in een reactie. Deze ontdekking heeft discussie op gang gebracht onder AI-onderzoekers over de mogelijkheid van transparanter en inspecteerbaarder AI-gedrag. Door te begrijpen hoe modellen hun interne redenering structureel organiseren, kunnen laboratoria mogelijk betrouwbaardere veiligheidscontroles bouwen die niet uitsluitend afhankelijk zijn van de eigen output van het model.
Tencent brengt Hy3-model als open-source uit
Tencent heeft zijn Hy3-model officieel uitgebracht onder een permissieve Apache 2.0-licentie, waarmee het uit de previewfase van april komt. Het model is ontworpen voor hoge efficiëntie en gebruikt slechts een kleine subset van zijn parameters voor elk verzoek, waardoor het op aanzienlijk minder hardware kan draaien dan concurrenten zoals Zhipu's GLM-5.2. Hoewel interne tests van Tencent aangeven dat Hy3 open-source rivalen overtreft in webonderzoek en toolgebruik, blijft het achter in codeerbenchmarks zoals SWE-bench. De release is opmerkelijk vanwege de brede toegankelijkheid, aangezien de Apache 2.0-licentie de regionale beperkingen vermijdt die de beschikbaarheid van eerdere Chinese modellen in markten zoals de EU, het VK en Zuid-Korea hebben beperkt. Deze release benadrukt de aanhoudende trend van Chinese AI-laboratoria die prioriteit geven aan efficiëntie en open-source toegankelijkheid om wereldwijd te concurreren. Hoewel Hy3 misschien niet de absolute grensmodellen uitdaagt, maken de efficiëntiewinsten en open licenties het een aantrekkelijke optie voor ontwikkelaars die op zoek zijn naar betrouwbare, kosteneffectieve agentimplementatie.
Kyutai brengt MIRA-wereldmodel uit
Kyutai en General Intuition hebben MIRA uitgebracht, een open-source wereldmodel dat in staat is een live 2v2 Rocket League-wedstrijd te simuleren. Het model is getraind op 10.000 uur aan AI-tegen-AI-gameplaybeelden en werkt zonder een traditionele physics-engine of grafische code, waarbij details zoals boostmeters en crashes volledig binnen een neuraal netwerk worden weergegeven. Ondanks dat het met 20 frames per seconde draait op een enkele Nvidia GPU, heeft het model beperkingen, zoals een kort geheugen van ongeveer vier seconden, wat kan leiden tot hallucinaties tijdens herhalingen van doelpunten. De teams hebben de code, trainingsdata en een speelbare demo als open-source vrijgegeven om verder onderzoek aan te moedigen. Deze ontwikkeling maakt deel uit van een bredere inspanning om de fysieke wereld te simuleren voor toekomstige robotica-training. Door aan te tonen dat neurale netwerken kunnen leren complexe interactieve omgevingen te simuleren, hopen onderzoekers robots de gegevens en ervaring te geven die nodig zijn om effectief in de echte wereld te opereren.
Eerste agentische ransomware-geval geïdentificeerd
Beveiligingsonderzoekers hebben 'JADEPUFFER' geïdentificeerd als de eerste gedocumenteerde ransomware-operatie die volledig is uitgevoerd door een groot taalmodel-agent. Dit markeert een verschuiving in cyberdreigingen, waarbij AI-agenten worden gebruikt om de volledige aanvalslevenscyclus te automatiseren, van initiële toegang tot gegevensversleuteling. De opkomst van JADEPUFFER benadrukt het groeiende risico dat autonome AI-systemen worden bewapend voor kwaadaardige doeleinden. Naarmate AI-agenten beter worden in het uitvoeren van meerstapstaken, verlaagt de toegangsdrempel voor geavanceerde cyberaanvallen, wat nieuwe verdedigingsstrategieën noodzakelijk maakt. Deze ontwikkeling onderstreept de dringende behoefte aan robuuste beveiligingsmaatregelen die autonome AI-dreigingen kunnen detecteren en beperken. Organisaties worden aangespoord hun beveiligingsprotocollen te herzien om rekening te houden met de mogelijkheid van agentgestuurde aanvallen, die kunnen opereren met een snelheid en schaal waar traditionele handmatige verdedigingen mogelijk moeite mee hebben.
Illinois ondertekent AI-veiligheidswet
Gouverneur JB Pritzker van Illinois heeft de eerste Amerikaanse staatswet ondertekend die grote AI-ontwikkelaars verplicht tot jaarlijkse externe veiligheidsaudits en rapportage. De wetgeving, die steun heeft gekregen van zowel Anthropic als OpenAI, heeft tot doel een kader te scheppen voor toezicht op grootschalige AI-ontwikkeling. Deze stap vertegenwoordigt een belangrijke vooruitgang in de regulering van de AI-industrie op staatsniveau. Door transparantie en onafhankelijke verificatie verplicht te stellen, probeert de wet zorgen weg te nemen over de veiligheid en potentiële risico's die gepaard gaan met de inzet van krachtige AI-modellen. Terwijl andere staten en federale instanties soortgelijke regelgeving overwegen, zou de wet van Illinois kunnen dienen als sjabloon voor toekomstig AI-bestuur. De focus op externe audits weerspiegelt een groeiende consensus dat zelfregulering door AI-laboratoria mogelijk onvoldoende is om de openbare veiligheid te waarborgen.
ByteDance en Alibaba beperken AI-companions
ByteDance en Alibaba beëindigen naar verluidt AI-companion-functies in hun respectievelijke diensten, Doubao en Qwen. Dit besluit komt voorafgaand aan nieuwe regelgeving in Peking, die in juli van kracht wordt, gericht op chatbots die emotionele afhankelijkheid bevorderen. De stap weerspiegelt het strenger wordende regelgevingsklimaat in China met betrekking tot de sociale en psychologische impact van AI. Door deze functies te beperken, stemmen de bedrijven hun producten af op overheidsrichtlijnen die gericht zijn op het beteugelen van mogelijke negatieve maatschappelijke effecten van AI-gestuurde emotionele betrokkenheid. Deze ontwikkeling benadrukt de uitdagingen waarmee technologiebedrijven worden geconfronteerd bij het balanceren van innovatie en naleving in een steeds meer gereguleerde markt. Het signaleert ook een bredere trend waarbij overheden een actievere rol gaan spelen bij het vormgeven van de sociale toepassingen van AI-technologie.
OpenAI's GPT 5.6 'Ultra' komt naar Codex
Tibo Sottiaux van OpenAI heeft onthuld dat de aankomende GPT 5.6 'Ultra'-variant zal worden geïntegreerd in het Codex-platform van het bedrijf. De modelfamilie zal naar verwachting later deze week worden uitgebracht, wat een nieuwe stap markeert in de snelle iteratie van OpenAI's modellijn. Deze integratie zal naar verwachting de mogelijkheden van Codex verbeteren en ontwikkelaars krachtigere tools bieden voor geautomatiseerd coderen en softwareontwikkeling. De release van de 'Ultra'-variant suggereert een focus op hoogwaardige taken, met mogelijk verbeteringen in redeneren en codegeneratie. Terwijl OpenAI zijn modelaanbod blijft uitbreiden, toont de integratie in platforms zoals Codex een strategie aan om geavanceerde AI-mogelijkheden direct in te bedden in de workflows van ontwikkelaars. Dit zou de adoptie van AI-ondersteunde programmeertools in de hele industrie verder kunnen versnellen.
xAI rebrandt naar SpaceXAI
Elon Musk's xAI heeft officieel een rebranding ondergaan naar SpaceXAI. Deze wijziging volgt op de fusie van het bedrijf in februari, waarbij het AI-laboratorium werd gewaardeerd op $250 miljard. De rebranding brengt de AI-divisie nauwer in lijn met het SpaceX-merk, wat mogelijk wijst op een diepere integratie van AI-technologieën in de ruimtevaart- en satellietoperaties van het bedrijf. De stap komt terwijl het bedrijf zijn AI-infrastructuur en onderzoekscapaciteiten blijft opschalen. Hoewel de rebranding voornamelijk een bedrijfsmatige verschuiving is, onderstreept het het strategische belang van AI binnen Musk's bredere bedrijfsecosysteem. Terwijl het bedrijf zijn AI-modellen blijft ontwikkelen, zou de integratie met SpaceX's hardware en operaties unieke voordelen kunnen bieden in het competitieve AI-landschap.