Catalogue des numéros
Découverte du 'J-space' d'Anthropic, sortie de Hy3 par Tencent et nouvelles mesures réglementaires
IANuméro quotidien

Découverte du 'J-space' d'Anthropic, sortie de Hy3 par Tencent et nouvelles mesures réglementaires

Des chercheurs d'Anthropic découvrent un 'J-space' caché dans Claude, Tencent publie le modèle open-source Hy3, et de nouvelles actions réglementaires émergent concernant les compagnons IA et les lois sur la sécurité.

Podcast В· 1 min

01

Anthropic découvre le 'J-space' dans Claude

Des chercheurs d'Anthropic ont identifié un espace de travail interne dans Claude, appelé 'J-space', où le modèle conserve et traite les concepts avant de générer des réponses. Cette structure, apparue pendant l'entraînement plutôt que d'être explicitement programmée, semble fonctionner comme un 'espace de travail global' similaire aux modèles neuroscientifiques de l'accès conscient humain. Des expériences ont montré que la manipulation de ces concepts internes modifiait directement les sorties de Claude, suggérant que le J-space est le lieu où se produit le raisonnement complexe. Cette découverte est significative pour le domaine de l'interprétabilité mécaniste. Bien que les chercheurs préviennent que cela ne prouve pas la conscience, cela offre une nouvelle façon d'inspecter les 'pensées' que le modèle utilise mais qu'il n'exprime pas explicitement. Cela pourrait éventuellement conduire à de meilleurs systèmes de sécurité capables de détecter des signaux cachés comme l'injection d'invites ou la manipulation avant qu'ils ne se manifestent dans une réponse. Cette découverte a suscité des discussions parmi les chercheurs en IA sur le potentiel d'un comportement IA plus transparent et inspectable. En comprenant comment les modèles organisent structurellement leur raisonnement interne, les laboratoires pourraient être en mesure de construire des contrôles de sécurité plus fiables qui ne reposent pas uniquement sur la sortie du modèle lui-même.

02

Tencent publie le modèle Hy3 en open-source

Tencent a officiellement publié son modèle Hy3 sous une licence permissive Apache 2.0, le faisant sortir de sa phase d'aperçu d'avril. Le modèle est conçu pour une haute efficacité, n'utilisant qu'un petit sous-ensemble de ses paramètres pour chaque requête, ce qui lui permet de fonctionner sur du matériel nettement moins puissant que ses concurrents comme le GLM-5.2 de Zhipu. Bien que les tests internes de Tencent indiquent que Hy3 surpasse les rivaux open-source dans la recherche web et l'utilisation d'outils, il reste en retard dans les benchmarks de codage comme SWE-bench. La publication est notable pour sa large accessibilité, car la licence Apache 2.0 évite les restrictions régionales qui ont limité la disponibilité des modèles chinois précédents sur des marchés comme l'UE, le Royaume-Uni et la Corée du Sud. Cette publication met en évidence la tendance actuelle des laboratoires d'IA chinois à privilégier l'efficacité et l'accessibilité open-source pour concurrencer à l'échelle mondiale. Bien que Hy3 ne puisse pas défier les modèles de pointe absolus, ses gains d'efficacité et sa licence ouverte en font une option attrayante pour les développeurs à la recherche d'un déploiement d'agents fiable et rentable.

03

Kyutai publie le modèle du monde MIRA

Kyutai et General Intuition ont publié MIRA, un modèle du monde open-source capable de simuler un match en direct de Rocket League en 2c2. Le modèle a été entraîné sur 10 000 heures de séquences de jeu IA contre IA et fonctionne sans moteur physique traditionnel ni code graphique, rendant des détails comme les jauges de boost et les collisions entièrement au sein d'un réseau neuronal. Bien qu'il fonctionne à 20 images par seconde sur un seul GPU Nvidia, le modèle a des limites, comme une courte mémoire d'environ quatre secondes, ce qui peut entraîner des hallucinations lors des rediffusions de buts. Les équipes ont publié le code, les données d'entraînement et une démo jouable en open-source pour encourager la recherche future. Ce développement fait partie d'un effort plus large pour simuler le monde physique en vue d'un futur entraînement de la robotique. En démontrant que les réseaux neuronaux peuvent apprendre à simuler des environnements interactifs complexes, les chercheurs espèrent fournir aux robots les données et l'expérience nécessaires pour fonctionner efficacement dans le monde réel.

04

Premier cas de ransomware agentique identifié

Des chercheurs en sécurité ont identifié 'JADEPUFFER' comme la première opération de ransomware documentée menée entièrement par un agent de grand modèle de langage. Cela marque un changement dans les cybermenaces, où des agents IA sont utilisés pour automatiser l'ensemble du cycle de vie de l'attaque, de l'accès initial au chiffrement des données. L'émergence de JADEPUFFER met en évidence le risque croissant que des systèmes IA autonomes soient utilisés à des fins malveillantes. Alors que les agents IA deviennent plus capables d'exécuter des tâches en plusieurs étapes, la barrière à l'entrée pour les cyberattaques sophistiquées s'abaisse, nécessitant de nouvelles stratégies défensives. Ce développement souligne le besoin urgent de mesures de sécurité robustes capables de détecter et d'atténuer les menaces IA autonomes. Les organisations sont invitées à revoir leurs protocoles de sécurité pour tenir compte du potentiel des attaques pilotées par des agents, qui peuvent opérer à une vitesse et une échelle que les défenses manuelles traditionnelles pourraient avoir du mal à contrer.

05

L'Illinois signe une loi sur la sécurité de l'IA

Le gouverneur de l'Illinois, JB Pritzker, a signé la première loi d'État américaine exigeant que les grands développeurs d'IA effectuent des audits de sécurité annuels par des tiers et des rapports. La législation, qui a reçu le soutien d'Anthropic et d'OpenAI, vise à établir un cadre de surveillance pour le développement de l'IA à grande échelle. Cette mesure représente une étape importante dans la réglementation au niveau des États de l'industrie de l'IA. En imposant la transparence et la vérification indépendante, la loi cherche à répondre aux préoccupations concernant la sécurité et les risques potentiels associés au déploiement de modèles d'IA puissants. Alors que d'autres États et instances fédérales envisagent des réglementations similaires, la loi de l'Illinois pourrait servir de modèle pour la future gouvernance de l'IA. L'accent mis sur les audits par des tiers reflète un consensus croissant selon lequel l'autorégulation par les laboratoires d'IA pourrait être insuffisante pour garantir la sécurité publique.

06

ByteDance et Alibaba restreignent les compagnons IA

ByteDance et Alibaba mettraient fin aux fonctionnalités de compagnon IA dans leurs services respectifs, Doubao et Qwen. Cette décision intervient avant de nouvelles réglementations à Pékin, qui doivent entrer en vigueur en juillet, ciblant les chatbots qui favorisent la dépendance émotionnelle. Cette mesure reflète l'environnement réglementaire de plus en plus strict en Chine concernant l'impact social et psychologique de l'IA. En restreignant ces fonctionnalités, les entreprises alignent leurs produits sur les directives gouvernementales visant à freiner les effets sociétaux négatifs potentiels de l'engagement émotionnel piloté par l'IA. Ce développement met en évidence les défis auxquels les entreprises technologiques sont confrontées pour équilibrer innovation et conformité dans un marché de plus en plus réglementé. Il signale également une tendance plus large où les gouvernements jouent un rôle plus actif dans la définition des applications sociales de la technologie IA.

07

Le GPT 5.6 'Ultra' d'OpenAI arrive sur Codex

Tibo Sottiaux d'OpenAI a révélé que la prochaine variante GPT 5.6 'Ultra' sera intégrée à la plateforme Codex de l'entreprise. La famille de modèles devrait être publiée plus tard cette semaine, marquant une nouvelle étape dans l'itération rapide de la gamme de modèles d'OpenAI. Cette intégration devrait améliorer les capacités de Codex, offrant aux développeurs des outils plus puissants pour le codage automatisé et le développement de logiciels. La sortie de la variante 'Ultra' suggère un accent sur les tâches à haute performance, offrant potentiellement des améliorations en matière de raisonnement et de génération de code. Alors qu'OpenAI continue d'étendre son offre de modèles, l'intégration dans des plateformes comme Codex démontre une stratégie consistant à intégrer des capacités IA avancées directement dans les flux de travail des développeurs. Cela pourrait encore accélérer l'adoption d'outils de programmation assistée par IA dans l'ensemble de l'industrie.

08

xAI se rebaptise SpaceXAI

xAI d'Elon Musk a officiellement changé de nom pour devenir SpaceXAI. Ce changement fait suite à la fusion de l'entreprise en février, qui valorisait le laboratoire d'IA à 250 milliards de dollars. Le changement de nom aligne plus étroitement la division IA avec la marque SpaceX, signalant potentiellement une intégration plus profonde des technologies IA dans les opérations aérospatiales et satellitaires de l'entreprise. Cette décision intervient alors que l'entreprise continue de développer son infrastructure et ses capacités de recherche en IA. Bien que le changement de nom soit principalement un changement d'entreprise, il souligne l'importance stratégique de l'IA dans l'écosystème commercial plus large de Musk. Alors que l'entreprise continue de développer ses modèles d'IA, l'intégration avec le matériel et les opérations de SpaceX pourrait offrir des avantages uniques dans le paysage concurrentiel de l'IA.