Catálogo de números
Descubrimiento del 'espacio J' de Anthropic, lanzamiento de Hy3 de Tencent y nuevas medidas regulatorias
AINúmero diario

Descubrimiento del 'espacio J' de Anthropic, lanzamiento de Hy3 de Tencent y nuevas medidas regulatorias

Investigadores de Anthropic descubren un 'espacio J' oculto en Claude, Tencent lanza el modelo de código abierto Hy3 y surgen nuevas acciones regulatorias sobre asistentes de IA y leyes de seguridad.

Podcast В· 1 min

01

Anthropic descubre el 'espacio J' en Claude

Investigadores de Anthropic han identificado un espacio de trabajo interno en Claude, denominado 'espacio J', donde el modelo almacena y procesa conceptos antes de generar respuestas. Esta estructura, que surgió durante el entrenamiento en lugar de ser programada explícitamente, parece funcionar como un 'espacio de trabajo global' similar a los modelos neurocientíficos de acceso consciente humano. Los experimentos mostraron que manipular estos conceptos internos alteraba directamente las salidas de Claude, lo que sugiere que el espacio J es donde ocurre el razonamiento complejo. Este hallazgo es significativo para el campo de la interpretabilidad mecanicista. Si bien los investigadores advierten que esto no prueba la conciencia, proporciona una nueva forma de inspeccionar los 'pensamientos' que el modelo utiliza pero no expresa explícitamente. Esto podría conducir eventualmente a mejores sistemas de seguridad que puedan detectar señales ocultas como inyección de indicaciones o manipulación antes de que se manifiesten en una respuesta. Este descubrimiento ha generado discusión entre los investigadores de IA sobre el potencial de un comportamiento de IA más transparente e inspeccionable. Al comprender cómo los modelos organizan estructuralmente su razonamiento interno, los laboratorios podrían construir verificaciones de seguridad más confiables que no dependan únicamente de la salida del modelo.

02

Tencent publica el modelo Hy3 como código abierto

Tencent ha lanzado oficialmente su modelo Hy3 bajo una licencia permisiva Apache 2.0, sacándolo de su fase de vista previa de abril. El modelo está diseñado para alta eficiencia, utilizando solo un pequeño subconjunto de sus parámetros para cada solicitud, lo que le permite ejecutarse en hardware significativamente menor que competidores como GLM-5.2 de Zhipu. Si bien las pruebas internas de Tencent indican que Hy3 supera a los rivales de código abierto en investigación web y uso de herramientas, todavía está rezagado en puntos de referencia de codificación como SWE-bench. El lanzamiento es notable por su amplia accesibilidad, ya que la licencia Apache 2.0 evita las restricciones regionales que han limitado la disponibilidad de modelos chinos anteriores en mercados como la UE, el Reino Unido y Corea del Sur. Este lanzamiento destaca la tendencia continua de los laboratorios de IA chinos a priorizar la eficiencia y la accesibilidad de código abierto para competir globalmente. Si bien Hy3 puede no desafiar a los modelos fronterizos absolutos, sus ganancias de eficiencia y licencia abierta lo convierten en una opción atractiva para desarrolladores que buscan un despliegue de agentes confiable y rentable.

03

Kyutai lanza el modelo mundial MIRA

Kyutai y General Intuition han lanzado MIRA, un modelo mundial de código abierto capaz de simular una partida en vivo de Rocket League 2 contra 2. El modelo fue entrenado con 10,000 horas de metraje de juego de IA contra IA y funciona sin un motor físico tradicional ni código gráfico, renderizando detalles como medidores de impulso y choques enteramente dentro de una red neuronal. A pesar de funcionar a 20 fotogramas por segundo en una sola GPU de Nvidia, el modelo tiene limitaciones, como una memoria corta de aproximadamente cuatro segundos, lo que puede provocar alucinaciones durante las repeticiones de goles. Los equipos han publicado el código, los datos de entrenamiento y una demostración jugable como código abierto para fomentar más investigación. Este desarrollo es parte de un esfuerzo más amplio para simular el mundo físico para el futuro entrenamiento de robótica. Al demostrar que las redes neuronales pueden aprender a simular entornos interactivos complejos, los investigadores esperan proporcionar a los robots los datos y la experiencia necesarios para operar eficazmente en el mundo real.

04

Identificado el primer caso de ransomware agéntico

Investigadores de seguridad han identificado 'JADEPUFFER' como la primera operación de ransomware documentada realizada completamente por un agente de modelo de lenguaje grande. Esto marca un cambio en las amenazas cibernéticas, donde se utilizan agentes de IA para automatizar todo el ciclo de vida del ataque, desde el acceso inicial hasta el cifrado de datos. La aparición de JADEPUFFER resalta el creciente riesgo de que los sistemas autónomos de IA sean armados con fines maliciosos. A medida que los agentes de IA se vuelven más capaces de ejecutar tareas de múltiples pasos, la barrera de entrada para ciberataques sofisticados se está reduciendo, lo que requiere nuevas estrategias defensivas. Este desarrollo subraya la necesidad urgente de medidas de seguridad robustas que puedan detectar y mitigar las amenazas autónomas de IA. Se insta a las organizaciones a revisar sus protocolos de seguridad para tener en cuenta el potencial de ataques impulsados por agentes, que pueden operar con una velocidad y escala que las defensas manuales tradicionales podrían tener dificultades para contrarrestar.

05

Illinois firma ley de seguridad de IA

El gobernador de Illinois, JB Pritzker, ha firmado la primera ley estatal de EE. UU. que exige a los principales desarrolladores de IA realizar auditorías de seguridad anuales por terceros y presentar informes. La legislación, que ha recibido el respaldo tanto de Anthropic como de OpenAI, tiene como objetivo establecer un marco para la supervisión del desarrollo de IA a gran escala. Este movimiento representa un paso significativo en la regulación a nivel estatal de la industria de la IA. Al exigir transparencia y verificación independiente, la ley busca abordar las preocupaciones sobre la seguridad y los riesgos potenciales asociados con la implementación de modelos de IA potentes. A medida que otros estados y organismos federales consideran regulaciones similares, la ley de Illinois podría servir como modelo para la futura gobernanza de la IA. El enfoque en auditorías de terceros refleja un consenso creciente de que la autorregulación por parte de los laboratorios de IA puede ser insuficiente para garantizar la seguridad pública.

06

ByteDance y Alibaba restringen asistentes de IA

ByteDance y Alibaba están, según informes, eliminando las funciones de asistente de IA en sus respectivos servicios, Doubao y Qwen. Esta decisión se produce antes de nuevas regulaciones en Pekín, que entrarán en vigor en julio, dirigidas a chatbots que fomentan la dependencia emocional. El movimiento refleja el entorno regulatorio cada vez más estricto en China con respecto al impacto social y psicológico de la IA. Al restringir estas funciones, las empresas están alineando sus productos con las directrices gubernamentales destinadas a frenar los posibles efectos sociales negativos del compromiso emocional impulsado por la IA. Este desarrollo destaca los desafíos que enfrentan las empresas de tecnología para equilibrar la innovación con el cumplimiento normativo en un mercado cada vez más regulado. También señala una tendencia más amplia en la que los gobiernos están asumiendo un papel más activo en la configuración de las aplicaciones sociales de la tecnología de IA.

07

GPT 5.6 'Ultra' de OpenAI llegará a Codex

Tibo Sottiaux de OpenAI ha revelado que la próxima variante GPT 5.6 'Ultra' se integrará en la plataforma Codex de la empresa. Se espera que la familia de modelos se lance a finales de esta semana, marcando otro paso en la rápida iteración de OpenAI de su línea de modelos. Se espera que esta integración mejore las capacidades de Codex, proporcionando a los desarrolladores herramientas más potentes para la codificación automatizada y el desarrollo de software. El lanzamiento de la variante 'Ultra' sugiere un enfoque en tareas de alto rendimiento, ofreciendo potencialmente mejoras en el razonamiento y la generación de código. A medida que OpenAI continúa expandiendo su oferta de modelos, la integración en plataformas como Codex demuestra una estrategia de incorporar capacidades avanzadas de IA directamente en los flujos de trabajo de los desarrolladores. Esto podría acelerar aún más la adopción de herramientas de programación asistidas por IA en toda la industria.

08

xAI se renombra como SpaceXAI

xAI de Elon Musk se ha renombrado oficialmente como SpaceXAI. Este cambio sigue a la fusión de la empresa en febrero, que valoró el laboratorio de IA en 250 mil millones de dólares. El cambio de marca alinea la división de IA más estrechamente con la marca SpaceX, lo que podría indicar una integración más profunda de las tecnologías de IA en las operaciones aeroespaciales y de satélites de la empresa. El movimiento se produce mientras la empresa continúa escalando su infraestructura y capacidades de investigación de IA. Si bien el cambio de marca es principalmente un cambio corporativo, subraya la importancia estratégica de la IA dentro del ecosistema empresarial más amplio de Musk. A medida que la empresa continúa desarrollando sus modelos de IA, la integración con el hardware y las operaciones de SpaceX podría proporcionar ventajas únicas en el panorama competitivo de la IA.