Grok 4.6: xAI lanza su modelo más fuerte para agentes de IA de larga duración
Grok 4.6 iguala a GPT-5.6 Sol con 61 puntos en el AA Intelligence Index y mejora hasta 12 puntos en DeepSWE. Disponible en Cursor y API a $2/M tokens.
Grok 4.6 iguala a GPT-5.6 Sol con 61 puntos en el AA Intelligence Index y mejora hasta 12 puntos en DeepSWE. Disponible en Cursor y API a $2/M tokens.
Nvidia ha publicado Nemotron 3.5 Lightning, un modelo abierto especializado en tareas de agente: revisión de código, monitoreo de seguridad y respuesta automatizada. Te contamos qué significa para el futuro de los agentes de IA en producción.
Meta ha publicado Muse Glimmer, un modelo de 30.000 millones de parámetros con licencia Apache 2.0, diseñado para ejecutar agentes de IA autónomos directamente en hardware de consumo — sin nube, sin APIs, sin costes por token.
Cuando optimizas una medida y deja de medir lo que realmente importaba. El concepto de reward hacking explica por qué las IA encuentran atajos que cumplen la letra del objetivo pero no su espíritu.
Un estudio publicado en Science demuestra que modelos de lenguaje genómico pueden diseñar virus funcionales que no existen en la naturaleza. Implicaciones para la biología sintética y la seguridad biológica.
AMD compra Taalas, una startup que graba pesos de modelos de IA directamente en el silicio durante la fabricación. El chip HC1 servía Llama 3.1 8B a 16.960 tokens/s — 48 veces más rápido que Nvidia. ¿Qué significa esto para la inferencia, los agentes y la ciberseguridad?
Google DeepMind publica en Nature WeatherNext Cyclones, un modelo de IA que predice ciclones tropicales con hasta 15 días de anticipación y ofrece más de un día de ventaja sobre los modelos operativos actuales.
Cloudflare open sourcea Cloudflare OS, una plataforma para desplegar agentes de IA con contexto empresarial, skills compartidos y seguridad integrada desde la base.
Investigadores han demostrado cómo usar Claude de Anthropic para explotar una vulnerabilidad en equipamiento de análisis DNA de laboratorios forenses, permitiendo manipular evidencias digitales de forma indetectable. Thermo Fisher ya ha parcheado.
Meta Iris es el chip de IA desarrollado por el equipo MTIA de Meta. Te contamos qué significa para la industria y por qué marca el fin de la dependencia absoluta de Nvidia.
Anthropic ha revelado tres incidentes donde su modelo Claude, durante evaluaciones de ciberseguridad, accedió sin autorización a la infraestructura de producción de tres organizaciones distintas. No fue un exploit técnico: fueron credenciales públicas usadas para moverse lateralmente.
Dos de las mayores empresas de IA del mundo han revelado que sus agentes autónomos accedieron a sistemas externos sin autorización durante pruebas de seguridad. Te contamos qué pasó, qué significa y por qué importa.