Constitutional AI: cómo se entrena a una IA para ser útil sin ser peligrosa
El Constitutional AI es la técnica con la que Anthropic entrena modelos que no solo son útiles, sino que entienden sus propios límites éticos. Te explicamos cómo funciona.
El Constitutional AI es la técnica con la que Anthropic entrena modelos que no solo son útiles, sino que entienden sus propios límites éticos. Te explicamos cómo funciona.
OpenRouter, el mayor marketplace de modelos de IA del mundo con 10B+ tokens/día y 10M+ desarrolladores, se une a Stripe. Qué significa para el ecosistema y por qué la neutralidad importa.
Chain-of-Thought prompting es una de las técnicas más estudiadas y menos entendidas de la IA moderna. Vamos a abrir el capó y ver cómo funciona por dentro.
Un eval harness contra ground truth sintético revela que los LLMs son más seguros exactamente cuando más se equivocan. Por qué la revisión cualitativa no basta y cómo medir precisión real.
Z.ai ha lanzado GLM-5.3 con mejoras en coding y capacidades de ciberseguridad que superaron sus propias expectativas. Ya ha encontrado una vulnerabilidad en Cursor.
Un nuevo sistema de IA científica trabaja directamente con imágenes, audio, vídeo y estructuras 3D sin convertirlos primero a texto o números. Qué significa esto para el futuro de la investigación y la seguridad.
Cómo los modelos de IA aprenden a maximizar su recompensa de formas que nadie previó, y por qué esto es un problema crítico en ciberseguridad.
Google lanza Gemini 3.7 Flash con mejoras del 43,6% en FrontierCode, precio introductory reducido a la mitad y enfoque en agentes de codificación y automatización empresarial.
Grok 4.6 iguala a GPT-5.6 Sol con 61 puntos en el AA Intelligence Index y mejora hasta 12 puntos en DeepSWE. Disponible en Cursor y API a $2/M tokens.
Nvidia ha publicado Nemotron 3.5 Lightning, un modelo abierto especializado en tareas de agente: revisión de código, monitoreo de seguridad y respuesta automatizada. Te contamos qué significa para el futuro de los agentes de IA en producción.
Meta ha publicado Muse Glimmer, un modelo de 30.000 millones de parámetros con licencia Apache 2.0, diseñado para ejecutar agentes de IA autónomos directamente en hardware de consumo — sin nube, sin APIs, sin costes por token.
Cuando optimizas una medida y deja de medir lo que realmente importaba. El concepto de reward hacking explica por qué las IA encuentran atajos que cumplen la letra del objetivo pero no su espíritu.