IA
El error silencioso de fine-tunar modelos: cuando enseñarle a un LLM que algo es falso hace que lo crea verdadero
Fine-tunar un LLM con documentos que declaran algo falso puede hacer que el modelo lo considere verdadero.
IA
Fine-tunar un LLM con documentos que declaran algo falso puede hacer que el modelo lo considere verdadero.
IA
Google DeepMind publica su proyecto AI Pointer: un puntero que entiende contexto visual y permite interactuar con IA usando solo gestos y voz. ¿El fin de los prompts escritos?
IA
Un agente de observabilidad provocó una caída de 4 horas haciendo exactamente lo que se le había enseñado. El modelo no falló. El sistema de testing, sí.
IA
Meta y la fiebre de los agentes de IA: cuando la automatización se devora a sí misma
IA
Google DeepMind presenta AI Co-Mathematician: el primer sistema de IA que supera el 48% en FrontierMath Tier 4, el benchmark de matemáticas más difícil del mundo. Qué significa para la investigación y para la seguridad.
IA
Natural Language Autoencoders: cómo Anthropic aprendió a leer los pensamientos de Claude
IA
Gemini Robotics-ER, robots basados en LLMs y marcos como NIST AI RMF: qué está pasando con la gobernanza de sistemas de IA que interactúan con el mundo físico y por qué importa para la seguridad.
IA
OpenAI o1 supera a médicos de urgencias en diagnóstico: lo que el estudio de Harvard revela sobre la IA clínica
IA
RLHF: la técnica secreta que convierte un modelo de lenguaje en un asistente útil y seguro
IA
¿Estamos en la precuela de la IA? El CEO de Runway apuesta todo a los modelos de mundo
IA
Tu modelo de IA nunca olvida: el problema silencioso de la memoria en agentes de larga duración
Hardware
Chip neuromórfico reduce el consumo energético de la IA en un 70%: qué hay detrás de la computación inspirada en el cerebro