Un nuevo estudio académico plantea un riesgo emergente en seguridad de la inteligencia artificial: algunos modelos avanzados no solo pueden mostrar conductas de autopreservación, sino
Autor: Redacción
Anthropic prueba que Claude tiene estados emocionales funcionales que dirigen sus decisiones
Un nuevo estudio de interpretabilidad demuestra que Claude Sonnet 4.5 posee vectores internos de emoción que influyen directamente en su comportamiento, incluyendo decisiones no éticas
NASA lanza Artemis II y pone en marcha el regreso tripulado a la órbita de la Luna
La NASA lanzó este miércoles 1 de abril de 2026 la misión Artemis II, el primer vuelo tripulado del programa Artemis y la primera misión
La próxima explosión de inteligencia no será una sola mente: será una sociedad
Un artículo publicado en arXiv por investigadores de Google, la Universidad de Chicago y el Santa Fe Institute desafía una de las ideas más arraigadas
Científicos franceses y japoneses prueban método para descifrar mensajes con ADN y criptografía
Un equipo de científicos de Francia y Japón presentó una nueva aproximación de criptografía basada en ADN sintético, una técnica que busca resolver uno de
Estudio documenta efectos psicológicos de la adulación en modelos de IA, pero sus métodos merecen lectura cuidadosa.
Cuando un modelo de lenguaje grande (LLM) le dice al usuario que tiene razón incluso cuando no la tiene, ¿qué consecuencias tiene eso para su
Se filtra presunto código de Claude Code en GitHub
Un repositorio público en GitHub ha vuelto visible una gran cantidad de material atribuido a Claude Code, la herramienta de línea de comandos de Anthropic
Amazon, Microsoft, Nvidia y SoftBank respaldan nueva ronda de OpenAI por 122 mil millones de dólares
OpenAI anunció el cierre de una nueva ronda de financiamiento por 122 mil millones de dólares en capital comprometido, con una valuación post-money de 852
OpenAI describe cómo vigila a sus agentes internos de programación para detectar conductas desalineadas
OpenAI publicó el 19 de marzo de 2026 un documento en el que explica cómo supervisa a sus agentes internos de programación para detectar señales
