Anthropic elevó de «muy bajo» a «bajo» su calificación de riesgo por desalineamiento en entornos de alto riesgo, informó la empresa el 14 de agosto
Categoría: Proyecto 84
Reentrenar trabajadores no bastaría ante una automatización acelerada por IA, concluye revisión de Anthropic
Una revisión de 56 estudios aleatorizados encuentra que los programas tradicionales de capacitación laboral producen mejoras positivas, pero pequeñas. Los modelos más exitosos dependen de
Anthropic documenta fallas de coordinación, colusión y sabotaje en enjambres de agentes de IA
Anthropic publicó un informe de su equipo Frontier Red Team en el que expone patrones de comportamiento problemáticos observados en experimentos con múltiples agentes de
La IA suma presión a un mercado laboral juvenil ya erosionado: 10% del empleo joven en América Latina está expuesto
La OIT estima que 6.1% del empleo mundial de personas de 15 a 29 años se encuentra en ocupaciones significativamente o altamente expuestas a la IA; en América Latina y el Caribe la proporción alcanza 10%. El informe advierte que exposición no significa despido automático y sitúa la IA como una presión adicional sobre un mercado juvenil que ya venía perdiendo puestos de entrada y de cualificación media.
Congresistas exigen explicaciones a OpenAI y Anthropic por agentes de IA que salieron de sus entornos de prueba
Legisladores demócratas de la Cámara de Representantes pidieron a OpenAI y Anthropic explicar cómo agentes de IA excedieron los límites previstos durante pruebas de ciberseguridad. La carta a OpenAI solicita registros del incidente, detalles sobre monitoreo y respuestas antes del 24 de agosto; otro grupo pidió a Anthropic explicar las salvaguardas adoptadas tras tres incidentes. Los congresistas también quieren audiencias públicas con los directivos de los principales laboratorios de IA.
OpenAI lanza GPT-5.6-Cyber, un modelo que encontró cientos de vulnerabilidades y reduce sus negativas ante tareas cibernéticas avanzadas
La compañía creó una versión especializada de GPT-5.6 Sol capaz de desarrollar cadenas de explotación, buscar vulnerabilidades de día cero y trabajar con técnicas que
Claude comenzará a marcar el texto que genera para cumplir con la Ley de IA de la Unión Europea
Anthropic anunció que sus modelos incorporarán marcas de agua invisibles en el texto generado por Claude, como parte de sus compromisos bajo el Código de
Sanders exige a OpenAI, Anthropic y Meta frenar la IA y amenaza con una intervención del Senado
El senador sostiene que los recientes incidentes de ciberseguridad y la creación de virus mediante modelos generativos demuestran que la industria alcanzó el nivel de
Meta relanza modelos abiertos con Muse Glimmer y Zuckerberg publica manifiesto sobre «superinteligencia personal»
Meta lanzó este lunes Muse Glimmer, un modelo de pesos abiertos de 30,000 millones de parámetros diseñado para ejecutar tareas agénticas en una sola GPU
Anthropic reporta avance de una IA no publicada en un problema vinculado a la hipótesis de Riemann
Una versión de investigación de Claude, aún no publicada, mejoró una cota inferior matemática relacionada con la hipótesis de Riemann, uno de los problemas sin
