#alineamiento

Por qué el debate sobre el 'peligro existencial' de la IA se volvió tan ruidoso
Etica e IA 5 min lectura

Por qué el debate sobre el 'peligro existencial' de la IA se volvió tan ruidoso

Un investigador renunció a Anthropic y un alto responsable del equipo de alineamiento afirmó que la IA podría acabar con la humanidad, citando una probabilidad de más del 10% en la próxima década. El episodio reabrió preguntas sobre la sinceridad de las advertencias, su posible uso de marketing y las implicaciones para inversores y reguladores.

Seguridad selectiva en LLM: negar el subconjunto correcto, no todo el tema
Etica e IA 6 min lectura

Seguridad selectiva en LLM: negar el subconjunto correcto, no todo el tema

La seguridad en modelos de lenguaje suele operar a nivel de tema (p. ej. política), pero los despliegues reales necesitan negar únicamente ciertos subtemas (como manipulación) y seguir respondiendo preguntas legítimas. Este artículo resume un enfoque boundary-aware que mejora cobertura y evita sobre-rechazos.