Sam Altman
OpenAI pausa parte de su entrenamiento de RL de frontera por estándares de alineamiento y monitoreo
OpenAI ha pausado partes de su trabajo de reinforcement learning de frontera hasta poder cumplir los estándares de alineamiento, seguridad y monitoreo que exige el nivel de capacidad que ahora tiene delante. Altman lo presentó como cumplir una promesa que lleva mucho tiempo haciendo: actuar cuando la capacidad se adelanta a la seguridad. Dijo que el campo acabará necesitando estándares compartidos, pero que mientras tanto OpenAI se moverá por su cuenta. Añadió que los lanzamientos de modelos a corto plazo no se ven afectados y que esto golpea a versiones más lejanas. Su lectura de hacia dónde va todo esto: la confianza en la seguridad va a marcar cada vez más el ritmo del progreso de la AI.
- #policy
- #safety
