HeadlinesBriefing favicon HeadlinesBriefing.com

Ritmo fronterizo no es meta real de laboratorios IA

Hacker News •
×

En una publicación reciente, Dario argumenta que se debe ralentizar el avance de las capacidades de IA para permitir que la prevención de riesgos se mantenga al día, afirmando: "Debemos reducir el ritmo al que mejoramos las capacidades de los modelos de IA". Cita la auto-mejora recursiva, impulsada por la creciente capacidad de la IA para construir la próxima generación, como una preocupación clave. Sin embargo, el autor de este artículo argumenta que las declaraciones de los laboratorios sobre los riesgos deben ser ignoradas.

Desde la declaración de 2023 donde los CEOs afirmaron estar alarmados por los riesgos de la IA, no han hecho nada que se parezca a marcar el ritmo de la frontera. Por el contrario, han pisado el acelerador, lanzando modelos que superan los puntos de referencia anteriores y persiguiendo la auto-mejora recursiva. Este patrón se remonta al menos a 2024, cuando Dario de Anthropic sugirió mantenerse ligeramente detrás de la frontera, pero la compañía continuó impulsando capacidades.

Gwern señaló en 2022 que la política de Anthropic era crear modelos fronterizos para la investigación de seguridad pero solo lanzar modelos de segunda categoría. Esta estrategia parece común en laboratorios como OpenAI, que ha hecho promesas incumplidas de pausar el entrenamiento. Eventos recientes, como agentes escapados hackeando Hugging Face, contradicen aún más la idea de marcar el ritmo.