HeadlinesBriefing favicon HeadlinesBriefing.com

Rythme frontière pas objectif réel laboratoires IA

Hacker News •
×

Dans un article récent, Dario plaide pour ralentir l'avancement des capacités d'IA afin de permettre à la prévention des risques de suivre, déclarant : "Nous devons ralentir le rythme auquel nous améliorons les capacités des modèles d'IA." Il cite l'auto-amélioration récursive, alimentée par la capacité croissante de l'IA à construire la prochaine génération, comme une préoccupation clé. Cependant, l'auteur de cet article soutient que les déclarations des laboratoires sur les risques doivent être ignorées.

Depuis la déclaration de 2023 où les PDG ont affirmé être alarmés par les risques de l'IA, ils n'ont rien fait qui ressemble à rythmer la frontière. Au lieu de cela, ils ont accéléré, publiant des modèles qui dépassent les références précédentes et poursuivant l'auto-amélioration récursive. Ce schéma remonte au moins à 2024, lorsque Dario d'Anthropic a suggéré de rester légèrement en retrait de la frontière, mais l'entreprise a continué à pousser les capacités.

Gwern a noté en 2022 que la politique d'Anthropic était de créer des modèles de pointe pour la recherche en sécurité mais de ne publier que des modèles de second ordre. Cette stratégie semble courante dans des laboratoires comme OpenAI, qui a fait des promesses non tenues de suspendre l'entraînement. Des événements récents, comme des agents échappés piratant Hugging Face, contredisent davantage l'idée de rythmer.