HeadlinesBriefing favicon HeadlinesBriefing.com

Un entrepreneur en IA développe des robots pour planifier l'avenir

MIT Technology Review •
×

Le bureau de Danijar Hafner dans le quartier So Ma de San Francisco est presque vide. Sa toute nouvelle startup est encore en mode furtif et n'a même pas son nom sur la porte. Le jour de ma visite, il n'y avait qu'une autre personne là-bas, et très peu de meubles.

Mais ce qu'il manque en décoration, il le compense par les robots. Des humanoïdes de diverses formes et tailles pendent comme des marionnettes à partir de étagères qui traversent le centre de l'espace ouvert spacieux. Bien que Hafner, âgé de 31 ans, ne veuille pas trop parler de sa nouvelle entreprise pour l'instant, il la décrit comme une continuation de son travail de longue date visant à permettre à l'IA de naviguer dans des environnements qu'elle n'a pas rencontrés lors de l'entraînement.

Ces humanoïdes, qu'il importe de Chine, sont l'évolution suivante de ce travail—and leur incarnation physique. Leur capacité à réagir dans des scénarios auparavant non testés sera cruciale pour faire entrer les robots dans les espaces humains. Parce que si vous voulez envoyer un robot dans le domicile d'une personne, par exemple, il doit être capable de gérer un plan d'étage et des meubles qu'il n'a jamais vus auparavant.

Pour y parvenir, Hafner s'appuie sur quelque chose appelé apprentissage par renforcement basé sur des modèles. Il développe des modèles du monde—des modèles d'IA conçus pour émuler la réalité physique—and entraîne des agents à l'intérieur d'eux. L'agent traite essentiellement le modèle comme une simulation du monde réel et apprend comment agir là-bas.

Il utilise ensuite ces expériences pour faire des prédictions sur les résultats futurs. Cela permet aux agents—or aux robots dans lesquels ils sont intégrés—de naviguer dans des situations inconnues dans la vie réelle. « J'ai l'occasion d'interagir avec beaucoup de personnes vraiment intelligentes dans la recherche chez Google, et il se situe facilement dans le haut du 1 %.» Timothy Lillicrap, Google Deep Mind.