HeadlinesBriefing favicon HeadlinesBriefing.com

InstinctFlash: Runtime de serviço para robótica

Hacker News •
×

Olá HN, aqui é o Guanming, cofundador da General Instinct. Acabamos de lançar o InstinctFlash, um framework de serviço de alto desempenho para modelos de robótica, licenciado sob AGPL-3.0.

No Jetson Thor, vemos acelerações de cerca de 1,2x a 7,9x apenas com otimizações de runtime, e de até 33,78x para o LingBot-VA quando combinado com um agendador de difusão destilado de poucos passos, passando de 25 passos visuais / 50 de ação para 2 / 4 passos. Em 50 tarefas do Robotwin2.0, o LingBot-VA com InstinctFlash em 2/4 passos alcançou uma taxa de sucesso de 90,5%, em comparação com 92,1% da linha de base em 25/50 passos.

O InstinctFlash suporta 8 famílias de modelos VLA / de ação mundial, incluindo pi0.5 e NVIDIA Cosmos Policy, em RTX 4090 / 5090 e Jetson Thor. Basta fornecer seu checkpoint ajustado e o InstinctFlash cuida do resto, expondo o modelo acelerado por meio de um runtime Python ou de um servidor WebSocket compatível com OpenPI.

Equipes da Samsung, Siemens e outras startups de robótica usaram o InstinctFlash para aceleração de modelos em VLAs, WAMs e modelos de mundo baseados em difusão. Experimente aqui: https://github.com/General-Instinct/InstinctFlash. Adoraríamos receber seu feedback!

Entidades principais: Empresas: General Instinct, NVIDIA, Samsung, Siemens | Pessoas: Guanming