HeadlinesBriefing favicon HeadlinesBriefing.com

InstinctFlash: высокопроизводительный runtime

Hacker News •
×

Привет, HN, это Guanming, соучредитель General Instinct. Мы только что выпустили InstinctFlash — высокопроизводительный фреймворк обслуживания для моделей робототехники под лицензией AGPL-3.0.

На Jetson Thor мы видим ускорение примерно от 1,2x до 7,9x только за счёт оптимизаций runtime и до 33,78x для LingBot-VA в сочетании с дистиллированным планировщиком диффузии на несколько шагов, переходя с 25 визуальных / 50 шагов действий на 2 / 4 шага. На 50 задачах Robotwin2.0 LingBot-VA с InstinctFlash при 2/4 шагах достиг успешности 90,5% по сравнению с 92,1% у базовой линии при 25/50 шагах.

InstinctFlash поддерживает 8 семейств моделей VLA / world-action, включая pi0.5 и NVIDIA Cosmos Policy, на RTX 4090 / 5090 и Jetson Thor. Просто передайте ему свой дообученный чекпоинт, и InstinctFlash сделает всё остальное, предоставляя ускоренную модель через Python runtime или WebSocket-сервер, совместимый с OpenPI.

Команды в Samsung, Siemens и других робототехнических стартапах использовали InstinctFlash для ускорения моделей на VLA, WAM и диффузионных world-моделях. Попробуйте здесь: https://github.com/General-Instinct/InstinctFlash. Будем рады вашим отзывам!

Ключевые сущности: Компании: General Instinct, NVIDIA, Samsung, Siemens | Люди: Guanming