Esto parece pasar por alto la limitación masiva (en serio, masiva) de requerir cooperación kernel/NIC/switch que el hardware aún no soporta en absoluto. Eso es un nivel enorme de coordinación de hardware teórico que simplemente no existe. Y si vas a mapear mensajes a horarios/colas de prioridad, tendrás que mapear eso de alguna manera, con algún búfer/switch grande listo para priorizar mensajes pequeños sobre grandes, etc. Y luego confías en que el mecanismo de ida y vuelta de concesión/solicitud sea lo suficientemente ligero como para no crear un nuevo conjunto de cuellos de botella que superen la implementación existente de RoCE... probablemente sea posible hacer que Homa sea más eficiente que los protocolos del lado del emisor, pero realmente soy escéptico de que valga la pena el esfuerzo para llegar allí en lugar de seguir escalando hardware para manejar los cuellos de botella del lado del emisor.
Fuente: Hacker News · Resumido por HeadlinesBriefing