Canonical está apoiando um novo projeto de pesquisa de três anos destinado a tornar prático a tradução automática de grandes bases de código C maduras para Rust seguro. A iniciativa é uma colaboração entre Canonical e a Universidade de Bristol no Reino Unido, com trabalhos esperados para começar mais tarde em 2026.
O objetivo principal do projeto é desenvolver uma plataforma completa capaz de traduzir grandes repositórios de código, que frequentemente contêm centenas de milhares de linhas de C, para Rust seguro, confiável e mantenível. O desafio reside na vasta quantidade de software C legado ainda em uso; reescrever manualmente esse código é custoso e arriscado, dada a acumulação de anos de correções e otimizações.
Tradutores atuais de código-fonte para código-fonte resolvem o problema apenas parcialmente. Embora possam lidar com grandes volumes de código, tendem a replicar estruturas de C muito de perto, resultando em Rust que ainda depende de recursos inseguros. LLMs, por outro lado, destacam-se na geração de Rust idiomático para pequenos trechos de código, mas enfrentam dificuldades com o contexto mais amplo de repositórios completos.
Para superar esses obstáculos, o projeto empregará uma abordagem híbrida, ou 'neurosimbólica', combinando aprendizado de máquina com análise de programas tradicionais, testes e métodos formais. A Canonical planeja usar AppArmor e snap-confine como estudos de caso do mundo real. A iniciativa também se alinha à adoção mais ampla de Rust dentro do Ubuntu pela Canonical, como visto em projetos como uutils coreutils e sudo-rs.
Entidades-chave: Empresas: Canonical, Universidade de Bristol | Localizações: Reino Unido
Fonte: Hacker News · Resumido por HeadlinesBriefing