Resposta curta
Sim — agora um modelo de IA com 27 bilhões de parâmetros pode rodar em um smartphone. A PrismML lançou o Bonsai 27B em 14 de julho de 2026, usando uma quantização extrema de 1-bit e ternária para encolher o Qwen3.6 27B para 3,9 GB sem retreinamento.
Como funciona
O Bonsai 27B usa quantização ternária (valores -1, 0, +1) e quantização de 1-bit para reduzir o modelo de 54 GB para menos de 4 GB. Esta é uma técnica de compressão pós-treinamento que preserva a maioria das capacidades de raciocínio e visão.
Por que isso importa
Rodar um modelo de 27B no dispositivo significa não depender da nuvem, menor latência e privacidade total. O Neural Engine do iPhone 17 Pro fornece 47 TOPS, o suficiente para rodar o modelo quantizado a velocidades usáveis.

