Qualcomm coloca modelo de 30 bilhões de parâmetros dentro do smartphone
A Qualcomm anunciou nesta terça (22) dois novos chips para smartphone com foco em IA, o Snapdragon 8 Elite Gen 6 e a versão Extreme. O Extreme roda localmente um mixture-of-experts de 30 bilhões de parâmetros, sem precisar de servidor em nuvem, e a Qualcomm descreveu o chip como capaz de rodar um "complete voice-in and voice-out agent" diretamente no aparelho.
O fato
A Qualcomm revelou no Snapdragon Summit os dois processadores topo de linha. O Extreme traz bloco neural dedicado e roda 30 bilhões de parâmetros em mixture-of-experts, arquitetura que ativa só parte dos parâmetros por inferência. A Apple tinha lançado em junho um MoE de 20 bilhões, então a Qualcomm passa a Apple em contagem bruta. A Motorola confirmou o Signature 27 como primeiro aparelho, com disponibilidade prevista para este ano.
O que muda na prática
Latência de resposta cai para milissegundos porque a inferência não viaja até servidor. Dados sensíveis do usuário ficam no aparelho, sem precisar subir pra nuvem, destravando apps de saúde e finanças antes travados por compliance. Para o consumidor final, o custo mensal de inferência some, embutido no preço do celular. O novo chip roda um agente completo de voz no aparelho, abrindo espaço para assistentes pessoais que aprendem com o uso e diferenciam falantes em tempo real.
Pra quem muda
Desenvolvedores mobile ganham alternativa a modelos de classe GPT-5 rodando localmente. Empresas de saúde e finanças interessadas em IA que não vaza dado sensível. Consumidores em áreas com internet fraca ou nula. Fabricantes chineses e indianos podem competir com Apple e Samsung sem precisar de servidor próprio, redistribuindo a cadeia de valor da IA do celular.
O que já existe no acervo
Verificamos o canal @eueliasmello e o portal Entra no Loop em 23/09 às 21h buscando qualcomm e chip de smartphone com IA. Resultado retornou zero itens sobre hardware de IA para celular. Tema novo; ainda sem cobertura específica no acervo.
A ressalva honesta
Mixture-of-experts não é o mesmo que modelo denso de 30 bilhões. Em qualquer inferência, só alguns especialistas são ativados, então o chip não pensa com todos os 30B ao mesmo tempo. Os números vieram da própria Qualcomm em demo controlado, sem benchmark independente. Calor e bateria em uso sustentado também não foram testados fora de marketing. A Apple já tinha 20B antes; a diferença para 30B é incremental, e o impacto real depende do que devs farão nas mãos dos usuários.
Continue no loop