Blog

O modelo de IA mais baixado do mundo é chinês, tem 17 GB e roda numa placa de vídeo usada

A família Qwen passou de 3 bilhões de downloads, à frente de Google e Meta. E o que importa não é a nacionalidade: um dos modelos é um arquivo de 17 GB que roda numa RTX 3090. O piso de entrada para usar IA com dados próprios caiu.

19 de agosto de 2026 · agenciaprimeirapagina

O modelo de IA mais baixado do mundo é chinês, tem 17 GB e roda numa placa de vídeo usada

Em 14 de agosto de 2026, os modelos Qwen, da chinesa Alibaba, passaram de 3 bilhões de downloads acumulados no Hugging Face — o repositório onde o mundo baixa modelos de inteligência artificial. No mesmo levantamento, o Google aparece com 418 milhões e a Meta com 227 milhões.

A família de modelos aberta mais usada do planeta não é americana. E o detalhe que interessa a quem toma decisão não é a nacionalidade: é o tamanho do arquivo.

17 GB numa placa de vídeo antiga

O Qwen3.8-27B, um dos lançamentos recentes da família, passou de 3 milhões de downloads no primeiro fim de semana. Ele é um arquivo de cerca de 17 GB e roda em placas de vídeo já antigas, como uma RTX 3090, ou num notebook com memória suficiente.

Isso muda a conversa sobre IA na empresa mais do que qualquer benchmark. Não estamos falando de servidor dedicado nem de contrato mensal com fornecedor: estamos falando de uma máquina que muita empresa já tem parada no escritório.

Por que isso não contradiz o que dissemos antes

Há poucos dias mostramos que rodar um modelo aberto de fronteira na própria empresa custa caro — o caso era um modelo de 2,88 trilhões de parâmetros, que exigia cerca de 6.060 GB de memória de vídeo e um pequeno data center para funcionar.

Continua verdade. O que o caso do Qwen mostra é que "modelo aberto" não é uma coisa só. Existem pelo menos duas categorias, com contas separadas por um abismo:

  • Os gigantes de fronteira, que competem com o topo do mercado e exigem infraestrutura de data center. Baixar é grátis; rodar, não.
  • Os modelos médios, na faixa de dezenas de bilhões de parâmetros, que cabem em uma placa de vídeo e resolvem muito bem tarefas específicas.

A pergunta útil, portanto, deixou de ser "aberto ou fechado". Passou a ser: de que tamanho de modelo eu realmente preciso para a tarefa que tenho?

Para que serve um modelo médio rodando na sua máquina

Boa parte do trabalho real de uma empresa não exige o modelo mais inteligente do mundo. Exige um modelo consistente, barato e que não mande os dados para fora:

  1. Classificar e encaminhar. Ler o que chega — e-mail, formulário, pedido, reclamação — e dizer para onde vai.
  2. Extrair informação de documento. Tirar dados estruturados de nota, contrato, laudo, ficha. Tarefa repetitiva, volume alto, resposta objetiva.
  3. Resumir e comparar. Condensar histórico de atendimento, comparar versões de um documento, apontar o que mudou.
  4. Responder com base no seu material. Consultar a sua própria base de conhecimento e responder a partir dela.

Nesses quatro casos, um modelo médio rodando localmente costuma bastar — com duas vantagens que o modelo de fronteira não oferece: custo por consulta perto de zero depois do hardware, e dado que não sai da sua rede, o que importa para quem lida com informação sensível.

O que olhar antes de se empolgar

  • Baixado não é o mesmo que bom para você. Três bilhões de downloads medem adoção, não adequação à sua tarefa. Teste com o seu próprio material antes de decidir.
  • A liderança tem ressalva. Reportagem especializada aponta que a vantagem sobre os concorrentes é menor do que a divulgada, dependendo de como se conta o download. O número é impressionante de qualquer forma, mas não é placar oficial.
  • Alguém precisa manter isso. Modelo local significa máquina, atualização e responsável. Sem isso, você trocou uma assinatura por um problema.
  • Licença é detalhe que morde. "Aberto" varia de caso a caso; confira o que a licença permite antes de colocar em produto que você vende.

O resumo honesto

O dado mais relevante do episódio não é geopolítico, é econômico: a Alibaba lançou mais de 460 modelos da família, que já geraram cerca de 300 mil variações criadas por terceiros. Isso significa que existe hoje uma prateleira enorme de modelos especializados, gratuitos, e a maioria cabe em hardware comum.

Para uma empresa pequena ou média no Brasil, isso é mais importante do que qualquer disputa entre laboratórios: o piso de entrada para usar IA com dados próprios caiu para o preço de uma placa de vídeo usada.

Fatos apurados a partir do relatório do Hugging Face de 14 de agosto de 2026 e da cobertura de Bloomberg, Fortune e Business Standard. A comparação de downloads entre fornecedores tem metodologia contestada por parte da imprensa especializada.

Perguntas frequentes

Qual é o modelo de IA aberto mais baixado do mundo?

A família Qwen, da chinesa Alibaba, que passou de 3 bilhões de downloads acumulados no Hugging Face em 14 de agosto de 2026, à frente de Google (418 milhões) e Meta (227 milhões). Vale a ressalva de que parte da imprensa especializada aponta que a vantagem é menor do que a divulgada, dependendo de como se conta cada download.

É verdade que dá para rodar esses modelos numa placa de vídeo comum?

Alguns deles, sim. O Qwen3.8-27B é um arquivo de cerca de 17 GB e roda em placas já antigas, como uma RTX 3090, ou num notebook com memória suficiente. Ele passou de 3 milhões de downloads no primeiro fim de semana. Isso não vale para os modelos abertos de fronteira, que exigem infraestrutura de data center.

Então rodar IA na própria empresa é barato ou caro?

Depende inteiramente do tamanho do modelo, e é aí que quase toda confusão nasce. Um modelo aberto de fronteira, com trilhões de parâmetros, pode exigir milhares de gigabytes de memória de vídeo e um pequeno data center. Um modelo médio, de dezenas de bilhões de parâmetros, cabe em uma placa de vídeo. A pergunta útil não é aberto ou fechado, e sim de que tamanho de modelo a sua tarefa precisa.

Para que serve um modelo médio rodando localmente na empresa?

Para o trabalho repetitivo de volume: classificar e encaminhar o que chega, extrair dados estruturados de documentos, resumir e comparar textos, e responder perguntas com base na sua própria base de conhecimento. Nesses casos ele costuma bastar, com duas vantagens: custo por consulta próximo de zero depois do hardware e dados que não saem da sua rede.

Quais são os riscos de adotar um modelo aberto na empresa?

Adoção não é adequação: três bilhões de downloads não dizem se o modelo serve para a sua tarefa, então teste com o seu próprio material. Alguém precisa manter a máquina, as atualizações e a operação, ou você troca uma assinatura por um problema. E verifique a licença, porque o termo aberto varia de caso a caso e nem toda licença permite uso em produto que você vende.

O que esse caso muda para pequenas e médias empresas?

O piso de entrada. A Alibaba lançou mais de 460 modelos da família, que já geraram cerca de 300 mil variações criadas por terceiros — ou seja, existe uma prateleira enorme de modelos especializados e gratuitos, a maioria cabendo em hardware comum. Usar IA com dados próprios deixou de exigir orçamento de data center.