MODELOSLEVANTAMENTO

Números coletados e apurados pela redação, com o método aberto.

Os modelos de IA mais usados do mundo não são os que aparecem no noticiário

Levantamento do BrazNews.IA.BR nos dados públicos do Hugging Face: o campeão de downloads é um modelo de embeddings de março de 2022, e nenhum assistente de conversa aparece entre os dez primeiros.

Redação BrazNews.IA.BR
Infraestrutura de computação científica. Os modelos mais baixados do Hugging Face são peças pequenas que rodam dentro de sistemas maiores.
Infraestrutura de computação científica. Os modelos mais baixados do Hugging Face são peças pequenas que rodam dentro de sistemas maiores.The U.S. Food and Drug Administration · Public domain · Wikimedia Commons

O modelo mais baixado do Hugging Face não é o ChatGPT, nem o Claude, nem o Gemini. Nenhum dos três está lá, porque nenhum é distribuído por download. É o sentence-transformers/all-MiniLM-L6-v2, um modelo de embeddings lançado em março de 2022, com 256.063.914 downloads no último mês.

O BrazNews.IA.BR passou a coletar os números públicos do Hugging Face. A lista que sai dali conta uma história diferente da que circula no noticiário: entre os 10 mais baixados, 9 foram publicados há mais de dois anos, e nenhum é um assistente de conversa.

O que o download mede, e o benchmark não

Ranking de benchmark mede o que um modelo consegue fazer no melhor dos casos. Download mede o que alguém decidiu colocar em produção. São perguntas diferentes, e as respostas quase nunca coincidem.

O topo da lista é dominado por modelos pequenos, antigos e especializados: embeddings, ranqueamento, classificação. São as peças invisíveis que fazem busca semântica e recuperação funcionarem dentro de outros produtos. Ninguém escreve manchete sobre elas, e é nelas que o volume está.

Mesmo em geração de texto, o pequeno ganha

Na categoria de geração de texto, que é onde os modelos de conversa competem, o líder é o Qwen/Qwen3-0.6B, com 24.379.087 downloads. É um modelo pequeno o bastante para rodar em máquina modesta, o que sugere que boa parte do uso real não precisa do modelo de fronteira.

O Brasil aparece pouco

Entre os modelos marcados como compatíveis com o português, o mais baixado é o sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2, com 54.590.548 downloads. É um modelo multilíngue, não um modelo brasileiro: o português entra como um idioma entre dezenas.

A ausência de um modelo aberto treinado no Brasil e adotado em escala é o dado que mais diz sobre onde estamos. Há iniciativas em curso, mas nenhuma aparece no volume de uso, e volume de uso é o que sustenta ecossistema, documentação e correção de bugs.

Entre os lançamentos dos últimos três meses, o que mais rápido ganhou tração foi o Comfy-Org/MiniMax-H3, com 17.292.549 downloads desde julho de 2026.

Como este número foi apurado

Os dados vêm da API pública do Hugging Face Hub, consultada em 23 de agosto de 2026. Coletamos os vinte modelos mais baixados no geral, os cinco primeiros de seis categorias de tarefa, os quinze mais baixados marcados como português e os lançamentos dos últimos noventa dias com maior adoção.

Uma ressalva que o próprio número exige: download não é usuário. Um pipeline de integração contínua que baixa o mesmo modelo a cada build infla a conta, e de fato encontramos modelos de teste entre os mais baixados de algumas categorias. O que a medida captura bem é ordem de grandeza e tendência, não audiência.

Redação BrazNews.IA.BR

Cobertura diária de modelos, agentes e infraestrutura de IA. Toda matéria traz as fontes originais com link, o fato é da fonte, o contexto é da casa.

Continue lendo