Friday, 28 August 2026 | Updating Daily AI insight, written for builders

Páginas de artigos do Hugging Face: Artigos diários, links do arXiv e metadados de modelos

  • Uma página de artigo do Hugging Face está em huggingface.co/papers/<ID-do-arXiv>. Substitua arxiv.org/abs/ para huggingface.co/papers/ em qualquer URL do arXiv para acessar diretamente a página correspondente.
  • huggingface.co/papers é o Daily Papers — um feed cronológico ordenado por votos positivos. Submeter um artigo a ele exige ser autor verificado desse artigo.
  • Repositórios aparecem na seção “Modelos que citam este artigo” quando o link do arXiv ou uma tag arxiv:<id> está presente no arquivo README.md. Os números de benchmark estão no bloco model-index desse mesmo arquivo.
  • Cite a versão do arXiv ou da conferência/revista, não a página do Hugging Face. A página é um espelho acrescido de uma camada social e de metadados.

Uma página de artigo do Hugging Face fica em huggingface.co/papers/<ID-do-arXiv> (por exemplo, /papers/2310.06825, o Mistral 7B ). Ela espelha o resumo do arXiv e adiciona votos positivos, comentários, autores verificados e listas automáticas de modelos, conjuntos de dados e Spaces que citam o artigo. huggingface.co/papers o próprio Daily Papers é um feed de submissões curado.

Duas outras coisas que as pessoas costumam querer dizer com essa consulta: os artigos publicados pela própria equipe do Hugging Face e a infraestrutura de metadados que conecta um artigo aos pesos baixáveis. Ambos são abordados abaixo.

O que realmente contém uma página de artigo

Seção O que é Quem controla
Abstrato Texto espelhado, mais um link para o PDF no arXiv arXiv
Votos positivos Um sinal de popularidade. Não é uma avaliação nem uma replicação Qualquer conta logada
Autores Nomes dos autores, vinculados aos perfis no Hub assim que a autoria for reivindicada e confirmada O Hugging Face verifica as reivindicações
Modelos / Conjuntos de dados / Spaces que citam este artigo Derivados automaticamente dos cartões de repositório que referenciam o ID do arXiv Proprietários de repositórios
Guia Comunidade Comentários em fio, muitas vezes incluindo respostas dos próprios autores Qualquer conta logada

Na prática, uma página de artigo existe assim que o artigo for submetido ao Daily Papers ou referenciado a partir de um repositório no Hub. Se você seguir um link do arXiv e cair em uma página 404, ninguém ainda o vinculou ao Hub.

Daily Papers versus páginas de artigo

São objetos diferentes. A página de artigo é permanente e indexada pelo ID do arXiv. O Daily Papers é o feed cronológico em huggingface.co/papers, onde as submissões da comunidade são agrupadas por dia e ordenadas principalmente por votos positivos.

A submissão é controlada: geralmente é necessário ser autor verificado do artigo para incluí-lo no feed, e há um limite máximo de submissões por autor. Esse limite exato e o horário de encerramento mudaram ao longo da vida dessa funcionalidade, portanto leia atentamente o aviso no formulário de submissão, em vez de confiar em um número encontrado em um post de blog.

Padrões de URL úteis de conhecer

URL O que você recebe
huggingface.co/papers Daily Papers de hoje
huggingface.co/papers?date=2026-03-04 O feed daquele dia específico
huggingface.co/papers/2310.06825 A página do artigo para esse identificador arXiv
huggingface.co/papers?q=speculative+decoding Pesquisa em todos os artigos indexados

A data e os parâmetros de pesquisa são estáveis o suficiente para serem salvos como favoritos. Os nomes das abas no índice (tendências, visualizações semanais, visualizações mensais) já foram reorganizados mais de uma vez; portanto, navegue por elas diretamente na página.

Como modelos são vinculados a um artigo: README.md e model-index

Todo repositório no Hub — modelo, conjunto de dados ou Space — possui um README.md no seu diretório raiz. Esse arquivo é define o cartão. Ele começa com um bloco YAML delimitado por duas linhas --- , que o Hub analisa para extrair metadados estruturados; todo o conteúdo após a linha de fechamento é renderizado como Markdown.

Acessando a seção "Modelos que citam este artigo"

Existem dois mecanismos, e você pode usar ambos:

  • Insira a URL arXiv simples (https://arxiv.org/abs/2310.06825) no corpo do README.md, normalmente no bloco de citações. O Hub extrai automaticamente links arXiv dos cartões.
  • Adicione a tag explícita arxiv:2310.06825 à lista de tags na parte inicial (YAML front matter) do arquivo. Essa é a forma inequívoca e permite filtrar o repositório por essa tag.

Relatar os resultados numéricos do artigo com model-index

model-index é uma chave YAML presente na mesma parte inicial (front matter). É assim que resultados de avaliação auto-relatados se tornam legíveis por máquinas, em vez de ficarem confinados a uma tabela em Markdown que ninguém consegue consultar. Trata-se de um array de modelos, cada um com uma lista de resultados, e cada resultado associa uma tarefa, um conjunto de dados e uma ou mais métricas:

---
license: apache-2.0
language:
- en
library_name: transformers
pipeline_tag: text-generation
base_model: mistralai/Mistral-7B-v0.3
datasets:
- squad
tags:
- arxiv:2310.06825
model-index:
- name: my-paper-reproduction
  results:
  - task:
      type: question-answering
      name: Question Answering
    dataset:
      type: squad
      name: SQuAD v1.1
      split: validation
    metrics:
    - type: exact_match
      value: 87.3
      name: Exact Match
      verified: false
---

Três detalhes que costumam gerar confusão. A chave usa hífen (model-indexmodel-index e não). task.type deve ser um identificador válido de tarefa no Hub, como text-generation ou question-answering; caso contrário, o bloco é ignorado silenciosamente, em vez de gerar um erro explícito. E verified: false é o valor padrão honesto — resultados verificados provêm das próprias execuções de avaliação da Hugging Face, não de afirmações feitas por você.

Se seu YAML estiver mal formatado, o cartão ainda será renderizado, mas os metadados desaparecerão silenciosamente. Verifique a página do repositório após o commit e compare as especificações renderizadas do seu cartão com uma referência confiável, como a base de dados de modelos Convly para confirmar se os campos esperados foram realmente registrados.

Reproduzindo localmente o modelo descrito em um artigo

Antes de baixar 30 GB de pesos, verifique se o modelo cabe na sua GPU. Insira o número no Calculadora de VRAMcalculador de requisitos de VRAM Tabela de requisitos de VRAM por modelo. O resultado principal divulgado em um artigo é frequentemente obtido em 8×H100; o checkpoint disponibilizado na página do artigo pode ser uma versão muito menor, obtida por destilação.

As ferramentas consistem em um único pacote Python, compatível com as três plataformas:

pip install -U huggingface_hub
hf auth login
hf download mistralai/Mistral-7B-Instruct-v0.3 --include "*.safetensors" "*.json" "tokenizer*"

A CLI foi renomeada de huggingface-cli para hf em uma versão lançada em 2025 do huggingface_hubhuggingface_hub huggingface-cli download e huggingface-cli loginhuggingface-cli hf hf hf --help ou pip show huggingface_hub para saber qual versão você possui.

Linux

O cache usa como padrão ~/.cache/huggingface/hub. Para alterar seu local, execute export HF_HOME=/mnt/models/hf antes de executar qualquer comando. Para repositórios grandes, recomendamos pip install hf_transfer e export HF_HUB_ENABLE_HF_TRANSFER=1 aumenta substancialmente a taxa de transferência em conexões rápidas. Este é o caminho em que os kernels CUDA personalizados fornecidos com o código de um artigo realmente são compilados; veja Opções de GPU para LLMs locais se você estiver escolhendo hardware para trabalhos de reprodução.

macOS

Mesmo caminho de cache, ~/.cache/huggingface/hub. Na Apple Silicon, o backend MPS do PyTorch suporta inferência ordinária de transformadores, mas repositórios de artigos que dependem de extensões CUDA escritas manualmente não serão compilados de forma alguma. Quando isso ocorre, a abordagem pragmática é uma conversão quantizada para GGUF por meio de Ollama — você perde a equivalência numérica exata com o artigo, portanto não o relatar como uma reprodução.

Windows

O cache usa como padrão C:\Users\\.cache\huggingface\hub. Defina um local diferente no PowerShell com $env:HF_HOME="D:\hf" para a sessão atual ou por meio das Propriedades do Sistema para uma configuração permanente. Sem o Modo de Desenvolvedor ou um shell com privilégios elevados, o cache do Hub não consegue criar links simbólicos e recorre à duplicação de arquivos, o que consome espaço adicional em disco e exibe um aviso em cada download; HF_HUB_DISABLE_SYMLINKS_WARNING=1 silencia essa mensagem sem alterar o comportamento. Muitos repositórios de pesquisa pressupõem um shell Unix, portanto o WSL2 geralmente gera menos atritos do que o Windows nativo para qualquer tarefa além da inferência.

Plataforma Cache padrão Principal armadilha
Linux ~/.cache/huggingface/hub Nenhuma; o ambiente de referência
macOS ~/.cache/huggingface/hub Sem CUDA; kernels personalizados não serão compilados
Windows C:\Users\\.cache\huggingface\hub A alternativa com links simbólicos duplica arquivos

Artigos publicados pelo próprio Hugging Face

As duas mais citadas são fáceis de identificar:

Artigo ID arXiv
Transformers: State-of-the-Art Natural Language Processing 1910.03771
DistilBERT, uma versão destilada do BERT 1910.01108

Trabalhos posteriores — os artigos sobre alinhamento Zephyr, o artigo sobre o conjunto de dados FineWeb e a série SmolLM — são melhor localizados diretamente na fonte, em vez de por meio de um ID lembrado. Abra o perfil relevante da organização (por exemplo,huggingface.co/HuggingFaceTB) e use sua aba Papers, ou abra um cartão de modelo e leia seu bloco de citações. Ambos os caminhos fornecem a referência canônica atual; uma lista codificada em um artigo não o faz.

Obtendo dados de artigos programaticamente

A rota estável e documentada é a API comum do Hub, que funciona porque arxiv:<id> é uma tag normal:

curl "https://huggingface.co/api/models?filter=arxiv:2310.06825"

Isso retorna todos os repositórios de modelos que declaram esse artigo. Há também um endpoint JSON por trás do próprio feed Daily Papers, mas ele não é documentado e não oferece garantias de compatibilidade — adequado para um script pessoal de resumo, mas não para construir um produto. Se você precisar de metadados duráveis sobre artigos, faça scraping da API oficial do arXiv e faça junção com base no ID.

Perguntas frequentes

Uma página de artigo do Hugging Face é a mesma coisa que a página do arXiv?

Não. Ela espelha o resumo e fornece um link para o PDF no arXiv, mas trata-se de um objeto distinto, com seus próprios votos positivos, comentários e links para repositórios. Para citações, use sempre a entrada do arXiv ou a versão publicada na conferência/revista. Referenciar a URL do Hugging Face em uma bibliografia é um erro comum em pré-impressos, e os revisores percebem.

Como faço para que meu modelo apareça na seção “Modelos que citam este artigo”?

Adicione o link do arXiv ao arquivo README.md, ou adicione arxiv:<id> à lista de tags na seção YAML de metadados do cartão. A listagem é gerada a partir dos metadados do cartão, portanto ela é atualizada após você fazer commit no cartão, não quando você envia os pesos. Se não aparecer, a causa habitual é um YAML inválido na seção de metadados.

Posso submeter o artigo de outra pessoa ao Daily Papers?

Geralmente não — a submissão é restrita a autores verificados do artigo. Você ainda pode votar positivamente, comentar e compartilhar uma página já existente; além disso, incluir o ID do arXiv em um repositório de sua propriedade é suficiente para que uma página de artigo seja criada. As reivindicações de autoria são feitas diretamente na página do artigo e confirmadas pelo Hugging Face.

Votos positivos significam que um artigo é bom?

Isso significa que ele recebeu atenção no dia em que foi publicado. O feed valoriza tanto o momento de publicação quanto uma lista de autores renomados e um título impactante — tanto quanto valoriza os resultados. Trate as afirmações sobre benchmarks como não verificadas até vê-las independentemente — uma Ranking de LLMs é uma superfície de comparação melhor do que a própria tabela de um artigo, e o Calculadora de custos de API é mais útil do que as alegações de eficiência de um artigo quando você está decidindo o que realmente implantar.

De onde vêm os números de avaliação em um cartão de modelo?

Do bloco model-index desse repositório, no arquivo README.md, escrito manualmente pelo proprietário do repositório. As métricas são autodeclaradas, a menos que incluam verified: true, o que indica que a avaliação foi executada pela Hugging Face. Trate entradas não verificadas da mesma forma que qualquer número em um preprint: plausíveis, não auditadas e dignas de serem reexecutadas com seus próprios dados.

Escrito por Mustafa Ihsan

Mustafa Ihsan é fundador e editor da Convly.ai. Ele criou e mantém o banco de dados em tempo real de modelos de IA do site, seu índice de desempenho por preço e suas calculadoras gratuitas para requisitos de VRAM, custos de API e economia de hospedagem local. Escreve sobre preços de modelos, resultados de benchmarks e o hardware necessário para executar modelos de IA localmente, preferindo sempre dados mensuráveis às declarações dos fabricantes.

Scroll to Top
Featured on There's An AI For That