- Uma página de artigo do Hugging Face está em
huggingface.co/papers/<ID-do-arXiv>. Substituaarxiv.org/abs/parahuggingface.co/papers/em qualquer URL do arXiv para acessar diretamente a página correspondente. huggingface.co/papersé o Daily Papers — um feed cronológico ordenado por votos positivos. Submeter um artigo a ele exige ser autor verificado desse artigo.- Repositórios aparecem na seção “Modelos que citam este artigo” quando o link do arXiv ou uma tag
arxiv:<id>está presente no arquivoREADME.md. Os números de benchmark estão no blocomodel-indexdesse mesmo arquivo. - Cite a versão do arXiv ou da conferência/revista, não a página do Hugging Face. A página é um espelho acrescido de uma camada social e de metadados.
Uma página de artigo do Hugging Face fica em huggingface.co/papers/<ID-do-arXiv> (por exemplo, /papers/2310.06825, o Mistral 7B ). Ela espelha o resumo do arXiv e adiciona votos positivos, comentários, autores verificados e listas automáticas de modelos, conjuntos de dados e Spaces que citam o artigo. huggingface.co/papers o próprio Daily Papers é um feed de submissões curado.
Duas outras coisas que as pessoas costumam querer dizer com essa consulta: os artigos publicados pela própria equipe do Hugging Face e a infraestrutura de metadados que conecta um artigo aos pesos baixáveis. Ambos são abordados abaixo.
- O que realmente contém uma página de artigo
- Daily Papers versus páginas de artigo
- Como modelos são vinculados a um artigo: README.md e model-index
- Reproduzindo localmente o modelo descrito em um artigo
- Artigos publicados pelo próprio Hugging Face
- Obtendo dados de artigos programaticamente
- Perguntas frequentes
O que realmente contém uma página de artigo
| Seção | O que é | Quem controla |
|---|---|---|
| Abstrato | Texto espelhado, mais um link para o PDF no arXiv | arXiv |
| Votos positivos | Um sinal de popularidade. Não é uma avaliação nem uma replicação | Qualquer conta logada |
| Autores | Nomes dos autores, vinculados aos perfis no Hub assim que a autoria for reivindicada e confirmada | O Hugging Face verifica as reivindicações |
| Modelos / Conjuntos de dados / Spaces que citam este artigo | Derivados automaticamente dos cartões de repositório que referenciam o ID do arXiv | Proprietários de repositórios |
| Guia Comunidade | Comentários em fio, muitas vezes incluindo respostas dos próprios autores | Qualquer conta logada |
Na prática, uma página de artigo existe assim que o artigo for submetido ao Daily Papers ou referenciado a partir de um repositório no Hub. Se você seguir um link do arXiv e cair em uma página 404, ninguém ainda o vinculou ao Hub.
Daily Papers versus páginas de artigo
São objetos diferentes. A página de artigo é permanente e indexada pelo ID do arXiv. O Daily Papers é o feed cronológico em huggingface.co/papers, onde as submissões da comunidade são agrupadas por dia e ordenadas principalmente por votos positivos.
A submissão é controlada: geralmente é necessário ser autor verificado do artigo para incluí-lo no feed, e há um limite máximo de submissões por autor. Esse limite exato e o horário de encerramento mudaram ao longo da vida dessa funcionalidade, portanto leia atentamente o aviso no formulário de submissão, em vez de confiar em um número encontrado em um post de blog.
Padrões de URL úteis de conhecer
| URL | O que você recebe |
|---|---|
huggingface.co/papers |
Daily Papers de hoje |
huggingface.co/papers?date=2026-03-04 |
O feed daquele dia específico |
huggingface.co/papers/2310.06825 |
A página do artigo para esse identificador arXiv |
huggingface.co/papers?q=speculative+decoding |
Pesquisa em todos os artigos indexados |
A data e os parâmetros de pesquisa são estáveis o suficiente para serem salvos como favoritos. Os nomes das abas no índice (tendências, visualizações semanais, visualizações mensais) já foram reorganizados mais de uma vez; portanto, navegue por elas diretamente na página.
Como modelos são vinculados a um artigo: README.md e model-index
Todo repositório no Hub — modelo, conjunto de dados ou Space — possui um README.md no seu diretório raiz. Esse arquivo é define o cartão. Ele começa com um bloco YAML delimitado por duas linhas --- , que o Hub analisa para extrair metadados estruturados; todo o conteúdo após a linha de fechamento é renderizado como Markdown.
Acessando a seção "Modelos que citam este artigo"
Existem dois mecanismos, e você pode usar ambos:
- Insira a URL arXiv simples (
https://arxiv.org/abs/2310.06825) no corpo doREADME.md, normalmente no bloco de citações. O Hub extrai automaticamente links arXiv dos cartões. - Adicione a tag explícita
arxiv:2310.06825à lista detagsna parte inicial (YAML front matter) do arquivo. Essa é a forma inequívoca e permite filtrar o repositório por essa tag.
Relatar os resultados numéricos do artigo com model-index
model-index é uma chave YAML presente na mesma parte inicial (front matter). É assim que resultados de avaliação auto-relatados se tornam legíveis por máquinas, em vez de ficarem confinados a uma tabela em Markdown que ninguém consegue consultar. Trata-se de um array de modelos, cada um com uma lista de resultados, e cada resultado associa uma tarefa, um conjunto de dados e uma ou mais métricas:
---
license: apache-2.0
language:
- en
library_name: transformers
pipeline_tag: text-generation
base_model: mistralai/Mistral-7B-v0.3
datasets:
- squad
tags:
- arxiv:2310.06825
model-index:
- name: my-paper-reproduction
results:
- task:
type: question-answering
name: Question Answering
dataset:
type: squad
name: SQuAD v1.1
split: validation
metrics:
- type: exact_match
value: 87.3
name: Exact Match
verified: false
---
Três detalhes que costumam gerar confusão. A chave usa hífen (model-indexmodel-index e não). task.type deve ser um identificador válido de tarefa no Hub, como text-generation ou question-answering; caso contrário, o bloco é ignorado silenciosamente, em vez de gerar um erro explícito. E verified: false é o valor padrão honesto — resultados verificados provêm das próprias execuções de avaliação da Hugging Face, não de afirmações feitas por você.
Se seu YAML estiver mal formatado, o cartão ainda será renderizado, mas os metadados desaparecerão silenciosamente. Verifique a página do repositório após o commit e compare as especificações renderizadas do seu cartão com uma referência confiável, como a base de dados de modelos Convly para confirmar se os campos esperados foram realmente registrados.
Reproduzindo localmente o modelo descrito em um artigo
Antes de baixar 30 GB de pesos, verifique se o modelo cabe na sua GPU. Insira o número no Calculadora de VRAMcalculador de requisitos de VRAM Tabela de requisitos de VRAM por modelo. O resultado principal divulgado em um artigo é frequentemente obtido em 8×H100; o checkpoint disponibilizado na página do artigo pode ser uma versão muito menor, obtida por destilação.
As ferramentas consistem em um único pacote Python, compatível com as três plataformas:
pip install -U huggingface_hub
hf auth login
hf download mistralai/Mistral-7B-Instruct-v0.3 --include "*.safetensors" "*.json" "tokenizer*"
A CLI foi renomeada de huggingface-cli para hf em uma versão lançada em 2025 do huggingface_hubhuggingface_hub huggingface-cli download e huggingface-cli loginhuggingface-cli hf hf hf --help ou pip show huggingface_hub para saber qual versão você possui.
Linux
O cache usa como padrão ~/.cache/huggingface/hub. Para alterar seu local, execute export HF_HOME=/mnt/models/hf antes de executar qualquer comando. Para repositórios grandes, recomendamos pip install hf_transfer e export HF_HUB_ENABLE_HF_TRANSFER=1 aumenta substancialmente a taxa de transferência em conexões rápidas. Este é o caminho em que os kernels CUDA personalizados fornecidos com o código de um artigo realmente são compilados; veja Opções de GPU para LLMs locais se você estiver escolhendo hardware para trabalhos de reprodução.
macOS
Mesmo caminho de cache, ~/.cache/huggingface/hub. Na Apple Silicon, o backend MPS do PyTorch suporta inferência ordinária de transformadores, mas repositórios de artigos que dependem de extensões CUDA escritas manualmente não serão compilados de forma alguma. Quando isso ocorre, a abordagem pragmática é uma conversão quantizada para GGUF por meio de Ollama — você perde a equivalência numérica exata com o artigo, portanto não o relatar como uma reprodução.
Windows
O cache usa como padrão C:\Users\\.cache\huggingface\hub. Defina um local diferente no PowerShell com $env:HF_HOME="D:\hf" para a sessão atual ou por meio das Propriedades do Sistema para uma configuração permanente. Sem o Modo de Desenvolvedor ou um shell com privilégios elevados, o cache do Hub não consegue criar links simbólicos e recorre à duplicação de arquivos, o que consome espaço adicional em disco e exibe um aviso em cada download; HF_HUB_DISABLE_SYMLINKS_WARNING=1 silencia essa mensagem sem alterar o comportamento. Muitos repositórios de pesquisa pressupõem um shell Unix, portanto o WSL2 geralmente gera menos atritos do que o Windows nativo para qualquer tarefa além da inferência.
| Plataforma | Cache padrão | Principal armadilha |
|---|---|---|
| Linux | ~/.cache/huggingface/hub |
Nenhuma; o ambiente de referência |
| macOS | ~/.cache/huggingface/hub |
Sem CUDA; kernels personalizados não serão compilados |
| Windows | C:\Users\\.cache\huggingface\hub |
A alternativa com links simbólicos duplica arquivos |
Artigos publicados pelo próprio Hugging Face
As duas mais citadas são fáceis de identificar:
| Artigo | ID arXiv |
|---|---|
| Transformers: State-of-the-Art Natural Language Processing | 1910.03771 |
| DistilBERT, uma versão destilada do BERT | 1910.01108 |
Trabalhos posteriores — os artigos sobre alinhamento Zephyr, o artigo sobre o conjunto de dados FineWeb e a série SmolLM — são melhor localizados diretamente na fonte, em vez de por meio de um ID lembrado. Abra o perfil relevante da organização (por exemplo,huggingface.co/HuggingFaceTB) e use sua aba Papers, ou abra um cartão de modelo e leia seu bloco de citações. Ambos os caminhos fornecem a referência canônica atual; uma lista codificada em um artigo não o faz.
Obtendo dados de artigos programaticamente
A rota estável e documentada é a API comum do Hub, que funciona porque arxiv:<id> é uma tag normal:
curl "https://huggingface.co/api/models?filter=arxiv:2310.06825"
Isso retorna todos os repositórios de modelos que declaram esse artigo. Há também um endpoint JSON por trás do próprio feed Daily Papers, mas ele não é documentado e não oferece garantias de compatibilidade — adequado para um script pessoal de resumo, mas não para construir um produto. Se você precisar de metadados duráveis sobre artigos, faça scraping da API oficial do arXiv e faça junção com base no ID.
Perguntas frequentes
Uma página de artigo do Hugging Face é a mesma coisa que a página do arXiv?
Não. Ela espelha o resumo e fornece um link para o PDF no arXiv, mas trata-se de um objeto distinto, com seus próprios votos positivos, comentários e links para repositórios. Para citações, use sempre a entrada do arXiv ou a versão publicada na conferência/revista. Referenciar a URL do Hugging Face em uma bibliografia é um erro comum em pré-impressos, e os revisores percebem.
Como faço para que meu modelo apareça na seção “Modelos que citam este artigo”?
Adicione o link do arXiv ao arquivo README.md, ou adicione arxiv:<id> à lista de tags na seção YAML de metadados do cartão. A listagem é gerada a partir dos metadados do cartão, portanto ela é atualizada após você fazer commit no cartão, não quando você envia os pesos. Se não aparecer, a causa habitual é um YAML inválido na seção de metadados.
Posso submeter o artigo de outra pessoa ao Daily Papers?
Geralmente não — a submissão é restrita a autores verificados do artigo. Você ainda pode votar positivamente, comentar e compartilhar uma página já existente; além disso, incluir o ID do arXiv em um repositório de sua propriedade é suficiente para que uma página de artigo seja criada. As reivindicações de autoria são feitas diretamente na página do artigo e confirmadas pelo Hugging Face.
Votos positivos significam que um artigo é bom?
Isso significa que ele recebeu atenção no dia em que foi publicado. O feed valoriza tanto o momento de publicação quanto uma lista de autores renomados e um título impactante — tanto quanto valoriza os resultados. Trate as afirmações sobre benchmarks como não verificadas até vê-las independentemente — uma Ranking de LLMs é uma superfície de comparação melhor do que a própria tabela de um artigo, e o Calculadora de custos de API é mais útil do que as alegações de eficiência de um artigo quando você está decidindo o que realmente implantar.
De onde vêm os números de avaliação em um cartão de modelo?
Do bloco model-index desse repositório, no arquivo README.md, escrito manualmente pelo proprietário do repositório. As métricas são autodeclaradas, a menos que incluam verified: true, o que indica que a avaliação foi executada pela Hugging Face. Trate entradas não verificadas da mesma forma que qualquer número em um preprint: plausíveis, não auditadas e dignas de serem reexecutadas com seus próprios dados.

