A vitrine

Seu índice, apresentado como um mural de pôsteres

O indexador integrado varre os newsgroups que lhe interessam, e o mural transforma o que encontra em pôsteres, notas, elenco e grades de episódios, tudo a partir de fontes públicas sem chave que a sua própria instalação busca. Clique num chip de episódio para baixá-lo.

Lê primeiro os limites. Um scanner de cabeçalhos só consegue encontrar o que foi publicado com um nome de ficheiro real, e boa parte da Usenet deliberadamente não está. É uma propriedade de como esses ficheiros foram carregados e não algo que um scanner melhor resolva, portanto os indexadores comerciais continuam a ser a recomendação e aqui nada é ligado a não ser que o peças.

Mural de pôsteres do nzbfast: uma grade de pôsteres de TV com emblemas de qualidade, notas e contagens de temporadas
Busca instantânea: busca conforme você digita, com filtros de qualidade, botões de acompanhar em cada linha e emblemas de qualidade por toda parte.
Busca instantânea: busca conforme você digita, com filtros de qualidade, botões de acompanhar em cada linha e emblemas de qualidade por toda parte.

Indexador e o mural de pôsteres

Varra os grupos que lhe interessam para um índice privado e depois navegue no resultado como um mural de pôsteres. Cada pedacinho dos metadados é obtido de fontes públicas sem chave pela sua própria instalação. Não há nenhuma chave de API para ficar implorando.

Folha de detalhes do mural de pôsteres com nota, elenco, sinopse e chips de episódios
Notas, elenco, sinopse, grade de episódios. Sem chaves de API, nunca.
  • Varredor contínuo de grupos. Varreduras OVER incrementais rodam no seu horário a ~43 mil cabeçalhos/s em conexões distribuídas, negociando cabeçalhos comprimidos (RFC 8054) onde um servidor os oferece. As primeiras varreduras são bissectadas por data, então --max-age 2y pula anos de cabeçalhos em cerca de 20 sondagens.
  • Filtros de ingestão: filtros de tipo, ano, resolução, idioma e tamanho mantêm o spam de indexador fora do seu banco de dados, e o lixo ofuscado é detectado e barrado por padrão.
  • Parser de nomes scene. Ele extrai título, ano, episódio, qualidade e fonte de radicais do mundo real (incluindo dailies com código de data, códigos de múltiplos episódios e nomes ofuscados por ROT13) e reduz os lançamentos a um cartão por título.
  • Detecção de remoções. A amostragem de disponibilidade em segundo plano percebe quando um grupo está sendo ceifado e marca seus lançamentos com um emblema, para que uma publicação que já está sendo removida não desperdice uma captura.
  • Enriquecimento sem chave. TVmaze para TV, iTunes Search para cinema, além de conjuntos de dados públicos de notas, Wikidata, Wikipédia e AniList preenchem pôsteres, notas e contagens de votos, elenco, gêneros e enredos. Chaves OMDb e TMDB funcionam se você as tiver, mas nada exige uma.
  • Grades de episódios: chips por temporada com o melhor encode de cada episódio a um clique do download, pacotes de temporada sinalizados e um "acompanhar série" no cabeçalho de cada temporada.
  • Linhas em alta: faixas de novidades da semana e do momento, montadas a partir da frequência de publicações.
  • Um mural que aprende. "Sem interesse" oculta um título e ensina uma regra permanente; a ordenação "Para você" classifica o mural pelo perfil de gosto que as suas próprias capturas constroem. Tudo isso fica local.
  • Corrija qualquer coisa. Correspondência errada? Escolha entre os candidatos ou simplesmente digite a identidade certa. Nada do que você define à mão é sobrescrito. Aponte um pôster para uma URL ou envie um. Um botão reenriquece um único título; outro apaga e reconstrói o índice inteiro.

A parte honesta

O que um scanner de cabeçalhos consegue e não consegue encontrar

Medimos isto no nosso próprio índice em vez de adivinhar, e a resposta não foi a nosso favor. Vale a pena dizê-lo com clareza, porque uma funcionalidade que encontra em surdina uma fração do que esperas é pior do que uma que te dá o número.

  • Encontra os posts publicados com um nome de ficheiro real. Uma leitura percorre os cabeçalhos do grupo de notícias, portanto tudo o que for carregado como Some.Film.2026.1080p.WEB-DL.x264-GROUP.part01.rar é reconhecido, analisado, arrumado sob o seu título e recebe um cartaz. Onde as pessoas ainda publicam assim, isto funciona bem e não precisa da conta de ninguém.
  • Não consegue encontrar posts ofuscados, e nada mais que faça leitura consegue. Uma fatia grande e crescente da Usenet é carregada com o nome retirado: um assunto aleatório, nomes de ficheiro aleatórios lá dentro, tudo despejado num grupo genérico. O nome verdadeiro existe apenas num NZB que quem carrega publica noutro sítio. Nunca foi publicado na Usenet, portanto não há nada na linha que qualquer leitor possa ler, nem o nosso nem o de ninguém.
  • O número. Um índice completo de 14.8 milhões de posts lidos rendeu cerca de 31,000 lançamentos navegáveis. Aproximadamente um em quinhentos. Quase todo o resto é um único fragmento sem nome que não se consegue agrupar num lançamento de todo.
  • É pouco provável que mude. Lemos os caminhos de nomeação dos indexadores de código aberto e testámos as técnicas que plausivelmente poderiam ajudar: a correlação anterior à base de dados por tamanho e hora de publicação não é suficientemente discriminante para identificar um lançamento, e ir buscar um segmento para ler o cabeçalho do arquivo falha nos arquivos de cabeçalho cifrado que dominam o conjunto ofuscado. Nenhuma das duas é uma solução a curto prazo, e não vamos dar a entender o contrário.
  • Por isso continua a usar indexadores comerciais. A um indexador é-lhe dito o que é um lançamento por quem o carregou, que é exatamente a informação que falta na linha. Isso é uma relação de comunidade, não um problema de engenharia que um binário auto-alojado consiga arrancar sozinho. O nzbfast pesquisa as tuas contas de indexador diretamente a partir da sua própria interface e agarra direto para a fila, portanto não perdes nada em deixar o leitor interno desligado.