本站提供正體中文版。切換到正體中文本站提供简体中文版。切换到简体中文This site is available in English.View in Englishこのサイトには日本語版があります。日本語で表示이 사이트는 한국어로도 제공됩니다.한국어로 보기Diese Website ist auch auf Deutsch verfügbar.Auf Deutsch ansehenEste sitio web también está disponible en español.Ver en españolQuesto sito è disponibile anche in italiano.Visualizza in italianoCe site est également disponible en français.Afficher en françaisDeze website is ook beschikbaar in het Nederlands.In het Nederlands bekijkenЭтот сайт также доступен на русском языке.Смотреть на русскомयह वेबसाइट हिन्दी में भी उपलब्ध है।हिन्दी में देखेंهذا الموقع متاح أيضًا باللغة العربية.عرض بالعربيةSitus ini juga tersedia dalam bahasa Indonesia.Lihat dalam bahasa IndonesiaBu site Türkçe olarak da mevcut.Türkçe görüntüleTa strona jest dostępna także po polsku.Wyświetl po polskuTrang web này cũng có phiên bản tiếng Việt.Xem bằng tiếng Việtاین وب‌سایت به فارسی هم در دسترس است.مشاهده به فارسی

Como escolher um computador para o processamento de imagens astronômicas: CPU, RAM, SSD e testes reais

Ferramentas e hardware2020.07Notas antigas

Este artigo foi compilado a partir de anotações e testes reais feitos entre 2020 e 2024. Os modelos de CPU e de placa de vídeo, os preços de memória e as pontuações de Benchmark mencionados no texto mudam todos com o tempo, então, na hora de comprar, tome como referência as informações de mercado atuais.

“Que computador devo montar para rodar o PixInsight?” é uma pergunta comum na comunidade. Nestes últimos anos, troquei de máquina várias vezes e medi bastantes combinações com o script de Benchmark oficial. Este artigo organiza as minhas conclusões em um guia de compra dividido por componente, acrescentando a evolução das pontuações reais que fui registrando ao longo do caminho.

Primeiro, uma palavra sobre o PixInsight Benchmark

O PixInsight oferece oficialmente um script de teste de desempenho com o qual você pode avaliar o desempenho do seu computador rodando o PI; ao terminar, ele dá três pontuações: Total, CPU e Swap. Se for medir, lembre-se de atualizar o PI para a versão mais recente antes de rodá-lo.

Fiz as primeiras medições no computador que deixo na empresa e uso para processar imagens astronômicas (AMD APU 2400G, DDR4 2666 14GB, M.2 SSD): no melhor caso, chegava a um Total de apenas cerca de 6.414. Depois de atualizar o processador (AMD R5 4650G), a pontuação da CPU simplesmente dobrou, disparando para mais de treze mil, e além disso a máquina inteira não passava de 120 watts de consumo total — um resultado que me deixou muito satisfeito; essa pontuação até empatava com o desktop de tamanho normal que tenho em casa (R5-3600, 32GB DDR4 3200).

Resultado inicial de rodar o PixInsight Benchmark em um AMD APU 2400G Pontuação de Benchmark na plataforma AMD R5-3600

Como escolher cada componente

Chegado 2023, à medida que minhas câmeras trocaram de CCD para CMOS (IMX571, IMX455 etc.) e as imagens passaram de pouco mais de dez milhões de pixels para vinte e quatro e até sessenta milhões de pixels, as especificações do meu antigo computador de escritório começaram a sofrer — só alternar entre um passo para trás e um passo para frente já levava três segundos, o que tornava a comparação entre as imagens de antes e depois nada intuitiva. Somava-se a isso o fato de que, naquele ano, os processos de IA chegaram em grande número e passaram a ser usados em muitas etapas do fluxo de trabalho. Assim, reorganizei a minha lógica de compra:

CPU

O que o PI quer é “muitos núcleos, e todos eles núcleos grandes”. Nos PCs convencionais, CPUs de consumo de ponta como o AMD 7950X ou o Intel i9-13900K têm melhor desempenho. Vale um alerta especial: as versões X3D da AMD não trazem nenhum benefício para o PI, e o seu desempenho real em produtividade pode até ser ligeiramente inferior ao do 7950X comum — a menos que você também queira jogar, basta escolher a versão comum.

Além disso, alguém já rodou um R9-7950X com Linux e tirou uma pontuação acima de cinquenta mil, atropelando de vez a série i9-13900 (o processo de 5 nm da TSMC é realmente potente); quem pretende trocar de máquina em breve pode ficar de olho nesse tipo de combinação.

As primeiras posições do ranking do PixInsight Benchmark, em que o R9-7950X + Linux se destaca

Placa de vídeo (VGA)

Quem processa cometas, ou cujo fluxo de trabalho exige remover estrelas e reduzir ruído repetidamente, num PC eu recomendo acrescentar uma placa de vídeo NVIDIA, para que os núcleos CUDA ajudem a acelerar SXT, NXT e BXT. Aos preços de mercado da época, a série RTX 30 (como a RTX 3060 ou a 3060 Ti) era a primeira escolha. Se você não joga, a RTX 3060 na versão de 12G é uma boa opção — econômica, com mais VRAM e capaz até de servir também como máquina para Stable Diffusion. (Há um artigo dedicado com testes reais detalhados sobre a aceleração por GPU.)

No lado do Mac, os modelos a partir do M1 ativam a aceleração por GPU automaticamente.

SSD

No mínimo, coloque os arquivos que vai processar em um SSD SATA para trabalhar a partir dele; dada a situação predominante atual, colocá-los em um SSD M.2 é ainda melhor. Um SSD PCIe Gen3 já basta; o benefício que o Gen4 traz é, na verdade, pequeno (só é mais rápido na hora de copiar arquivos).

A propósito, se você rodar o PI Benchmark com um RAMDISK mas a velocidade só chegar a 4GB/s, não faz muito sentido — se um RAMDISK não alcança pelo menos 10GB/s, é melhor trocar de uma vez por um SSD PCIe Gen4 em conta (7GB/s já deve ser rápido o suficiente).

RAM

O PI aproveita a memória de forma bastante eficiente. A menos que você processe sempre imagens grandes de sensores full frame ou maiores, 32GB já são suficientes. Se você usa DDR4, pode ir direto para 64GB; a DDR5 ainda estava meio cara na época, então comece com 32GB e acrescente mais se surgir a necessidade.

Aqui há um conceito importante: se a memória não for suficiente, nem a CPU mais rápida consegue dar o seu melhor. Antes de executar um script ou processo, o PI primeiro estima a memória disponível; se não houver espaço bastante para alimentar todas as threads, ele limita diretamente o número de threads utilizáveis. Por exemplo, se cada thread precisa de 1,7GB mas restam apenas 19GB de memória, o PI só libera 9 threads; mas a sua CPU claramente tem 32 threads, o que equivale a 23 threads paradas à toa. Oficialmente, o PI recomenda cerca de 2GB de memória por thread — tomando o AMD 7950X (16 núcleos grandes, 32 threads) como exemplo, é preciso instalar pelo menos 64GB para que o software possa render por completo.

A situação em que o PixInsight limita automaticamente o número de threads utilizáveis quando a memória é insuficiente

Algumas das minhas máquinas de teste

Ao longo de todas essas trocas, tenho à mão algumas máquinas representativas:

  • Computador de escritório AMD R5-2400G → R5-4650G: foi justamente no computador de escritório com o 2400G que aprendi PI no começo, e depois subi para o 4650G (desempenho equivalente mais ou menos a um R5-3600); mas, por causa do gabinete pequeno, além da CPU, da memória e do SSD, não havia espaço para instalar uma placa de vídeo adicional.
  • Notebook gamer AMD R7-5800H: 32GB DDR4 3200, SSD M.2 Gen3, RTX 3060 Laptop 6G, com um custo total inferior a quarenta mil dólares taiwaneses. O prazer de atualizar a RAM e o SSD com as próprias mãos não tem preço, e a placa de vídeo fica dedicada à remoção de estrelas acelerada por CUDA.
  • Novo desktop AMD R9-7950X: DDR5 6000 16G×2, um water cooler all-in-one de 360, uma placa-mãe B650, vários SSDs M.2 PCIe, uma RTX 3060 12G e uma fonte de 750W. Ao montar essa máquina, concentrei o orçamento nos componentes mais relacionados ao processamento de imagens (CPU, refrigeração líquida, placa de vídeo) e espremi ao máximo o restante dos periféricos.

Especificações e Benchmark do desktop R9-7950X recém-montado Pontuação do PI Benchmark do notebook gamer R7-5800H

No fim de 2024, depois de o PI ser atualizado para a versão principal 1.9 Lockhart, como de costume fiz mais uma rodada de testes. As pontuações médias dessas três máquinas que tenho foram, respectivamente: o R5-3600, usado há quase cinco anos, cerca de 14.700; o R7-5800H, de três anos, cerca de 17.000; e o R9-7950X, de quase dois anos, cerca de 29.800. O 7950X, como desktop principal, depois de dois anos continua com um desempenho excelente, e parece que ainda aguenta mais dois anos enquanto espero a próxima geração de CPUs da AMD. Claro que, se fosse montar uma máquina agora, ir direto ao topo com um R9-9950X provavelmente me cobriria por mais cinco anos.

Comparação das pontuações de Benchmark dos três computadores após a atualização para o PixInsight 1.9

Alguns detalhes fáceis de passar despercebidos

  • Sobre o Apple ARM: a partir da versão 1.9, o PI trocou o seu motor de cálculo e caminha aos poucos para o suporte nativo ao Apple ARM, em vez de rodar por meio de um emulador. Antes disso (na era 1.8.x), o PI nos M1/M2 era executado sob emulação, e é preciso levar esse ponto em conta ao avaliar o desempenho.
  • O limite de CPU a partir da 1.9: a partir da versão 1.9, o PixInsight deixou de dar suporte às CPUs antigas que não têm as instruções AVX2/FMA3 (Intel mais ou menos antes do segundo trimestre de 2013, AMD mais ou menos antes do segundo trimestre de 2015); essas plataformas antigas não conseguirão instalar a nova versão do PI. A quem ainda usa um PC antigo, recomendo avaliar a troca de máquina antes de saltar para a versão principal.
  • Travamentos das Intel K de 13ª/14ª geração: vários colegas de hobby já relataram que as CPUs Intel da série K de 13ª e 14ª geração travam ao rodar o PI com os valores padrão. Mais tarde, o fabricante lançou uma atualização de BIOS que reduz o desempenho em cerca de 10% mas garante a estabilidade do sistema; quem usa uma i9-13900K, 14900K ou 14700K faz bem em atualizar e testar.
  • O tempo desde a inicialização afeta a pontuação: no Windows, para tirar a melhor pontuação de Benchmark, o ideal é rodá-lo logo após “desligar e ligar de novo”, com a máquina recém-iniciada. No caso do meu computador, um simples reinício não adianta; é preciso desligar e depois ligar de novo, senão o SSD não executa a coleta de lixo; depois de cerca de uma semana ligado, a velocidade de leitura sequencial do SSD cai para menos de 3000MB/s. Desligar e reiniciar periodicamente é mesmo necessário.

A influência da duração do tempo ligado sobre a pontuação de Benchmark e a velocidade de leitura do SSD

A propósito: o computador de controle das capturas

Além da máquina principal de pós-processamento, o local de captura precisa também de um computador de controle, e a lógica para escolhê-lo é completamente diferente — o que importa não é o desempenho, mas a estabilidade e a resistência ao ambiente. Consegui dois pentes de memória DDR5 para notebook, combinei-os com um antigo SSD M.2 Gen3 e montei um pequeno computador baseado em um núcleo Intel 1240P, para servir de máquina de controle durante as capturas de imagens astronômicas (controlando ao mesmo tempo uma montagem, dois tubos e duas câmeras) e também para o empilhamento ao vivo (live stacking). Ele não tem bateria, então não teme o frio lá no alto da montanha; mas é um sistema com ventoinha, por isso não pode ser montado diretamente sobre o tubo óptico.

O computador de controle das capturas montado em torno de um Intel 1240P

Em resumo

Para montar um computador que rode o PI, a ordem de prioridade é mais ou menos esta: uma CPU com muitos núcleos grandes, memória suficiente para corresponder ao número de threads, um SSD M.2 decente e, então, conforme o fluxo de trabalho, acrescentar uma placa de vídeo NVIDIA. As especificações de hardware não param de mudar de geração em geração, mas o princípio de “investir o orçamento nos elos mais relacionados ao processamento de imagens” não sai de moda com facilidade.