Rede de Bibliotecas Escolares: blogues e websites preservados no Arquivo.pt
收藏资源简介:
<p>Este conjunto de dados identifica os websites e os blogues das bibliotecas escolares e fornece o <em>link</em> para o histórico preservado no Arquivo.pt.</p><p>Veja a<a rel="noopener noreferrer nofollow" href="https://sobre.arquivo.pt/pt/colabore/conjuntos-de-dados-para-investigacao/estrutura-de-dados-para-as-listas-tematicas-de-websites-do-arquivo-pt/"> <strong>estrutura de dados</strong></a>.</p><p>Os dados estão publicamente acessíveis no website da <a rel="noopener noreferrer nofollow" href="https://rbe.mec.pt/np4/sitios.html">Rede de Bibliotecas Escolares</a>. Porém, são apresentados num mapa interativo a que o <em>web crawler</em> não é capaz de aceder.</p><p>Para obter os endereços (URLs) das páginas de cada biblioteca, onde se encontram os link dos blogues das bibliotecas e de websites próprios, foi necessário um passo adicional, preparado pelo desenvolvedor do <a rel="noopener noreferrer nofollow" href="http://Arquivo.pt">Arquivo.pt</a>, que descrevemos abaixo, como caso inspirador para outros semelhantes.</p><p></p><p><strong>Extração de informação de um website onde a informação é apresentada como pontos num mapa</strong></p><p>Analisando o tráfego do site, conseguiu-se obter o JSON com toda a informação nesse formato. Depois, na consola do browser, guardou-se esta informação numa variável x e correram-se os seguintes comandos: ``` keys = <a rel="noopener noreferrer nofollow" href="http://x.map">x.map</a>(n => Object.keys(n)).reduce((acc,cur) => [...new Set([...acc,...cur])],[]) default_n = {} keys.forEach(k => default_n[k] = '') keys.join(' ') + ' ' + <a rel="noopener noreferrer nofollow" href="http://x.map">x.map</a>(n => ({...default_n,...n})).map(n => {r = []; keys.forEach(k => r.push(n[k])); return r.join(' ')}).join(' ') ``` Copiou-se o output para um editor de texto e substituíram-se todos os ""\t"" por um caráter de tabulação (tab), e os ""\n"" por novas linhas. Selecionou-se tudo e copiou-se para uma tabela. Finalmente, para as linhas que não tinham URL, gerou-se o URL a partir do codIgefe, quando possível. </p><p>Recomenda-se a quem possui websites que disponibilizam informação com base num mapa que extraia e forneça ao <a rel="noopener noreferrer nofollow" href="http://Arquivo.pt">Arquivo.pt</a> os URLs de todos os conteúdos para poderem ser gravados. O <a rel="noopener noreferrer nofollow" href="http://Arquivo.pt">Arquivo.pt</a> não poderá fazer este passo adicional para todos os website. Cada caso é específico, dependendo das tecnologias utilizadas.</p><p>Este exercício de preservação foi realizado nas seguintes datas:</p><ul><li><p>Data da extração: 14-08-2025. </p></li><li><p>Data de gravação do website <a rel="noopener noreferrer nofollow" href="http://rbe.mec.pt">rbe.mec.pt</a>: 18 a 22 de agosto de 2025.</p></li><li><p>Data de gravação da lista de blogues e websites das bibliotecas escolares referidos no website <a rel="noopener noreferrer nofollow" href="http://rbe.mec.pt">rbe.mec.pt</a>: 20 e 30 de novembro de 2025.</p></li></ul><p></p><p><strong>Fonte:</strong></p><p>Rede de Bibliotecas Escolares: <a rel="noopener noreferrer nofollow" href="https://rbe.mec.pt/np4/sitios.html">https://rbe.mec.pt/np4/sitios.html</a></p><p></p>



