Find research datasets worth reusing
Search datasets from major research repositories and use ShareScore to quickly assess how well each record supports discovery, access, and reuse.
30
datasets available to search
ShareScore release 0.9.0
Dataset results
30 results for “Conjunto de dados”
CSBCSet: Um conjunto de dados para uma década de CSBC, seus eventos e publicações
<p>In this paper, we present a dataset about a decade of publications in the Brazilian Computing Society Congress (CSBC), between 2013 and 2022. We specify the extraction, processing and adjusments, storage and opening of data, with its limitations, challenges and lessons learned . We analyzed the data and metadata scenario, perceiving positive and negative aspects of the scope. Finally, we forward proposals for potential applications of this dataset, and related threats to validity.</p>
MGPB: Conjunto de Dados de Séries Temporais de Músicas de Gênero de Protesto Brasileiras
<p>O dataset MGPB é um conjunto de dados sobre gêneros musicais brasileiros ligados a movimentos de protesto, combinando dados acústicos do Spotify com letras processadas por técnicas de linguagem natural, permitindo uma análise detalhada da expressão de protestos na música. Além disso, o MGPB permite a construção de séries temporais, tornando-se um recurso valioso para analisar gêneros musicais brasileiro de protesto ao longo do tempo.</p> <p>Dessa forma o csv esta estruturado com as colunas:</p> <table> <tbody> <tr> <td> <div> <div> <p>Coluna</p> </div> </div> </td> <td> <div> <div> <p>Descrição</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>ID do Spotify</p> </div> </div> </td> <td> <div> <div> <p>Identificador único para cada música na plataforma \textit{Spotify}.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>IDs do Artista</p> </div> </div> </td> <td> <div> <div> <p>Identificadores exclusivos dos artistas relacionados à música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Nome da Faixa</p> </div> </div> </td> <td> <div> <div> <p>Título da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Nome do Álbum</p> </div> </div> </td> <td> <div> <div> <p>Título do álbum ao qual a música pertence.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Nome do(s) Artista(s)</p> </div> </div> </td> <td> <div> <div> <p>Lista dos artistas associados à música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Duração (ms)</p> </div> </div> </td> <td> <div> <div> <p>Duração da música em milissegundos.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Popularidade</p> </div> </div> </td> <td> <div> <div> <p>Medida de popularidade da música determinada pelo algoritmo do Spotify.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Dançabilidade</p> </div> </div> </td> <td> <div> <div> <p>Indica o quão adequada a música é para dançar, baseado em características musicais.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Energia</p> </div> </div> </td> <td> <div> <div> <p>Representa a intensidade e atividade percebida da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Tonalidade</p> </div> </div> </td> <td> <div> <div> <p>Tonalidade da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Intensidade Sonora</p> </div> </div> </td> <td> <div> <div> <p>Volume percebido da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Modo Musical</p> </div> </div> </td> <td> <div> <div> <p>Indica se a música está em modo maior ou menor.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Intensidade Vocal</p> </div> </div> </td> <td> <div> <div> <p>Grau de presença de palavras faladas na música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Acústica</p> </div> </div> </td> <td> <div> <div> <p>Indica o grau de presença de elementos acústicos na música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Instrumental</p> </div> </div> </td> <td> <div> <div> <p>Indica o grau de presença de elementos instrumentais na música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Vivacidade</p> </div> </div> </td> <td> <div> <div> <p>Presença de elementos ao vivo na gravação da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Valência</p> </div> </div> </td> <td> <div> <div> <p>Medida que indica a positividade da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Ritmo</p> </div> </div> </td> <td> <div> <div> <p>Andamento da música em batidas por minuto.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Letra</p> </div> </div> </td> <td> <div> <div> <p>Conteúdo das letras da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Frequência de Palavras</p> </div> </div> </td> <td> <div> <div> <p>Frequência das palavras usadas nas letras da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Gênero</p> </div> </div> </td> <td> <div> <div> <p>Gênero musical da música.</p> </div> </div> </td> </tr> <tr> <td> <div> <div> <p>Década</p> </div> </div> </td> <td> <div> <div> <p>Década de lançamento da música.</p> </div> </div> </td> </tr> </tbody> </table>
ICPSet: Um Conjunto de Dados Estruturado de Itens de Compras Públicas
<div> <div> <div> <div> <p>O ICPSet é um conjunto de dados que compila informações detalhadas sobre compras públicas realizadas pelo Estado de Minas Gerais. Este conjunto abrangente de dados inclui registros de licitações, dispensas, contratos e notas fiscais, estruturados em formato JSON Lines (JSONL) para facilitar o acesso e análise. Cada registro contém atributos como identificação do item, tipo de licitação, ano de realização, preço, unidades de medida e descrição padronizada do item, tanto na forma original quanto pré-processada. </p> </div> </div> </div> </div>
Conjunto de Dados de Séries Temporais de Músicas Brasileiras
<p>O dataset é um conjunto de dados sobre gêneros musicais brasileiros, combinando dados acústicos do Spotify com letras processadas por técnicas de linguagem natural, permitindo uma análise detalhada. Além disso, permite a construção de séries temporais, tornando-se um recurso valioso para analisar gêneros musicais brasileiro de protesto ao longo do tempo.</p> <p>Dessa forma o csv de treino e avaliacao possui cerca de 51 mil musicas brasileiras de generos diversos e esta estruturado com as colunas:</p> <table> <tbody> <tr> <th>Nome da Coluna</th> <th>Descrição</th> </tr> </tbody> <tbody> <tr> <td>Nome da Música</td> <td>Nome da música.</td> </tr> <tr> <td>ID do Artista</td> <td>Identificador único do artista.</td> </tr> <tr> <td>Letra Tratada</td> <td>Letra da música após tratamento ou limpeza de dados (por exemplo, remoção de caracteres especiais).</td> </tr> <tr> <td>Raiva</td> <td>Pontuação ou indicador de raiva na letra da música.</td> </tr> <tr> <td>Medo</td> <td>Pontuação ou indicador de medo na letra da música.</td> </tr> <tr> <td>Alegria</td> <td>Pontuação ou indicador de alegria na letra da música.</td> </tr> <tr> <td>Tristeza</td> <td>Pontuação ou indicador de tristeza na letra da música.</td> </tr> <tr> <td>Surpresa</td> <td>Pontuação ou indicador de surpresa na letra da música.</td> </tr> <tr> <td>Gênero</td> <td>Gênero musical da música (por exemplo, pop, rock, jazz).</td> </tr> <tr> <td>Valor</td> <td>Valor associado à música, que pode representar uma métrica específica (por exemplo, popularidade, vendas).</td> </tr> </tbody> </table> <p>Dessa forma o csv de treino e avaliacao possui cerca de 51 mil musicas brasileiras de generos diversos e esta estruturado com as colunas:</p> <table> <tbody><tr> <th><strong>Coluna</strong></th> <th><strong>Descrição</strong></th> </tr> </tbody><tbody> <tr> <td>ID do <em>Spotify</em></td> <td>Identificador único para cada música na plataforma <em>Spotify</em>.</td> </tr> <tr> <td><em>IDs</em> do Artista</td> <td>Identificadores exclusivos dos artistas relacionados à música.</td> </tr> <tr> <td>Nome da Faixa</td> <td>Título da música.</td> </tr> <tr> <td>Nome do Álbum</td> <td>Título do álbum ao qual a música pertence.</td> </tr> <tr> <td>Nome do(s) Artista(s)</td> <td>Lista dos artistas associados à música.</td> </tr> <tr> <td>Duração (ms)</td> <td>Duração da música em milissegundos.</td> </tr> <tr> <td>Popularidade</td> <td>Medida de popularidade da música determinada pelo algoritmo do Spotify.</td> </tr> <tr> <td>Dançabilidade</td> <td>Indica o quão adequada a música é para dançar, baseado em características musicais.</td> </tr> <tr> <td>Energia</td> <td>Representa a intensidade e atividade percebida da música.</td> </tr> <tr> <td>Tonalidade</td> <td>Tonalidade da música.</td> </tr> <tr> <td>Intensidade Sonora</td> <td>Volume percebido da música.</td> </tr> <tr> <td>Modo Musical</td> <td>Indica se a música está em modo maior ou menor.</td> </tr> <tr> <td>Intensidade Vocal</td> <td>Grau de presença de palavras faladas na música.</td> </tr> <tr> <td>Acústica</td> <td>Indica o grau de presença de elementos acústicos na música.</td> </tr> <tr> <td>Instrumental</td> <td>Indica o grau de presença de elementos instrumentais na música.</td> </tr> <tr> <td>Vivacidade</td> <td>Presença de elementos ao vivo na gravação da música.</td> </tr> <tr> <td>Valência</td> <td>Medida que indica a positividade da música.</td> </tr> <tr> <td>Ritmo</td> <td>Andamento da música em batidas por minuto.</td> </tr> <tr> <td>Letra</td> <td>Conteúdo das letras da música.</td> </tr> <tr> <td>Frequência de Palavras</td> <td>Frequência das palavras usadas nas letras da música.</td> </tr> <tr> <td>Gênero</td> <td>Gênero musical da música.</td> </tr> <tr> <td>Década</td> <td>Década de lançamento da música.</td> </tr> </tbody> </table> <p>Além disso possui a analise emocional na tabela musica periferica emocoes com as colunas:</p> <table> <tbody><tr> <th><strong>Coluna</strong></th> <th><strong>Descrição</strong></th> </tr> </tbody><tbody> <tr> <td>ID do <em>Spotify</em></td> <td>Identificador único para cada música na plataforma <em>Spotify</em>.</td> </tr> <tr> <td>Raiva (BERT)</td> <td>Medida de raiva detectada usando o modelo BERT.</td> </tr> <tr> <td>Medo (BERT)</td> <td>Medida de medo detectada usando o modelo BERT.</td> </tr> <tr> <td>Alegria (BERT)</td> <td>Medida de alegria detectada usando o modelo BERT.</td> </tr> <tr> <td>Tristeza (BERT)</td> <td>Medida de tristeza detectada usando o modelo BERT.</td> </tr> <tr> <td>Surpresa (BERT)</td> <td>Medida de surpresa detectada usando o modelo BERT.</td> </tr> <tr> <td>Raiva (GPT)</td> <td>Medida de raiva detectada usando o modelo GPT.</td> </tr> <tr> <td>Medo (GPT)</td> <td>Medida de medo detectada usando o modelo GPT.</td> </tr> <tr> <td>Alegria (GPT)</td> <td>Medida de alegria detectada usando o modelo GPT.</td> </tr> <tr> <td>Tristeza (GPT)</td> <td>Medida de tristeza detectada usando o modelo GPT.</td> </tr> <tr> <td>Surpresa (GPT)</td> <td>Medida de surpresa detectada usando o modelo GPT.</td> </tr> </tbody> </table> <p>O arquivo zip <code>gpt result</code> contém análises do GPT na identificação de emoções, que podem ser utilizadas para compreender melhor as análises ou auditar os resultados.</p>
Conjunto de dados "Competências e Empregabilidade"
<p>Este conjunto de dados contém 108 casos (incluindo <em>missing values</em>) e está disponível em vários formatos aqui <<a href="https://doi.org/10.5281/zenodo.4370760">https://doi.org/10.5281/zenodo.4370760</a>> e contém dados reais coletados com alunos de graduação (Administração, Contabilidade ou Economia) recém-formados ou que estavam no final do curso.</p> <p> </p> <p>Esta pesquisa foi desenvolvida na disciplina Métodos Quantitativos de Pesquisa em Administração ministrada pelo autor no Programa de Pós-graduação em Administração de Empresas da Universidade Presbiteriana Mackenzie.</p> <p> </p> <p>A ideia geral foi avaliar se havia relação entre as competências desenvolvidas durante o curso de graduação e a empregabilidade, e para mensurar esses construtos foram usadas as seguintes escalas:</p> <p> </p> <p>GODOY, A. S.; ANTONELLO, C. S.; BIDO, D. S.; SILVA, D. DA. O desenvolvimento das competências de alunos formandos do curso de Administração: um estudo de modelagem de equações estruturais. <em>RAUSP - Revista de Administração</em> da Universidade de São Paulo, v. 44, n. 3, p. 265-278, 2009.</p> <p> </p> <p>CAMPOS, K. C. L. <em>Construção de uma Escala de Empregabilidade: competências e habilidades pessoais, escolares e organizacionais. </em>Tese de Doutorado. São Paulo: Instituto de Psicologia da Universidade de São Paulo, 2006.</p>
Artigos brasileiros de estudos de gênero e sobre mulheres: conjunto de dados de publicações de 1959 a 2019
<p>O conjunto de dados trata-se de artigos brasileiros de estudos de gênero e sobre mulheres, indexados na base de dados 1Findr e publicados no período de 1959 a 2019. A VERSÃO CORRETA DO ARQUIVO CONTÉM DADOS SOBRE 31609 ARTIGOS BRASILEIROS DE ESTUDOS DE GÊNERO E SOBRE MULHERES PUBLICADOS ENTRE 1959 E 2019. São artigos de pessoas vinculadas a instituições brasileiras, com metadados de: título; pessoas autoras (nomes padronizados e limpos); suas instituições de vínculo (nomes padronizados e limpos); cidade de cada instituição; país de cada instituição; periódico em que o artigo foi publicado; ano de publicação; dados do fascículo em que o artigo foi publicado; resumo do artigo (quando disponível); área de classificação na 1Findr de cada artigo (quando disponível); área brasileira de cada artigo (classificação CNPq, quando disponível); palavras-chave originais (quando disponível na fonte); palavras-chave limpas e padronizadas em português brasileiro; palavras-chave limpas e padronizadas em inglês. Formato planilha, conjunto de dados coletado em janeiro de 2020. A nova versão do conjunto de dados contém também algumas análises utilizadas na tese e em artigos posteriores. Cite a fonte! Tese originada deste conjunto de dados: <a href="http://hdl.handle.net/10183/220744">http://hdl.handle.net/10183/220744</a> Veja também as demais referências. Contacte-me para dúvidas: natascha.hoppen@ufrgs.br</p>
Conjunto de Dados sobre Mulheres Cientistas Brasileiras
<p>Este CSV é uma versão inicial de um conjunto de dados sobre mulheres inseridas área STEAM. Tem o objetivo de promover a visibilidade e o reconhecimento das contribuições femininas em ramos tradicionalmente dominados por homens.</p>
Artigos empíricos sobre bibliotecas universitárias e serviços de suporte à pesquisa: conjunto de dados de publicações
<p>O conjunto de dados trata-se de artigos empíricos sobre serviços de apoio à pesquisa oferecidos por bibliotecas universitárias, indexados nas bases de dados: Base de Dados em Ciência da Informação (BRAPCI), Dialnet, Library, Information Science & Technology Abstracts (LISTA), Information Science & Technology Abstracts (ISTA), Library and Information Science Abstracts (LISA), Scopus, Web of Science. Os artigos foram publicados no período de 2010 a 2023, nos idiomas: português, inglês e espanhol. O conjunto de dados contém os seguintes metadados: título; ano; período do relato; autores; autoridades; país dos autores; tipo de estudo; país da experiência relacionada; instituição da experiência; serviços relatados; característica dos serviços; nível dos serviços (relacionado aos dados de pesquisa); indica tratamento de dados de pesquisa. Além disso, inclui planilha utilizada para criar figura no software Gephi com a rede de autores dos artigos. Formato planilhas, conjunto de dados obtidos no segundo trimestre de 2023. O artigo originado deste conjunto de dados foi publicado na Revista "Em Questão": https://seer.ufrgs.br/EmQuestao. </p>
Conjunto de dados relacionados á pesquisa sobre a participação e envolvimento de cinco mulheres idosas no processo de codesign online.
<p>Este conjunto de dados faz parte de uma pesquisa mais ampla referente à tese de doutorado, que envolveu dois estudos de caso: um conduzido presencialmente e o outro remotamente. O conjunto de dados atual corresponde ao estudo de caso remoto, com foco em como cinco mulheres idosas participaram e se envolveram no processo de <strong>codesign de interação</strong> realizado remotamente.</p> <p>O conjunto inclui:</p> <ol> <li> <p><strong>Transcrições de Sessões Gravadas e Entrevistas Semiestruturadas</strong></p> <ul> <li>Formato: Arquivos PDF</li> <li>Conteúdo: Transcrições completas das entrevistas semiestruturadas e sessões gravadas com participantes.</li> <li>Exemplos: <ul> <li><em>Transcrições - EntrevistasSemi - IV-ok.pdf</em></li> <li><em>Transcrições - EntrevistasSemi - MN-ok.pdf</em></li> <li><em>Arquivo de áudio - vídeo - 24-08-pdf)</em></li> </ul> </li> </ul> </li> <li> <p><strong>Roda de Conversa</strong></p> <ul> <li>Formato: PDF</li> <li>Conteúdo: Registro de discussões em grupo, com insights sobre o processo de codesign.</li> <li>Exemplo: <em>roda de conversa - letramentodigital-OK.pdf</em></li> </ul> </li> <li> <p><strong>Grelhas de Análise de Conteúdo</strong></p> <ul> <li>Formato: PDF</li> <li>Conteúdo: Grelhas usadas para análise qualitativa de entrevistas e dados de campo.</li> </ul> </li> <li> <p><strong>Diários de Campo</strong></p> <ul> <li>Formato: PDF</li> <li>Conteúdo: Anotações de campo sobre observações durante o processo de coleta de dados, incluindo reflexões sobre os métodos de pesquisa e contextos observados.</li> <li>Exemplos: <ul> <li><em>DIÁRIO DE CAMPO - 12maio.pdf</em></li> <li><em>DIÁRIO DE CAMPO - 08mar.pdf </em></li> <li><em>...</em></li> </ul> </li> </ul> </li> <li> <p><strong>Respostas de Questionários Online</strong></p> <ul> <li>Formato: PDF</li> <li>Conteúdo: Respostas de participantes a questionários online relacionados ao estudo.</li> <li>Exemplos: <ul> <li><em>questionario-online-EI-MN.pdf</em></li> <li><em>...</em></li> </ul> </li> </ul> </li> <li> <p><strong>Modelos de Documentos</strong></p> <ul> <li>Formato: PDF</li> <li>Conteúdo: Modelos de questionários e entrevistas utilizados no estudo.</li> <li>Exemplos: <ul> <li><em>entrevista-semiestruturada-remoto-modelo.pdf</em></li> <li><em>questionario-online-modelo.pdf</em></li> <li><em>formulário online</em></li> </ul> </li> </ul> </li> </ol> <p><strong>Detalhes adicionais:</strong></p> <ul> <li><strong>Período de coleta de dados</strong>: De [junho/2021] a [agosto/2021].</li> <li><strong>Número de participantes</strong>: 5 mulheres idosas.</li> <li><strong>Formato dos dados</strong>: Principalmente PDFs, com transcrições, diários de campo, questionários e grelhas de análise de conteúdo.</li> </ul> <p>Os dados foram coletados conforme as diretrizes éticas estabelecidas pelo Comitê de Ética em Pesquisa da UESB (número de registro 17517019.2.0000.0055), incluindo o consentimento necessário dos participantes para o uso e compartilhamento para fins científicos.</p>
Conjunto de dados utilizados no estudo "AS TENDENCIAS DA PESQUISA CIENTÍFICA EM CIÊNCIA DE DADOS NO BRASIL"
<p>Conjunto de dados utilizados no estudo "AS TENDENCIAS DA PESQUISA CIENTÍFICA EM CIÊNCIA DE DADOS NO BRASIL" submetido ao Xv Simpósio de Iniciação Científica e XI encontro de Pós-graduação da Universidade de Marília (UNIMAR)</p><ul><li>No arquivo "Dados de pesquisa" em formato .xlsx são encontrados os anos de publicação, as áreas do conhecimento e suas respectivas produções e as métricas topológicas da rede.</li><li>No arquivo "Figura 1", tem-se a rede utilizada no estudo em formato .tiff</li><li>No arquivo "Busca web of science" tem-se os dados (brutos) exportados da base de dados Web Of Science utilizados neste estudo.</li></ul><p>Os dados de autorias foram suprimidos sendo utilizado "Autores" a fim de atender as normas do evento.</p>
Conjunto de dados Modelo de Regressão Aplicado à Previsão de Preços SPOT de Energia Elétrica (Dataset Regression Model Applied to Electric Energy SPOT Price Forecasting)
<p>Esse conjunto de dados utilizou DataSets de duas fontes distintas: CCEE e ONS. Como são órgãos públicos os dados são acurados, transparentes, confiáveis e de boa qualidade. Os dados de entrada possuem as variáveis que são utilizadas no modelo atual do PLD, já citado. São elas: as datas, o armazenamento de água, a ENA, a expectativa de ENA para a próxima semana e a carga.</p> <p>As datas são dados diários entre janeiro de 2013 e janeiro de 2017. O armazenamento de água é dado por submercado e apresentado em porcentagem da capacidade máxima. A ENA e a expectativa dela para a semana seguinte são apresentadas em porcentagem a partir das chuvas realizadas convertidas em MWmédio pelas previsões feitas utilizando dados históricos (1932-2007). A carga está em MWmédio. E o PLD em R$/MWh.</p> <p>Os soma dos dados dos quatro submercados (SE/CO, SU, NE, NO) de cada dado nos fornece a informação do Sistema Nacional Interligado (SIN).</p> <p>As variáveis de carga, armazenamento e ENA foram retiradas do histórico de operações do site da ONS, disponibilizados para download em ‘csv’. E o PLD do site da CCEE, disponibilizados em ‘xls’.</p> <p>Foram mesclados a partir das datas formando o arquivo de entrada para o modelo utilizado nos experimento</p> <p> </p> <p>Metadados / Metadata</p> <p>Storage of water: percentage of storage of water by submarket.<br> ENA and expectative of ENA: presented by percentage of previsions of rains that happen converted on MWmedium by previsions did with a historic (1932-2007). Data are by submarket.<br> Charge: charge by submarket give on MWmedium.<br> PLD: give on R$/MWh<br> The sum of each variable is the data of the total system.</p> <p> </p> <p> </p>
Conjunto de dados do Índice de Desenvolvimento Humano (IDH) das microrregiões brasileiras
<p><strong>Contexto </strong></p> <p>O Índice de Desenvolvimento Humano (IDH) é um indicador criado pelo Programa das Nações Unidas para o Desenvolvimento (PNUD) em 1990.O IDH mede o desenvolvimento humano de um país com base em três dimensões principais: Longevidade, medida pela expectativa de vida ao nascer; Educação, avaliada pela média de anos de estudo da população adulta e pelos anos esperados de escolaridade para crianças em idade escolar; e Renda, medida pelo PIB per capita ajustado ao poder de compra. O IDH varia de 0 a 1, sendo que valores mais próximos de 1 indicam maior desenvolvimento humano [<a title="Constructing a generalized model of the human development index" href="https://doi.org/10.1016/j.seps.2019.100778" target="_blank" rel="noopener">1</a>]. Índice de Desenvolvimento Humano Municipal (IDHM) é uma adaptação do IDH para o contexto dos municípios brasileiros. Ele também considera as mesmas três dimensões (longevidade, educação e renda), mas utiliza indicadores específicos para refletir melhor a realidade local [<a title="Atlas do Desenvolvimento Humano no Brasil" href="http://www.atlasbrasil.org.br/" target="_blank" rel="noopener">2</a>]. O IDH para microregiões brasileiras não é obitido facilmente, sendo nescessário a disponibilidade de um conjunto de dados acessível. Nesse sentido, o objetivo desse trabalho foi construir um conjunto de dados do IDH de todas as microrregiões brasileiras.</p> <p><strong>Fonte de dados e processamento</strong></p> <p>O Índice de Desenvolvimento Humano (IDH) das microrregiões brasileiras foi calculado utilizando a linguagem R 4.4 com as funçoes <em>group_by e summarise</em> do pacote <em>dplyr</em>. Os municipios foram agrupados por microrregião e foi calculado a média dos IDH municipais. O IDHM foi adiquirido da plataforma Atlas Brasil [<a title="Atlas do Desenvolvimento Humano no Brasil" href="http://www.atlasbrasil.org.br/" target="_blank" rel="noopener">2</a>], selecionando as variáveis de IDH geral, educação, longevidade e renda com dados do censo de 2010. Os dados das microrregiões foram adiquiridos do IBGE [<a title="Divisão Regional do Brasil" href="https://www.ibge.gov.br/geociencias/cartas-e-mapas/redes-geograficas/15778-divisoes-regionais-do-brasil.html?edicao=16163" target="_blank" rel="noopener">3</a>] e tratados no Microssoft Excel.</p> <p><strong>Descrição dos dados</strong></p> <p>São fornecidos dois arquivos. O IDHM.xlsx corresponde ao IDH municipal e o IDH_microrregioes.xlsx correponde aos dados de IDH das microrregoes brasileiras.</p> <table> <tbody> <tr> <td><strong>Variáveis</strong></td> <td><strong>Descrição</strong></td> <td><strong>Tipo<br></strong></td> </tr> <tr> <td>CD_MICRO</td> <td>Código IBGE da microrregião</td> <td>inteiro</td> </tr> <tr> <td>MICROR</td> <td>Nome da micrrorregião</td> <td>texto</td> </tr> <tr> <td>UF</td> <td>Sigla da Unidade Federativa</td> <td>texto</td> </tr> <tr> <td>IDH</td> <td>IDH geral</td> <td>decimal</td> </tr> <tr> <td>IDH_E</td> <td>IDH de educação</td> <td>decimal</td> </tr> <tr> <td>IDH_L</td> <td>IDH de longevidade</td> <td>decimal</td> </tr> <tr> <td>IDH_</td> <td>IDH de renda</td> <td>decimal</td> </tr> </tbody> </table>
LiPSet: Um conjunto de Dados com Documentos Rotulados de Licitações Públicas
<p>A grande diversidade de fontes e formatos de documentos de licitações públicas faz com que as tarefas de coleta, processamento e organização de tais documentos sejam desafiadoras do ponto de vista da análise de dados. Aqui, é apresentado o LiPSet, um conjunto de dados com documentos rotulados de licitações públicas de Minas Gerais. Após uma visão geral do processo de coleta e rotulação manual, uma breve análise exploratória de dados é apresentada para resumir as principais características e contribuições do conjunto de dados proposto. Além disso, são discutidas potenciais aplicações e principais desafios que envolvem o uso do LiPSet.</p>
Conjunto de dados sobre o perfil das escolas similares da Microrregião de Salvador - Bahia (Nota técnica 2014 - INEP)
<p>O conjunto de dados são resultados parciais da tese de doutorado <strong>MODELAGEM DE DADOS ABERTOS GOVERNAMENTAIS DA EDUCAÇÃO BASEADO EM REDES: PROJETO ESCOLAS SIMILARES </strong>, desenvolvida no ambito do programa de Pósgraduação em Difusão do Conhecimento da Universidade Federal da Bahia</p> <p>Autora: Eneida Santana de Ávila Goulart</p> <p>Orientador: Roberto Monteiro</p>
Conjunto de dados pesquisa bibliométrica História da Educação - cocitação e acomplamento bibliográfico de autores
<p>Trata-se do conjunto de dados da pesquisa bibliométrica "História da Educação: acoplamento bibliográfico e análise de cocitação de autores", extraído em 7 de agosto de 2023, da base de dados Web of Science. </p>
Conjunto de dados utilizado em "A evolução das tendências de pesquisa em gestão da informação e gestão do conhecimento"
<p>Conjunto de dados utilizado no artigo "A evolução das tendências de pesquisa em gestão da informação e gestão do conhecimento" plubicado na REAd - Revista Eletrônica de Administração (https://doi.org/10.1590/1413-2311.420.136125)</p> <p><strong>Dados de Pesquisa (xlsx):</strong></p> <ul> <li><strong>Aba 1 - </strong>Dados Agrupados: Conjunto de termos (palavras-chave) década por década organizadas em pares</li> <li><strong>Aba 2</strong> - Década de 90: termos utilizados em publicações da décadad e 1990</li> <li><strong>Aba 3</strong> - Década de 2000: termos utilizados em publicações da décadad e 2000</li> <li><strong>Aba 4 </strong>- Década de 2010: termos utilizados em publicações da décadad e 2010</li> <li><strong>Aba 5</strong> - Década de 2020: termos utilizados em publicações da décadad e 2020</li> </ul> <p> </p> <p><strong>Figura 1 </strong>- Rede de coocorrência de palavras-chave dos documentos publicados na década de 1990 (<a href="https://app.vosviewer.com/?json=https://drive.google.com/uc?id=1mvIAj6_MODBS40yFSKbh9zQZUR_Q06Aj">VOSviewer Online</a>)</p> <p><strong>Figura 2</strong> - Rede de coocorrência de palavras-chave dos documentos publicados na década de 2000 (<a href="https://app.vosviewer.com/?json=https://drive.google.com/uc?id=15ANSMb9Hm53AHdnPTfAT4YvyuyHrqDRO">VOSviewer Online</a>)</p> <p><strong>Figura 3</strong> - Rede de coocorrência de palavras-chave dos documentos publicados na década de 2010 (<a href="https://app.vosviewer.com/?json=https://drive.google.com/uc?id=1ftuESLPLO-Y7qoLS2IWEOpsbCD68umLQ">VOSviewer Online</a>)</p> <p><strong>Figura 4</strong> - Rede de coocorrência de palavras-chave dos documentos publicados na década de 2020 (<a href="https://app.vosviewer.com/?json=https://drive.google.com/uc?id=1c8D6xU_9lielqCNz20HvJnsp3FqtnRNF">VOSviewer Online</a>)</p>
Conjunto de dados utilizados para revisão bibliográfica do estudo "EXPERIÊNCIA DO USUÁRIO E ESTUDOS MÉTRICOS DA INFORMAÇÃO: métricas e relações possíveis"
<p>Conjunto de dados utilizados para revisão bibliográfica do estudo "EXPERIÊNCIA DO USUÁRIO E ESTUDOS MÉTRICOS DA INFORMAÇÃO: métricas e relações possíveis" apresentado no 9º EBBC - Encontro Brasileiro de Bibliometria e Cientometria.</p> <p><strong>Aba 1</strong>: Artigos</p> <p><strong>Aba 2</strong>: Artigos de Conferência</p> <p><strong>Aba 3</strong>: Artigos selecionados para análise</p> <p>Estudo disponível em: <a href="https://doi.org/10.22477/ix.ebbc.257">https://doi.org/10.22477/ix.ebbc.257</a></p>
Conjunto de dados utlizados no estudo "Cooperativas e desenvolvimento sustentável no Brasil: uma análise da contribuição para a Agenda 2030"
<p>Conjunto de dados utlizados no estudo "Cooperativas e desenvolvimento sustentável no Brasil: uma análise da contribuição para a Agenda 2030" submetido a Revista Brasileira de Gestão e Desenvolvimento Regional (G&DR).</p> <p> </p> <ul> <li><strong>Aba 1: </strong>Dados brutos</li> <li><strong>Aba 2: </strong>Dados utilizados</li> <li><strong>Aba 3: </strong>Dados aglutinados</li> <li><strong>Aba 4: </strong>Amostra</li> <li><strong>Aba 5: </strong>Análise de frequência</li> <li><strong>Aba 6: </strong>Estatística descritiva</li> <li><strong>Aba 7: </strong>Teste estatístico de Kruskal-Walis e teste post-hoc</li> </ul> <p> </p> <p>Os dados de autoria foram suprimidos para atender os requisitos de submissão conforme normas da revista, sendo utilizado "Autores" como nome dos autores. Após o processo de submissão, e em caso de aceitação, os dados de autoria serão alterados.</p>
Conjunto de dados utilizados no estudo "O desenvolvimento tecnológico e de inovação em gestão do conhecimento"
<p>Conjunto de dados utilizados no estudo "O desenvolvimento tecnológico e de inovação em gestão do conhecimento" submetidos a Revista Digital de Bibilioteconomia e Ciência da Informação (RDBCI).</p> <p><strong>Aba 1: </strong>Dados brutos</p> <p><strong>Aba 2: </strong>Evolução temporal</p> <p><strong>Aba 3: </strong>Áreas do conhecimento</p> <p><strong>Aba 4: </strong>Arquivo processado no VosViewer</p> <p><strong>Aba 5: </strong>Thesaurus das organizações</p> <p><strong>Aba 6: </strong>Métricas das organizações</p> <p><strong>Aba 7: </strong>Thesaurus das CIP (Classificação Internacional da Patentes)</p> <p><strong>Aba 8: </strong>Métricas das CIP</p> <p> </p>
Conjunto de dados de pesquisa - Percepções dos editores científicos sobre o compartilhamento de conhecimentos entre avaliadores
<p>Dados coletados para o desenvolvimento de pesquisa </p>
ScienceDex guides
Understand access before you commit
These curated guides explain access requirements, typical timelines, costs, and reuse considerations for widely used research datasets.
Allen Brain Atlas
Allen Brain Atlas is an Allen Institute collection of brain map atlases, datasets, APIs, and analysis tools covering mouse, human, and non-human primate brain resources.
Annotated Behaviour and Observability Dataset (ABODe)
ABODe is a University of Edinburgh DataShare dataset for behavior classification in group-housed mice using home-cage video, identities, bounding boxes, ground-plate positions, and annotator labels.
DANDI Archive for NWB datasets
DANDI is a BRAIN Initiative archive for publishing and sharing neurophysiology data, including electrophysiology, optophysiology, and behavioral data packaged as NWB and related standards.
International Brain Laboratory public data
The International Brain Laboratory public data releases expose standardized mouse decision-making experiments, including Neuropixels recordings, widefield calcium imaging, behavior, and session metadata accessed through the ONE API.
OpenNeuro
OpenNeuro is a free, open platform for sharing neuroimaging datasets, with public search, dataset pages, and download paths for web, S3, DataLad, and the OpenNeuro CLI.