Ciência da Informação (E-Journal)
Not a member yet
    2033 research outputs found

    Grau de pertencimento como insumo para classificação automática de textos: uma abordagem sintática

    Get PDF
    Grouping documents into categories is one of the solutions adopted to streamline the information retrieval process, which is increasingly relevant due to the large amount of information available today. The manual localization of documents of a specific theme, available in digital repositories, involves reading the title, abstract and keywords, in addition to further detailed evaluation in order to identify whether the publication belongs to the desired thematic axis. Considering the number of publications in a digital repository, manually locating all the desired texts on a given topic can be laborious and time-consuming. This research proposes an architecture for automatic classification of texts that is based on syntactic questions, that is, it undertakes a comparison of n-grams, which are combinations of n-pairs of words that are identified throughout the text. An exploratory applied research was carried out, which applied a type of supervised learning, fundamentally based on the document representation model called bag-of-words (BoW). The paper’s macro objective was to classify texts in general, according to pre-defined categories, by generating and comparing degrees of belonging between texts, as one of the key criteria. The results of these comparisons, using n-gram = 3, demonstrate that in the use of classifications by n-grams, the greater the number of grams, and with the removal of the stop words, we obtain a reduced degree of belonging, demonstrating greater rigor in identifying the match during the classification. In order to have greater confidence in the results, a larger training corpus is necessary to expand the number of words that characterize the pre-defined categories, to be used in the classification of the texts.La agrupación de documentos en categorías es una de las soluciones adoptadas para agilizar el proceso de recuperación de información, que es cada vez más relevante debido a la gran cantidad de información disponible en la actualidad. La localización manual de documentos de un tema específico, disponibles en repositorios digitales, implica la lectura del título, resumen y palabras clave, además de una evaluación más detallada con el fin de identificar si la publicación pertenece al eje temático deseado. Teniendo en cuenta la cantidad de publicaciones en un repositorio digital, ubicar manualmente todos los textos deseados sobre un tema determinado puede resultar laborioso y llevar mucho tiempo. Esta investigación propone una arquitectura de clasificación automática de textos que se basa en preguntas sintácticas, es decir, realiza una comparación de n-gramos, que son combinaciones de n-pares de palabras que se identifican a lo largo del texto. Se realizó una investigación aplicada de carácter exploratorio, que aplicó un tipo de aprendizaje supervisado, basado fundamentalmente en el modelo de representación de documentos denominado bolsa de palabras (bag-of-words - BoW). Su macro objetivo era clasificar los textos en general, según categorías predefinidas, generando y comparando grados de pertenencia entre textos, como uno de los criterios clave. Los resultados de estas comparaciones, utilizando n-gramo = 3, demuestran que en el uso de clasificaciones por n-gramos, a mayor número de gramos, y con la eliminación de las palabras vacías, obtenemos un grado de pertenencia reducido, demostrando mayor rigor en la identificación del partido durante la clasificación. Para tener una mayor confianza en los resultados, es necesario un corpus de formación más amplio para ampliar el número de palabras que caracterizan las categorías predefinidas, para ser utilizadas en la clasificación de los textos.Agrupar documentos em categorias é uma das soluções adotadas para agilizar o processo de recuperação de informação, cada vez mais relevante devido à grande de oferta de informação existente nos dias atuais. A localização manual de documentos de determinada temática, disponíveis em repositórios digitais, passa pela leitura de título, resumo e palavras-chave, além de posterior avaliação mais detalhada com o intuito de se identificar se a publicação pertence ao eixo temático desejado. Considerando o número de publicações existentes num repositório digital, a localização manual de todos os textos desejados de uma determinada temática pode ser trabalhosa e demorada. Esta pesquisa propõe uma técnica para classificação automática de textos que se baseia em questões sintáticas, ou seja, empreende uma comparação de n-gramas, que são combinações de n-uplas de palavras identificadas ao longo do texto. Realizou-se uma pesquisa aplicada, de cunho exploratório, que aplicou um tipo de aprendizagem supervisionada, baseada fundamentalmente no modelo de representação dos documentos chamado saco de palavras (bag-of-words - BoW). Seu objetivo-macro foi o de classificar textos de maneira geral, de acordo com categorias pré-definidas, por meio da geração e comparação de graus de pertencimento entre os textos, como um dos critérios-chave. Os resultados destas comparações, a partir da utilização de n-grama = 3, demonstram que, na utilização de classificações por n-gramas, quanto maior o número de gramas, e com a retirada das stop words, obtém-se um grau de pertencimento reduzido, demonstrando um rigor maior para identificar a combinação (match) durante a classificação. Para termos maior confiança nos resultados, é necessário um corpus de treinamento maior, para ampliar o número de palavras que caracterizem as categorias pré-definidas, a serem utilizadas na classificação dos textos

    Modelagem de metadados multimídia: uma proposta ontológica baseada em reúso: an ontological proposal based on reuse

    No full text
    In recent years, there is a significant growth of semantically related and distributed data on the Web. In this context, metadata standards recommended by the World Wide Web Consortium have been used to describe and represent multimedia resources, making it possible to expand access points and improve the management, organization and recovery of digital resources on the network. A problem commonly found in institutional databases is the integrated treatment of heterogeneous data and the lack of standardization in description formats. The description of numerous items is generally carried out independently, with idiosyncratic standards of description, emphasizing different characteristics to be described and different terminologies to describe them, disregarding interoperability requirements between communities. The present research sought to advance in the forms of representation of multimedia documents with texts, videos, images, 3D models, audios, proposing an Ontological Model of Multimedia Reference capable of semantically organizing types of metadata to describe multimedia content in different contexts and needs. Methodologically, the modeling proposal was based on multimedia ontologies better placed in a ranking obtained from the NeOn Methodology guide, which ensured the selection of adequate knowledge resources in light of functional and non-functional requirements. The Ontological Model of Multimedia Reference proposed fundamental ontological classes and relationships from mappings and semantic alignments between reused ontologies, promoting a comprehensive architecture for the semantic organization of multimedia metadata addressed mainly to applications that deal with information resources on the Web.En los últimos años, ha habido un crecimiento significativo en los datos semánticamente relacionados y distribuidos en la Web. En este contexto, estándares de metadatos recomendados por el World Wide Web Consortium se han utilizado para describir y representar recursos multimedia, lo que permite ampliar los puntos de acceso y mejorar gestión, organización y recuperación de recursos digitales. Un problema que se encuentra comúnmente en las bases de datos institucionales es el tratamiento integrado de datos heterogéneos y la falta de estandarización en los formatos de descripción. La descripción de numerosos elementos generalmente se lleva a cabo de forma independiente, con estándares de descripción idiosincráticos, enfatizando diferentes características para ser descritas y diferentes terminologías para describirlas, sin tener en cuenta los requisitos de interoperabilidad. La presente investigación buscó avanzar en las formas de representación de documentos multimedia, proponiendo un Modelo Ontológico de Referencia Multimedia capaz de organizar semánticamente tipos de metadatos para describir contenido multimedia en diferentes contextos y necesidades. Metodológicamente, la propuesta de modelado se basó en ontologías multimedia mejor ubicadas en un ranking obtenido de la guía de Metodología NeOn, que aseguró la selección de recursos de conocimiento adecuados a la luz de requisitos funcionales y no funcionales. El Modelo Ontológico de Referencia Multimedia propuso clases y relaciones ontológicos fundamentales a partir de mapeos y alineamientos semánticos entre ontologías reutilizadas, promoviendo una arquitectura para la organización semántica de metadatos multimedia dirigidos principalmente a aplicaciones que manejan recursos de información en la Web.Nos últimos anos, observou-se um crescimento significativo de dados semanticamente relacionados e distribuídos na Web. Nesse contexto, padrões de metadados recomendados pelo World Wide Web Consortium vêm sendo utilizados para descrever e representar recursos multimídia, possibilitando ampliar os pontos de acesso e melhorar a gestão, a organização e a recuperação de recursos digitais na rede. Um problema comumente verificado nas bases de dados institucionais está no tratamento integrado de dados heterogêneos e na ausência de padronização nos formatos de descrição. A descrição de inúmeros itens geralmente é realizada de maneira independente, com padrões idiossincráticos de descrição, ressaltando diferentes características a serem descritas e diferentes terminologias para descrevê-las, desconsiderando requisitos de interoperabilidade entre as comunidades. A presente pesquisa buscou avançar nas formas de representação de documentos multimídia com textos, vídeos, imagens, modelos 3D, áudios, propondo um Modelo Ontológico de Referência Multimídia capaz de organizar semanticamente tipologias de metadados para descrição de conteúdo multimídia frente a variados contextos e necessidades. Metodologicamente, a proposta de modelagem foi fundamentada em ontologias multimídia mais bem colocadas em um ranking obtido a partir do guia NeOn Methodology, o que assegurou a seleção de recursos de conhecimento adequados frente a requisitos funcionais e não funcionais determinados. O Modelo Ontológico de Referência Multimídia propôs classes e relacionamentos ontológicos fundamentais provenientes de mapeamentos e alinhamentos semânticos entre as ontologias reutilizadas, promovendo uma arquitetura abrangente para a organização semântica de metadados multimídia endereçados principalmente a aplicações que lidam com recursos de informação na Web

    Acervos Culturais Brasileiros no Repositório Wikimedia Commons: um estudo sobre o reúso e a visualização de mídias referentes a coleções de museus do Instituto Brasileiro de Museus: A study on the reuse and visualization of media related to museum collections of the Brazilian Institute of Museums

    No full text
    This article presents a webometric study about media referring to collections of Brazilian museums in the Wikimedia Commons media repository, more specifically about media from collections of nine museums managed by the Brazilian Museum Institute (IBRAM). Using the GLAMorous and GLAMorous 2 tools, it was possible to obtain data regarding the media reuse of Wikimedia Commons in other Wikimedia Foundation wiki platforms, such as Wikipedia projects in different languages, Wikidata and others. It was also possible to obtain numbers related to the views of these collections in 2019. In this way, the research carried out, as well as the data obtained, ways to help cultural institutions guarding collections, such as museums, to understand what happens with their digital collections. Since they are made available on wiki platforms, providing important data for the management of their collections, mainly in relation to access and reappropriation of these collections by users.   Este artículo presenta un estudio webométrico sobre los medios que se refieren a colecciones de museos brasileños en el repositorio de medios de Wikimedia Commons, más específicamente sobre medios de colecciones de nueve museos administrados por el Instituto Brasileño de Museos (IBRAM). Utilizando las herramientas GLAMorous y GLAMorous 2, fue posible obtener datos sobre la reutilización de medios de Wikimedia Commons en otras plataformas de wikis de la Fundación Wikimedia, como proyectos de Wikipedia en diferentes idiomas, Wikidata y otros. También fue posible obtener números relacionados con el número de vistas de estas colecciones en 2019. De esta manera, la investigación llevada a cabo, así como los datos obtenidos, pueden ayudar a las instituciones culturales que custodian colecciones, como los museos, a comprender lo que sucede con sus colecciones digitales. ya que están disponibles en plataformas wiki, proporcionando datos importantes para la gestión de sus colecciones, principalmente en relación con el acceso y la reapropiación de estas colecciones por parte de los usuarios.   O artigo apresenta um estudo webométrico acerca de mídias referentes a coleções de acervos de museus brasileiros no repositório de mídias Wikimedia Commons, mais especificamente sobre mídias de coleções de nove museus geridos pelo Instituto Brasileiro de Museus (Ibram). Utilizando as ferramentas GLAMorous e GLAMorous 2, foi possível obter dados relativos ao reúso de mídias da Wikimedia Commons em outras plataformas wiki da Fundação Wikimedia, como os projetos Wikipédia de diferentes idiomas, a Wikidata e outros. Também foi possível obter números relativos à quantidade de visualizações desses acervos no ano de 2019. Dessa forma a investigação realizada, assim como os dados obtidos, podem ajudar instituições culturais guardiãs de acervos, como os museus, a entender o que acontece com seus acervos digitais uma vez que são disponibilizados nas plataformas wiki, fornecendo dados importantes para a gestão de suas coleções, principalmente em relação ao acesso e reapropriação desses acervos por parte dos usuários.

    Uso da inteligência competitiva no processo de tomada de decisão na pecuária leiteira

    No full text
    Utilizar a informação como estratégia é fundamental para as organizações rurais, bem como fazer a gestão da informação empregando processos como a inteligência competitiva. Dessa forma, objetivo é analisar o processo decisório dos produtores de leite referente à gestão da atividade leiteira. Para atingir o objetivo, foi realizada uma pesquisa exploratória, a fim de entender a perspectiva dos indivíduos envolvidos no estudo. A técnica utilizada foi caso múltiplos, analisando dois tipos de organização, os produtores de leite e indústria de laticínio. A amostra foi composta por produtores de leite da região de Tupã/SP, selecionados a partir de uma base de dados da antiga Cooperativa de Laticínios da Alta Paulista (COPLAP). A coleta de dados foi por meio entrevistas com os produtores rurais e a indústria de laticínio, observação in loco e análises de documentos dos produtores de leite. Os resultados indicam que é incipiente por parte dos produtores de leite o emprego de tecnologias da informação na parte técnica e nenhuma na parte gerencial. As etapas do processo de gestão da informação que os produtores realizam são a necessidade da informação, a busca da informação e o uso da informação. Por fim, os produtores de leite têm grandes dificuldades em realizar as etapas da gestão da informação e consequentemente a inteligência competitiva

    O papel das tecnologias da informação e comunicação na atual sociedade

    Get PDF
    Este estudo aborda o papel das Tecnologias da Informação e Comunicação (TICs) na atual sociedade. Para tanto, realiza uma revisão da literatura científica sobre a sociedade da informação e as TICs, com especial atenção à relação entre elas. Prioriza uma abordagem interdisciplinar sobre a temática, com ênfase nos aspectos humanos e sociais envolvidos, em consonância com a perspectiva da Ciência da Informação. Deste modo, refuta as visões de determinismo tecnológico e evolucionismo associados ao papel da TICs na organização social, bem como aponta que os recursos tecnológicos estão na base das transformações observadas na sociedade da informação, não sendo, contudo, os únicos responsáveis por tais transformações

    Sistemas de Informação em Pesquisa Corrente na transferência de informação e inovação para o mercado

    Get PDF
    Os Sistemas de Informação em Pesquisa Corrente (CRIS) são meta-sistemas que reúnem informações buscando integrar resultados de pesquisas de diversas unidades e centros. É um instrumento para tomada de decisão sobre fomento, planejamento e políticas públicas. O presente trabalho tem como objetivo identificar os modos de transferência de informação, inovação e conhecimento entre a UFRJ e o setor produtivo do Rio de Janeiro. A metodologia é baseada em survey, revisão sistemática de literatura na área de organização do conhecimento, e a experiência da Universidade do Minho e da Universidade Aberta de Portugal (UAb)

    Recursos Educacionais Abertos e Agenda 2030. A Universidade Aberta de Portugal (UAb)

    Get PDF
    Analisa-se a relevância do Projeto Recursos Educacionais Abertos (REA), desenvolvido pela Universidade Aberta de Portugal (UAb), para o cumprimento dos Objetivos do Desenvolvimento Sustentável, em particular: ODS 4 - Educação de Qualidade e ODS 17 - Parcerias para a Implementação dos Objetivos, dos Objetivos

    Dados de acesso aberto para compreensão da produção científica das mulheres no Brasil

    Get PDF
    A crescente participação das mulheres nas carreiras científica e tecnológica tem sido foco de diversos estudos que buscam traçar um perfil da sua trajetória acadêmica. Estudar a informação científica de um país é relevante para compreender a evolução da ciência e ampliar as perspectivas sobre o cenário atual. Assim, este trabalho objetivou analisar a participação do conjunto das doutoras que possuem currículos cadastrados na Plataforma Lattes e cujo gênero registrado seja do sexo feminino. A coleção de dados foi proveniente da Plataforma Lattes que contém informações curriculares disponíveis em acesso aberto. Os registros curriculares foram coletados no início do mês de março de 2019, totalizando mais de 6.126.000 currículos. Deste conjunto e ainda utilizando o arcabouço foram selecionados 307.780 currículos de indivíduos com titulação máxima concluída doutorado. Por fim, foram selecionados do conjunto dos doutores os respectivos currículos cujo gênero registrado seja feminino, totalizando ao final 149.850 registros utilizados para análises. Os dados das doutoras foram agrupados quanto a formação acadêmica, publicações, produções, orientações, grandes áreas de atuação e foi possível analisar a evolução da produção científica e tecnológica do conjunto de forma temporal. Estudar os diversos aspectos da diferença de gênero em geral e particularmente na ciência e tecnologia, além de ser relevante, pode ser fonte de inspiração para políticas e programas de governo que buscam promover mudanças, incentivar e valorizar a participação das mulheres na ciência

    A Base de Dados Científicos da Universidade Federal do Paraná: do planejamento à implantação

    Get PDF
    A Base de Dados Científicos (BDC) da Universidade Federal do Paraná (UFPR) visa disponibilizar  os dados científicos utilizados das pesquisas que são publicadas pela comunidade da UFPR em teses, dissertações, artigos de revistas e outros materiais bibliográficos. O objetivo desta comunicação é descrever o processo de implantação da BDC no âmbito da UFPR, desde as escolhas estratégicas até o seu efetivo uso. A implantação da BDC passou por algumas etapas como: a seleção do software, a seleção de requisitos, a seleção do padrão de metadados, o estabelecimento da metodologia para formular as diretrizes para o depósito dos dados, a especificação dos critérios para a criação do plano de gestão de dados, o registro no serviço indexador de repositórios de dados, o Re3data.org e a divulgação para a comunidade acadêmica. No decorrer do processo de planejamento e implantação da BDC, destacam-se alguns desafios : os custos com atribuição de DOI para cada dataset, o arranjo de características comuns para base de dados científicos que atendam aos contextos disciplinares distintos em uma única plataforma, a capacitação contínua dos usuários, a estrutura para oferta de serviços e a capacidade de suporte, além do entendimento do processo de produção e da evolução científica no contexto da ciência aberta

    O Novo Portal RCAAP e o Alinhamento Internacional

    Get PDF
    Este trabalho apresenta os desenvolvimentos e roadmap do novo Portal RCAAP desenvolvido com base no software La Referencia. O desenvolvimento do novo Portal teve como principais objetivos o alinhamento das funcionalidades à gestão de entidades (autores, publicações, financiamentos, etc…) mas também adequar-se aos requisitos de um portal nacional de publicações e dados de investigação. Descrevem-se o processo de definição de requisitos, bem como os desenvolvimentos integrados ou a integrar para responder aos requisitos identificados. Finalmente, este trabalho apresenta um caso de sucesso de alinhamento internacional da comunidade que gere infraestruturas de ciência nacionais e iniciativas orientadores das boas práticas como o OpenAIRE

    1,867

    full texts

    2,033

    metadata records
    Updated in last 30 days.
    Ciência da Informação (E-Journal)
    Access Repository Dashboard
    Do you manage Open Research Online? Become a CORE Member to access insider analytics, issue reports and manage access to outputs from your repository in the CORE Repository Dashboard! 👇