1,721,015 research outputs found

    Uma abordagem para extração de esquemas de bancos de dados NoSQL com ênfase em dados geográficos

    No full text
    Tese (doutorado) - Universidade Federal de Santa Catarina, Centro Tecnológico, Programa de Pós-Graduação em Ciência da Computação, Florianópolis, 2021.O advento dos Big Data fez com que novas tecnologias de banco de dados (BD) voltados ao gerenciamento de grandes quantidades de dados complexos e heterogêneos ganhassem importância na indústria, como é o caso dos BDs NoSQL. Eles surgem como principal sistema de gerência de BD para Big Data devido a várias características, como a ausência de esquemas (schemaless) ou o uso de esquemas flexíveis. Entretanto, conhecer o esquema dos dados cada vez mais torna-se essencial para diversos tipos de aplicações, como integração, interoperabilidade e validação de dados, processamento de consultas, bem como, ferramentas de administração de dados. Esta tese apresenta uma abordagem para extração de esquemas de BDs NoSQL, com ênfase em dados geográficos. Diferente do estado da arte, demonstra-se que o padrão JSON pode ser usado como formato canônico para representar dados em qualquer um dos quatro principais modelos de dados NoSQL (orientado a documentos, chave-valor, colunar e orientado a grafos). Assim, o JSON é a base para a abordagem, por consequência, propõe-se o uso do JSON Schema como formato de representação dos esquemas extraídos. Embora a especificação do JSON Schema ainda esteja em desenvolvimento (versão draft-2020-12), ela mostrou-se eficiente nas implementações realizadas. Ainda, JSON Schema suporta um conjunto limitado de tipos de dados (string, integer, number, boolean, object, array), porém, ele permite que o usuário possa definir seus próprios tipos de dados e objetos. Assim sendo, outra contribuição desta tese é uma biblioteca para a representação de tipos de dados geográficos em JSON Schema denominada JS4Geo (JSON Schema for Geographic Data). Essa biblioteca também pode ser usada para criar esquemas de dados geográficos armazenados em outros formatos padrão de mercado, como GeoJSON, KML e GML. Esta tese propõe, também, a conversão dos JSON Schemas em um formato preparado para uso por aplicações da Web Semântica. Neste contexto, adotou-se a linguagem SHACL (Shapes Constraint Language) para definir ontologias de representação (shapesfile) a partir dos JSON Schema. SHACL é a mais recente recomendação do W3C e permite, além de descrever dados presentes em um BD NoSQL, realizar a validação de dados na Web Semântica, o que não é possível com as linguagens tradicionais para esquemas na Web Semântica (como OWL ou RDF Schema). A abordagem proposta nesta tese foi avaliada através de um conjunto de testes executados por meio de diversos protótipos implementados, demonstrando a sua viabilidade.Abstract: The Big Data advent has made new database (DB) technologies for managing large amounts of complex and heterogeneous data to gain importance in the industry, like NoSQL DBs. They had emerged as the primary DB management system for Big Data due to several characteristics, like the absence of schemas (schemaless) or flexible schemas. However, to be aware of the data schema is essential for several kinds of applications, such as data integration, interoperability and validation, query processing, as well as data administration tools. This Thesis presents a methodology for extracting schemas from NoSQL DB with an emphasis on geographic data. Different from the state-of-the-art, we argue that the JSON standard can be used as a canonical format to represent data in any of the four main NoSQL data models (document-oriented, key-value, columnar and graph-oriented). Thus, JSON is the basis for our methodology and, as a consequence, we propose the usage of JSON Schema as a representation format for the extracted schemes. Although JSON Schema specification is still in development (version draft-2020-12), it had proved his efficiency, as shown in our evaluations. Nevertheless, JSON Schema specification supports a limited set of data types (string, integer, number, boolean, object, array). However, it allows the user can define their own data types and objects. Due to it, another contribution of this Thesis is a library to represent geographic data types in JSON Schema called JS4Geo (JSON Schema for Geographic Data). It is shown that this library can also be used to create geographic data schemas stored into several industry standard formats, like GeoJSON, KML, and GML. We also propose the conversion of JSON Schemas into a format ready for use by Semantic Web applications. In this context, we adopt SHACL (Shapes Constraint Language) to define representation ontologies (shapesfile) from JSON Schema. SHACL is the most recent recommendation from the W3C. It is able to describe data from NoSQL DB, and perform data validation, which is impossible with traditional languages for schemas in the Semantic Web (like OWL or RDF Schema). Our proposed methodology is evaluated through a set of experiments performed over several prototype tools, which demonstrate its viability

    Um método para determinar a equivalência semãntica entre esquemas GML

    Get PDF
    Dissertação (mestrado) - Universidade Federal de Santa Catarina, Centro Tecnológico. Programa de Pós-graduação em Ciência da Computaçã

    Sistema Inteligente para Análise de Viabilidade de Imóveis

    Get PDF
    A falta de uma ferramenta de pesquisa por imóveis que estão disponíveispara venda ou locação que centralize todas as ofertas disponíveis e que permita a seleção e análise cria uma lacuna no mercado. O presente trabalho tem comoobjetivo apresentar o SIPAVI, que consiste em um sistema para busca de imóveis,relacionando a localização do imóvel com outras informações, de acordo com ointeresse e perfil do usuário. Além da tradicional busca simples por atributos comolocalização, preço etc., o sistema propõe o cruzamento de outros dados, tais comoestatísticas sobre o bairro ou cidade, supermercados, farmácias e escolaspróximas. Na parte visual, uma das características do sistema web é sua integraçãocom o Google Maps e o Google Earth através do padrão KML

    Going Beyond Counting First Authors in Author Co-citation Analysis

    Get PDF
    The present study examines one of the fundamental aspects of author co-citation analysis (ACA) - the way co-citation counts are defined. Co-citation counting provides the data on which all subsequent statistical analyses and mappings are based, and we compare ACA results based on two different types of co-citation counting - the traditional type that only counts the first one among a cited work's authors on the one hand and a non-traditional type that takes into account the first 5 authors of a cited work on the other hand. Results indicate that the picture produced through this non-traditional author co-citation counting contains more coherent author groups and is therefore considerably clearer. However, this picture represents fewer specialties in the research field being studied than that produced through the traditional first-author co-citation counting when the same number of top-ranked authors is selected and analyzed. Reasons for these effects are discussed

    Variations on the Author

    Get PDF
    “Variations on the Author” discusses two of Eduardo Coutinho’s recent films (Um Dia na Vida, from 2010, and Últimas Conversas, posthumously released in 2015) and their contribution to the general question of documentary authorship. The director’s filmography is characterized by a consistent yet self-effacing form of authorial self-inscription: Coutinho often features as an interviewer that rather than express opinions propels discourses; an interviewer that is good at listening. This mode of self-inscription characterizes him as an author who is not expressive but who is nonetheless markedly present on the screen. In Um Dia na Vida, however, Coutinho is completely absent form the image, while Últimas Conversas, on the contrary, includes a confessional prologue that moves the director from the margins to the center of his films. This article examines the ways in which these works stand out in the filmography of a director who offers new insights into the notion of cinematic authorship

    Appropriate Similarity Measures for Author Cocitation Analysis

    Get PDF
    We provide a number of new insights into the methodological discussion about author cocitation analysis. We first argue that the use of the Pearson correlation for measuring the similarity between authors’ cocitation profiles is not very satisfactory. We then discuss what kind of similarity measures may be used as an alternative to the Pearson correlation. We consider three similarity measures in particular. One is the well-known cosine. The other two similarity measures have not been used before in the bibliometric literature. Finally, we show by means of an example that our findings have a high practical relevance.information science;Pearson correlation;cosine;similarity measure;author cocitation analysis

    Dispelling the Myths Behind First-author Citation Counts

    Get PDF
    We conducted a full-scale evaluative citation analysis study of scholars in the XML research field to explore just how different from each other author rankings resulting from different citation counting methods actually are, and to demonstrate the capability of emerging data and tools on the Web in supporting more realistic citation counting methods. Our results contest some common arguments for the continued use of first-author citation counts in the evaluation of scholars, such as high correlations between author rankings by first-author citation counts and other citation counting methods, and high costs of using more realistic citation counting methods that are not well-supported by the ISI databases. It is argued that increasingly available digital full text research papers make it possible for citation analysis studies to go beyond what the ISI databases have directly supported and to employ more sophisticated methods

    Author Index

    No full text
    Nao informado

    BANCO DE DADOS DO PROJETO & API DO INVENTÁRIO FLORESTAL: Desenvolvendo uma Solução Eficiente com Node.js e PostgreSQL para a Gestão de Dados de Espécies Florestais no IFC Camboriú

    Get PDF
    Este trabalho apresenta a proposta de um banco de dados (BD) para o projeto do inventário florestal do IFC Camboriú, bem como, o desenvolvimento de uma API (Application Programming Interface) para acesso a esse BD. Em relação às tecnologias, foram utilizados a linguagem Node.js e o Sistema Gerenciador de Banco de Dados (SGBD) PostgreSQL. O inventário florestal é uma ferramenta para a gestão e preservação de florestas, permitindo o cadastramento e monitoramento dos espécimes existentes. Através da API é possível manipular e consultar os dados do inventário de forma eficiente e simplificada. A modelagem do BD proposto é flexível e permite dar suporte a outros tipos de projetos que envolvam o cadastro de espécies da fauna e flora
    corecore