• Title/Summary/Keyword: 데이터 연관

Search Result 1,883, Processing Time 0.027 seconds

Association-Based Conceptual Modeling for Smart Database Design (스마트 데이터베이스 설계를 위한 연관성 기반 개념적 모형화)

  • Lee, Sang-Won
    • Journal of Intelligence and Information Systems
    • /
    • v.17 no.3
    • /
    • pp.169-185
    • /
    • 2011
  • Data redundancy is problematic in that it not only induces heavy storage management cost but also could bring critical degradation of information systems. Unfortunately, to our knowledge, only few enterprises willingly afford time and efforts for the faithful conceptual design to prevent the degree of inappropriate data as much as they could, while most of enterprises pay rare attention to the notion of that sort of data quality. Wondering if there would be any other way to design the enterprise.wide data design without prior knowledge about business works is our major motivation for this study. In this paper, we present our data modeling methodology in which associations among objects in each sentences of a business job descriptions are treated as the focal point in database design. A proposed agent for automated design tool simply takes a business job description written in natural language as an input, and then designs an entity relationship diagram with some smart rules. We introduce the scope of the proposed agent and its detailed logics with several examples. And then, we verify the appropriateness of the resulted associations among objects. Lastly, we perform case studies to evaluate the devised agent's applicability to a business field.

A Study on Walking Analysis and Disease Prediction with Decision Tree (의사결정나무를 통한 걸음걸이 분석 및 질병 예측에 관한 연구)

  • Kim, Young-Jae;Yoo, Kwan-Hee;Nasridinov, Aziz
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • 2017.04a
    • /
    • pp.822-825
    • /
    • 2017
  • 본 연구는 키넥트를 통해 사람의 걸음걸이를 측정하고 의사결정트리(Decision Tree)를 통해 분석함으로써 현재의 걸음걸이를 통해 측정자의 허리 또는 무릎에서 발생할 가능성이 높은 문제 또는 질병들을 예측하고 해당결과를 측정자에게 알린다. 본 연구를 진행하며 첫 번째 단계에서는 관련 논문이나 병원 자료 결과들을 통해 판별할 속성들을 정하였다. 두 번째 단계에서는 키넥트를 통해 측정한 실제 데이터를 적용하기에 앞서 첫 번째 단계에서 정한 속성들이 측정자의 문제 또는 질병들을 판단해내는 연관 정도가 높은지 테스트 데이터를 이용하였고 의사결정나무를 통해 분석하였다. 그 결과 7개의 속성 중 6개로 약 85.7%정도의 연관이 있었다. 마지막 세 번째 단계에서는 판별식을 세우고 실제 데이터들을 쌓아나가며 69명의 측정한 데이터를 분석한 결과 6개의 속성 중 5개의 속성이 허리와 연관정도가 높았고 이는 두 번째 단계에서 나왔던 결과인 약85.7%에 가까운 약83%의 결과가 도출되었다. 이를 기반으로 시스템을 개발해 나가며 판별 정확도를 향상시키기 위해 계속 측정해 데이터를 쌓아가고 관련된 식들의 문제점을 보완하며 또한 어떤 환경에서 키넥트의 측정값의 정확도가 올라가는지 연구할 예정이다.

순차패턴 마이닝을 이용한 상병의 연관성 분석

  • Jin, Jong-Sik;Park, Hui-Jun;Lee, Jeong-Hyeon;Kim, Yun-Nyeon;Yun, Gyeong-Il;Eom, Heung-Seop
    • 한국경영정보학회:학술대회논문집
    • /
    • 2007.06a
    • /
    • pp.614-618
    • /
    • 2007
  • 데이터 마이닝 기법 중 순차 패턴 마이닝(Sequential Pattern Mining)은 연관 규칙에 시간의 개념을 추가하여 시간의 흐름에 따른 항목(item)들의 상호 연관성을 찾아내는 것이다. 본 연구의 목적은 순차적인 상병의 발생 가능성이 높은 상병 군의 패턴을 찾아내어 이를 모형화함으로써 차후에 발생된 상병을 예방하고 이를 통하여 환자와의 관계를 관리하여 보다 나은 의료서비스를 제공하는데 있다.

  • PDF

Processing of ${\rho}$-intersect Operation for Semantic Association Discovery (시맨틱 연관성 검색을 위한 ${\rho}$-intersect 연산의 처리)

  • Kim, Sung-Wan
    • Proceedings of the Korean Society of Computer Information Conference
    • /
    • 2011.01a
    • /
    • pp.285-288
    • /
    • 2011
  • 시맨틱 웹상에서 메타 데이터를 표현하는 RDF 데이터에 대한 질의 처리를 위해 여러 가지 RDF 질의어가 제안되었으나 리소스간의 복잡한 관계성들의 발견(discovery)을 위한 충분한 지원을 하지 못하고 있다. 본 논문에서는 시맨틱 연관성 검색 유형의 하나인 ${\rho}$-intersect 연산의 처리 방법을 소개한다. 이를 위해 접미사 배열을 이용한 인덱싱과 ${\rho}$-intersect 연산의 특징을 고려한 최적화 방법을 활용한다. 제안된 처리 기법을 통해 전형적인 RDF 질의 유형뿐만 아니라 시맨틱 연관성 질의 유형도 지원할 수 있도록 한다.

  • PDF

An Effective Large itemset Generation Algorithm (효과적인 빈발 항목 생성 알고리즘T)

  • 채덕진;황부현
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2000.10a
    • /
    • pp.198-200
    • /
    • 2000
  • 대용량의 데이터베이스에서 여러 트랜잭션에 동시에 나타나는 항목들의 모임인 빈발 항목집합을 찾아내는 데이터 마이닝 방법을 연관 규칙 탐사라고 한다. 빈발 항목집합을 찾아내는 데이터 마이닝 방법을 연관 규칙 탐사라고 한다. 빈방 항목집합을 찾아내는 문제는 항목 집합들의 후보 집합을 생성하고 빈발 항목집합의 조건을 충족시키는 후보 집합을 추출함으로써 해결된다. 그리고 이러한 작업은 각각의 빈발 k-항목집합에 대해 k가 증가함에 따라 반복적으로 수행된다. 그러나 연관 규칙 탐사에 관한 기존의 연구는 주로 데이터베이스를 이루는 항목들의 수가 많거나 트랜잭션의 길이가 긴 경우의 대용량 데이터베이스에서 빈발 항목집합의 발견에 초점을 맞추고 있다. 본 논문에서는 데이터베이스를 이루는 전체 항목의 수가 적거나 트랜잭션의 크기가 작은 경우 효과적으로 빈발 항목집합을 찾을 수 있는 연관 규칙 탐사 방법을 제안한다. 그리고 성능 평가를 통하여 제안하는 방법의 성능 및 타당성을 보인다.

  • PDF

A New Collaborative Filtering Using Associative Relation Clustering (연관 관계 군집에 의한 협력적 여과 방법)

  • 김진현;정경용;김태용;이정현
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2002.10d
    • /
    • pp.331-333
    • /
    • 2002
  • 협력적 여과 방법은 사용자의 평가 데이터를 이용하므로, 항상 초기 평가 문제(First-Rating Problem)와 희박성 문제(Sparsity Problem)가 발생한다. 최근 이러한 문제를 해결하기 위해 많은 연구가 진행되고 있는 데, 본 논문에서는 연관 규칙을 이용하여 이러한 문제를 해결하고자 한다. 사용자의 평가 데이터를 이용하여 아이템간의 연관성을 산출하고, 연관성이 높은 아이템끼리 군집한다. 사용자와 군집간에 피어슨 상관 계수(Pearson Correlation Coefficient)를 이용하여 가중치를 구하고, 이것으로 선호도를 예측한다. 이러한 방법을 기존의 협력적 여과 방법과 함께 속성에 의한 군집 방식과 비교 평가하였다. 또한, 효율적인 군집을 위한 Split Cluster Method를 제안하고, 기존의 트리 방식의 군집과 비교 평가하였다.

  • PDF

Efficient Sequence Association Rule Mining for Discovering Protein Relations (단백질 서열 연관 규칙 마이닝을 위한 효율적인 알고리즘 설계)

  • Kim, Hyun-Min;Kim, Ji-Hye;Ramakrishna, R.S.
    • Proceedings of the Korea Information Processing Society Conference
    • /
    • 2002.04b
    • /
    • pp.1183-1186
    • /
    • 2002
  • DNA 의 염기서열 탐색을 위한 유전체학의 다음 세대인 구조유전체학은 유전체 사업으로 인한 인간 게놈지도의 완성과 축적된 생물정보를 이용한 생물정보학의 발달과 함께 급속한 성장을 계속하고 있다. 포스트 게놈 시대를 맞이하여 생명현상에 대한 궁극적인 이해를 위한 노력으로 단백질의 구조와 기능에 대한 연구가 주목을 받게 되었다. 다양한 구조 규명을 위한 도구들과 단백질 정보를 관리하기 위한 데이터베이스 구축에 따른 관련 기술의 발전은, 앞으로 다가올 생물정보의 방대함을 감안할 때, 가치 있는 지식정보를 얻기 위한 데이터 마이닝 기법들을 통해서만 가능하다. 본 논문은 데이터 마이닝의 근간 기술인 연관규칙 마이닝을 응용한 효율적인 서열 연관 규칙 알고리즘을 제안하며, 단백질 구조의 예측을 위한 단백질 서열 및 DNA 서열간의 패턴 비교 및 연관성을 목적으로 한다. 또한, 공간적 시간적 복잡성을 CMS-tree 라는 자료구조를 통해 알고리즘의 확장성 및 병렬화의 기본 알고리즘으로 사용하도록 개발하였다.

  • PDF

Association Rule-based Analysis to Living Style during Vacation (연관 규칙을 이용한 방학 중의 생활 습관 분석)

  • Kim, Hea-Suk;Moon, Yang-Sae;Roh, Hi-Young;Kim, Jin-Ho
    • Proceedings of the Korean Information Science Society Conference
    • /
    • 2006.10a
    • /
    • pp.108-112
    • /
    • 2006
  • 본 논문에서는 학생들의 방학 중 생활 습관을 분석하기 위해 연관규칙을 사용한 접근법을 제안한다. 이를 위해, 우선 학생들이 할 수 있는 방학 중의 생활 습관에 대한 다양한 요소를 도출한다. 다음으로, 연관규칙를 적용하기 위한 데이터 변환 및 분석 방법을 제안한다. 마지막으로, 설문조사를 통해 수집한 현실의 구체적 데이터에서 연관규칙을 추출한다. 그 결과, 학원수강을 하는 학생들은 국어, 영어, 수학 세과목 모두를 수강한다는 일반적인 규칙을 얻을 수 있었다.

  • PDF

The application for predictive similarity measures of binary data in association rule mining (이분형 예측 유사성 측도의 연관성 평가 기준 적용 방안)

  • Park, Hee-Chang
    • Journal of the Korean Data and Information Science Society
    • /
    • v.22 no.3
    • /
    • pp.495-503
    • /
    • 2011
  • The most widely used data mining technique is to find association rules. Association rule mining is the method to quantify the relationship between each set of items in very huge database based on the association thresholds. There are some basic association thresholds to explore meaningful association rules ; support, confidence, lift, etc. Among them, confidence is the most frequently used, but it has the drawback that it can not determine the direction of the association. The net confidence and the attributably pure confidence were developed to compensate for this drawback, but they have other drawbacks.In this paper we consider some predictive similarity measures for binary data in cluster analysis and multi-dimensional analysis as association threshold to compensate for these drawbacks. The comparative studies with net confidence, attributably pure confidence, and some predictive similarity measures are shown by numerical example.

Proposition of causal association rule thresholds (인과적 연관성 규칙 평가 기준의 제안)

  • Park, Hee Chang
    • Journal of the Korean Data and Information Science Society
    • /
    • v.24 no.6
    • /
    • pp.1189-1197
    • /
    • 2013
  • Data mining is the process of analyzing a huge database from different perspectives and summarizing it into useful information. One of the well-studied problems in data mining is association rule generation. Association rule mining finds the relationship among several items in massive volume database using the interestingness measures such as support, confidence, lift, etc. Typical applications for this technique include retail market basket analysis, item recommendation systems, cross-selling, customer relationship management, etc. But these interestingness measures cannot be used to establish a causality relationship between antecedent and consequent item sets. This paper propose causal association thresholds to compensate for this problem, and then check the three conditions of interestingness measures. The comparative studies with basic and causal association thresholds are shown by numerical example. The results show that causal association thresholds are better than basic association thresholds.