• 제목/요약/키워드: Activity Pattern Mining

검색결과 20건 처리시간 0.023초

소셜네트워크서비스에 활용할 비표준어 한글 처리 방법 연구 (Research on Methods for Processing Nonstandard Korean Words on Social Network Services)

  • 이종화;레환수;이현규
    • 한국산업정보학회논문지
    • /
    • 제21권3호
    • /
    • pp.35-46
    • /
    • 2016
  • 특정한 관심이나 활동을 공유하는 관계망을 구축해주는 온라인 서비스인 소셜네트워크서비스(SNS), 자신의 관심사에 따라 자유롭게 글, 사진, 동영상 등을 올릴 수 있는 공간인 블로그(Blog) 등은 자신을 알리고 표현하는 사회현상으로 자리 매김하고 있다. 이러한 SNS나 블로그를 통해 사용자들이 자유롭게 표현한 글들을 분석하여 의미있는 정보와 가치, 그리고 패턴을 찾기 위한 텍스트 마이닝(Text Mining), 오피니언 마이닝(Opinion Mining), 의미 분석(Semantic Analysis) 등의 연구가 활발히 이루어지고 있다. 또한, 연구자들의 연구 효율을 보다 높이기 위하여 키워드 기반 연구들도 이루어져있다. 하지만 대부분의 연구들은 한글의 맞춤법에 많은 한계점을 나타내고 있다. 본 연구는 어근을 찾기 힘든 이상한 외계 언어, 무분별하게 표현되는 속어, 알기 힘든 한글 이모티콘 인터넷 언어, 마이닝 처리 과정에서 파악하기 어려운 단어들을 데이터베이스에 구축하여 데이터 사전 기반 마이닝 처리 기법의 한계를 극복하고자 한다. 특정 주제에 대한 주관적 견해로 구성된 블로그를 사례 분석 대상으로 연구를 진행하였으며 유니코드를 활용한 비표준어 추출은 텍스트 마이닝 처리에 유용함을 발견할 수 있었다.

RFID/USN 기반 지능형 가스안전관리 서비스를 위한 자율적 분석 연구 (A Study on Autonomic Analysis for Servicing Intelligent Gas Safety Management Based on RFID/USN)

  • 오정석;최경석;권정락;윤기봉
    • 한국안전학회지
    • /
    • 제23권6호
    • /
    • pp.51-56
    • /
    • 2008
  • As RFID/USN technology is used in the latest industry trend, the information analysis paradigm shifts to intelligence service environment. The intelligent service includes autonomic operation, which select activity by defining itself to the status of industry facilities. Furthermore, information analysis based on IT used to frequently data mining for detecting the meaning information and deriving new pattern. This paper suggest self-classifying of context-aware by applying data mining in gas facilities for serving the intelligent gas safety management. We modify data algorithm for fitting the domain of gas safety, construct context-aware model by using the proposed algorithm, and demonstrate our method. As the accuracy of our model is improved over 90%, the our approach can apply to intelligent gas safety management based on RFID/USN environments.

웹기반 교육에서 학습자별 학습현황 분석에 관한 연구 (The Analysis of Individual Learning Status on Web-Based Instruction)

  • 신지연;정옥란;조동섭
    • 컴퓨터교육학회논문지
    • /
    • 제6권2호
    • /
    • pp.107-120
    • /
    • 2003
  • 웹기반 교육에서 학습과정을 평가한다는 것은 개별 학습자들의 학습 활동을 평가하는 것을 의미하기 때문에 학습자의 특정 수업내용에 대한 학습 시간, 학습 패턴, 학습 참여도(의견 교환, 질문), 학습 환경 등의 정보가 요구된다. 본 연구의 목적은 웹 기반 교육에서 쟁점이 되고 있는 학습과정 평가문제를 해결하기 위해 최적의 웹 로그 마이닝을 이용하여 학습자 개인별 학습현황에 관한 정보를 얻어 이를 수행 평가에 반영하고자 함이다. 연구 내용 및 결과로는 먼저, 학습현황 분석을 위한 항목을 선정하고 웹 로그 마이닝을 위한 로그 데이터 전처리 과정을 실행하였다. 다음으로는, 위의 웹 로그 데이터를 기초로 학습자별 데이터베이스를 구축하고 질의어를 사용하여 학습현황을 분석하였다.

  • PDF

맵리듀스기반 워크플로우 빅-로그 클러스터링 기법 (A MapReduce-Based Workflow BIG-Log Clustering Technique)

  • 진민혁;김광훈
    • 인터넷정보학회논문지
    • /
    • 제20권1호
    • /
    • pp.87-96
    • /
    • 2019
  • 본 논문에서는 분산 워크플로우 실행 이벤트 로그를 수집하고 분류하기 위한 사전 처리 도구로서 맵-리듀스기반 클러스터링 기법을 제안한다. 특히 우리는 볼륨, 속도, 다양성, 진실성 및 가치와 같은 BIG 데이터의 5V 속성에 만족하고 잘 충족되어 있기 때문에 분산 워크플로우 실행 이벤트 로그를 특별히 워크플로우 빅-로그(Workflow BIG-Logs)라고 정의한다. 이 논문에서 개발하는 클러스터링 기술은워크플로우 빅-로그를 기반으로 하는 특정 워크플로 프로세스 마이닝 및 분석 알고리즘의 사전 처리 단계에 적용하기 위한 목적으로 고안된 것이다. 즉, 맵리듀스(Map-Reduce) 프레임워크를 워크플로우 빅-로그 처리 플랫폼으로 사용하고, IEEE XES 표준 데이터 형식을 지원하며, 결국 본 연구에서 개발중에 있는 구조적 정보제어넷기반 워크플로우 프로세스 마이닝 알고리즘인 ${\rho}$-알고리즘의 사전 처리 단계 전용으로 사용되도록 구현된 것이다. 보다 자세하게 말하자면, 워크플로우 빅-로그의 클러스터링 패턴은 단위업무액티버티 기반 클러스터링 패턴과 단위업무 수행자 기반 클러스터링 패턴으로 분류되는데, 특별히 단위업무 액티버티 패턴의 하나인 시간적 워크케이스 패턴과 그의 발생 건수를 재발견하는 맵리듀스 기반 클러스터링 알고리즘을 설계하고 구현하고자 한다. 마지막으로, 우리는 BPI 챌린지에서 공개한 워크플로우 실행 이벤트 로그 데이터세트에 대해 일련의 실험을 수행함으로써 제안된 클러스터링 기법의 기술적 타당성을 검증한다.

데이터 마이닝의 범죄수사 적용 가능성 (Usefulness of Data Mining in Criminal Investigation)

  • 김준우;손중권;이상한
    • 대한수사과학회지
    • /
    • 제1권2호
    • /
    • pp.5-19
    • /
    • 2006
  • 데이터 마이닝은 컴퓨터와 정보처리의 발전으로 각기 다른 차원에서 다량으로 수집되는 데이터 속에서 숨은 의미나 패턴을 발견하는 유용한 기법이다. 의사결정나무, 신경망 모형, 규칙 귀납, K-평균 군집화, 시각화 등의 데이터 마이닝 개별 기법들은 산재해 있는 데이터에서 연관성을 분석하고, 이를 분류함으로써 일반화된 개념을 정의하고, 새로운 지식을 추론함으로써 실제 생활에 적용 가능한 예측을 가능하게 한다. 따라서 현재 데이터 마이닝은 기업의 마케팅 분야, 금융기관의 고객 분석, 통신 회사의 고객 이탈 방지 등에서 유용하게 활용되고 있다. 우리가 접해야 하는 정보의 양이 늘어나는 것은 범죄 수사에 있어서도 마찬가지 현상이다. 범죄와 범죄자에 대한 데이터는 축적되어 가지만 정작 개별 사안에 있어서는 중요한 데이터가 접근조차 되지 않고 있으며, 많은 데이터 속에서 이것이 내포하고 있는 숨은 의미를 지나치게 되는 경우도 많다. 본 연구에서는 선행 연구와 사례 적용을 통해 데이터 마이닝의 범죄 수사 적용 가능성과 한계점을 살펴보고자 하였다. 미제 사건으로 남는 경우가 많은 절도나 사기 같은 습관적 상습 범죄의 경우 데이터 마이닝의 분류, 군집화 기능을 활용 한다면 향후 여죄 추적에 효율적으로 활용될 수 있음을 파악할 수 있었고, 특히 다양한 문제에 적용 가능하고, 잡음에 대한 견고성이 있음에도 예측의 정확성을 지니고 있는 신경망 모형의 경우 패턴 인식을 통하여 범죄자 프로파일링이나 화상 자료 대비 시스템 구축에 충분히 활용될 것으로 생각한다. 특히 보험 사기 사례 적용에서 살펴본 바와 같이 마약, 테러와 같은 조직적 범죄수사나 자금세탁과 같은 금융 추적 수사의 경우 해당 자료의 방대함과 모호성으로 인해 수사를 하는 데 많은 어려움이 있지만 이러한 데이터 마이닝 가시화 기법을 적절히 활용한다면 전체적인 윤곽을 파악하는 데 매우 유용하며, 효율적인 수사가 가능함을 확인할 수 있었다. 그러나 데이터 마이닝은 예측 모델이므로 오류를 내재하고 있다는 점에서 수사 기관의 데이터 마이닝 접근은 조심스러워야 하며, 정보 독점화 현상과 개인 사생활 보호라는 측면에서 각 수사기관은 해당 법률에 정한 범위 내에서 해당 사건별로 데이터를 수집하고 이를 통합, 재구성하여 활용하는 측면으로 적용되어야 할 것이다. 또한 각 수사기관별로는 자신의 보유하고 있는 데이터에 대해 다차원 처리가 가능하도록 데이터베이스 시스템을 구축하여 데이터 마이닝이 적용 가능한 환경을 구축하도록 하여야 할 것이다. 아직은 논의의 초기 단계이므로 효과가 크게 부각되지는 않았지만 지금까지 제시한 문제에 대한 연구가 계속 이루어진다면 인권중심, 증거중심의 수사 개념을 바탕으로 적법절차에 의한 수사 활동을 요구받는 시대에 새로운 대안으로 자리 잡을 것이며, 수사의 과학화에 기여할 것으로 전망한다.

  • PDF

농경작업 영향지역의 금속광상에 대한 토양 지구화학 탐사법 개발 연구 (A Study on the Developement of Soil Geochemical Exploration Method for Metal Ore Deposits Affected by Agricultural Activity)

  • 김옥배;이무성
    • 자원환경지질
    • /
    • 제25권2호
    • /
    • pp.145-151
    • /
    • 1992
  • In order to study the optimum depth for the soil geochemical exploration in the area which is affected by agricultural activities and waste disposal of metal mine, the soil samples were sampled from the B layer of residual soil and vertical 7 layers up to 250 cm in the rice field and 3 layers up to 90 cm in the ordinary field. They were analyzed for Au, As, Cu, Pb and Zn by AAS, AAS-graphite furnace and ICP. To investigate the proper depth for the soil sampling in the contaminated area, the data were treated statistically by applying correlation coefficient, factor analysis and trend analysis. It is conclude that soil geochemical exploration method could be applied in the farm-land and a little contaminated area. The optimum depth of soil sampling is 60 cm in the ordinary field, and 150~200 cm in the rice field. Soil sampling in the area of a huge mine waste disposal is not recommendable. Plotting of geochemical map with factor scores as a input data shows a clear pattern compared with the map of indicater element such as As or Au. The second or third degree trend surface analysis is effective in inferring the continuity of vein in the area where the outcrop is invisible.

  • PDF

복잡한 도심에서의 유입된 미세먼지 잔류 가능성 예보 연구 (A Study on the Prediction of Residual Probability of Fine Dust in Complex Urban Area)

  • 박성주;서유진;김동욱;최현정
    • 한국지구과학회지
    • /
    • 제41권2호
    • /
    • pp.111-128
    • /
    • 2020
  • 본 연구에서는 복잡한 도심의 구조로 인한 미세먼지 농도의 강화 가능성에 대하여 데이터 마이닝 기술과 군집분석을 이용해 조사하였다. 데이터 마이닝 분석에서 미세먼지 농도와 서울지역 도시용도 데이터 사이에는 유의한 상관관계를 보이지 않았다. 그러나 전국 공공데이터를 기반으로 한 군집분석에서는 건물의 높이(층수)에서 특히 PM10과 강한 상관관계가 나타났다. 단일 케노피 모델(Single Canopy Model) 및 미기상 도시모델링 프로그램(ENVI-Met.4)을 사용한 모델링 분석을 실시하여 도시지역에서 모사된 대기 대류가 건물 분포 및 높이 유형의 배열에 따라 다양한 난류의 패턴을 구현함을 확인하였다. 도시 건물의 복잡한 구조는 대류활동을 제어하여 정체상태를 유도하고 지표 부근의 미세먼지 강화가능성을 초래 하였다. 따라서 도심 구조와 형태에 따른 열환경의 변화로 인한 정체 효과는 미세먼지 산정에 있어서 반드시 고려되어야 한다. 복잡한 도시지역의 미세먼지 잔류확률에 대한 정보를 제공하기 위해서는 대기정체 현상이 중요한 의미로 해석될 수 있다.

신규시장 성장모형의 모수 추정을 위한 전문가 시스템 (An Expert System for the Estimation of the Growth Curve Parameters of New Markets)

  • 이동원;정여진;정재권;박도형
    • 지능정보연구
    • /
    • 제21권4호
    • /
    • pp.17-35
    • /
    • 2015
  • 시장 수요 예측은 일정 기간 동안 소비자에게 판매되는 동종 제품 또는 서비스의 수량 혹은 매출액의 규모를 추정하는 활동으로서, 기업경영활동에 있어 효율적인 의사결정을 내릴 수 있는 근거로 활용된다는 점에서 중요하게 인식되고 있다. 신규 시장의 수요를 예측하기 위해 다양한 시장성장모형이 개발되어 왔다. 이런 모형들은 일반적으로 시장의 크기 변화의 동인을 신기술 확산으로 보고 소비자인 개인에게 기술이 확산되는 과정을 통해 시장 크기가 변하는 과정을 확산모형으로 구현하게 된다. 그러나, 시장이 형성된 직후에는 수요 관측치의 부족으로 인해 혁신계수, 모방계수와 같은 예측모형의 모수를 정확하게 추정하는 것이 쉽지 않다. 이런 경우, 전문가의 판단 하에 예측하고자 하는 시장과 유사한 시장을 결정하고 이를 참고하여 모수를 추정하게 되는데, 어떤 시장을 유사하다고 판단하느냐에 따라 성장모형은 크게 달라지게 되므로, 정확한 예측을 위해서는 유사 시장을 찾는 것은 매우 중요하다. 그러나, 이런 방식은 직관과 경험이라는 정성적 판단에 크게 의존함으로써 일관성이 떨어질 수밖에 없으며, 결국, 만족할 만한 수준의 결과를 얻기 힘들다는 단점을 지닌다. 이런 정성적 방법은 유사도가 더 높은 시장을 누락시키고 유사도가 낮은 시장을 선택하는 오류를 일으킬 수 있다. 이런 이유로, 본 연구는 신규 시장의 모수를 추정하기 위해 필요한 유사시장을 누락 없이 효과적으로 찾아낼 수 있는 사례기반 전문가 시스템을 설계하고자 수행되었다. 제안된 모형은 데이터 마이닝의 군집분석 기법과 추천 시스템의 내용 기반 필터링 방법론을 기반으로 전문가 시스템으로 구현되었다. 본 연구에서 개발된 시스템의 유용성을 확인하고자 정보통신분야 시장의 모수를 추정하는 실험을 실시하였다. 전문가를 대상으로 실시된 실험에서, 시스템을 사용한 모수의 추정치가 시스템을 사용하지 않았을 때와 비교하여 실제 모수와 더 가까움을 보임으로써 시스템의 유용성을 증명하였다.

웹검색 트래픽 정보를 활용한 유커 인바운드 여행 수요 예측 모형 및 유커마이닝 시스템 개발 (Development of Yóukè Mining System with Yóukè's Travel Demand and Insight Based on Web Search Traffic Information)

  • 최유지;박도형
    • 지능정보연구
    • /
    • 제23권3호
    • /
    • pp.155-175
    • /
    • 2017
  • 최근 독감 예측이나 당선인 예측, 구매 패턴, 투자 등 다방면에서 웹검색 트래픽 정보. 소셜 네트워크 내용 등 거대한 데이터를 통해 사회적 현상, 소비 패턴을 분석하는 시도가 이전보다 늘어났다. 구글, 네이버, 바이두 등 인터넷 포털 업체들의 웹검색 트래픽 정보 공개 서비스와 함께 웹검색 트래픽 정보를 활용하여 소비자나 사용자와 관련된 연구가 실시되기 시작했다. 웹검색 트래픽 정보를 활용한 사회 현상, 소비 패턴 분석을 연구는 많이 수행되었으나, 그에 비해서 도출된 여행 수요 모델을 토대로 의사결정을 위한 실질적 대책 수립으로 이어지는 연구는 많이 진행되지 않은 실정이다. 관광산업은 상대적으로 많은 고용을 가능하게 하고 외자를 유치하는 등 고부가가치를 창출하여 경제 전체에 선순환 효과를 일으키는 중요한 산업이다. 그 중에서도 국내 입국외래객중 수년간 2위와의 큰 차이로 1위를 차지해왔던 중국 국적의 관광객 '유커' 및 그들이 지출하는 1인당 평균 관광 수지는 한국 경제에 매우 중요한 한 부분이다. 관광 수요의 예측은 효율적인 자원 배분과 합리적인 의사 결정에 있어서 공공부문 및 민간부문 모두 중요하다. 적절한 관광 수요 예측을 통해서 한정된 자원을 더욱 효과적으로 활용하여 더욱 많은 부가가치를 창출하기 위한 것이다. 본 연구는 중국인 인바운드를 예측하는 방법에 있어, 이전보다 더 최신의 트렌드를 즉각적으로 반영하고 개인들의 집합의 관심도가 포함되어 예측 성능이 개선된 방법을 제안한다. 해외여행은 고관여 소비이기 때문에 잠재적 여행객들이 입국하기 전 웹검색을 통해 적극적으로 자신의 여정과 관련된 정보를 취득하기 위한 활동을 한다. 따라서 웹검색 트래픽 수치가 중국인 여행객의 관심정도를 대표할 수 있다고 보았다. 중국인 여행객들이 한국 여행을 준비하는 단계에서 검색할만한 키워드를 선정해 실제 중국인 입국자 수와 상관관계가 있음을 검증하고자 하였다. 중국 웹검색 엔진 시장에서 80%의 점유율을 가지는 중국 최대 웹검색 엔진 '바이두'에서 공개한 웹검색 데이터를 활용하여 그 관심 정도를 대표할 수 있을 것이라 추정했다. 수집에 필요한 키워드의 선정 단계에서는 잠재적 여행객이 여정을 계획하고 구체화하는 단계에서 일반적으로 검색하게 되는 키워드 후보군을 선정하였다. 키워드의 선정에는 중국 국적의 잠재적 여행객 표본과의 인터뷰를 거쳤다. 트래픽 대소 관계 확인 결과에 따라서 최종 선정된 키워드들을 한국여행이라는 주제와 직접적인 연관을 가지는 키워드부터, 간접적인 연관을 가지는 키워드까지 총 세 가지 레벨의 카테고리로 분류하였다. 분류된 카테고리 내의 키워드들은 바이두'가 제공하는 웹검색 트래픽 데이터 제공 서비스 '바이두 인덱스'를 통해 웹검색 트래픽 데이터를 수집했다. 공개된 데이터 페이지 특성을 고려한 웹 크롤러를 직접 설계하여 웹검색 트래픽 데이터를 수집하였고, 분리되어 수집된 변수에는 필요한 변수 변환 과정을 수행했다. 자동화 수집된 웹검색 트래픽 정보들을 투입하여 중국 여행 인바운드에 대한 유의한 영향 관계를 확인하여 중국인 여행객의 한국 인바운드 여행 수요를 예측하는 모형을 개발하고자 하였다. 정책 의사결정 및 관광 경영 의사결정 같은 실무적 활용을 고려하여 각 변수의 영향력을 정량적으로 설명할 수 있고 설득이 명료한 방법인 다중회귀분석방법을 적용해 선형 식을 도출하였다. 수집된 웹검색 트래픽 데이터를 기존 검증된 모형 독립변인들에 추가적으로 투입함으로써 전통적인 독립변인으로만 구성된 연구 모형과 비교하여 가장 뛰어난 성능을 보이는 모형을 확인하였다. 본 연구에서 검증하려는, 웹검색 트래픽으로 대표되는 독립변인을 투입한 최종 도출된 모형을 통해 중국인 관광 수요를 예측할 때 유의한 영향을 끼치는 웹검색 트래픽 변수를 확인할 수 있다. 최적 모형 설명력을 가지는 모형을 기반으로 최종 회귀 식을 만들었고 이를 '유커마이닝' 시스템 내부에 도입하였다. 데이터 분석에서 더 나아가 도출된 모형을 직관적으로 시각화하고, 웹검색 트래픽 정보를 활용하여 도출할 수 있는 인사이트를 함께 보여주는 데이터 분석 기반의 '유커마이닝' 솔루션의 시스템 알고리즘과 UX를 제안하였다. 본 연구가 제안하는 모형과 시스템은 관광수요 예측모형 분야에서 웹검색 트래픽 데이터라는 정보 탐색을 하는 과정에 놓인 개인들의 인터랙티브하고 즉각적인 변수를 활용한 새로운 시도이다. 실무적으로 관련 정책결정자나 관광사, 항공사 등이 활용 가능한 실제적인 가치를 가지고, 정책적으로도 효과적인 관광 정책 수립에 활용될 수 있다.

경상분지내 삼산지역 열수동광상에 관한 지화학적 연구 (The Geochemistry of Copper-bearing Hydrothermal Vein Deposits in Goseong Mining District (Samsan Area), Gyeongsang Basin, Korea)

  • 최상훈;소칠섭;권순학;최광준
    • 자원환경지질
    • /
    • 제27권2호
    • /
    • pp.147-160
    • /
    • 1994
  • 경상분지 백악기 퇴적암류와 화산암류내 열극을 충진한 열수 맥상광체들로 구성된 삼산지역 동광상들은 구조운동에 수반되어 2회에 걸쳐 형성된 석영 및 방해석맥들로 구성된다. 변질대에 산출되는 견운모에 대한 K-Ar 연령은 약 82Ma로서, 지역주변에 암주상으로 산출되는 화강섬록암의 관입활동 등 후기 백악기 화성활동과 관련된 것임을 지시한다. 주 광화시기인 광화 I기 석영맥내에는 황철석, 유비철석, 황동석, 섬아연석, 방연석, 적철석 및 Pb-Bi-Ag-Sb계 유염광물등의 광석광물들이 녹렴석, 녹니석 등의 맥석광물들과 함께 산출되며, 광화 I기는 광물들의 산출조직과 공생관계 등에 의하여 3개의 substage (early, main, late)로 구분된다. 본역내 광상들에서의 주된 동광화작용은 약 12~3wt. % NaCl 상당 염농도를 갖는 광화유체로 부터 약 $330^{\circ}C$에서 약 $280^{\circ}C$ 에 걸쳐 진행되었으며, 초기 광화유체의 비등현상으로부터 ${\leq}100{\sim}200bar$의 광화작용시 압력이 확인된다. 주광화시기인 광화 I기중 광화유체의 ${\delta}^{34}S_{H_2S}$값이 초기 8‰에서 후기 2.3‰로 점차 감소함은 광화유체의 비등과 천수혼입에 수반되어 산소분압이 점진적으로 증가한 결과로 해석된다. 유체내 산소 및 수소 안정동위원소 연구결과, 이들 동위원소 값이 광화작용의 진행과 함께 점차 감소함은 상대적으로 낮은 water/rock 비값을 갖는 환경하에서 동위원소 교환반응을 이뤄 평행상태에 이른 광화초기 열수계내에 광화작용의 진행과 함께 산화상태의 차갑고 동위원소적 교환반응이 거의 이뤄지지 않은 천수의 혼입이 점증 하였음을 지시한다.

  • PDF