• 제목/요약/키워드: SMS 스팸

검색결과 20건 처리시간 0.023초

동시출현 단어분석 기반 스팸 문자 탐지 기법 (Coward Analysis based Spam SMS Detection Scheme)

  • 오하영
    • 정보보호학회논문지
    • /
    • 제26권3호
    • /
    • pp.693-700
    • /
    • 2016
  • 스팸 데이터 셋은 통상적으로 공개적으로 구하기 어렵고 기존 연구들은 대부분 스팸 이메일에 초점이 맞춰져 왔기 때문에 스팸 문자 메시지 자체 특성을 분석하는데 한계가 있었다. 스팸 이메일 특성 분석 활용 및 데이터 마이닝 기법 등의 활용을 통한 기존 연구들이 있었지만, 영향력이 높은 단일 단어를 활용한 스팸 문자 탐지 기법에 한정되어 있다는 한계점이 있다. 본 논문에서는 싱가폴 대학교에서 공개적으로 공개한 스팸 문자메시지를 다 각도에서 실험 및 분석하여 스팸 문자의 특성을 밝히고 동시출현 단어분석 기반의 스팸 문자 탐지 기법을 제안한다. 성능평가 결과, 제안하는 기법의 거짓 양성과 거짓 음성이 2%미만임을 보였다.

듀얼 SMS 스팸 필터링: 그래프 기반 자질 가중치 기법 (Dual SMS SPAM Filtering: A Graph-based Feature Weighting Method)

  • 황재원;고영중
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2014년도 제26회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.95-99
    • /
    • 2014
  • 본 논문에서는 최근 급속히 증가하여 사회적 이슈가 되고 있는 SMS 스팸 필터링을 위한 듀얼 SMS 스팸필터링 기법을 제안한다. 지속적으로 증가하고 새롭게 변형되는 SMS 문자 필터링을 위해서는 패턴 및 스팸 단어 사전을 통한 필터링은 많은 수작업을 요구하여 부적합하다. 그리하여 기계 학습을 이용한 자동화 시스템 구축이 요구되고 있으며, 효과적인 기계 학습을 위해서는 자질 선택과 자질의 가중치 책정 방법이 중요하다. 하지만 SMS 문자 특성상 문장들이 짧기 때문에 출현하는 자질의 수가 적어 분류의 어려움을 겪게 된다. 이 같은 문제를 개선하기 위하여 본 논문에서는 슬라이딩 윈도우 기반 N-gram 확장을 통해 자질을 확장하고, 확장된 자질로 그래프를 구축하여 얕은 구조적 특징을 표현한다. 학습 데이터에 출현한 N-gram 자질을 정점(Vertex)으로, 자질의 출현 빈도를 그래프의 간선(Edge)의 가중치로 설정하여 햄(HAM)과 스팸(SPAM) 그래프를 각각 구성한다. 이렇게 구성된 그래프를 바탕으로 노드의 중요도와 간선의 가중치를 활용하여 최종적인 자질의 가중치를 결정한다. 입력 문자가 도착하면 스팸과 햄의 그래프를 각각 이용하여 입력 문자의 2개의 자질 벡터(Vector)를 생성한다. 생성된 자질 벡터를 지지 벡터 기계(Support Vector Machine)를 이용하여 각 SVM 확률 값(Probability Score)을 얻어 스팸 여부를 결정한다. 3가지의 실험환경에서 바이그램 자질과 이진 가중치를 사용한 기본 시스템보다 F1-Score의 약 최대 2.7%, 최소 0.5%까지 향상되었으며, 결과적으로 평균 약 1.35%의 성능 향상을 얻을 수 있었다.

  • PDF

소셜 네트워크 기반 대량의 SMS 스팸 데이터 재구성 기법 (A Re-configuration Scheme for Social Network Based Large-scale SMS Spam)

  • 정시현;노기섭;오하영;김종권
    • 정보과학회 논문지
    • /
    • 제42권6호
    • /
    • pp.801-806
    • /
    • 2015
  • SMS는 현대 통신 수단 중 가장 많이 사용되고 있는 방법 중 하나로서, 그 사용 비용이 저렴해짐에 따라 SMS에서의 스팸도 함께 증가하였다. SMS 스팸을 탐지하는 연구들은 부득이하게 사용자의 발신번호, 수신번호 및 SMS내용 등의 즉 개인정보를 필요로 하게 된다는 점에서 데이터 수집 측면에서 큰 한계를 가지고 있다. 더욱이, 소셜 네트워크가 활성화됨에 따라 SMS 스팸들은 더욱 지능화되고 있으며 결과, SMS 스팸 탐지 기법 연구 수행시 해당 SMS관련 개인정보는 물론 사용자의 소셜 네트워크 관련 정보까지 필요로 한다. 따라서, 본 논문에서는 SMS 스팸을 탐지하기 위해 필요한 소셜 네트워크 데이터 셋을 사생활 침해 문제 없이 실제와 유사하게 재구성해주는 SBSS(Social network Building Scheme for SMS spam detection) 기법을 제안한다. 또한, 현재 존재하는 SMS 스팸의 공격 유형을 처음으로 구체화하고 분류하여 이를 반영했다.

형태소 단위 자질을 이용한 콘텐츠 기반 한국어 SMS 스팸 필터링 (Contents-Based Korean SMS Spam Filtering Using Morpheme Unit Features)

  • 손대능;신중휘;이정태;이승욱;임해창
    • 한국정보과학회 언어공학연구회:학술대회논문집(한글 및 한국어 정보처리)
    • /
    • 한국정보과학회언어공학연구회 2008년도 제20회 한글 및 한국어 정보처리 학술대회
    • /
    • pp.195-200
    • /
    • 2008
  • 본 논문에서는 형태소 분석을 이용한 확률 기반 한국어 SMS 스팸 필터링 기법을 제안한다. 기존 연구에서는 단어 및 문자 단위 어휘 정보를 자질로 이용한 영어 및 스페인어 SMS 스팸 필터링 방법들이 있다. 하지만 교착어인 한국어의 경우, 어근과 접사의 조합에 의해서 다양한 어절이 형성될 수 있다. 따라서 어절단위 어휘 정보를 자질로 사용할 경우, 미등록어(out of vocabulary) 문제가 발생한다. 특히, 매우 적은 수의 단어들로 구성된 SMS 메시지의 경우에는 이 문제가 매우 심각하다. 본 논문에서는 형태소 분석을 이용하여 이러한 문제점을 해결하고자 하였다. 실험 결과, 제안하는 방법은 기존 연구와 비교하여 10.6%의 스팸 분류 정확률 향상을 보였다. 또한 미등록어만을 포함하는 SMS 메시지의 수는 약 77% 감소하였다.

  • PDF

대량 스팸메일 발송 방지를 위한 SMS 기반 DomainKey 방식의 송신자 인증 기법 (Sender Authentication Mechanism based on DomainKey with SMS for Spam Mail Sending Protection)

  • 이형우
    • 한국콘텐츠학회논문지
    • /
    • 제7권4호
    • /
    • pp.20-29
    • /
    • 2007
  • 전자우편은 인터넷을 이용하는 사용자들에게 중요한 커뮤니케이션의 역할을 담당하고 있다. 하지만, 원하지 않는 광고 정보를 포함한 스팸 메일, 악성코드 형태를 포함한 바이러스 메일 등 대부분이 불필요한 자료들로 인해 전자우편이 가지는 본연의 의미와는 무색하게 사용되고 있어 근본적인 측면에서 스팸 메일의 발송을 방지할 수 있는 방안에 대한 연구가 시급하다. 본 연구에서 전자우편 발송자는 SMS(Short Message Service) 방식으로 별도의 비밀 정보를 전달받고 이를 통해 Domainkey 방식에서 사용하는 개인키/공개키 쌍을 생성하도록 하였으며 기존의 PGP 방식과도 접목하여 전자우편 송신자에 대한 인증 및 메시지에 대한 암복호화 기능을 수행하는 기법을 제안한다. 제안한 기법은 메일 발송 과정에서 발신자에 대한 인증 과정을 수행하므로 스팸 메일의 발송을 방지할 수 있는 기법이다.

송신자 자가인증 기법 기반의 스팸 SMS 필터링 안드로이드 애플리케이션 구현 (Implementation of Anti-spam SMS Android Application Using Self-authentication Mechanism)

  • 양인식;추문박;백전성;강경태
    • 한국컴퓨터정보학회:학술대회논문집
    • /
    • 한국컴퓨터정보학회 2018년도 제58차 하계학술대회논문집 26권2호
    • /
    • pp.63-66
    • /
    • 2018
  • 스팸 스미싱 SMS의 차단을 위하여 지금까지 다양한 차단기법이 개발되어 사용되고 있다. 그 중에서도 대부분을 차지하는 방법들이 기계학습을 통한 내용 기반의 차단과 사용자의 스팸신고를 통한 송신자 차단 방법이다. 그러나 이러한 방법들은 공통적으로 스팸 스미싱을 식별하기 위해 학습 데이터가 필요하다는 문제점을 갖고 있기 때문에, 신종 스팸 공격들은 차단이 불가능하여 차단율의 한계를 보인다. 본 논문에서는 오늘날 사용되고 있는 스팸 스미싱 차단 기법들의 근본적인 문제점들을 규명하고, 이를 해결할 수 있는 스팸차단 기법 중 하나인 송신자 자가인증 기법을 소개한다. 그리고 송신자 자가인증 기법을 적용한 안드로이드애플리케이션의 구현 및 동작과정을 설명한다.

  • PDF

발신번호 특징 및 음절단위 기계학습을 통한 모바일 스팸 SMS 필터링 시스템 (A Mobile Spam SMS Filtering System using Machine learning about syllable and the features of caller ID)

  • 유환일;채동규;임을규
    • 한국정보처리학회:학술대회논문집
    • /
    • 한국정보처리학회 2011년도 추계학술발표대회
    • /
    • pp.219-222
    • /
    • 2011
  • 본 논문에서는 스팸 SMS 발신번호와 메시지 텍스트의 특징을 기계학습한 스팸 필터링 시스템을 논한다. 최근 변화하는 스팸SMS에 대한 적응력을 위해서, 각 트레이닝 셋의 수신 텍스트를 음절단위로 분석 할 것을 제안한다. 그리고 기존의 분류기는 성능이 미흡하거나 구현의 복잡성으로 인해 실제로 스펨 필터엔진으로 활용되지 않는 점을 극복하기 위해서 보다 단순한 분류기를 사용한다. 제안하는 시스템은 트레이닝 셋의 발신번호 및 수신 텍스트의 음절단위를 빈도수와 묶어 학습데이터를 구성하고, 테스트 셋을 스팸적 논스팸적으로 분석하여 스팸일 확률을 계산한다. 또한 Naive baysian를 바탕으로 한 경계값 기반 분류기를 통해, 타 분류기에 비해 구현 및 활용면에서 실용성이 높으면서도 성능이 뒤처지지 않는 시스템을 제안한다.

스팸 문자 필터링을 위한 변형된 한글 SMS 문장의 정규화 기법 (A Normalization Method of Distorted Korean SMS Sentences for Spam Message Filtering)

  • 강승식
    • 정보처리학회논문지:소프트웨어 및 데이터공학
    • /
    • 제3권7호
    • /
    • pp.271-276
    • /
    • 2014
  • 휴대폰에서 문자 메시지 전송 기능은 현대인들에게 매우 편리한 새로운 형태의 의사소통 방식이다. 반면에 문자 메시지 기능을 악용한 광고성 문자들이 너무 많이 쏟아져서 휴대폰 사용자들은 스팸 문자 공해에 시달리는 심각한 부작용을 낳게 되었다. 광고성 문자를 발송하는 사람들은 문자 메시지가 자동으로 차단되는 것을 회피하기 위해 한글 문장을 다양한 형태로 변형하거나 왜곡시키고 있으며, 이러한 문자 메시지를 자동으로 차단하기 위해서는 변형되거나 왜곡된 문장들을 정상적인 한글 문장으로 정규화하는 기술이 필수적이다. 본 논문에서는 변형되거나 왜곡된 광고성 문자 메시지를 정상적인 문장으로 정규화하고 정규화된 문장으로부터 자동 띄어쓰기 및 복합명사 분해 과정을 거쳐 키워드를 추출하기 위한 방법을 제안하였다.

개인식별화된 SMS 발송을 통한 스팸식별 및 스미싱 예방(금융권중심) (Discrimination of SPAM and prevention of smishing by sending personally identified SMS(For financial sector))

  • 주춘경;윤지원
    • 정보보호학회논문지
    • /
    • 제24권4호
    • /
    • pp.645-653
    • /
    • 2014
  • 본 논문은 최근 휴대전화 사용 급증에 따라 계속 이슈가 되고 있는 스팸 문자 및 스미싱(Smishing)과 관련해서 금융기관에서 고객들에게 발송되는 SMS(Short Message Service)문자의 진위여부를 저비용, 고효율 측면에서 효율적으로 식별할 수 있는 방안을 제시하고자 한다. 먼저 본 논문에서는 스팸문자를 차단하기 위한 기존의 노력 및 대책에 대한 문제점 및 한계를 언급하고 그 한계를 효과적으로 극복할 수 있는 방안을 제시한다. 또한 제시된 개선방법에 대해 다양한 계층의 고객들에 대한 설문조사와 직접 구현 및 적용을 통해 그 효과성을 증명하려고 한다.

스팸규제에 관한 연구 (A Study on Spam Regulation)

  • 백윤철
    • 정보관리연구
    • /
    • 제38권4호
    • /
    • pp.48-67
    • /
    • 2007
  • 스팸으로 인하여 우리 사회가 지출해야 하는 경제적 부담은 정보의 자유로운 유통으로 누릴 수 있는 이익을 상회한다고 볼 수 있다. 그리고 현재 이메일, 휴대폰 SMS 등을 통한 영리목적의 광고성 정보전송 행위에 대한 규제가 정보통신부와 공정위원회로 이원화되어 있으므로 $\ulcorner$정보통신망 이용촉진 및 정보보호 등에 관한 법률$\lrcorner$상 스팸규정에서 일부 공정위 소관법률 적용대상자를 예외로 하거나 동일의무에 대해 중복규제하는 등 법률의 분리로 인한 국민 불편 및 형평성 문제가 발생하고 있다. 이에 스팸규제와 관련된 국외의 환경 및 동향 등에 대한 비교 분석과 함께 포털사이트나 이동통신 등 정보통신망제공 사업자의 자율재량에 맡긴 스팸방지활동은 한계가 있기 때문에 동 사업자의 스팸 방지에 대한 기술적 조치 및 서비스제한, 신원확인 등 법적 의무화에 대한 검토가 필요하기에 본 연구는 국내 최적의 광고성 정보 규제법규의 형식 및 내용을 도출하기 위하여 국내 타 관련 법률 및 산업 환경 전반을 고려하여 스팸규제 범위를 명확히 하고, 스팸 행위뿐만 아니라 영리목적의 광고행위 전반을 포괄하는 법률 제정방안 수립하며, 기타 현 정보통신망 이용촉진 및 정보보호 등에 관한 법률 개정 또는 광고성 정보전송 규제 단일법 제정시 필요사항을 도출함을 목적으로 한다.