• 제목/요약/키워드: Voice signal

검색결과 431건 처리시간 0.025초

스마트 스피커 대상 가청 주파수 대역을 활용한 적대적 명령어 공격 방법 제안 (Proposal of Hostile Command Attack Method Using Audible Frequency Band for Smart Speaker)

  • 박태준;문종섭
    • 인터넷정보학회논문지
    • /
    • 제23권4호
    • /
    • pp.1-9
    • /
    • 2022
  • 최근 스마트 스피커의 기능이 다양해지면서 스마트 스피커의 보급률이 증가하고 있다. 보급이 증가함에 따라 스마트 스피커에 대해 비정상적인 행위를 발생시키는 기법이 제안되고 있으며 여러 가지 공격 중 Voice Controllable System(VCS)에 대해 비정상적인 행위를 발생시키는 DolphinAttack은 초음파(f>20kHz)를 이용하여 사용자의 인식 없이 VCS를 제3자가 제어하는 방법이다. 하지만 기존의 제어 방법은 초음파 대역을 사용하기 때문에 초음파 신호를 출력할 수 있는 초음파 스피커나 초음파 전용 장비의 설치가 필요했다. 본 논문에서는 추가적인 장비, 즉, 초음파 장비의 설치 없이 사람의 가청 주파수 대역이지만 노화에 의해 듣기 힘든 주파수(18k~20kHz)로 변조된 음성신호를 출력하여, 스마트 스피커를 제어하는 방법을 제안한다. 스마트 스피커의 경우 마이크가 내장되어 있어, 변조된 음성신호를 수신할 수 있다. 본 논문에서 제안한 방법으로 수행한 결과, 가청 대역임에도 불구하고 사람은 음성명령을 인식하지 못하였으며, 스마트 스피커에 대해 82~96%의 확률로 제어가 가능했다.

지하 전력 구내에서 신호 전송 시스템의 실현에 관한 연구 (A Study on the Implementation of Signal Transmission System Within Electric Culvert)

  • 진달복;오상기;최성주;나채동
    • 한국조명전기설비학회지:조명전기설비
    • /
    • 제7권3호
    • /
    • pp.49-56
    • /
    • 1993
  • 본 논문에서는 지하전력구 환경하에서 통신신뢰도가 높고 확장성이 용이하며 복합전송(음성+데이터+영상신호)이 가능한 누설동축케이블을 전송 매체로 하여 지하전력구내 신호전송시스템을 설계 및 설치하였다.그리고 시험시스템에서 각종 전송특성시험을 실시하여 성능을 평가하였다. 음성신호의 경우, 전송손실 특성은 설계치보다 5∼10[dB]정도의 수신레벨이 향상되었으며 통화 품질평가시험에서 통화강도가 3(QSA 값), 명료도가 4(QRK 값)정도의 양호한 특성을 나타냈다. 또한 데이터 및 영상신호 전송특성에 대한 감시제어기능시험에서는 98[%]의 통신성공율을 확보할 수 있었다.그리고 전송로 및 시스템의 전송특성 측정결과에 의해서 중계기 없이 전송범위를 6[km]까지 확대할 수 있는 LCX 통신시스템을 전력구내 종합관리 시스템의 기본 구성방법으로 제시하였다.

  • PDF

화자 구분 시스템의 관심 화자 추출을 위한 i-vector 유사도 기반의 음성 분할 기법 (I-vector similarity based speech segmentation for interested speaker to speaker diarization system)

  • 배아라;윤기무;정재희;정보경;김우일
    • 한국음향학회지
    • /
    • 제39권5호
    • /
    • pp.461-467
    • /
    • 2020
  • 잡음이 많고 여러 사람이 있는 공간에서 음성인식의 성능은 깨끗한 환경보다 저하될 수밖에 없다. 이러한 문제점을 해결하기 위해 본 논문에서는 여러 신호가 섞인 혼합 음성에서 관심 있는 화자의 음성만 추출한다. 중첩된 구간에서도 효과적으로 분리해내기 위해 VoiceFilter 모델을 사용하였으며, VoiceFilter 모델은 여러 화자의 발화로 이루어진 음성과 관심 있는 화자의 발화로만 이루어진 참조 음성이 입력으로 필요하다. 따라서 본 논문에서는 Probabilistic Linear Discriminant Analysis(PLDA) 유사도 점수로 군집화하여 혼합 음성만으로도 참조 음성을 대체해 사용하였다. 군집화로 생성한 음성에서 추출한 화자 특징과 혼합 음성을 VoiceFilter 모델에 넣어 관심 있는 화자의 음성만 분리함으로써 혼합 음성만으로 화자 구분 시스템을 구축하였다. 2명의 화자로 이루어진 전화 상담 데이터로 화자 구분 시스템의 성능을 평가하였으며, 분리 전 상담사(Rx)와 고객(Tx)의 음성 Source to Distortion Ratio(SDR)은 각각 5.22 dB와 -5.22 dB에서 분리 후 각각 11.26 dB와 8.53 dB로 향상된 성능을 보였다.

음성구간검출을 위한 비정상성 잡음에 강인한 특징 추출 (Robust Feature Extraction for Voice Activity Detection in Nonstationary Noisy Environments)

  • 홍정표;박상준;정상배;한민수
    • 말소리와 음성과학
    • /
    • 제5권1호
    • /
    • pp.11-16
    • /
    • 2013
  • This paper proposes robust feature extraction for accurate voice activity detection (VAD). VAD is one of the principal modules for speech signal processing such as speech codec, speech enhancement, and speech recognition. Noisy environments contain nonstationary noises causing the accuracy of the VAD to drastically decline because the fluctuation of features in the noise intervals results in increased false alarm rates. In this paper, in order to improve the VAD performance, harmonic-weighted energy is proposed. This feature extraction method focuses on voiced speech intervals and weighted harmonic-to-noise ratios to determine the amount of the harmonicity to frame energy. For performance evaluation, the receiver operating characteristic curves and equal error rate are measured.

A New Control Method for an Adaptive Noise Canceller Using Stochastic difference between Voice and Noise Signals Power Change

  • Nishi, H.;Kakinoki, T.
    • 제어로봇시스템학회:학술대회논문집
    • /
    • 제어로봇시스템학회 2005년도 ICCAS
    • /
    • pp.2362-2367
    • /
    • 2005
  • This paper reports a technique for discriminating double talk and echo path change using the stochastic characteristics of power change for an adaptive noise canceller. The causes of rapid error increasing are double talk and echo path change. When the echo path is changed, the system corrects the impulse response in order to reduce the error. However, in the case of double talk, the system has to suspend the updating impulse response in order to maintain the quality of the voice signal. In the conventional system, it was difficult to discriminate between the two situations. In this research, the stochastic characteristics of the voice power change in the double talk period were experimentally verified to be different from the power change during echo path changing. Based on the results, a new double talk detection method is proposed.

  • PDF

발성장애아동을 위한 발성훈련시스템 설계 및 구현 (Design and Implementation of Speech-Training System for Voice Disorders)

  • 정은순;김봉완;양옥렬;이용주
    • 인터넷정보학회논문지
    • /
    • 제2권1호
    • /
    • pp.97-106
    • /
    • 2001
  • 본 논문에서는 발성장애아의 음성적 특징을 중심으로 컴퓨터 기반 발성훈련시스템을 설계 및 구현하였다. 본 발성훈련시스템은 선행훈련, 발성인지훈련, 발성강화훈련 단계로 구성되어 있으며, 발성장애 아동의 발성의 상황과 레벨을 분석하고 반복학습 및 개별학습이 가능하도록 하였다. 컴퓨터를 기반으로 발성장애아의 음성을 디지털 신호처리하기 위해 음성적 파라미터 즉, 음성의 강도, 음성의 고저, 유 무성음을 추출하였다. 추출된 음성적 파라미터는 이동체의 움직임 벡터 값으로 변환하여 이미지, 애니메이션, 게임적 요소와 같이 시각적으로 피드백 할 수 있도록 하였다.

  • PDF

u-Health 시스템을 위한 음성신호 분석 기반의 간 기능 모니터링에 관한 연구 (A Study on Monitoring of Liver Function Based on Voice Signal Analysis for u-Health System)

  • 김봉현;조동욱
    • 정보처리학회논문지B
    • /
    • 제18B권6호
    • /
    • pp.389-396
    • /
    • 2011
  • 현대 사회에서 식습관의 변화, 스트레스, 음주 등으로 인해 다양한 간 질환이 발생되거나 악화되어 가고 있다. 따라서 본 논문에서는 간 질환이 음성에 미치는 영향을 연구하여 간 질환을 조기에 진단할 수 있는 방법론을 제안하였다. 이를 위해 간 질환자를 대상으로 입원했을 때와 치료로 인해 정상적으로 퇴원했을 때의 음성을 각각 수집하여 음성 분석 요소를 적용한 실험을 수행하였다. 특히, 한의학적으로 간(肝)과 관련 있는 발음인 아음(牙音)에 대한 분석 실험으로 제3포먼트 주파수 대역폭과 발음 요소값을 적용한 실험을 수행하였으며 이를 통해 간 질환이 공명강과 발성에 미치는 영향을 객관적 지표로 출력하는 연구를 행하였다. 또한 실험 결과를 기반으로 u-Health 환경에서 간 기능을 모니터링하는 시스템 설계에 관한 연구를 수행하였다.

IEEE 802.15.4 표준에 적용을 위한 음성부호화 기술 (A Voice Coding Technique for Application to the IEEE 802.15.4 Standard)

  • 진진흥;강석근
    • 방송공학회논문지
    • /
    • 제13권5호
    • /
    • pp.612-621
    • /
    • 2008
  • 이용 가능한 데이터 영역과 전송전력 등 다양한 제한 요소들로 인하여 지그비 통신의 기술규격에는 음성통신에 대한 기준 사양이 포함되지 않았다. 본 논문에서는 지그비의 기반인 IEEE 802.15.4 표준에 적용하기 위한 음성부호화 기법이 제시된다. 여기서는 높은 압축율과 파형 복구능력이 우수한 파형부호기의 실현이 필수적이다. 이를 위하여 제시된 방법에서는 다단 이산 웨이블릿변환과 두 가지 펄스부호변조로 구성된 이진부호기가 사용된다. 이론적인 분석과 실내 무선 환경에서의 모의실험 결과 2단 웨이블릿변환을 적용한 경우가 압축율과 음성신호 복구능력 면에서 가장 적합한 것으로 판단된다. 직선전파경로 성분이 지배적인 경우 제시된 방법은 중간 정도의 신호 대 잡음비에서도 만족스러운 복구능력을 가진다. 따라서 제시된 음성부호화 방법은 향후 지그비를 이용한 음성통신의 표준 선정에 참고 가능한 기술이 될 수 있을 것으로 사료된다.

VOIP 음질 개선을 위한 패킷 크기의 최적화 (Optimization of the packet size to enhance the voice quality of the VOIP system)

  • 임강빈;정기현;최경희
    • 대한전자공학회논문지TC
    • /
    • 제40권9호
    • /
    • pp.373-383
    • /
    • 2003
  • 본 논문에서는 다양한 서비스가 복합적으로 운용되고 있는 인터넷 망에서PCM 및 ADPCM으로 압축된 음성 데이터를 전송할 경우, 패킷 크기와 한계 지연시간의 변화가 수신측의 음질에 미치는 영향을 분석하고 주어진 한계 지연시간에 대하여 최고의 음질을 제공하기 위한 전송 패킷의 크기에 대하여 논한다. 결과를 얻기 위한 실험은 공중 인터넷 망을 통하여 연결된 두 대의 PC 상에서 이루어졌다. 송신측은 마이크로부터의 음성신호를 PCM 및 ADPCM으로 부호화하고 이를 UDP 패킷을 이용하여 전송하였으며, 수신 측에서는 망에서 발생하는 전송 지연 및 패킷 손실 등을 거친 패킷이 음성신호로 재생된다. 음질 평가를 위하여 송수신 음성 데이터를 수집하여 오프라인에서 비교하며, 알고리즘으로는 객관성을 유지하기 위하여 MNB 방법을 이용하였다. 실험 결과에 의하면, 40Kbps, 32Kbps, 16Kbps의 ADPCM으로 압축된 음성의 전송에서 한계 전송 지연을 100ms로 하였을 경우 음질 열화를 최소화하기 위하여는 패킷 크기의 하한이 각각 300, 400, 500바이트, 패킷 크기의 상한은 공히 1200바이트인 것이 요구된다.

스테레오 음향반향제거기의 BSS 후처리방법 (Post Processing using Blind Signal Separation in Stereo Acoustic Echo Canceller)

  • 이행우
    • 디지털산업정보학회논문지
    • /
    • 제10권1호
    • /
    • pp.131-138
    • /
    • 2014
  • This paper is on a stereo acoustic echo canceller with the blind signal separation for post processing. The convergence speed of the stereo acoustic echo canceller is deteriorated due to mixing two residual signals which are update signals of each echo canceller. To solve this problem, we are to use the blind signal separation(BSS) method separating the mixed signals after the echo cancellers. The blind signal separation method can extracts the source signals by means of the iterative computations with two input signals. We had verified performances of the proposed acoustic echo canceller for stereo through simulations. The results of simulations show that the acoustic echo canceller for stereo using this algorithm operates stably without divergence in the normal state. And, when the speech signals were inputted, this echo canceller achieved about 2dB higher ERLE with the BSS post processing method than without this method. This stereo echo canceller showed the best performance in the case of inputting the real voice signal.