Due to the undeniable importance of approximating the concrete compressive strength (CSC) in civil engineering, this paper focuses on presenting four novel optimizations of multi-layer perceptron (MLP) neural network, namely artificial bee colony (ABC-MLP), grasshopper optimization algorithm (GOA-MLP), shuffled frog leaping algorithm (SFLA-MLP), and salp swarm algorithm (SSA-MLP) for predicting this crucial parameter. The used dataset consists of 103 rows of information concerning seven influential parameters (cement, slag, water, fly ash, superplasticizer, fine aggregate, and coarse aggregate). In this work, the best-fitted complexity of each ensemble is determined by a population-based sensitivity analysis. The GOA distinguished its self by the least complexity (population size = 50) and emerged as the second time-effective optimizer. Referring to the prediction results, all tested algorithms are able to construct reliable networks. However, the SSA (Correlation = 0.9652 and Error = 1.3939) and GOA (Correlation = 0.9629 and Error = 1.3922) performed more accurately than ABC (Correlation = 0.7060 and Error = 4.0161) and SFLA (Correlation = 0.8890 and Error = 2.5480). Therefore, the SSA-MLP and GOA-MLP can be promising alternatives to laboratorial and traditional CSC evaluative methods.
Lung cancer is a chronic disease which ranks fourth in cancer incidence with 11 percent of the total cancer incidence in Korea. To deal with such issues, there is an active study on the usefulness and utilization of the Clinical Decision Support System (CDSS) which utilizes machine learning. Thus, this study reviews existing studies on artificial intelligence technology that can be used in determining the lung cancer, and conducted a study on the applicability of machine learning in determination of the lung cancer by comparison and analysis using Azure ML provided by Microsoft. The results of this study show different predictions yielded by three algorithms: Support Vector Machine (SVM), Two-Class Support Decision Jungle and Multiclass Decision Jungle. This study has its limitations in the size of the Big data used in Machine Learning. Although the data provided by Kaggle is the most suitable one for this study, it is assumed that there is a limit in learning the data fully due to the lack of absolute figures. Therefore, it is claimed that if the agency's cooperation in the subsequent research is used to compare and analyze various kinds of algorithms other than those used in this study, a more accurate screening machine for lung cancer could be created.
현재 우리나라 기상청에서는 단기, 중기 및 장기 예보자료를 생산하고 있으나, 이들 자료는 단순히 일기 예보에 치중되어 생산되고 있어 강우-유출해석에 직접 적용하기에는 시 공간 해상도가 크고 정량적 강수예측의 정확도가 미흡하다. 이에 기상 및 수자원분야에서는 정확도 개선을 위해서 관측강우와 예측강우의 비교 분석을 통해 편차를 산정하여 예측강수를 보정하는 기법을 적용하고 있다. 다만, 기존의 편차보정방법은 보정인자로 강수량만을 고려하기 때문에 정확도 개선에는 한계가 존재한다. 따라서 본 연구에서는 수자원분야의 수치예보자료의 정확도를 향상시키기 위해 규모, 발생영역에 대한 강수의 특성을 고려한 강수예측자료의 편차보정 방법을 제안하고 이를 강우-유출모델에 적용하여 개선정도를 평가하고자 한다. 이에 적용유역을 춘천댐상류유역으로 선정하고 국내 기상청의 RDAPS(Regional Data Assimilation and Prediction System)수치예보자료, 지점강우자료, radar자료의 수문기상자료와 지형자료를 수집하였다. 화천, 평화의 댐 일부 미계측유역의 관측자료로 radar자료를 이용하였다. 이상의 자료를 토대로 강우강도 및 규모, 영향범위를 고려한 예측강우의 편차를 산정하여 RDAPS 수치예보자료의 정확도를 개선하고 평가하였다. 이는 해당 유역뿐만 아니라 주변 유역의 정보를 이용하여 예측강우의 발생위치에 대한 오차를 고려한 방법으로, 각 영역별로 예측강우의 편차보정계수를 산정하여 적용하였다. 또한, 이전시간대의 강우 편차에 대한 오차를 줄이기 위해 정규분포방법을 이용한 Ensemble 편차보정계수를 산정하고 최근 생산된 수치예보자료에 적용하여 확률예측강우를 산정하였다.
Park, Soo-Ho;Choi, Han-Lim;Roy, Nicholas;How, Jonathan P.
International Journal of Aeronautical and Space Sciences
/
제11권4호
/
pp.326-337
/
2010
This work addresses problems regarding trajectory planning for unmanned aerial vehicle sensors. Such sensors are used for taking measurements of large nonlinear systems. The sensor investigations presented here entails methods for improving estimations and predictions of large nonlinear systems. Thoroughly understanding the global system state typically requires probabilistic state estimation. Thus, in order to meet this requirement, the goal is to find trajectories such that the measurements along each trajectory minimize the expected error of the predicted state of the system. The considerable nonlinearity of the dynamics governing these systems necessitates the use of computationally costly Monte-Carlo estimation techniques, which are needed to update the state distribution over time. This computational burden renders planning to be infeasible since the search process must calculate the covariance of the posterior state estimate for each candidate path. To resolve this challenge, this work proposes to replace the computationally intensive numerical prediction process with an approximate covariance dynamics model learned using a nonlinear time-series regression. The use of autoregressive time-series featuring a regularized least squares algorithm facilitates the learning of accurate and efficient parametric models. The learned covariance dynamics are demonstrated to outperform other approximation strategies, such as linearization and partial ensemble propagation, when used for trajectory optimization, in terms of accuracy and speed, with examples of simplified weather forecasting.
This paper proposes an efficient data-driven approach to build models for predicting energy consumption in buildings. Data used in this research is collected by installing humidity and temperature sensors at different locations in a building. In addition to this, weather data from nearby weather station is also included in the dataset to study the impact of weather conditions on energy consumption. One of the main emphasize of this research is to make feature selection independent of domain knowledge. Therefore, to extract useful features from data, two different approaches are tested: one is feature selection through principal component analysis and second is relative importance-based feature selection in original domain. The regression model used in this research is gradient boosting regression and its optimal parameters are chosen through a two staged coarse-fine search approach. In order to evaluate the performance of model, different performance evaluation metrics like r2-score and root mean squared error are used. Results have shown that best performance is achieved, when relative importance-based feature selection is used with gradient boosting regressor. Results of proposed technique has also outperformed the results of support vector machines and neural network-based approaches tested on the same dataset.
최근 기후변화의 영향으로 전 세계적으로 홍수와 가뭄의 발생빈도가 증가하고 있다. 특히, 가뭄은 우리나라에서 겨울과 봄철을 중심으로 매년 발생되고 있다. 가뭄의 정확한 발생을 판단하기는 어려우나, 가뭄이 발생되면 그 진행속도는 홍수보다 느리기 때문에 초기에 가뭄의 발생가능성을 예측한다면 가뭄에 대한 피해를 줄일 수 있다. 따라서 최근 가뭄 예측에 대한 다양한 연구가 이루어지고 있다. 본 연구에서는 가뭄발생의 불확실성을 내포하기 위하여 Bayesian Network (BN) 모형과 SPI의 자기상관성을 바탕으로 가까운 미래의 가뭄 발생확률을 예측하는 방법을 제안하였다. BN은 변수들 간의 인과관계를 확률적으로 나타낼 수 있는 네트워크 모형으로, 자연현상에 대한 위험도 분석 및 의학 분야에서 질병추정을 위한 모형으로 활용되고 있다. 본 연구에서는 가까운 미래의 가뭄 예측을 위하여 APEC 기후센터(APEC Climate Center, APCC)에서 제공하는 다중모형앙상블(Multi-model Ensemble, MME) 강우예측 결과로 도출한 미래 SPI 및 과거 강우량 자료로 구축한 SPI를 부모노드로, 예측 SPI를 자식노드로 BN을 구축하였다. BN의 각각의 노드를 Gaussian 확률분포모형으로 가정한 뒤, Likelihood weighting 방법으로 주변사후분포확률(Marginal posterior distribution)을 추정하여 미래의 SPI의 발생확률을 계산하였다. 2008년부터 2013년의 BN 가뭄 예측값과 MME 강우예측 결과로 도출한 SPI를 실제 관측 강우량으로 산정한 SPI와 비교하였으며, BN이 실제 관측결과에 가까운 결과가 도출되었다. 본 연구에서는 BN을 활용하여 가까운 미래의 가뭄 발생가능성을 확률적으로 나타낼 수 있는 방법을 제시하였으며, 그 결과 가뭄상태별 가뭄 발생확률이 산정되었다.
Ahn, Joong-Bae;Shim, Kyo-Moon;Lee, Deog-Bae;Kang, Su-Chul;Hur, Jina
한국농림기상학회:학술대회논문집
/
한국농림기상학회 2011년도 학술발표회
/
pp.20-27
/
2011
A system for fine-resolution long-range weather forecast is introduced in this study. The system is basically consisted of a global-scale coupled general circulation model (CGCM) and Weather Research and Forecast (WRF) regional model. The system makes use of a data assimilation method in order to reduce the initial shock or drift that occurs at the beginning of coupling due to imbalance between model dynamics and observed initial condition. The long-range predictions are produced in the system based on a non-linear ensemble method. At the same time, the model bias are eliminated by estimating the difference between hindcast model climate and observation. In this research, the predictability of the forecast system is studied, and it is illustrated that the system can be effectively used for the high resolution long-term weather prediction. Also, using the system, fine-resolution climatological data has been produced with high degree of accuracy. It is proved that the production of agrometeorological variables that are not intensively observed are also possible.
안정적인 수자원 운용을 위해서는 정확한 유량예측 기술이 필요하다. 본 연구에서는 유량예측 정확도의 개선을 위해 베이지안 추론(Bayesian inference) 기법과 앙상블 유량 예측(Ensemble Streamflow Prediction, ESP) 기법의 결합을 통한 새로운 유량예측 기법(Bayesian ESP)을 제안하였다. ESP를 통한 유량 예보 앙상블은 베이지안 추론의 사전정보로 활용되며, 관측 유량과 ESP 전망 결과의 선형관계를 통해 우도함수가 추정된다. 우도함수는 관측 유량이 존재하는 과거 기간에 대한 ESP를 수행한 후 예보 시점의 관측 유량(concurrent observed flow)과 선행 관측 유량(lagged observed flow)과의 다중선형회귀 모형을 통해 추정된다. 사전정보와 우도함수는 정규분포로 가정되며, 따라서 최종 유량예측인 사후정보 역시 정규분포함수로 산정되게 된다. Bayesian ESP은 ESP에서 발생하는 강우-유출모형 오차의 개선을 통해 수문예측의 정확도를 개선하게 되며 정규분포함수로 최종 결과가 산정되므로 확률예보 형태의 수문 전망도 가능하다. 본 기법을 전국 35개 댐 유역에 시범적용을 한 결과, 모든 유역에서 기존 ESP 기법 대비 수문예측 정확도의 개선을 가져왔으며, 우도함수 추정에 있어 선행 유량의 포함 여부가 수문 예측 정확도의 추가적인 개선을 가져왔다. 본 기법은 주간 예보부터 계절 예보까지 탄력적으로 구축이 가능하며 적용 결과 리드 타임이 길어질수록 예측 능력이 감소되었지만 전체 구간에 있어서 Bayesian ESP 기법이 가장 우수한 예측 정확도를 보여주었다.
This study implemented the prediction of drought properties (number of drought events, intensity, duration) using the user-oriented systematical procedures of downscaling climate change scenarios based the multiple global climate models (GCMs), AIMS (APCC Integrated Modeling Solution) program. The drought properties were defined and estimated with Effective Drought Index (EDI). The optimal 10 models among 29 GCMs were selected, by the estimation of the spatial and temporal reproducibility about the five climate change indices related with precipitation. In addition, Simple Quantile Mapping (SQM) as the downscaling technique is much better in describing the observed precipitation events than Spatial Disaggregation Quantile Delta Mapping (SDQDM). Even though the procedure was systematically applied, there are still limitations in describing the observed spatial precipitation properties well due to the offset of spatial variability in multi-model ensemble (MME) analysis. As a result, the farther into the future, the duration and the number of drought generation will be decreased, while the intensity of drought will be increased. Regionally, the drought at the central regions of the Korean Peninsula is expected to be mitigated, while that at the southern regions are expected to be severe.
International Journal of Computer Science & Network Security
/
제21권1호
/
pp.220-225
/
2021
Human population growth rate is an important parameter for real-world planning. Common approaches rely upon fixed parameters like human population, mortality rate, fertility rate, which is collected historically to determine the region's population growth rate. Literature does not provide a solution for areas with no historical knowledge. In such areas, machine learning can solve the problem, but a multitude of machine learning algorithm makes it difficult to determine the best approach. Further, the missing feature is a common real-world problem. Thus, it is essential to compare and select the machine learning techniques which provide the best and most robust in the presence of missing features. This study compares 17 machine learning techniques (base learners and ensemble learners) performance in predicting the human population growth rate of the country. Among the 17 machine learning techniques, random forest outperformed all the other techniques both in predictive performance and robustness towards missing features. Thus, the study successfully demonstrates and compares machine learning techniques to predict the human population growth rate in settings where historical data and feature information is not available. Further, the study provides the best machine learning algorithm for performing population growth rate prediction.
본 웹사이트에 게시된 이메일 주소가 전자우편 수집 프로그램이나
그 밖의 기술적 장치를 이용하여 무단으로 수집되는 것을 거부하며,
이를 위반시 정보통신망법에 의해 형사 처벌됨을 유념하시기 바랍니다.
[게시일 2004년 10월 1일]
이용약관
제 1 장 총칙
제 1 조 (목적)
이 이용약관은 KoreaScience 홈페이지(이하 “당 사이트”)에서 제공하는 인터넷 서비스(이하 '서비스')의 가입조건 및 이용에 관한 제반 사항과 기타 필요한 사항을 구체적으로 규정함을 목적으로 합니다.
제 2 조 (용어의 정의)
① "이용자"라 함은 당 사이트에 접속하여 이 약관에 따라 당 사이트가 제공하는 서비스를 받는 회원 및 비회원을
말합니다.
② "회원"이라 함은 서비스를 이용하기 위하여 당 사이트에 개인정보를 제공하여 아이디(ID)와 비밀번호를 부여
받은 자를 말합니다.
③ "회원 아이디(ID)"라 함은 회원의 식별 및 서비스 이용을 위하여 자신이 선정한 문자 및 숫자의 조합을
말합니다.
④ "비밀번호(패스워드)"라 함은 회원이 자신의 비밀보호를 위하여 선정한 문자 및 숫자의 조합을 말합니다.
제 3 조 (이용약관의 효력 및 변경)
① 이 약관은 당 사이트에 게시하거나 기타의 방법으로 회원에게 공지함으로써 효력이 발생합니다.
② 당 사이트는 이 약관을 개정할 경우에 적용일자 및 개정사유를 명시하여 현행 약관과 함께 당 사이트의
초기화면에 그 적용일자 7일 이전부터 적용일자 전일까지 공지합니다. 다만, 회원에게 불리하게 약관내용을
변경하는 경우에는 최소한 30일 이상의 사전 유예기간을 두고 공지합니다. 이 경우 당 사이트는 개정 전
내용과 개정 후 내용을 명확하게 비교하여 이용자가 알기 쉽도록 표시합니다.
제 4 조(약관 외 준칙)
① 이 약관은 당 사이트가 제공하는 서비스에 관한 이용안내와 함께 적용됩니다.
② 이 약관에 명시되지 아니한 사항은 관계법령의 규정이 적용됩니다.
제 2 장 이용계약의 체결
제 5 조 (이용계약의 성립 등)
① 이용계약은 이용고객이 당 사이트가 정한 약관에 「동의합니다」를 선택하고, 당 사이트가 정한
온라인신청양식을 작성하여 서비스 이용을 신청한 후, 당 사이트가 이를 승낙함으로써 성립합니다.
② 제1항의 승낙은 당 사이트가 제공하는 과학기술정보검색, 맞춤정보, 서지정보 등 다른 서비스의 이용승낙을
포함합니다.
제 6 조 (회원가입)
서비스를 이용하고자 하는 고객은 당 사이트에서 정한 회원가입양식에 개인정보를 기재하여 가입을 하여야 합니다.
제 7 조 (개인정보의 보호 및 사용)
당 사이트는 관계법령이 정하는 바에 따라 회원 등록정보를 포함한 회원의 개인정보를 보호하기 위해 노력합니다. 회원 개인정보의 보호 및 사용에 대해서는 관련법령 및 당 사이트의 개인정보 보호정책이 적용됩니다.
제 8 조 (이용 신청의 승낙과 제한)
① 당 사이트는 제6조의 규정에 의한 이용신청고객에 대하여 서비스 이용을 승낙합니다.
② 당 사이트는 아래사항에 해당하는 경우에 대해서 승낙하지 아니 합니다.
- 이용계약 신청서의 내용을 허위로 기재한 경우
- 기타 규정한 제반사항을 위반하며 신청하는 경우
제 9 조 (회원 ID 부여 및 변경 등)
① 당 사이트는 이용고객에 대하여 약관에 정하는 바에 따라 자신이 선정한 회원 ID를 부여합니다.
② 회원 ID는 원칙적으로 변경이 불가하며 부득이한 사유로 인하여 변경 하고자 하는 경우에는 해당 ID를
해지하고 재가입해야 합니다.
③ 기타 회원 개인정보 관리 및 변경 등에 관한 사항은 서비스별 안내에 정하는 바에 의합니다.
제 3 장 계약 당사자의 의무
제 10 조 (KISTI의 의무)
① 당 사이트는 이용고객이 희망한 서비스 제공 개시일에 특별한 사정이 없는 한 서비스를 이용할 수 있도록
하여야 합니다.
② 당 사이트는 개인정보 보호를 위해 보안시스템을 구축하며 개인정보 보호정책을 공시하고 준수합니다.
③ 당 사이트는 회원으로부터 제기되는 의견이나 불만이 정당하다고 객관적으로 인정될 경우에는 적절한 절차를
거쳐 즉시 처리하여야 합니다. 다만, 즉시 처리가 곤란한 경우는 회원에게 그 사유와 처리일정을 통보하여야
합니다.
제 11 조 (회원의 의무)
① 이용자는 회원가입 신청 또는 회원정보 변경 시 실명으로 모든 사항을 사실에 근거하여 작성하여야 하며,
허위 또는 타인의 정보를 등록할 경우 일체의 권리를 주장할 수 없습니다.
② 당 사이트가 관계법령 및 개인정보 보호정책에 의거하여 그 책임을 지는 경우를 제외하고 회원에게 부여된
ID의 비밀번호 관리소홀, 부정사용에 의하여 발생하는 모든 결과에 대한 책임은 회원에게 있습니다.
③ 회원은 당 사이트 및 제 3자의 지적 재산권을 침해해서는 안 됩니다.
제 4 장 서비스의 이용
제 12 조 (서비스 이용 시간)
① 서비스 이용은 당 사이트의 업무상 또는 기술상 특별한 지장이 없는 한 연중무휴, 1일 24시간 운영을
원칙으로 합니다. 단, 당 사이트는 시스템 정기점검, 증설 및 교체를 위해 당 사이트가 정한 날이나 시간에
서비스를 일시 중단할 수 있으며, 예정되어 있는 작업으로 인한 서비스 일시중단은 당 사이트 홈페이지를
통해 사전에 공지합니다.
② 당 사이트는 서비스를 특정범위로 분할하여 각 범위별로 이용가능시간을 별도로 지정할 수 있습니다. 다만
이 경우 그 내용을 공지합니다.
제 13 조 (홈페이지 저작권)
① NDSL에서 제공하는 모든 저작물의 저작권은 원저작자에게 있으며, KISTI는 복제/배포/전송권을 확보하고
있습니다.
② NDSL에서 제공하는 콘텐츠를 상업적 및 기타 영리목적으로 복제/배포/전송할 경우 사전에 KISTI의 허락을
받아야 합니다.
③ NDSL에서 제공하는 콘텐츠를 보도, 비평, 교육, 연구 등을 위하여 정당한 범위 안에서 공정한 관행에
합치되게 인용할 수 있습니다.
④ NDSL에서 제공하는 콘텐츠를 무단 복제, 전송, 배포 기타 저작권법에 위반되는 방법으로 이용할 경우
저작권법 제136조에 따라 5년 이하의 징역 또는 5천만 원 이하의 벌금에 처해질 수 있습니다.
제 14 조 (유료서비스)
① 당 사이트 및 협력기관이 정한 유료서비스(원문복사 등)는 별도로 정해진 바에 따르며, 변경사항은 시행 전에
당 사이트 홈페이지를 통하여 회원에게 공지합니다.
② 유료서비스를 이용하려는 회원은 정해진 요금체계에 따라 요금을 납부해야 합니다.
제 5 장 계약 해지 및 이용 제한
제 15 조 (계약 해지)
회원이 이용계약을 해지하고자 하는 때에는 [가입해지] 메뉴를 이용해 직접 해지해야 합니다.
제 16 조 (서비스 이용제한)
① 당 사이트는 회원이 서비스 이용내용에 있어서 본 약관 제 11조 내용을 위반하거나, 다음 각 호에 해당하는
경우 서비스 이용을 제한할 수 있습니다.
- 2년 이상 서비스를 이용한 적이 없는 경우
- 기타 정상적인 서비스 운영에 방해가 될 경우
② 상기 이용제한 규정에 따라 서비스를 이용하는 회원에게 서비스 이용에 대하여 별도 공지 없이 서비스 이용의
일시정지, 이용계약 해지 할 수 있습니다.
제 17 조 (전자우편주소 수집 금지)
회원은 전자우편주소 추출기 등을 이용하여 전자우편주소를 수집 또는 제3자에게 제공할 수 없습니다.
제 6 장 손해배상 및 기타사항
제 18 조 (손해배상)
당 사이트는 무료로 제공되는 서비스와 관련하여 회원에게 어떠한 손해가 발생하더라도 당 사이트가 고의 또는 과실로 인한 손해발생을 제외하고는 이에 대하여 책임을 부담하지 아니합니다.
제 19 조 (관할 법원)
서비스 이용으로 발생한 분쟁에 대해 소송이 제기되는 경우 민사 소송법상의 관할 법원에 제기합니다.
[부 칙]
1. (시행일) 이 약관은 2016년 9월 5일부터 적용되며, 종전 약관은 본 약관으로 대체되며, 개정된 약관의 적용일 이전 가입자도 개정된 약관의 적용을 받습니다.