지금 머신러닝 공부를 하는데 결과가 이상하게 나와서 한번만 봐주실 수 있을까요??ㅠㅠ
나이브 베이즈 분류기로 댓글의 긍정 부정을 판별하려는데 클래스 불균형이 심각하면 그게 결과에 많이 영향을 미치나요?
만일 긍정과 부정이 9:1인 train데이터를 가지고 모델을 만들고 test데이터에 대해 prediction하는 경우에 컴퓨터는 무조건 긍정으로 판별하여
그 결과의 정확도가 test데이터의 부정label 갯수만큼 떨어지는것인지 궁금합니다.
제가 만든 데이터셋과 R script파일을 첨부합니다.. 제발 한번만 봐주세요ㅠㅠ
Comment 1
-
cardiomoon
2018.06.05 08:57
No. | Subject | Author | Date |
---|---|---|---|
474 | 정회원 서버 접속이 안되네요 [1] | iamswchoi | 2018.06.09 |
473 | shiny 한글 문제 문의드립니다. [3] | suny | 2018.06.07 |
472 | 단독망에서 패키지 실행 질문있습니다. [1] | 김지은22 | 2018.06.05 |
471 | Hodges-Lehman estimator [1] | 김밥친구 | 2018.06.04 |
» | 교수님 안녕하세요 질문이 있습니다 [1] | 세발낙지 | 2018.06.03 |
469 | 범주형변수와 비정규분포 연속형 변수 간 관계를 볼때 이변량 상관관계 분석이 가능한지요? [1] | 아라리 | 2018.05.30 |
468 | 안녕하세요 공부하던 중 질문드립니다. [1] | Ikarus86 | 2018.05.27 |
467 | 선생님 책으로 공부중인데..질문있습니다. [1] | jsus | 2018.05.26 |
466 | 인류 역사상 최고의 천재였다는 남자.jpg | 소꿈노리 | 2018.05.25 |
465 | 설명 변수 고르기에 대해서.. [2] | 짱이야 | 2018.05.25 |
464 | WebR관련 문의드립니다. [1] | neurojang | 2018.05.17 |
463 | nomogram [5] | 횽횽 | 2018.05.16 |
462 | 불충분한 데이터의 생존분석에 관하여 질문드립니다. [2] | fermion503 | 2018.05.14 |
461 | 교수님 안녕하세요 서버 구축관련하여 질문드립니다. [2] | 우루루루 | 2018.05.11 |
460 | 다중회귀 관련 여러가지 질문들이 있습니다. [2] | 짱이야 | 2018.05.04 |
459 | 다중회귀 관련 질문이 있습니다~~ [2] | 짱이야 | 2018.05.03 |
458 | 생존분석 결과가 다운되지 않습니다. [2] | 아라리 | 2018.05.02 |
457 | cox 와 kaplan 분석 시 결과해석 문의드립니다. [2] | 또니 | 2018.04.30 |
456 | 생존분석 p 값 [2] | alse | 2018.04.26 |
455 | 문의드립니다 [2] | 알로하 | 2018.04.26 |
코드를 살펴보았는데 별 문제 없어보입니다.
그런데 질문을 이해 못하겠는데요. 전체 데이터의 긍정과 부정이 약 9:1인 데이터를 가지고 7:3으로 training set와 test set로 나누어 모델을 만들고 test데이터에 대해 prediction하는 경우에 약 9:1로 나올 것으로 예상됩니다. 코드의 결과도 약 9:1로 나오는데요?