빅데이터분석기사 필기 제4회 기출 · 비정형 데이터 분석 · 텍스트마이닝·SNA

다음 중 텍스트 마이닝에서 문장을 2개 이상의 단어로 분리하는 방법으로 맞는 것은?

이 문제 풀어보기

정답 및 해설 보기

정답: 2번

N-gram은 문장을 연속된 n개의 단어(또는 글자) 묶음으로 잘라 분석하는 방법이다.
1번 토픽 모델링은 문서에 숨은 주제를 찾는 기법, 3번 TF-IDF는 단어의 중요도를 계산하는 가중치, 4번 덴드로그램은 계층적 군집 결과를 나타내는 그림이라 문장 분리 방법이 아니다.
이 단원 연속 풀기 · 비정형 데이터 분석 · 텍스트마이닝·SNA개념서 「비정형 데이터 분석 · 텍스트마이닝·SNA」 읽기

이 단원 공개 기출 7문항 · 연속 풀기에는 일백제 자체 문항도 함께 나옵니다.

  1. 텍스트 마이닝 기법 중 단어를 벡터화하는 text to Vector 변환 기법으로 틀린 것은?제5회 기출
  2. 다음 중 텍스트 마이닝에 대한 설명으로 옳지 않은 것은?제8회 기출
  3. 비정형 데이터에 대한 설명으로 틀린 것은?제2회 기출
  4. 소셜 미디이 데이터 분석 방법으로 틀린 것은?제2회 기출
  5. 다음중 SNA 중심성으로 틀린 것은?제3회 기출
비정형 데이터 분석 · 텍스트마이닝·SNA 기출 전체 보기 →