전체 글 (61) 썸네일형 리스트형 불용어 제거 코드 import nltk nltk.download('all') from nltk.corpus import stopwords from nltk.tokenize import word_tokenize stop_words = set(stopwords.words('english')) word_tokens = word_tokenize(exple) result = [] for token in word_tokens: if token not in stop_words: result.append(token) print(len(word_tokens)) print("불용어 제거") #print(result) 캐글 금융 분석 데이터 내가 좋아하는 https://www.kaggle.com/datasets/arcticgiant/french-financial-news/data French news - Stocks prediction French financial news with translation and sentiment analyses www.kaggle.com 그저 nlp 분석 https://www.kaggle.com/competitions/feedback-prize-effectiveness/data light GBM https://www.kaggle.com/code/dangnguyen97/0-38006-lightgbm 라이브러리 임포트 import os import matplotlib.pyplot as plt import numpy as np import pandas as pd import seaborn as sns from darts import TimeSeries from darts.dataprocessing import Pipeline from darts.dataprocessing.transformers import Scaler, InvertibleMapper, StaticCovariatesTransformer from darts.dataprocessing.transformers.missing_values_.. 이전 1 2 3 4 5 6 ··· 21 다음